AIニュース

すべてニュースチュートリアル Wiki AIプロジェクト AIアプリ

AIプロジェクト2025/12/18

Mobile-Agent - 阿里开源的自主多模态移动设备智能体

Mobile-Agent 是具有移动性的智能代理软件实体，能在网络的各个节点之间移动，代表用户或其他代理进行工作。能根据具体情况中断当前执行，移动至另一设备上恢...

AIプロジェクト2025/12/18

VideoRAG - 用于长视频理解的检索增强生成技术

VideoRAG是用于长视频理解的检索增强生成（Retrieval-Augmented Generation）技术。通过提取视频中的视觉对齐辅助文本，帮助大型视频语言模型（LVLMs）更好地...

AIプロジェクト2025/12/18

SPRIGHT - 专注于空间关系的大型视觉语言数据集

SPRIGHT（SPatially RIGHT）是亚利桑那州立大学、Intel 实验室、Hugging Face 、华盛顿大学等机构联合推出的，专注于空间关系的大型视觉-语言数据集，能解...

AIプロジェクト2025/12/18

LIGER - Meta AI 等机构推出的混合检索模型

LIGER是Meta AI等机构推出的混合检索模型，结合生成式检索和密集检索的优点。LIGER用生成式检索模块生成有限的候选项目集，基于密集检索对候选项目进行排序和...

AIプロジェクト2025/12/18

SeedVR - 南洋理工和字节跳动推出的扩散变换器模型，实现通用视频修复

SeedVR是南洋理工大学和字节跳动推出的扩散变换器模型，能实现高质量的通用视频修复。SeedVR基于引入移位窗口注意力机制，采用大尺寸（64×64）窗口和边界处的...

AIプロジェクト2025/12/18

AutoDroid-V2 - 清华推出的移动端GUI自动化脚本代理

AutoDroid-V2是清华大学人工智能产业研究院推出的基于小型语言模型（SLM）的移动端GUI自动化脚本代理，能基于代码生成技术提升设备上的GUI代理性能。AutoDroi...

AIプロジェクト2025/12/18

EnerVerse - 智元机器人推出的首个机器人4D世界模型

EnerVerse 是智元机器人团队开发的首个机器人4D世界模型，通过生成未来具身空间来指导机器人完成复杂任务。模型采用自回归扩散模型，结合稀疏记忆机制（Spars...

AIプロジェクト2025/12/18

Seer - 上海 AI Lab 联合北大等机构推出的端到端操作模型

Seer是由上海AI实验室、北京大学计算机科学与技术学院、北京大学软件与微电子学院等机构联合推出的端到端操作模型，实现机器人视觉预测与动作执行的高度协同...

AIプロジェクト2025/12/18

ArtCrafter - 清华联合鹏城实验室和联想共同推出的文本到图像风格迁移框架

ArtCrafter是清华大学、鹏城实验室和联想研究院共同推出的文本到图像风格迁移框架，基于扩散模型，解决传统方法在风格表达、内容一致性和输出多样性方面的局...

AIプロジェクト2025/12/18

Ingredients - 多ID照片定制视频生成框架，基于多ID照片与视频扩散相结合

Ingredients是强大的框架，基于将多个特定身份（ID）照片与视频扩散Transformer相结合，用在定制视频创作。Ingredients基于三个核心模块实现高度定制化的视频...

AIプロジェクト2025/12/18

MultiBooth - 清华联合 Meta 等机构推出的多概念图像生成方法

MultiBooth是清华大学深圳国际研究生院、 Meta、香港科技大学等机构推出的多概念图像生成方法，能从文本中生成包含多个用户指定概念的图像。MultiBooth将生成...

AIプロジェクト2025/12/18

Aria-UI - 港大联合 Rhymes AI 开源面向 GUI 智能交互的多模态模型

Aria-UI是香港大学和Rhymes AI共同推出的为图形用户界面（GUI）定位任务设计的大型多模态模型。基于纯视觉方法，不依赖于HTML或AXTree等辅助输入，用大规模、...

AIプロジェクト2025/12/18

TransPixar - 港中文联合 Adobe 等机构开源的生成透明背景视频技术

TransPixar是香港中文大学、Adobe研究院、香港科技大学和智能摩尔联合开源的，先进的文本到视频生成方法，扩展预训练的RGB视频模型生成包含透明度信息的RGBA...

AIプロジェクト2025/12/18

STAR - 南大、字节、西南大学联合开源的现实世界视频超分辨率框架

STAR是南京大学、字节跳动、西南大学联合推出的，创新的现实世界视频超分辨率（VSR）框架，能从低分辨率（LR）视频生成高分辨率（HR）视频，同时保持细节清晰...

AIプロジェクト2025/12/18

万相2.1 - 通义万相最新推出的视频生成模型

万相2.1是阿里推出的通义万相升级版本。基于自研的高效VAE和DiT架构，增强时空上下文建模能力，支持无限长1080P视频的高效编解码，首次实现中文文字视频生成...

AIプロジェクト2025/12/18

星火纪要 - 科大讯飞推出的会议交流总结和分析平台

星火纪要是科大讯飞推出的集转录、总结、翻译、分析为一体的音视频处理平台，广泛应用于通用会议、访谈、销售、培训等场景。能帮助个人高效总结会议重点内容...

AIプロジェクト2025/12/18

Hallo3 - 复旦联合百度开源的高动态与真实感肖像动画生成框架

Hallo3是复旦大学和百度公司联合推出的，基于扩散变换器网络（Diffusion Transformer Networks）的肖像图像动画技术，能生成高度动态和逼真的视频。Hallo3基...

AIプロジェクト2025/12/18

rStar-Math - 微软推出的小模型复杂推理与自进化SLMs的创新技术

rStar-Math是微软亚洲研究院推出的创新研究项目，基于蒙特卡洛树搜索（MCTS）驱动的深度思考，使小型语言模型（SLMs）在数学推理方面达到甚至超越OpenAI大型...

AIプロジェクト2025/12/18

SPAR3D - Stability AI等机构推出的单试图重建 3D 网络模型

SPAR3D是Stability AI和伊利诺伊大学香槟分校推出的，先进的单图生成3D模型方法，能从单张图像中高效重建出高质量的3D对象。SPAR3D基于两阶段设计，第一阶段...

AIプロジェクト2025/12/18

Search-o1 - 人大联合清华推出自主知识检索增强的推理框架

Search-o1是中国人民大学和清华大学推出的创新框架，能提升大型推理模型（LRMs）在面对复杂问题时的推理能力。基于整合代理检索增强生成（RAG）机制和Reason-...

AIプロジェクト2025/12/18

ConceptMaster - 高保真多概念视频定制生成的创新 AI 框架

ConceptMaster是用于多概念视频定制的创新框架，能在无需测试时调优的情况下，在扩散Transformer模型上生成高质量且概念一致的定制视频。框架通过学习解耦的...

AIプロジェクト2025/12/18

日日新融合大模型 - 商汤科技推出的原生融合模态大模型

“日日新”融合大模型（SenseNova）是商汤科技于2025年1月10日正式推出的多模态大模型。模型实现了原生融合模态，深度推理能力与多模态信息处理能力均大幅提升...

AIプロジェクト2025/12/18

Agent Laboratory - AMD 联合约翰·霍普金斯大学推出的自主科研 Agent

Agent Laboratory是AMD和约翰·霍普金斯大学推出，基于大型语言模型（LLM）的自主研究框架，能加速科学发现、降低成本并提高研究质量。Agent Laboratory接受人...

AIプロジェクト2025/12/18

新言意码 - 前月之暗面明超平创立的 AI Coding 项目

新言意码是专注于AI编程应用开发的公司，由前月之暗面海外产品Noisee的明超平创立。公司全称深圳新言意码科技有限公司，成立于2024年9月23日，位于广东省深圳...

←1...70 71 72 73 74 75 76...137 →

AIニュース

AIプロジェクト2025/12/18

Mobile-Agent - 阿里开源的自主多模态移动设备智能体

AIプロジェクト2025/12/18

VideoRAG - 用于长视频理解的检索增强生成技术

AIプロジェクト2025/12/18

SPRIGHT - 专注于空间关系的大型视觉语言数据集

SPRIGHT（SPatially RIGHT）是亚利桑那州立大学、Intel 实验室、Hugging Face 、华盛顿大学等机构联合推出的，专注于空间关系的大型视觉-语言数据集，能解...

AIプロジェクト2025/12/18

LIGER - Meta AI 等机构推出的混合检索模型

AIプロジェクト2025/12/18

SeedVR - 南洋理工和字节跳动推出的扩散变换器模型，实现通用视频修复

AIプロジェクト2025/12/18

AutoDroid-V2 - 清华推出的移动端GUI自动化脚本代理

AIプロジェクト2025/12/18

EnerVerse - 智元机器人推出的首个机器人4D世界模型

AIプロジェクト2025/12/18

Seer - 上海 AI Lab 联合北大等机构推出的端到端操作模型

AIプロジェクト2025/12/18

ArtCrafter - 清华联合鹏城实验室和联想共同推出的文本到图像风格迁移框架

AIプロジェクト2025/12/18

Ingredients - 多ID照片定制视频生成框架，基于多ID照片与视频扩散相结合

AIプロジェクト2025/12/18

MultiBooth - 清华联合 Meta 等机构推出的多概念图像生成方法

AIプロジェクト2025/12/18

Aria-UI - 港大联合 Rhymes AI 开源面向 GUI 智能交互的多模态模型

AIプロジェクト2025/12/18

TransPixar - 港中文联合 Adobe 等机构开源的生成透明背景视频技术

AIプロジェクト2025/12/18

STAR - 南大、字节、西南大学联合开源的现实世界视频超分辨率框架

AIプロジェクト2025/12/18

万相2.1 - 通义万相最新推出的视频生成模型

AIプロジェクト2025/12/18

星火纪要 - 科大讯飞推出的会议交流总结和分析平台

AIプロジェクト2025/12/18

Hallo3 - 复旦联合百度开源的高动态与真实感肖像动画生成框架

AIプロジェクト2025/12/18

rStar-Math - 微软推出的小模型复杂推理与自进化SLMs的创新技术

AIプロジェクト2025/12/18

SPAR3D - Stability AI等机构推出的单试图重建 3D 网络模型

AIプロジェクト2025/12/18

Search-o1 - 人大联合清华推出自主知识检索增强的推理框架

AIプロジェクト2025/12/18

ConceptMaster - 高保真多概念视频定制生成的创新 AI 框架

AIプロジェクト2025/12/18

日日新融合大模型 - 商汤科技推出的原生融合模态大模型

AIプロジェクト2025/12/18

Agent Laboratory - AMD 联合约翰·霍普金斯大学推出的自主科研 Agent

AIプロジェクト2025/12/18

すべてのカテゴリ

AIニュース

Mobile-Agent - 阿里开源的自主多模态移动设备智能体

VideoRAG - 用于长视频理解的检索增强生成技术

SPRIGHT - 专注于空间关系的大型视觉语言数据集

LIGER - Meta AI 等机构推出的混合检索模型

SeedVR - 南洋理工和字节跳动推出的扩散变换器模型，实现通用视频修复

AutoDroid-V2 - 清华推出的移动端GUI自动化脚本代理

EnerVerse - 智元机器人推出的首个机器人4D世界模型

Seer - 上海 AI Lab 联合北大等机构推出的端到端操作模型

ArtCrafter - 清华联合鹏城实验室和联想共同推出的文本到图像风格迁移框架

Ingredients - 多ID照片定制视频生成框架，基于多ID照片与视频扩散相结合

MultiBooth - 清华联合 Meta 等机构推出的多概念图像生成方法

Aria-UI - 港大联合 Rhymes AI 开源面向 GUI 智能交互的多模态模型

TransPixar - 港中文联合 Adobe 等机构开源的生成透明背景视频技术

STAR - 南大、字节、西南大学联合开源的现实世界视频超分辨率框架

万相2.1 - 通义万相最新推出的视频生成模型

星火纪要 - 科大讯飞推出的会议交流总结和分析平台

Hallo3 - 复旦联合百度开源的高动态与真实感肖像动画生成框架

rStar-Math - 微软推出的小模型复杂推理与自进化SLMs的创新技术

SPAR3D - Stability AI等机构推出的单试图重建 3D 网络模型

Search-o1 - 人大联合清华推出自主知识检索增强的推理框架

ConceptMaster - 高保真多概念视频定制生成的创新 AI 框架

日日新融合大模型 - 商汤科技推出的原生融合模态大模型

Agent Laboratory - AMD 联合约翰·霍普金斯大学推出的自主科研 Agent

新言意码 - 前月之暗面明超平创立的 AI Coding 项目

AIニュース

Mobile-Agent - 阿里开源的自主多模态移动设备智能体

VideoRAG - 用于长视频理解的检索增强生成技术

SPRIGHT - 专注于空间关系的大型视觉语言数据集

LIGER - Meta AI 等机构推出的混合检索模型

SeedVR - 南洋理工和字节跳动推出的扩散变换器模型，实现通用视频修复

AutoDroid-V2 - 清华推出的移动端GUI自动化脚本代理

EnerVerse - 智元机器人推出的首个机器人4D世界模型

Seer - 上海 AI Lab 联合北大等机构推出的端到端操作模型

ArtCrafter - 清华联合鹏城实验室和联想共同推出的文本到图像风格迁移框架

Ingredients - 多ID照片定制视频生成框架，基于多ID照片与视频扩散相结合

MultiBooth - 清华联合 Meta 等机构推出的多概念图像生成方法

Aria-UI - 港大联合 Rhymes AI 开源面向 GUI 智能交互的多模态模型

TransPixar - 港中文联合 Adobe 等机构开源的生成透明背景视频技术

STAR - 南大、字节、西南大学联合开源的现实世界视频超分辨率框架

万相2.1 - 通义万相最新推出的视频生成模型

星火纪要 - 科大讯飞推出的会议交流总结和分析平台

Hallo3 - 复旦联合百度开源的高动态与真实感肖像动画生成框架

rStar-Math - 微软推出的小模型复杂推理与自进化SLMs的创新技术

SPAR3D - Stability AI等机构推出的单试图重建 3D 网络模型

Search-o1 - 人大联合清华推出自主知识检索增强的推理框架

ConceptMaster - 高保真多概念视频定制生成的创新 AI 框架

日日新融合大模型 - 商汤科技推出的原生融合模态大模型

Agent Laboratory - AMD 联合约翰·霍普金斯大学推出的自主科研 Agent

新言意码 - 前月之暗面明超平创立的 AI Coding 项目