AIニュース

すべてニュースチュートリアル Wiki AIプロジェクト AIアプリ

AIプロジェクト2025/12/18

DELIFT - 数据高效语言模型指令微调算法

DELIFT（Data Efficient Language model Instruction Fine-Tuning）是新型算法，用在优化大型语言模型（LLMs）在指令调优、任务特定微调和持续微调三个关键阶...

AIプロジェクト2025/12/18

HART - 麻省理工学院推出的自回归视觉生成模型

HART（Hybrid Autoregressive Transformer）是麻省理工学院研究团队推出的自回归视觉生成模型。能直接生成1024×1024像素的高分辨率图像，质量媲美扩散模型。H...

AIプロジェクト2025/12/18

WebDreamer - 基于大语言模型模拟网页交互增强网络规划能力的框架

WebDreamer是俄亥俄州立大学和Orby AI研究团队推出的基于模型规划的网络智能体，基于大型语言模型（LLMs），特别是GPT-4o，作为世界模型预测网站上的交互结果...

AIプロジェクト2025/12/18

Kandinsky-3 - 开源的文本到图像生成框架，适应多种图像生成任务

Kandinsky-3是基于潜在扩散模型的文本到图像（T2I）生成框架，以高质量和逼真度在图像合成领域脱颖而出。Kandinsky-3能适应多种图像生成任务，包括文本引导的...

AIプロジェクト2025/12/18

CAVIA - 苹果、得克萨斯、谷歌联合推出的多视角视频生成框架

CAVIA是苹果公司、得克萨斯大学奥斯汀分校、谷歌联合推出的多视角视频生成框架，能将单一输入图像转换成多个时空一致的视频序列。框架基于引入视角集成注意力...

AIプロジェクト2025/12/18

Flex3D - Meta GenAI和牛津大学共同推出的两阶段3D生成框架

Flex3D是由Meta的GenAI团队和牛津大学研究团队推出的创新的两阶段3D生成框架，能基于任意数量的高质量输入视图，解决从文本、单张图片或稀疏视图图像生成高质...

AIプロジェクト2025/12/18

EvolveDirector - 阿里联合南洋理工推出文本到图像生成模型的高效训练技术

EvolveDirector是阿里巴巴和南洋理工大学联合推出的创新框架，用公开资源和高级模型的API接口训练一个高性能的文本到图像生成模型。框架基于与现有高级模型的...

AIプロジェクト2025/12/18

MCP - Anthropic 开源的模型上下文协议

MCP（Model Context Protocol，模型上下文协议）是一个开放协议，是Anthropic开源的，能实现大型语言模型（LLM）应用与外部数据源和工具之间的无缝集成。基于...

AIプロジェクト2025/12/18

LazyGraphRAG - 微软推出的图形增强生成增强检索框架

LazyGraphRAG是微软研究院推出的图形增强生成增强检索（RAG）框架，是GraphRAG的迭代版本。LazyGraphRAG在数据索引成本上大幅降低，是GraphRAG的0.1%，同时用...

AIプロジェクト2025/12/18

LEOPARD - 腾讯AI Lab西雅图实验室推出的视觉语言模型

LEOPARD是腾讯AI Lab西雅图实验室推出的视觉语言模型，专为理解和处理含有大量文本的多图像任务设计。LEOPARD基于两个主要技术创新：一是策划约一百万条专门...

AIプロジェクト2025/12/18

书生InternThinker - 上海 AI Lab 推出的强推理模型

书生InternThinker是上海人工智能实验室推出的强推理模型，具备自主生成高智力密度数据和元动作思考能力。基于长思维能力和自我反思、纠正机制，在数学、代码...

AIプロジェクト2025/12/18

Pangea - 卡内基梅隆大学开源的多语言多模态大语言模型

Pangea是卡内基梅隆大学团队推出的多语言多模态大型语言模型（LLM），能提升全球语言和文化多样性的覆盖。模型包含600万条指令的多样化数据集，支持39种语言...

AIプロジェクト2025/12/18

MobA - 上海交通大学推出的移动智能体

MobA（Mobile Agent）是上海交通大学团队推出的新型移动智能体，基于多模态大型语言模型（MLLMs）提升移动设备的自动化任务执行能力。MobA采用两级架构：高级...

AIプロジェクト2025/12/18

Frames - Runway 推出的AI图像生成模型

Frames是Runway推出的最新AI图像生成模型，在风格控制和视觉保真度方面取得巨大进步。Frames能维持风格一致性，支持广泛的创意探索，为项目建立特定外观，并...

AIプロジェクト2025/12/18

SlideChat - 上海AI Lab联合多所高校和机构推出的视觉语言助手

SlideChat是上海AI实验室、厦门大学、华东师范大学等机构推出的，首个能理解千兆像素级别全切片图像的视觉语言助手。SlideChat能生成详尽的全切片图像描述，...

AIプロジェクト2025/12/18

Fugatto - 英伟达推出的多功能AI音频生成模型

Fugatto是英伟达（NVIDIA）推出的音频合成和转换模型，全称为'Foundational Generative Audio Transformer Opus 1'。模型能根据文本提示生成音频或视频，接收...

AIプロジェクト2025/12/18

LongRAG - 智谱联合清华和中科院推出的双视角鲁棒检索框架

LongRAG是清华大学、中国科学院和智谱的研究团队推出的，面向长文本问答（LCQA）的双视角鲁棒检索增强生成（RAG）框架。基于混合检索器、LLM增强信息提取器、...

AIプロジェクト2025/12/18

Illustrious - 开源文本到图像生成模型，专注于生成高质量动漫风格图像

Illustrious是开源的文本到图像动漫图像生成模型，是Onoma AI Research推出的。基于优化批量大小、dropout控制、训练图像分辨率和多级标题等关键方法，实现高...

AIプロジェクト2025/12/18

aisuite - 吴恩达发布开源Python库，一个接口调用多个大模型

aisuite是开源的Python库，吴恩达（Andrew Ng）发布的，旨在提供一个统一的接口来调用多个大型语言模型（LLM）服务。支持包括OpenAI、Anthropic、Azure等在内...

AIプロジェクト2025/12/18

XGrammar - 陈天奇团队推出的LLM结构化生成引擎

XGrammar是由陈天奇团队推出的开源软件库，能为大型语言模型（LLM）提供高效、灵活且可移植的结构化数据生成能力。基于上下文无关语法（CFG）定义结构，支持...

AIプロジェクト2025/12/18

Edify 3D - NVIDIA 推出的3D生成模型

Edify 3D 是 NVIDIA 推出的先进3D资产生成方案，能从文本提示或参考图像快速合成高质量的3D模型。Edify 3D能在两分钟内生成具有详细几何形状、清晰拓扑结构、...

AIプロジェクト2025/12/18

SongCreator - AI音乐模型，能理解、生成和编辑歌曲

SongCreator是清华大学深圳国际研究生院、香港中文大学等机构推出的AI音乐生成模型，能从歌词出发生成包含声乐和伴奏的完整歌曲。

AIプロジェクト2025/12/18

Teacher2Task - 谷歌推出的多教师学习框架

Teacher2Task是谷歌团队推出的多教师学习框架，引入教师特定的输入标记和重新构思训练过程，消除对手动聚合启发式方法的需求。框架不依赖聚合标签，将训练数...

AIプロジェクト2025/12/18

DynaSaur - Adobe 推出的大语言模型代理框架

DynaSaur是Adobe Research推出的大型语言模型（LLM）代理框架，突破传统LLM代理系统受限于预定义动作集合的限制。框架支持代理动态创建和组合动作，基于生成...

←1...56 57 58 59 60 61 62...137 →

AIニュース

AIプロジェクト2025/12/18

DELIFT - 数据高效语言模型指令微调算法

DELIFT（Data Efficient Language model Instruction Fine-Tuning）是新型算法，用在优化大型语言模型（LLMs）在指令调优、任务特定微调和持续微调三个关键阶...

AIプロジェクト2025/12/18

HART - 麻省理工学院推出的自回归视觉生成模型

HART（Hybrid Autoregressive Transformer）是麻省理工学院研究团队推出的自回归视觉生成模型。能直接生成1024×1024像素的高分辨率图像，质量媲美扩散模型。H...

AIプロジェクト2025/12/18

WebDreamer - 基于大语言模型模拟网页交互增强网络规划能力的框架

AIプロジェクト2025/12/18

Kandinsky-3 - 开源的文本到图像生成框架，适应多种图像生成任务

AIプロジェクト2025/12/18

CAVIA - 苹果、得克萨斯、谷歌联合推出的多视角视频生成框架

AIプロジェクト2025/12/18

Flex3D - Meta GenAI和牛津大学共同推出的两阶段3D生成框架

AIプロジェクト2025/12/18

EvolveDirector - 阿里联合南洋理工推出文本到图像生成模型的高效训练技术

AIプロジェクト2025/12/18

MCP - Anthropic 开源的模型上下文协议

AIプロジェクト2025/12/18

LazyGraphRAG - 微软推出的图形增强生成增强检索框架

LazyGraphRAG是微软研究院推出的图形增强生成增强检索（RAG）框架，是GraphRAG的迭代版本。LazyGraphRAG在数据索引成本上大幅降低，是GraphRAG的0.1%，同时用...

AIプロジェクト2025/12/18

LEOPARD - 腾讯AI Lab西雅图实验室推出的视觉语言模型

AIプロジェクト2025/12/18

书生InternThinker - 上海 AI Lab 推出的强推理模型

AIプロジェクト2025/12/18

Pangea - 卡内基梅隆大学开源的多语言多模态大语言模型

AIプロジェクト2025/12/18

MobA - 上海交通大学推出的移动智能体

AIプロジェクト2025/12/18

Frames - Runway 推出的AI图像生成模型

AIプロジェクト2025/12/18

SlideChat - 上海AI Lab联合多所高校和机构推出的视觉语言助手

AIプロジェクト2025/12/18

Fugatto - 英伟达推出的多功能AI音频生成模型

Fugatto是英伟达（NVIDIA）推出的音频合成和转换模型，全称为'Foundational Generative Audio Transformer Opus 1'。模型能根据文本提示生成音频或视频，接收...

AIプロジェクト2025/12/18

LongRAG - 智谱联合清华和中科院推出的双视角鲁棒检索框架

AIプロジェクト2025/12/18

Illustrious - 开源文本到图像生成模型，专注于生成高质量动漫风格图像

AIプロジェクト2025/12/18

aisuite - 吴恩达发布开源Python库，一个接口调用多个大模型

AIプロジェクト2025/12/18

XGrammar - 陈天奇团队推出的LLM结构化生成引擎

AIプロジェクト2025/12/18

Edify 3D - NVIDIA 推出的3D生成模型

AIプロジェクト2025/12/18

SongCreator - AI音乐模型，能理解、生成和编辑歌曲

SongCreator是清华大学深圳国际研究生院、香港中文大学等机构推出的AI音乐生成模型，能从歌词出发生成包含声乐和伴奏的完整歌曲。

AIプロジェクト2025/12/18

Teacher2Task - 谷歌推出的多教师学习框架

AIプロジェクト2025/12/18

すべてのカテゴリ

AIニュース

DELIFT - 数据高效语言模型指令微调算法

HART - 麻省理工学院推出的自回归视觉生成模型

WebDreamer - 基于大语言模型模拟网页交互增强网络规划能力的框架

Kandinsky-3 - 开源的文本到图像生成框架，适应多种图像生成任务

CAVIA - 苹果、得克萨斯、谷歌联合推出的多视角视频生成框架

Flex3D - Meta GenAI和牛津大学共同推出的两阶段3D生成框架

EvolveDirector - 阿里联合南洋理工推出文本到图像生成模型的高效训练技术

MCP - Anthropic 开源的模型上下文协议

LazyGraphRAG - 微软推出的图形增强生成增强检索框架

LEOPARD - 腾讯AI Lab西雅图实验室推出的视觉语言模型

书生InternThinker - 上海 AI Lab 推出的强推理模型

Pangea - 卡内基梅隆大学开源的多语言多模态大语言模型

MobA - 上海交通大学推出的移动智能体

Frames - Runway 推出的AI图像生成模型

SlideChat - 上海AI Lab联合多所高校和机构推出的视觉语言助手

Fugatto - 英伟达推出的多功能AI音频生成模型

LongRAG - 智谱联合清华和中科院推出的双视角鲁棒检索框架

Illustrious - 开源文本到图像生成模型，专注于生成高质量动漫风格图像

aisuite - 吴恩达发布开源Python库，一个接口调用多个大模型

XGrammar - 陈天奇团队推出的LLM结构化生成引擎

Edify 3D - NVIDIA 推出的3D生成模型

SongCreator - AI音乐模型，能理解、生成和编辑歌曲

Teacher2Task - 谷歌推出的多教师学习框架

DynaSaur - Adobe 推出的大语言模型代理框架

AIニュース

DELIFT - 数据高效语言模型指令微调算法

HART - 麻省理工学院推出的自回归视觉生成模型

WebDreamer - 基于大语言模型模拟网页交互增强网络规划能力的框架

Kandinsky-3 - 开源的文本到图像生成框架，适应多种图像生成任务

CAVIA - 苹果、得克萨斯、谷歌联合推出的多视角视频生成框架

Flex3D - Meta GenAI和牛津大学共同推出的两阶段3D生成框架

EvolveDirector - 阿里联合南洋理工推出文本到图像生成模型的高效训练技术

MCP - Anthropic 开源的模型上下文协议

LazyGraphRAG - 微软推出的图形增强生成增强检索框架

LEOPARD - 腾讯AI Lab西雅图实验室推出的视觉语言模型

书生InternThinker - 上海 AI Lab 推出的强推理模型

Pangea - 卡内基梅隆大学开源的多语言多模态大语言模型

MobA - 上海交通大学推出的移动智能体

Frames - Runway 推出的AI图像生成模型

SlideChat - 上海AI Lab联合多所高校和机构推出的视觉语言助手

Fugatto - 英伟达推出的多功能AI音频生成模型

LongRAG - 智谱联合清华和中科院推出的双视角鲁棒检索框架

Illustrious - 开源文本到图像生成模型，专注于生成高质量动漫风格图像

aisuite - 吴恩达发布开源Python库，一个接口调用多个大模型

XGrammar - 陈天奇团队推出的LLM结构化生成引擎

Edify 3D - NVIDIA 推出的3D生成模型

SongCreator - AI音乐模型，能理解、生成和编辑歌曲

Teacher2Task - 谷歌推出的多教师学习框架

DynaSaur - Adobe 推出的大语言模型代理框架