KAT-Coder-Pro V2 - 快手KwaiKAT推出的旗舰级AI编程模型
KAT-Coder-Pro V2是快手KwaiKAT团队推出的旗舰级AI编程模型,专为Agentic Coding场景深度优化。模型原生兼容Claude Code、Cline、OpenClaw等10余种主流AI编码...
KAT-Coder-Pro V2是快手KwaiKAT团队推出的旗舰级AI编程模型,专为Agentic Coding场景深度优化。模型原生兼容Claude Code、Cline、OpenClaw等10余种主流AI编码...
Matrix-Game 3.0 是昆仑万维(Skywork AI)推出的实时交互式世界模型,支持720p@40FPS实时生成。模型采用误差缓冲机制实现自校正,结合相机感知记忆检索确保...
Star Office UI 是开源的像素风格的 AI 可视化状态看板,支持将 AI 助手的工作状态实时可视化。Star Office UI 支持 6 种状态映射到不同办公区域,配备昨日工...
AnyClaw 是专为 AI Agent 设计的开源智能转接头,扮演'Agent 互联网与传统互联网的连接器'角色。能将传统互联网分散的 API、脚本、网页自动化工作流等工具,...
Gemini 3.1 Flash Live是Google最新推出的高质量实时语音模型,专为自然流畅的对话交互设计。模型在语调理解、推理能力和响应速度上均有显著提升,能精准识别...
Voxtral TTS 是 Mistral AI开源的文本转语音模型,基于 40 亿参数架构,支持 9 种语言。模型具备 90 毫秒超低延迟和 6 倍实时生成速度,仅需 3-5 秒音频可实...
MOCR(Multimodal OCR)是华中科技大学与小红书hi lab联合推出的多模态文档解析模型,仅3B参数在文档解析和图形重建上实现突破性表现。
daVinci-MagiHuman 是上海创智学院 GAIR 实验室与 Sand.ai 联合开源的音视频联合生成基座模型。模型采用 150 亿参数的单流 Transformer 架构,统一建模文本、...
DataChef是上海人工智能实验室与复旦大学联合开源的AI数据配方生成模型。模型通过强化学习自动生成大模型适配任务的完整数据处理流水线,包括数据选择、清洗...
Lyria 3 Pro 是谷歌推出的 AI 音乐生成模型,支持创作最长 3 分钟的完整音轨,具备结构感知能力,可精准处理前奏、主歌、副歌、桥段等编曲要素。
TurboQuant 是 Google Research 推出的向量量化算法,可将大模型 KV Cache 从 32-bit 压缩至 3-bit,实现内存降低 6 倍、推理速度提升 8 倍,且精度零损失。
OpenCLI 是开源的命令行工具,能将任意网站和 Electron 桌面应用转化为命令行接口。工具通过 Chrome 浏览器扩展连接本地守护进程,复用用户已登录的账号权限...
MiniMax Office Skills 是稀宇科技开源的一套生产级办公文档引擎。工具包含四个核心组件,MiniMax-docx(Word)、MiniMax-xlsx(Excel)、MiniMax-pdf(PDF)...
Sub2API 是开源 AI API 中转网关平台,支持将 Claude、OpenAI、Gemini、Antigravity 等主流 AI 服务的订阅统一接入管理。平台提供多账号管理、API Key 分发、...
DeerFlow 2.0 是字节跳动开源的超级智能体框架,采用'主智能体+11层中间件链+动态子智能体'架构,通过LangGraph实现多智能体协同。框架内置深度研究、数据分...
MAI-Image-2 是微软 AI Superintelligence 团队推出的第二代文生图模型,目前在 Arena.ai 排行榜位列全球前三。模型主打三大核心能力:增强的照片级真实感、...
New API 是新一代 AI 网关与资产管理系统,作为 AI 基座平台,提供统一基础设施接入全球 30+ 主流 AI 服务(OpenAI、Claude、Gemini、DeepSeek 等)。
PrismAudio 是阿里通义实验室推出的视频生成音频(Video-to-Audio)框架,可为无声视频自动配上环境音效。模型首创'分解式思维链'技术,让模型先思考声音内容...
ChatClaw是智麻开源的AI智能体,30MB极小安装包支持macOS/Windows/Linux。工具内置本地知识库、技能市场、MCP扩展、长期记忆和计划任务,可接入钉钉、飞书、...
Uni-1 是 Luma AI 推出的统一图像理解与生成模型,首次将视觉推理与图像生成整合到单一自回归 Transformer 架构中。模型能在生成前和生成过程中进行结构化内...
SoulX-LiveAct 是Soul App AI团队开源的实时数字人生成框架,解决AR扩散模型流式生成的稳定性难题。核心创新包括:Neighbor Forcing技术对齐相邻帧扩散步数确...
gstack 是 YC CEO Garry Tan 开源的为 Claude Code 用的 AI 编程工作流,能将 AI 助手转化为虚拟工程团队。工具包含 15 个专家角色(如 CEO 审查、Staff 工程...
IndexCache 是清华与智谱团队推出的稀疏注意力加速技术,针对 DeepSeek 稀疏注意力(DSA)中索引器计算开销大的问题,通过跨层复用索引来减少冗余计算。
Qwen3.5-Max-Preview 是阿里通义千问团队推出的旗舰大模型预览版。模型在LMArena评测平台以1464分跻身全球前五、国内第一,在基础能力评测中排名全球第六。