Pollen Robotics推出399美元开源双足机器人Microduck
Hugging Face旗下Pollen Robotics推出身高约25厘米、搭载15个电机的开源双足机器人Microduck,预售价399美元。
Hugging Face旗下Pollen Robotics推出身高约25厘米、搭载15个电机的开源双足机器人Microduck,预售价399美元。
OpenRouter上线inclusionAI的Ling-3.0-flash-Fin金融增强模型,并提供免费调用入口。基础模型采用1240亿总参数、51亿激活参数。
Anthropic发布Model Hardware Standard研究预览,探索以模型无关的通用规范让AI代理操作可编程实体设备。
Google发布Gemini Omni 1.1 Flash视频生成模型,支持首尾帧控制、最长约40秒的场景延展,以及1080p和4K放大。
千问办公国际版(QwenWork)开启公测,海外个人及企业用户可通过网页版与PC客户端体验。产品定位All-in-One AI生产力平台,已接入Slack、Notion等海外协作工具,未来将连接企业数据库与工作流。产品现已支持中英文,即将拓展西语、葡语、日语、韩语等;账号体系支持Google账号、邮箱及阿里云国际账号注册。
谷歌推出 Gemini 3.5 Transcribe 语音转文本模型,可自动删除”嗯””呃”等口头禅及自我修正内容,生成更通顺文本。相比前代 Chirp 3,速度提升约 70%,实时语音错误率降至 5.5%。模型支持 85 种语言及最多 3 人预录音频,已用于 Pixel 11 的 Gboard 键盘的”Rambler”功能。
腾讯混元推出Hy-MT2-1.8B翻译模型,通过2-bit和自研Sherry 1.25-bit技术,将3.3GB模型极致压缩,翻译质量几乎无损且优于微软、豆包等商业API。联合英特尔完成x86算子优化,已在哔哩哔哩直播弹幕实时翻译中落地,支持33语种,单条弹幕翻译耗时500-800ms。
智谱正式推出 GLM-5.3-Flash,是GLM-5系列首个原生多模态模型,AA综合智能指数57分与Claude Opus 4.8持平,定价仅后者1/40。模型采用稀疏+线性注意力混合架构,激活参数量与层数近乎减半,长上下文成本大幅降低。原生集成视觉编码能力,支持代码、浏览器与GUI协同。
阿里正式推出多模态MoE模型 Qwen3.8-Flash,总参数125B,每token仅激活6B,原生支持26万token上下文并可扩展至100万。模型采用GDN与QSA混合注意力、门控残差、N-gram嵌入及Muon优化器四大升级,训练成本降至前代1/9,编码与办公能力更强。模型对外提供API服务定价输入1元、输出3元每百万token。
Google Antigravity CLI加入语音模式,开发者可通过语音与Agent交互;Gemini 3.5 Transcribe还可结合屏幕上下文和对话历史改善转写。
Claude Code 2.1.247新增SendFeedback工具,可在会话发生问题时自动起草反馈报告,经用户审阅后再通过/feedback发送。
OpenAI开始推出Visualizations预览,可在支持的ChatGPT和ChatGPT Work对话中生成图表、地图、模拟器及交互式解释。
Apodex发布1.1模型家族,其Mini模型权重已上线Hugging Face,页面标注约36B参数,并采用Apache 2.0许可。
彭博报道称,Anthropic将以约450亿美元向Nscale租用AI算力,六年协议涉及约460兆瓦容量和英伟达Vera Rubin芯片。