AB
AiBoss
News

紫东太初开源ZDTaichu5.0-9B:空间具身与通用能力双线推进

紫东太初开源通用多模态大模型ZDTaichu5.0-9B,据报在多项空间理解基准中表现突出,同时保持图文理解、OCR、数学与代码等通用能力。模型配套数据生产管线与自适应循环推理机制,权重及方案开放。

紫东太初开源9B多模态模型,主打空间具身能力

据量子位报道,紫东太初发布并开源通用多模态大模型 ZDTaichu5.0-9B。报道称,该模型在九项国际空间理解基准测试中有八项取得第一,并同时保持图文理解、文字识别、数学推理与代码等通用能力。相关权重与数据生产管线方案已通过 GitHub、HuggingFace、ModelScope 等渠道开放,具体许可条款与可用范围以官方页面当前信息为准。

背景:空间理解与通用能力难以兼顾

报道指出,多模态模型在图片理解上已较为成熟,但在真实物理世界中的空间判断与行动规划仍是难点;部分模型为补足空间能力而牺牲通用能力。ZDTaichu5.0-9B 的定位是同时覆盖两条线:一方面处理目标定位、多视角参照系转换、可操作区域判断等具身任务,另一方面维持通用多模态与 Agent 任务表现。报道还提到,该模型采用全栈数据生产管线与内置自适应循环推理机制,按预测不确定性分配额外计算,并配合阻尼更新、双重停止判据等稳定化设计。上述评测数据与效果描述均来自报道方,尚未获官方独立确认。

限制与来源

本文内容整理自量子位报道,文中涉及的基准得分、对比模型与演示案例均为该报道所述,未经第三方独立验证。模型的实际性能、支持语言、部署条件与许可证条款可能随版本变化,请以紫东太初官方仓库与官网当前信息为准。本文不构成任何投资或采购建议。