AB
AiBoss
News

Hugging Face Bio 发布 Carbon-A 基因注释模型与数据库

Hugging Face Bio 发布 12 亿参数的 Carbon-A 基因注释模型和开放数据库,称已在 22617 个物种中生成 5.66 亿个蛋白编码候选位点;这些预测并不等于逐一完成实验验证。

Hugging Face Bio 发布 Carbon-A 及配套的基因注释数据库。这个 12 亿参数模型从 DNA 序列预测蛋白编码区域,团队称已处理 22617 个物种,并形成约 5.66 亿个候选位点,模型和相关数据可公开获取。

团队报告了部分转录组实验支持,但也明确指出,观测到 RNA 转录并不能证明这些候选位点都被翻译成蛋白质,更不能直接确定其生物学功能。数据库数字应理解为模型预测规模。

参考:Hugging Face Bio 技术说明