AB
AiBoss
ニュース

DeepReinforceオープンソースエージェントプログラミングモデルシリーズ Ornith-1.0

DeepReinforceチームは、Gemma 4とQwen 3.5をベースとし、自己改善型の学習フレームワークを採用したオープンソースのエージェントプログラミングモデルOrnith-1.0をリリースしました。このモデルは9Bから397Bまでの4つの仕様に対応し、Terminal-Bench 2.1とSWE-Bench Verifiedベンチマークで最先端(SOTA)のパフォーマンスを実現しています。主力となる397Bバージョンは77.5/82.4のスコアでClaude Opus 4.7を上回り、35B MoEバージョンは64.4のスコアでQwen 3.5-397Bを上回っています。