AB
AiBoss
project

Hy-MT1.5-1.8B-1.25bit - テンセント・フンユアンのオープンソースモバイルオフライン翻訳モデル。

Hy-MT1.5-1.8B-1.25bitは、TencentのHunyuanチームが開発した、モバイルデバイス向けの超量子化・圧縮オフライン翻訳モデルです。このモデルは、Hunyuan翻訳モデルHy-MT1.5-1.8B(18億パラメータ)をベースに、革新的なShear...技術を採用しています。

Hy-MT1.5-1.8B-1.25bitとは何ですか?

Hy-MT1.5-1.8B-1.25bitは、テンセントの滄源チームが開発した、モバイル端末向けの超圧縮オフライン翻訳モデルです。滄源翻訳モデルHy-MT1.5-1.8B(18億パラメータ)をベースに、革新的なSherryスパース三値量子化技術を用いて、モデルサイズをわずか440MBに圧縮しています。33言語、5方言/少数言語、1056方向の翻訳に対応しています。インターネット接続なしでモバイル端末上でローカルに動作し、翻訳品質はGoogle翻訳などの主流商用システムを凌駕します。

Hy-MT1.5-1.8B-1.25bitの主な機能

  • 33言語間のオフライン翻訳中国語、英語、フランス語、日本語、アラビア語、ロシア語といった主要言語に加え、チベット語やモンゴル語といった少数言語も網羅しており、翻訳方向は合計1,056箇所に及ぶ。
  • モバイルデバイス上でローカルに実行モデルをダウンロードした後は、ネットワーク接続を必要とせず、データ通信量も消費しない、完全にオフラインでの翻訳が可能です。
  • 背景語の検索と翻訳付属のデモでは「バックグラウンド単語キャプチャモード」がサポートされており、ウェブページを閲覧したりメールをチェックしたりしながら、いつでも翻訳を呼び出すことができます。
  • リアルタイムテキスト翻訳テキストを入力または貼り付けるだけで、翻訳結果を素早く生成し、コピーと出力にも対応しています。
  • 多言語方向切り替えあらゆる言語ペア間での双方向翻訳切り替えをサポートします。

Hy-MT1.5-1.8B-1.25bitの技術原理

  • 基本モデルこのモデルは、テンセントの大規模翻訳モデルであるHy-MT1.5-1.8B(1.8Bパラメータ)をベースに、「一般的な事前学習 → 機械翻訳に特化した事前学習 → 教師あり微調整 → オンライン蒸留 → 強化学習」という多段階の学習フレームワークを通して構築されています。
  • シェリースパース三値量子化(1.25ビット)きめ細かい疎な戦略が採用されており、4つのパラメータのうち3つは1ビット(値は-1または1)を使用して格納され、1つは0に設定されるため、パラメータ1つあたり平均1.25ビットしか必要としません。
  • STQ専用カーネルTencentがモバイルCPU向けに特別に設計した疎な三値量子化推論カーネルは、SIMD命令セットと完全に互換性があり、効率的なデコードを可能にします。
  • 量子化対応トレーニング(QAT)トレーニング中に分布のアライメントとオフセットを最適化することで、超低ビット量子化によって引き起こされる精度低下を軽減できる。
  • GRPO強化学習翻訳品質を最適化するために、グループ相対ポリシー最適化アルゴリズムが、多次元の評価基準(正確性、流暢性、一貫性、文化的適合性、読みやすさ)と組み合わせて使用されます。

Hy-MT1.5-1.8B-1.25bit の使い方

  • ダウンロードしてインストールするModelScopeコミュニティ(https://modelscope.cn/models/AngelSlim/Hy-MT1.5-1.8B-1.25bit-GGUF/resolve/master/Hy-MT-demo.apk)またはHuggingFaceからデモAPKをダウンロードしてインストールしてください。
  • 起動時の読み込みアプリを初めて起動すると、440MBのモデルが自動的に読み込まれます。読み込みが完了すれば、すぐに使用できます。
  • テキスト翻訳テキストを入力または貼り付けて「翻訳」をクリックすると、オフライン翻訳が開始されます。画面下部の言語バーをクリックすると、翻訳の方向を切り替えることができます。
  • 背景語検索他のアプリでは、テキストを長押しして選択し、「オフライン翻訳」を選択すると、アプリを切り替えることなく、結果がフローティングウィンドウに直接表示されます。

Hy-MT1.5-1.8B-1.25bitの主要情報と使用要件

  • 出版社テンセント渾源チーム
  • モデルパラメータ:1.8B
  • 量子化精度1.25ビット(シェリー疎三値量子化)
  • モデルボリューム:440MB
  • 対応プラットフォームAndroid版はデモ版のみ対応しており、iOS版は後日正式にサポート予定です。
  • オープンソースライセンスモデルの重み、コード、技術レポートはすべて完全にオープンソースです。
  • システムAndroid端末(デモ版は現在iOSに対応していません)
  • メモリ推奨RAM:8GB以上(デモ機はSnapdragon 865/888/7+Gen2、8GB/16GB RAM搭載)
  • ストレージモデルのダウンロードには、約500MBの容量が確保されています。
  • ネットワーク初回モデルのダウンロードにはインターネット接続が必要ですが、その後は完全にオフラインで使用できます。

Hy-MT1.5-1.8B-1.25bitの主な利点

  • 非常に軽量このモデルはわずか440MBで、オリジナルのFP16版が3.3GBであるのに対し、圧縮率は約7.5倍です。一般的なスマートフォンでバックグラウンド動作が可能です。
  • 高い翻訳品質Flores-200やWMT25などのベンチマークにおいて、1.8Bのオリジナルモデルは、Google翻訳、Baidu翻訳、Microsoft翻訳などの商用APIや、Tower-Plus-72BやQwen3-32Bなどの大規模なオープンソースモデルを凌駕しています。1.25ビット量子化バージョンは、非常に小さなサイズを維持しながら、品質の低下を管理可能な範囲に抑えています。
  • 推論速度が速いSTQカーネルを使用すると、Snapdragon 888搭載スマートフォンでの変換速度は、FP16バージョンよりも約8倍速くなります(1.9秒対58.2秒)。
  • 完全にオフラインでプライバシーはゼロ完全ローカル処理、データアップロード不要、購読料不要、一度ダウンロードすれば永久利用可能。
  • ハードウェアの互換性1.25ビット方式はSIMD命令セットと互換性があり、すべてのAndroidモデルでスムーズに動作します。

Hy-MT1.5-1.8B-1.25bit プロジェクトアドレス

  • ハギングフェイスモデルライブラリ:https://huggingface.co/AngelSlim/Hy-MT1.5-1.8B-1.25bit
  • arXiv技術論文:https://arxiv.org/pdf/2512.24092

Hy-MT1.5-1.8B-1.25bit:類似の競合製品との比較

比較対象寸法 Hy-MT1.5-1.8B-1.25bit Tower-Plus-72B Google翻訳(Google翻訳API)
製品ポジショニング 大規模オフライン翻訳モデル 大規模なオープンソース翻訳モデル 商用クラウド翻訳サービス
出版社 テンセント・フンユアン アンバベル / コミュニティ Google
モデルボリューム 440 MB 145 GB クラウドベースの導入(ローカルストレージ不要)
パラメータ 1.8B 72B 非公開
動作モード 携帯電話のローカルオフライン操作 サーバー/高性能GPU(A100など)が必要です クラウドAPI呼び出し
インターネットアクセス要件 全く必要ない サーバーにデプロイする必要があります インターネット接続が必要です
対応言語 33言語+5方言/漢語および少数民族言語 多言語対応 100以上の言語
Flores-200 (ZH↔XX) 82.2 79.7 69.3
Flores-200 (EN↔XX) 87.4 86.2 77.0
WMT25 57.0 41.0 38.9
Minority↔Mandarin 59.1 35.4 33.4
推論速度 非常に高速(Snapdragon 888のみ) 1.9秒 処理速度が遅い(72Bの大規模モデルでは推論コストが高い) ネットワークの遅延時間(通常1~3秒)によって異なります。

Hy-MT1.5-1.8B-1.25bitの応用シナリオ

  • 海外旅行ネットワーク接続のない環境(遠隔地、飛行機、地下鉄など)におけるメニュー、道路標識、会話のリアルタイム翻訳により、海外での不安定な信号という課題を解決します。
  • 事務室国際メールや契約書をオフラインで処理することで、機密性の高いビジネス情報が完全にローカルで処理され、データアップロードのリスクが排除されます。
  • 少数民族とのコミュニケーションチベット語、モンゴル語、ウイグル語などの少数民族言語と中国語間の翻訳をサポートし、国境地帯における日常的なコミュニケーションや行政業務に役立つ。
  • 学術研究外国語の文献や論文へのローカルアクセス、即時単語翻訳機能、学術的プライバシーと知的財産権の保護。
  • 毎日の読書外国語のウェブサイト、ソーシャルメディア、電子書籍をオフラインで閲覧することで、データ通信量を消費することなく高品質な翻訳にアクセスできます。