project
Hy-MT2 - テンセントの次世代オープンソース翻訳モデル
Hy-MT2は、テンセント渾源がオープンソース化した次世代の大規模翻訳モデルです。1.8B、7B、30B-A3Bの3つのサイズがあり、33言語間の相互翻訳と5つの少数民族言語/方言間の翻訳をサポートしています。
Hy-MT2とは何ですか?
Hy-MT2は、テンセント・フンユアンがオープンソース化した次世代の大規模翻訳モデルで、1.8B、7B、30B-A3Bの3つのサイズを提供しています。33言語間の相互翻訳と、5つの少数言語/方言間の翻訳をサポートしています。中でも、7Bと30B-A3Bモデルは、複数の評価においてオープンソースモデルの中で最高のパフォーマンスを達成し、数十倍ものパラメータを持つモデルを凌駕しました。軽量版の1.8Bは、1.25ビットの極限量子化後、わずか440MBとなり、モバイルデバイス上でのローカル推論に展開可能です。
Hy-MT2の主な機能
-
多言語翻訳33の言語間の相互翻訳と、5つの少数民族言語/方言間の翻訳をサポートしており、世界中の主要言語と中国の少数民族言語を網羅しています。
-
音声入力翻訳このミニプログラムには音声入力機能が内蔵されており、ユーザーは話すだけで直接言語間の翻訳を行うことができます。
-
カスタム翻訳スタイル用語、出力形式、簡略化レベルなど、個別の指示を設定できるため、翻訳結果をより期待に沿ったものにすることができます。
-
エンドツーエンドのオフライン翻訳1.8Bモデルは、1.25ビット量子化後、わずか440MBとなり、携帯電話にダウンロードしてオフライン環境でローカル推論を行うことができる。
-
単語の分析と比較単語の定義や、異なるスタイルの翻訳の比較を提供することで、ユーザーが単語の使い方の違いを理解するのに役立ちます。
Hy-MT2の技術原理
-
マルチサイズモデルアーキテクチャ1.8B、7B、30B-A3Bの3つの仕様があり、それぞれ軽量なエッジ翻訳、効率的なクラウド翻訳、高精度翻訳のシナリオを対象としています。
-
エンジェルスリム・エクストリーム・クオンタイゼーション1.8Bモデルは1.25ビット量子化技術を用いて440MBに圧縮されており、モバイルフォンチップ上での低リソースでのローカル展開を可能にする。
-
複数シナリオ合同訓練大規模な多言語コーパスを用いた統一的な学習に基づき、このモデルの機能は、一般的な翻訳、専門分野、および実際のビジネスシナリオにおいて、バランスの取れた形で最適化されています。
-
指示遵守の強化翻訳タスクに特化して最適化されたこのモデルは、スタイル変換や用語制約といった複雑なユーザー要件を正確に実行できます。
Hy-MT2の使い方
- オンライン体験
-
ミニプログラムを開くWeChatでTencent Hy Translateミニプログラムを検索して開いてください。
-
翻訳する内容を入力してください原文言語と翻訳言語を選択するか、テキストを入力するか、音声ボタンをクリックして音声入力を行ってください。
-
カスタム翻訳スタイル翻訳スタイル、用語設定、書式設定要件などをカスタマイズするには、「パーソナライズ設定」をクリックしてください。
-
翻訳結果を表示翻訳結果を表示します。異なるスタイルを切り替えて比較したり、単語をクリックして詳細な説明を表示したりできます。
-
- オフラインでの使用
-
クライアント側モデルをダウンロードミニプログラムの設定で、1.8Bのクライアント側翻訳モデルをローカルマシンにダウンロードしてください。
-
オフラインモードを有効にするモデルのダウンロードが完了すると、ネットワーク接続がない、または接続が弱い環境でもオフライン翻訳を使用できます。
-
ローカル推論翻訳オフラインでテキストを入力すると、モデルが推論を実行し、翻訳結果をローカルのスマートフォンに出力します。
-
- オープンソースモデルの展開
-
オープンソースモデルを取得するHy-MT2オープンソースモデル(1.8B / 7B / 30B-A3B)を入手するには、GitHubまたはHuggingFaceにアクセスしてください。
-
モデルサイズを選択してくださいハードウェア要件に基づいて適切なサイズモデルを選択してください。1.8B量子化バージョンは、約440MBのストレージ容量しか必要としません。
-
推論環境を構成するオープンソースのドキュメントに従って推論環境を設定すれば、ローカルサーバーまたは端末デバイスにデプロイして使用できます。
-
Hy-MT2の主な利点
-
性能は大型モデルを凌駕する7Bと30B-A3Bは、FLORES-200などのレビューにおいてDeepSeek-V4-ProやKimi K2.6を凌駕し、30B-A3Bは実世界のシナリオやプロの分野でGemini 3.1 Proを上回りました。
-
極めて軽量なエッジ展開1.8Bモデルは量子化後わずか440MBのストレージ容量しか必要とせず、Apple、Qualcomm、MediaTekなどのモバイルチップ上でスムーズに動作し、推論速度は前世代の1.5倍高速です。
-
翻訳手順は以下に記載されていますIFMTBenchの命令準拠性テストセットにおいて優れた性能を発揮し、スタイル変換や指定用語変換といった複雑な命令を正確に実行できる。
-
専門分野の徹底的な最適化金融、法律、医療、教育など8つの専門分野にわたる徹底的な最適化により、GEMBAのスコアは主流のビジネスAPIに匹敵するか、それを凌駕します。
Hy-MT2プロジェクトの住所
- プロジェクト公式サイト:https://aistudio.tencent.com/llm/en?tabIndex=0
- GitHubリポジトリ:https://github.com/Tencent-Hunyuan/Hy-MT2
- ハギングフェイスモデルライブラリ:https://huggingface.co/collections/tencent/hy-mt2
Hy-MT2と類似製品との比較
| 比較対象寸法 | Hy-MT2 | GPT-Realtime-Translate |
|---|---|---|
| モデルの位置特定 | 高品質な多言語翻訳に特化した、オープンソースのテキスト翻訳モデル。 | 低遅延の音声翻訳に特化した、専用のクローズドソースのリアルタイム音声翻訳モデル。 |
| 出版社 | テンセント・フンユアン | OpenAI |
| パラメータサイズ | 1.8B、7B、30B-A3Bの3つのモデルが用意されています。 | 非公開 |
| 言語対応範囲 | 翻訳対象言語33言語+少数民族言語/中国語方言5言語 | 70以上の入力言語 → 13の出力言語 |
| 入力形式 | テキスト入力+音声入力(ミニプログラム) | リアルタイムオーディオストリーミング(24kHz PCM16) |
| 出力形式 | テキスト翻訳結果+単語分析 | リアルタイム音声翻訳+テキスト字幕 |
| レイテンシー性能 | クラウドベースの推論は高速だが、デバイス上でのローカル推論も高速である。 | 応答速度は1秒未満(約0.8秒) |
| エンドサイド展開 | 1.8B量子化後、ファイルサイズは440MBとなり、携帯電話上でローカルに実行できる。 | サポート対象外、クラウドAPIのみ |
| オフラインでの使用 | モデルをダウンロードすれば、インターネット接続なしでオフライン翻訳が可能です。 | サポートされていません。APIを呼び出すにはインターネット接続が必要です。 |
Hy-MT2のアプリケーションシナリオ
-
日常的な多言語コミュニケーションこのモデルは、観光や社会交流などの場面における33言語間のリアルタイム翻訳に適用可能です。
-
プロフェッショナルな文書翻訳このモデルは、金融、法律、医療、教育など、8つの主要な分野における正確な翻訳ニーズを満たすことができます。
-
オフライン翻訳のシナリオネットワーク接続がない、または弱い環境では、モバイル側のモデルを通じてローカルオフライン翻訳が実現されます。
-
パーソナライズされたコンテンツ作成このモデルは、ソーシャルメディアや学術論文など、特定の表現ニーズに対応するために、カスタム翻訳スタイルをサポートしています。
-
事務室アシスタント音声入力と文書翻訳に対応しており、国境を越えたビジネスコミュニケーションや会議の録音の効率を向上させます。