Doubao Big Model 1.6 - ByteDanceが発表したマルチモーダル深層思考モデル。
Doubao-Seed-1.6は、ByteDanceが開発したマルチモーダル深層思考モデルです。このモデルは、自動、思考、非思考の3つの思考モードをサポートし、テキスト、画像、動画などを処理できます。
Doubao大型モデル1.6とは何ですか?
Doubao-Seed-1.6は、ByteDanceが開発したマルチモーダル深層思考モデルです。このモデルは、自動、思考、非思考の3つの思考モードをサポートしています。テキスト、画像、動画など、さまざまな入力形式に対応し、高品質なテキスト出力が可能です。256kのコンテキストウィンドウ、最大224kトークンの入力長、最大16kトークンの出力長を備え、強力な推論能力を発揮します。複数の権威ある評価で優れた成績を収め、推論能力と数学的能力が大幅に向上しました。Doubao 1.6は、コンテンツ作成、インテリジェント対話、コード生成など幅広い分野で活用されており、企業や開発者に強力なAI生産性ツールを提供します。Doubao 1.6はVolcano Engine上で利用可能で、企業や開発者はAPIを通じて利用できます。
Doubaoの大型モデル1.6の最新アップグレードでは、思考時間モードを「最小」「低」「中」「高」の4つに革新的に導入しました。これにより、パフォーマンス、レイテンシ、コストのバランスが最適化され、中国で初めて「思考時間の段階的調整」をネイティブにサポートする大型モデルとなりました。中でも、低思考時間モードでは、以前のバージョンと比較して出力トークン総数を77.5%、思考時間を84.6%削減しながら、パフォーマンスは維持し、効率が大幅に向上しています。
大型豆まんモデルの主な機能 1.6
- 推論能力推論速度、精度、安定性が大幅に向上し、より複雑なビジネスシナリオの実装をサポートできるようになりました。
- DeepResearchで思考と検索を同時に行う思考しながら検索する能力を備え、不足している情報に基づいて検索を行い、複数回の検討と検索を経て推奨事項を提示します。DeepResearch機能は、調査レポートの迅速な生成をサポートします。
- マルチモーダルな理解能力シリーズ全体がマルチモーダル思考機能をネイティブにサポートしており、テキスト、画像、動画などの様々なモーダルデータの理解と処理を可能にします。
- グラフィカルインターフェース操作機能(GUI操作)視覚的な奥行き認識と正確な位置決めに基づいて、ブラウザやその他のソフトウェアと連携・操作することで、様々なタスクを効率的に実行できる。
斗濤大型モデル1.6の3つのモデル
- doubao-seed-1.6これは包括的なオールラウンドモデルであり、中国で初めて256Kのコンテキストをサポートする思考モデルです。このモデルは、深層思考、マルチモーダル理解、グラフィカルインターフェース操作など、複数の機能を備えています。ユーザーはニーズに応じて深層思考機能を柔軟に有効または無効にすることができ、適応型思考モードをサポートしています。適応型モードでは、プロンプトの難易度に基づいて深層思考を有効にするかどうかを自動的に判断し、効果を高めながらトークンの消費量を大幅に削減します。
- doubao-seed-1.6-thinkingDeep Thinking Enhanced Editionは、深層思考に焦点を当てたDoubao Big Model 1.6シリーズの強化版です。コーディング、数学的計算、論理的推論といった基本機能をさらに向上させ、より複雑なタスクに対応できるようになりました。また、256Kのコンテキストをサポートしているため、より長いテキストコンテンツの理解と生成が可能になり、高度な分析と複雑な推論を必要とするシナリオに適しています。
- doubao-seed-1.6-flashこれは、Doubao Big Model 1.6シリーズの中で最速となる、超高速応答バージョンです。深層思考とマルチモーダル理解能力を備え、256Kのコンテキストをサポートします。モデルのレイテンシは極めて低く、トップオブパイプライン時間(TOPT)はわずか10msで、ユーザーからのリクエストに迅速に対応できます。モデルの視覚理解能力は競合他社の主力モデルに匹敵し、リアルタイムインタラクションやビジュアルタスク処理など、極めて高い応答性が求められるシナリオに最適です。
Doubao大型モデル1.6の性能
- GPQAダイヤモンドテストDoubao 1.6思考モデルは81.5点のスコアを獲得し、世界トップレベルに達しており、現在利用可能な推論モデルの中でも最高レベルの1つである。
- AIME 25 数学評価斗毫1.6思考モデルは86.3点を獲得し、斗毫1.5深層思考モデルと比較して12.3点向上した。
斗澳の大型モデル1.6の価格設定モデル
Doubaoのビッグモデル1.6は、統一価格モデルに基づいています。ディープシンキングモードが有効になっているかどうか、また入力がテキストか画像かに関わらず、トークンの価格は同じです。
- 入力長 0~32K:
- 価格を入力してください100万トークンあたり0.8元。
- 生産物価格100万トークンあたり8元。
- 入力長:32K~128K:
- 価格を入力してください100万トークンあたり1.2元。
- 生産物価格100万トークンあたり16元。
- 入力長128K~256K:
- 価格を入力してください100万トークンあたり2.4元。
- 生産物価格100万トークンあたり24元。
- 入力32K、出力最大200トークン:
- 価格を入力してください100万トークンあたり0.8元。
- 生産物価格100万トークンあたり2元。
Doubao大型モデル1.6の使い方
- Volcano Engineプラットフォームに登録してログインしてください。Volcano Engineの公式サイトにアクセスし、指示に従って登録とログインを行ってください。
- 斗宝大型モデルサービス開始サービスページにアクセスし、Doubao Big Model 1.6 のサービスページを探してください。
- サービスを有効化するページに表示される指示に従って、Doubao Big Model 1.6サービスを有効化してください。
- バージョンを選択ニーズに応じて適切なモデルバージョンを選択してください(例:doubao-seed-1.6、doubao-seed-1.6-thinking、doubao-seed-1.6-flash)。
- APIキーを取得するサービスが有効化されると、プラットフォームはAPIキーを提供します。このAPIキーは、モデルを呼び出す際の認証に使用されます。
- 呼び出しモデル:
- APIインターフェースを使用するDoubao Big Model 1.6はAPI呼び出しに基づいています。
- ビルドリクエスト要件に基づいて、入力テキスト、パラメータ設定などを含むリクエストデータを作成します。
- リクエストを送信HTTPリクエストを使用して、モデルのAPIインターフェースにデータを送信します。
- 応答を受け取るモデルが処理を完了すると、生成されたテキストやその他の結果を含む応答データが返されます。
- サンプルコード(Python)以下は、Pythonを使用してDoubao Big Model 1.6を呼び出すためのサンプルコードです。
import requests
import json
# API密钥和接口地址
api_key =
"your_api_key"
api_secret =
"your_api_secret"
model_version =
"doubao-seed-1.6"
# 或doubao-seed-1.6-thinking、doubao-seed-1.6-flash
api_url =
f"https://api.volcengine.com/v1/model/{model_version}"
# 请求数据
data =
{
"input":
"你的输入文本",
"parameters":
{
"max_length":
256,
# 输出的最大长度
"temperature":
0.7,
# 随机性参数
"top_p":
0.9,
# 核心采样参数
"top_k":
50,
# 核心采样参数
"do_sample":
True
# 是否采样
}
}
# 设置请求头
headers =
{
"Authorization":
f"Bearer {api_key}",
"Content-Type":
"application/json"
}
# 发送请求
response = requests.post(api_url, headers=headers, data=json.dumps(data))
# 处理响应
if response.status_code ==
200:
result = response.json()
print("模型输出:", result["output"])
else:
print("请求失败,状态码:", response.status_code)
print("错误信息:", response.text)
斗宝大型モデル1.6のプロジェクト住所
- プロジェクト公式サイト:https://console.volcengine.com/ark/region:ark+cn-beijing/model/detail?Id=doubao-seed-1-6
大型豆まんモデルの応用シナリオ 1.6
- コンテンツ作成広告コピー、ニュース記事、物語、小説などを生成し、ユーザーが高品質なコンテンツを迅速に作成できるよう支援します。
- 知的な対話インテリジェントな顧客サービスやチャットボットで使用されることで、自然でスムーズな複数ターンの対話体験を提供し、ユーザーとのやり取りの効率を向上させます。
- コード生成要件に基づいてフロントエンドのコードスニペットを生成し、開発者がエラーのトラブルシューティングを行い、開発効率を向上させるのに役立ちます。
- 教育指導それは、特定の教科に関する質問に答え、教材を作成し、学生の学習と教師の授業準備を支援する。
- マルチモーダルコンテンツ生成画像または動画の入力を組み合わせて、関連するテキスト説明やクリエイティブなコンテンツを生成し、マルチメディア制作を容易にします。