AB
AiBoss
project

GPT-5.2 - OpenAIの最新汎用AIモデルシリーズ

GPT-5.2は、OpenAIの最新の高度な人工知能モデルシリーズで、専門的な作業や複雑なタスク向けに設計されています。このモデルは3つのバージョンで提供されています。GPT-5.2 Instantは、情報検索などの日常的なタスクを迅速に処理するのに適しています。

GPT-5.2とは何ですか?

GPT-5.2は、OpenAIの最新の高度な人工知能モデルシリーズで、専門的な業務や複雑なタスク向けに設計されています。このモデルは3つのバージョンで提供されています。GPT-5.2 Instantは、情報検索や翻訳などの日常的なタスクを高速に処理します。GPT-5.2 Thinkingは、プログラミング、長文ドキュメントの処理、多段階プロジェクト管理などの複雑なタスクに最適化されています。GPT-5.2 Proは、高度なタスクに特化し、高い精度と信頼性を提供し、科学研究や複雑な分析に適しています。GPT-5.2は、GDPvalやSWE-Bench Proなどの複数のベンチマークテストで業界標準を確立し、誤検出率を低減し、安全性と信頼性を向上させています。

GPT-5.2の主な機能

  • プロフェッショナルな業務最適化スプレッドシートの作成、プレゼンテーションの作成、コードの記述、長文ドキュメントの処理、複雑な複数ステップのプロジェクトの実行において優れた性能を発揮し、作業効率を大幅に向上させます。
  • 優れたプログラミングスキルSWE-Bench Proなどのベンチマークテストで記録を塗り替えるこのツールは、コードのデバッグ、機能要件の実装、大規模なコードベースのリファクタリング、そして人的介入の削減を確実に実行できます。
  • 長文処理報告書、契約書、学術論文などの長文文書の分析において、一貫性と正確性を維持し、詳細な分析や複数ソースのワークフローに適しています。
  • 視覚的理解チャート分析とソフトウェアインターフェースの理解に優れており、データダッシュボード、技術チャート、ビジュアルレポートを正確に解釈できます。
  • ツール呼び出しこれにより、長大な連鎖を伴う複数ラウンドのタスクにおいてツールを確実に使用することが可能になり、エンドツーエンドのワークフローをサポートし、ステップ間の中断を削減できます。
  • 科学・数学支援GPQA DiamondやFrontierMathといったベンチマークテストで優れた性能を発揮し、科学研究や複雑な数学的問題の解決に役立つ。
  • セキュリティ強化デリケートな話題を扱う際に信頼性が高く、反発を減らし、ユーザーのセキュリティを保護します。

GPT-5.2のパフォーマンス

  • 専門知識を要する業務
    • GDPvalベンチマークテストにおいて、GPT-5.2 Thinkingは70.9%の勝率を達成し、初めて人間の専門家レベルを上回りました。プレゼンテーション資料、スプレッドシート、会計報告書の作成など、44の職業知識ベースの作業シナリオにおいて、非常に優れたパフォーマンスを発揮しました。
    • 社内ジュニア投資銀行アナリストのタスクにおいて、GPT-5.2の思考力の平均スコアはGPT-5.1と比較して9.3%向上し、68.4%に達した。
  • プログラミングスキル
    • SWE-Bench Proテストにおいて、GPT-5.2 Thinkingは55.6%のスコアを達成し、新記録を樹立するとともに、以前のバージョンを大幅に上回る性能を示した。
    • SWE-bench検証テストにおいて、GPT-5.2 Thinkingは80%という高得点を獲得し、卓越した性能を示した。
  • 長文処理OpenAI MRCRv2テストにおいて、GPT-5.2 Thinkingは最大25万6千トークンの長文ドキュメントを処理する際にほぼ100%の精度を達成し、ディープドキュメント分析に適していることが示された。
  • 視覚的理解CharXiv ReasoningおよびScreenSpot-Proのテストにおいて、GPT-5.2 Thinkingはエラー率の大幅な低下を示し、グラフ、インターフェース、および視覚的なレポートをより正確に解釈することができた。
  • ツール呼び出しTau2-bench Telecomテストにおいて、GPT-5.2 Thinkingは98.7%の精度を達成し、優れた性能を示しました。推論強度が最も低い場合でも、GPT-5.1およびGPT-4.1を大幅に上回る結果となりました。
  • 科学と数学
    • GPQA Diamondテストにおいて、GPT-5.2 Proは93.2%、GPT-5.2 Thinkingは92.4%のスコアを獲得し、卓越した性能を示した。
    • FrontierMathテストにおいて、GPT-5.2 Thinkingは専門家レベルの数学問題の40.3%を解決した。
  • 事実の正確性ChatGPTを使用した匿名化されたクエリにおいて、GPT-5.2 ThinkingはGPT-5.1 Thinkingと比較してエラー率を30%削減し、事実の正確性を大幅に向上させた。
  • 安全自殺やメンタルヘルスといったデリケートなテーマを扱う場合、GPT-5.2は著しく低い有害反応率を示し、より高い安全性と信頼性を実証した。

GPT-5.2の使い方

  • ChatGPTでGPT-5.2を使用するGPT-5.2は本日より、有料ユーザー(Plus、Pro、Go、Business、Enterpriseプランを含む)向けに段階的に展開されます。対象となるのは、Instant、Thinking、Proの各バージョンです。スムーズかつ安定した運用を確保するため、段階的に展開されるため、一部のユーザーはすぐに利用できない場合があります。この期間中、有料ユーザーは引き続きGPT-5.1(レガシーモード)を3か月間利用できます。その後、GPT-5.1は段階的に廃止されます。ユーザーはニーズに応じて適切なバージョンを選択できます。
  • APIプラットフォームでGPT-5.2を使用するOpenAI APIプラットフォームでは、GPT-5.2の3つのバージョンすべてが完全に利用可能になり、具体的にはGPT-5.2 Instantという名称が付けられています。gpt-5.2-chat-latest)、GPT-5.2 Thinking(gpt-5.2)および GPT-5.2 Pro(gpt-5.2-pro開発者はGPT-5.2 Proで推論パラメータを設定できます。GPT-5.2 ProとGPT-5.2 Thinkingはどちらも、新しい5段階目の推論難易度をサポートしています。 xhighこれは、極めて高い品質が求められるタスクに適しています。APIを通じて、ユーザーはGPT-5.2の強力な機能を柔軟に統合し、複雑なアプリケーションシナリオのニーズに対応できます。

GPT-5.2のプロジェクトアドレス

  • プロジェクト公式サイト:https://openai.com/index/introducing-gpt-5-2/
  • 技術論文:https://cdn.openai.com/pdf/3a4153c8-c748-4b71-8e31-aecbde944f8d/oai_5_2_system-card.pdf

GPT-5.2による製品価格設定

ChatGPTの購読料金は変更ありません。

API価格設定

  • GPT-5.2 Instant(gpt-5.2-chat-latest
    • 入力:100万トークンあたり1.75ドル
    • 出力:100万トークンあたり14ドル
  • GPT-5.2 Thinking(gpt-5.2
    • 入力:100万トークンあたり1.75ドル
    • 出力:100万トークンあたり14ドル
  • GPT-5.2 Pro(gpt-5.2-pro
    • 入力:100万トークンあたり21ドル
    • 出力:100万トークンあたり1億6800万ドル
  • GPT-5.2はキャッシュされた入力に対して90%の割引を提供します。つまり、キャッシュされた入力は100万トークンあたり0.175ドルです。

GPT-5.2の応用シナリオ

  • 専門的な文書処理GPT-5.2は、報告書、契約書、学術論文などの長文文書を効率的に処理でき、詳細な分析や文書間の情報統合をサポートし、内容の一貫性と正確性を維持し、作業効率を大幅に向上させます。
  • プログラミングとソフトウェア開発複数のプログラミング言語でコードを生成、デバッグ、最適化し、複雑なフロントエンド開発や大規模なコードベースのリファクタリングをサポートし、フルスタックエンジニアに強力な支援を提供し、ソフトウェア開発プロセスを加速します。
  • 科学研究とデータ分析高度な数学的問題の解決や複雑な科学的疑問への回答を支援し、詳細なデータ分析とレポート作成をサポートし、研究者に強力なツールを提供し、学術研究の進歩を促進します。
  • カスタマーサービスとサポート複数回の対話やツールを使った通話を通じて、フライトの遅延や手荷物の紛失といった複雑な顧客問題に対応し、包括的なソリューションを提供することで顧客満足度を向上させています。
  • コンテンツ作成とコピーライティング高品質なコピー、ニュース記事、ソーシャルメディアコンテンツ、クリエイティブライティングを迅速に生成し、複数の言語とスタイルをサポートすることで、創造性を刺激し、多様なコンテンツニーズに対応します。