AI Tech News
By H.O.

Claude Sonnet 5とサマーリフレッシュ:今週のリリース情報

Claude Sonnet 5とサマーリフレッシュ:今週のリリース情報

リリースサイクルが変わった

Anthropicの Claude Sonnet 5は2026年6月30日にリリースされ、初夏における最も重要なフロンティアモデルの発表となります。しかし、それだけではありません。過去10日間で、2026年6月30日にリリースされた Claude Sonnet 5(Anthropic)に加え、2026年6月26日にプレビューされた GPT-5.6の3つのティア—Sol(フラグシップ)、Terra(バランス型)、Luna(高速・低コスト)—、そして2026年6月28日にプライベートベータで発表された Grok 4.5(公開リリース日はまだ未定)が登場しています。これが重要である理由は、夏の時期は従来、AIの発表が静かで、各企業は秋のカンファレンスと年末のイベント向けに大きな発表を温存していましたが、そのパターンは消え去ったからです。

ビジネスロジックはシンプルです:企業の調達サイクルが四半期ごとのスケジュールで数百件走っているため、7月にリリースしたラボはQ3の予算を確保できるのです。技術チームにとってこれが意味することは、今この瞬間の決定がQ3のインフラ支出を形作るということです。

Claude Sonnet 5:毎日実際に使う機能

ここがリリース内容です:6月30日にリリースされた Claude Sonnet 5は、Anthropicの最もエージェント的な Sonnetであり、現在は Claude の無料プランと Pro プランのデフォルトモデルです。コード作業の重要な指標:エージェント的なコーディングでは SWE-Bench Pro で 63.2% を記録し、Sonnet 4.6 の 58.1% から上昇し、Opus 4.8 の 69.2% に急速に迫っており、知識作業では実は Opus 4.8 を上回っています

コンテキストウィンドウのストーリーが重要です。標準装備として 100 万トークンのネイティブコンテキストウィンドウでリリースされています。これは単なる脚注ではありません—プロンプトエンジニアリングなしに何ができるかを変えます。テスターは一貫して同じ動作を説明しています:複雑な多段階タスクを完了させ、前の Sonnet が止まるものを終わらせ、自分で指摘されることなく自分の出力をチェックします

価格設定が興味深い場所です。導入期の API 価格は 2026 年 8 月 31 日までは 100 万トークンあたり $2/$10(約30万円/150万円)で、その後 $3/$15(約45万円/225万円)に上昇します。タスクベースで Claude と競合他社を評価しているエンタープライズチームにとって、それは重要です。Sonnet 4.6(1,643 を保持)よりも大体 223 GDPval-AA Elo 上昇し、Artificial Analysis の専門的なライティングベンチマークで Opus 4.8 と GPT-5.5 を上回ってリードしています

GPT-5.6:アクセスリストに含まれている場合のみ利用可能

GPT-5.6 は OpenAI の次世代モデルファミリーで、2026 年 6 月 26 日にプレビューされました:Sol はフラグシップ、Terra は日常的なバランス型モデル、Luna は高速で手頃な価格のティアです。現在のところ、おそらく使用することはできません—これは米国政府のアクセスの背後に設定された最初の米国フロンティアリリースであり、OpenAI が米国政府とモデルとリリース計画を共有した後、約 20 の信頼できる組織のみが OpenAI API と Codex を通じて利用できます

ここが異なることです:これはテスター向けのクローズドベータではありません。米国政府のアクセスの背後に設定されており、OpenAI が米国政府とモデルとリリース計画を共有した後、約 20 の信頼できる組織のみが利用でき、一般公開は「今後数週間以内」が予定されており、Sol は 7 月に Cerebras で 1 秒あたり最大 750 トークンでローンチします。開かれる際に、発表された価格は Sol $5/$30(約750円/4,500円)、Terra $2.50/$15(約375円/2,250円)、Luna $1/$6(約150円/900円)/100 万トークンです。

注視する機能:Sol は Terminal-Bench 2.1 で新しい SOTA を設定し、Terra は 2 倍低いコストで GPT-5.5 競争力のあるパフォーマンスを提供し、Luna は最速で最も安いです。アクセスリストにないチーム向けに、GPT-5.5 は依然として OpenAI のシッピングフラグシップです

より広いパターン:コスト圧縮が勝利する

すべてのリリース全体で、コスト圧縮は加速しており、ほぼすべての主要ラボがこの月にはより手頃な推論オプションをシップし、トップティアモデルの価格性能比率は 12 ヶ月前と比較して大体 3 倍になっていますエージェント的パフォーマンスは主要な競争の場であり、ラボは複数ステップツール使用、メモリ管理、計画信頼性で最も激しく競争しており、企業の需要が集中している場所を反映しています—常に人間の介入なしに複数ステップのワークフローを完了できる AI システム上で

モデル リリース日 主要指標 API 価格(入力/出力) ステータス
Claude Sonnet 5 2026年6月30日 SWE-Bench Pro 63.2%; 100万トークンコンテキスト $2/$10(導入期); 8月31日以降$3/$15 一般利用可能
GPT-5.6 Sol/Terra/Luna 2026年6月26日(プレビュー) Sol: 新しい Terminal-Bench SOTA; Terra: 2倍のコスト削減 Sol: $5/$30; Terra: $2.50/$15; Luna: $1/$6 ゲートアクセス(約20組織)
Grok 4.5 2026年6月28日(プライベートベータ) 1.5兆パラメータ; V9ファウンデーション まだ公開されていません プライベートベータのみ
Gemini 3.5 Pro 2026年7月(予想) Gemini 3.1 Pro の後継者 TBD 予定された一般利用可能性

今あなたのチームにとってこれが意味すること

3つのアクション、影響度でランク付け:

  • 本番 API で Claude を使用している場合: Claude Sonnet 5 の価格は 2026 年 8 月 31 日まで導入期で $2/$10(約30万円/150万円)で、その後 $3/$15(約45万円/225万円)に上昇します。あなたのワークロードが Sonnet の仕様に適合している場合(エージェント的なタスク、長いコンテキストの推論、執筆)、増加前にコストベースラインをロックインしてください。100 万入力トークンあたり $2 から $3 へのジャンプは、ボリュームで急速に拡大します。
  • 複数ステップのワークフローを評価している場合: ラボは複数ステップツール使用、メモリ管理、計画信頼性で最も激しく競争しています。Sonnet 5 の自己修正での改善(自分の作業をチェック)と継続的なタスク完了は測定可能です。10 の代表的なタスクで現在のモデルに対して実行してください。
  • GPT-5.6 を待っている場合: あなたはまだアクセスリストに含まれていません。今日は GPT-5.5 または Claude Sonnet 5 で構築してください;ゲートされたリリースを待って計算容量を保持しないでください。一般公開が(今後数週間以内に予想される)到着した際に、実際のボリュームデータを使用して移行コストと利益を評価できます。

リリースサイクルはフロンティアで現在月次です。今週シップされたものは 8 月までに時代遅れになります。しかし根本的なシフト—コストが能力の獲得よりも速く低下している—はあなたのインフラ決定がより柔軟になり、より少なくないことを意味します。ブランドではなく、タスク向けに構築してください。実際のボリュームでベンチマークしてください。今、価格がリセットされる前に、勝利をロックインしてください。

編集部の観測データ

AIインテリジェンス指数(主要3モデル)

01632476305-1706-0106-0807-0607-1307-2007-2708-0308-1008-17Claude Opus 4.7 (Adaptive Reasoning, Max Effort) — Anthropic: 57 (2026-05-17)Claude Opus 4.8 (Adaptive Reasoning, Max Effort) — Anthropic: 61 (2026-06-01)Claude Opus 4.8 (Adaptive Reasoning, Max Effort) — Anthropic: 61 (2026-06-08)Claude Opus 4.8 (Adaptive Reasoning, Max Effort) — Anthropic: 56 (2026-07-06)Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) — Anthropic: 60 (2026-07-13)Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) — Anthropic: 59.9 (2026-07-20)Claude Opus 5 (Adaptive Reasoning, Max Effort) — Anthropic: 61 (2026-07-27)Claude Opus 5 (Adaptive Reasoning, Max Effort) — Anthropic: 61 (2026-08-03)Claude Opus 5 (Adaptive Reasoning, Max Effort) — Anthropic: 63 (2026-08-10)Claude Opus 5 (Adaptive Reasoning, Max Effort) — Anthropic: 63 (2026-08-17)63GPT-5.5 (xhigh) — OpenAI: 60 (2026-05-17)GPT-5.5 (xhigh) — OpenAI: 60 (2026-06-01)GPT-5.5 (xhigh) — OpenAI: 60 (2026-06-08)GPT-5.5 (xhigh) — OpenAI: 55 (2026-07-06)GPT-5.6 Sol (max) — OpenAI: 59 (2026-07-13)GPT-5.6 Sol (max) — OpenAI: 58.9 (2026-07-20)GPT-5.6 Sol (max) — OpenAI: 59 (2026-07-27)GPT-5.6 Sol (max) — OpenAI: 59 (2026-08-03)GPT-5.6 Sol (max) — OpenAI: 61 (2026-08-10)GPT-5.6 Sol (max) — OpenAI: 61 (2026-08-17)61Gemini 3.1 Pro Preview — Google DeepMind: 57 (2026-05-17)Gemini 3.1 Pro Preview — Google DeepMind: 57 (2026-06-01)Gemini 3.1 Pro Preview — Google DeepMind: 57 (2026-06-08)Gemini 3.1 Pro Preview — Google DeepMind: 46 (2026-07-06)Gemini 3.5 Flash (high) — Google DeepMind: 55 (2026-07-13)Gemini 3.1 Pro Preview — Google DeepMind: 46 (2026-07-20)Gemini 3.6 Flash (high) — Google DeepMind: 50 (2026-07-27)Gemini 3.6 Flash (high) — Google DeepMind: 50 (2026-08-03)Gemini 3.6 Flash (high) — Google DeepMind: 52 (2026-08-10)Gemini 3.7 Flash (high) — Google DeepMind: 56 (2026-08-17)56
  • Anthropic
  • OpenAI
  • Google DeepMind

Intelligence Index — Trend

各点にホバーすると、その時点のモデル名(バージョン)が表示されます。

最終更新: 2026-08-17 · 10 データ点 · artificialanalysis.ai

編集部が一次ソースから毎週収集しています。

データセット全体を見る