📰 生成AIニュースメモ

Anthropic、エージェント性能を高めた「Claude Sonnet 5」を発表

🗓 2026年7月1日#Anthropic#Claude#AIエージェント

「生成AIニュースメモ」は、生成AIの最新ニュースを要点3行+詳細メモで記録していくシリーズです。関連するG検定キーワード解説への内部リンク付きで、最新動向のキャッチアップと試験の時事対策に使えます。

⚡ 3行まとめ
  1. 1Sonnetクラスで最もエージェント的なモデルで、計画立案やブラウザ・ターミナル操作を自律的に実行
  2. 2性能は上位のOpus 4.8に迫りつつ低価格(2026年8月31日まで入力2ドル/出力10ドルの導入価格)
  3. 3安全性評価ではSonnet 4.6より望ましくない挙動が全体的に減少

Anthropicは2026年6月30日(米国時間)、新モデル「Claude Sonnet 5」を発表しました。Sonnetクラスで最もエージェント的なモデルと位置づけられ、計画の立案、ブラウザやターミナルといったツールの利用、自律的なタスク遂行を、数か月前には大型で高価なモデルが必要だった水準でこなせるとしています。性能は上位モデルのOpus 4.8に近づきながら価格は低く抑えられており、発表当日から全プランで利用できます。

性能

前モデルのSonnet 4.6から、推論・ツール利用・コーディング・ナレッジワークといったエージェント性能の重要領域で大幅に改善しました。エージェント検索(BrowseComp)とコンピュータ操作(OSWorld-Verified)の評価では、努力水準(effort)を変えたコスト性能曲線でSonnet 4.6を全域で上回り、高い努力水準ではタスクによってOpus 4.8に並ぶとしています。

早期アクセスパートナーからは、従来のSonnetが途中で止まっていた複雑なタスクを完遂する、指示がなくても自分の出力を確認する、といった一貫したフィードバックが寄せられています。

提供と価格

  • 提供範囲 — 全プランで提供され、FreeとProのデフォルトモデルに。Claude CodeとClaude Platformでも利用可能で、APIのモデルIDは claude-sonnet-5
  • 導入価格 — 2026年8月31日まで入力100万トークンあたり2ドル・出力10ドル。以降は入力3ドル・出力15ドルの標準価格
  • トークナイザー — 性能向上のため更新され、同じ入力が内容により約1.0〜1.35倍のトークン数になる。導入価格は移行がほぼコスト中立になる設定
  • レート制限 — 高い努力水準でのトークン消費増に対応するため、Chat・Cowork・Claude Code・Claude Platformで引き上げ

安全性評価

事前の安全性評価では、悪意ある依頼の拒否やプロンプトインジェクション攻撃による乗っ取りへの耐性が向上し、ハルシネーションと迎合(sycophancy)の発生率もSonnet 4.6より低下しました。幅広い問題行動を試す自動行動監査でも全体としてSonnet 4.6より安全側のスコアでしたが、より高性能なOpus 4.8やMythos Previewと比べるとやや高い水準です。

サイバーセキュリティ能力は意図的には訓練しておらず、Firefox 147の脆弱性を突くエクスプロイト開発の評価では、完全に動作するエクスプロイトを一度も作成できませんでした(部分的成功率はSonnet 4.6よりわずかに上昇)。これを踏まえ、Opus 4.7・4.8と同じサイバーセーフガードを既定で有効にした状態で提供されます(より広範なタスクを遮断するFable 5のセーフガードよりは制限が緩い)。

補足

発表当日、BrowseCompのコスト性能グラフについて、標準的な手法と異なる簡易な手法に基づきSonnet 5の性能を過小評価していたとして、システムカードと同じ手法(コンパクションとプログラマティックなツール呼び出しを併用した1,000万トークン予算)に合わせて図と本文が更新されています。

📚 このニュースをG検定の知識につなげる

関連キーワードの解説記事で、背景となる技術・概念を確認できます。

🔗 出典(一次ソース)
https://www.anthropic.com/news/claude-sonnet-5
※本記事は一次情報をもとに要約・再構成したものです。詳細は出典をご確認ください。