📰 生成AIニュースメモ

Anthropic、最上位モデルClaude Opus 4.6を発表

🗓 2026年2月6日#Anthropic#Claude#LLM

「生成AIニュースメモ」は、生成AIの最新ニュースを要点3行+詳細メモで記録していくシリーズです。関連するG検定キーワード解説への内部リンク付きで、最新動向のキャッチアップと試験の時事対策に使えます。

⚡ 3行まとめ
  1. 1AnthropicがClaude Opus 4.6を発表し、コーディング能力や長時間のエージェントタスク、大規模コードベースへの対応を強化
  2. 2Opusクラスとして初めて100万トークンのコンテキストウィンドウをベータ提供し、長文脈の検索・推論を大幅に改善
  3. 3Terminal-Bench 2.0など複数のベンチマークで最高水準を達成し、価格は据え置きで同日から提供開始

Anthropicは2026年2月5日(米国時間)、最上位モデル「Claude Opus 4.6」を発表しました。前モデルよりも慎重に計画を立て、エージェントタスクをより長く持続し、大規模なコードベースでより確実に動作するようコーディング能力を強化したほか、Opusクラスとして初めて100万トークンのコンテキストウィンドウをベータ提供します。Terminal-Bench 2.0など複数の評価で最高水準の成績を示し、claude.ai、API、主要クラウドで同日から利用可能です。価格は100万トークンあたり入力5ドル・出力25ドルで据え置きです。

モデルの特徴

Opus 4.6は前モデルのコーディング能力を改善し、より慎重に計画を立て、エージェントタスクをより長く持続し、大規模なコードベースでより確実に動作し、自らの誤りを捕捉するコードレビュー・デバッグ能力も向上しています。Opusクラスとして初めて100万トークンのコンテキストウィンドウをベータ提供します。財務分析、調査、文書・スプレッドシート・プレゼン資料の作成と活用といった日常的な業務にも改善された能力を適用でき、Claudeが自律的にマルチタスクをこなすCowork内でもこれらのスキルを活用できます。社内エンジニアの先行利用では、指示がなくてもタスクの難所に注力し、単純な部分は素早く進め、曖昧な問題をより良い判断で扱い、長いセッションでも生産性を保つ点が確認されたとしています。深く考えすぎる場合はエフォートを既定のhighからmediumへ下げることを推奨しています。

ベンチマーク成績

  • Terminal-Bench 2.0 — エージェント型コーディング評価で最高スコアを達成
  • Humanity’s Last Exam — 複数分野にまたがる複雑な推論テストで全フロンティアモデルをリード
  • GDPval-AA — 金融・法務などの経済的に価値ある知識労働タスクの評価で、業界次点のGPT-5.2を約144Eloポイント、前モデルのOpus 4.5を190ポイント上回る
  • BrowseComp — オンラインの見つけにくい情報を探し当てる能力で他のどのモデルよりも高性能
  • MRCR v2(8-needle 1M) — 長文からの情報検索を測る本テストで76%を記録し、Sonnet 4.5の18.5%から大幅に向上。会話が長くなると性能が落ちる「コンテキストの劣化」への耐性を示す

安全性

自動化された行動監査では、欺瞞・追従・ユーザーの妄想の助長・悪用への協力といったミスアラインメント行動の発生率が低く、これまで最もアラインメントされたフロンティアモデルだった前モデルのOpus 4.5と同等の水準としています。無害な質問に答え損なう過剰拒否の率は近年のClaudeモデルで最低です。同社のモデルとして最も包括的な安全性評価を実施し、ユーザーのウェルビーイングに関する新評価や解釈可能性の新手法も導入しました。サイバーセキュリティ能力の強化に対応して悪用検知のための6つの新しいプローブを開発したほか、オープンソースソフトウェアの脆弱性の発見・修正といった防御的活用を加速させ、将来的にはリアルタイムの悪用ブロックの導入もありうるとしています。

APIの新機能

  • アダプティブ思考 — 拡張思考のオン・オフの二択に代わり、深い推論が役立つ場面をモデル自身が文脈から判断
  • エフォート設定 — low・medium・high(既定)・maxの4段階で知能・速度・コストのバランスを制御
  • コンテキスト圧縮(ベータ) — 設定したしきい値に近づくと古いコンテキストを自動的に要約・置換し、長時間タスクの制限到達を回避
  • 100万トークンコンテキスト(ベータ) — Opusクラス初。20万トークン超のプロンプトには入力10ドル・出力37.50ドル(100万トークンあたり)のプレミアム価格を適用
  • 出力とリージョン — 最大12.8万トークンの出力に対応し、米国内限定推論を1.1倍のトークン料金で提供

製品アップデート

Claude Codeでは、複数のエージェントが並行して協調する「エージェントチーム」をリサーチプレビューとして導入しました。コードベースのレビューのような、独立した読み取り中心の作業に分割できるタスクに適しており、Shift+上下キーまたはtmuxで任意のサブエージェントを直接操作できます。オフィスツール連携ではClaude in Excelを大幅に強化し、実行前の計画立案、非構造化データの取り込みと構造の推定、複数ステップの変更の一括処理に対応しました。また、レイアウト・フォント・スライドマスターを読み取ってブランドに沿った資料を作成するClaude in PowerPointを、Max・Team・Enterpriseプラン向けのリサーチプレビューとして公開しました。

提供と価格

claude.ai、Claude API、主要なクラウドプラットフォームで同日から利用できます。開発者はClaude APIでモデル名claude-opus-4-6を指定します。価格は100万トークンあたり入力5ドル・出力25ドルで従来から据え置きです。

📚 このニュースをG検定の知識につなげる

関連キーワードの解説記事で、背景となる技術・概念を確認できます。

📅 月刊「G検定時事対策」で総ざらい

このニュースの月のまとめ号があります。その月の生成AIニュースの全体傾向と、G検定試験風の理解度チェック問題を1本にまとめています。

🎓 2026年2月号を読む →
🔗 出典(一次ソース)
https://www.anthropic.com/news/claude-opus-4-6
※本記事は一次情報をもとに要約・再構成したものです。詳細は出典をご確認ください。