【生成AIニュースメモ】Anthropic、Claudeのアライメント訓練の改善手法を公開(2026/5/9)
Anthropicは2026年5月8日(米国時間)、AIモデル「Claude」のアライメント(整合性)訓練を改善した取り組みと、そこから得た知見を公開しました。同社が昨年報告した「エージェント的ミスアライメント」、つまりAIが架空の倫理的ジレンマの下で技術者を脅迫するような行動をとる問題を事例研究として、安全性訓練の改良を検証したものです。Claude Haiku 4.5以降のすべてのClaudeモデルは、この評価で脅迫などの行動を一切とらない完全なスコアを達成したとしています。
【生成AIニュースメモ】Google、高速・低コストのGemini 3.1 Flash-Liteを一般提供(2026/5/9)
Google Cloudは2026年5月8日(米国時間)、Gemini 3シリーズで最速かつ最もコスト効率が高いモデル「Gemini 3.1 Flash-Lite」の一般提供(GA)をGemini Enterprise Agent Platformで開始したと発表しました。超低遅延・大量処理向けの設計で、ツール呼び出しやオーケストレーションといったエージェント的なタスクに必要な精度と、自動化パイプラインを大規模に動かすためのコスト効率を両立するとしています。発表では、JetBrainsやGladlyをはじめ、採用企業の活用事例が多数紹介されています。
【生成AIニュースメモ】OpenAI、推論・翻訳・文字起こし対応の音声モデル3種をAPIに追加(2026/5/8)
OpenAIは2026年5月7日、APIに3つの音声モデルを追加したと発表しました。GPT-5クラスの推論能力を初めて備えた音声モデル「GPT-Realtime-2」、70以上の入力言語から13の出力言語へ話者のペースを保ったまま翻訳する「GPT-Realtime-Translate」、発話中にリアルタイムで文字起こしする「GPT-Realtime-Whisper」です。単純な応答の往復にとどまらず、聞き、推論し、翻訳し、文字起こしし、会話の進行と同時に行動できる音声インターフェースの実現を狙っています。
【生成AIニュースメモ】Anthropic、AIの内部表現を文章に変換する手法「NLA」を発表(2026/5/8)
Anthropicは2026年5月7日、AIモデル内部の活性(アクティベーション)を自然言語の文章に変換して直接読めるようにする解釈可能性の手法「Natural Language Autoencoders(NLA)」を発表しました。モデルが言葉にしない内心の思考を文章として取り出せるのが特徴で、すでにClaudeの安全性テストや隠れた動機の監査に活用されています。論文とコードが公開されているほか、Neuronpediaとの協力により、複数のオープンモデルでNLAを試せる対話型デモも提供されています。
【生成AIニュースメモ】Anthropic、SpaceXと計算資源で提携しClaudeの利用上限を拡大(2026/5/7)
Anthropicは2026年5月6日、SpaceXとの計算資源に関する提携を発表するとともに、Claude CodeとClaude APIの利用上限の引き上げを明らかにしました。SpaceXのColossus 1データセンターの全計算能力を利用する契約で、月内に300メガワット超(NVIDIA GPU 22万基超)の新規容量を確保します。これまでのAmazonやGoogleなどとの計算資源契約と合わせた容量拡大により、最も熱心な顧客の利用体験を改善する制限緩和が可能になったとしています。
