【生成AIニュースメモ】Google、Gemini 3 FlashにAgentic Visionを導入(2026/1/28)
Googleは2026年1月27日(米国時間)、Gemini 3 Flashの新機能「Agentic Vision」を発表しました。画像理解を1回の静的な処理から能動的な調査プロセスへ変えるもので、視覚的な推論とコード実行を組み合わせ、モデルが計画を立てて段階的にズーム・検査・加工を行い、視覚的証拠に基づいて回答します。コード実行を有効にすると大半の視覚ベンチマークで5〜10%の品質向上が得られるとし、Google AI StudioとVertex AIのGemini APIで提供が始まったほか、Geminiアプリへの展開も始まっています。
【生成AIニュースメモ】Anthropic、LLMの人格を安定させる「アシスタント軸」を特定(2026/1/20)
Anthropicは2026年1月19日(米国時間)、大規模言語モデルの「アシスタント」人格が内部でどのように表現されているかを調べた解釈可能性研究を発表しました。MATSとAnthropic Fellowsプログラムを通じて実施されたもので、Gemma 2 27B、Qwen 3 32B、Llama 3.3 70Bの3つのオープンウェイトモデルを対象に、275種類のキャラクター類型に対応する神経活動を抽出して「人格空間」を写像し、その主要な変動方向である「アシスタント軸」がアシスタントらしさを捉えることを見いだしました。軸上の活性を監視・制限することで、有害な出力につながる人格の逸脱を検知・抑制できるとしています。
【生成AIニュースメモ】Anthropic、AIエージェントの評価設計の実践手法を解説(2026/1/10)
Anthropicは2026年1月9日(米国時間)、AIエージェント向けの評価(eval)を設計・運用するための実践手法をまとめた技術記事を公開しました。自律性・知能・柔軟性というエージェントを有用にする性質そのものが評価を難しくすると指摘し、社内開発や顧客との協業で得た知見をもとに、評価の構成要素、グレーダーの種類と使い分け、エージェントの類型別の評価手法、そして評価をゼロから構築する8ステップのロードマップを整理しています。
【生成AIニュースメモ】Anthropic、Claudeを拡張するスキルとMCPの使い分けを解説(2025/12/20)
Anthropicは2025年12月19日(米国時間)、Claudeの能力を拡張する2つの仕組みであるスキルとMCP(Model Context Protocol)の関係と使い分けを解説する記事を公開しました。MCPはClaudeを外部のツールやデータに接続する役割を、スキルはその接続を効果的に使うための手順や専門知識を教える役割を担います。両者を組み合わせることで、汎用的な処理ではなくチーム固有のワークフローに従うエージェントを構築できるとし、金融分析と会議準備という実際のワークフローでの連携例を紹介しています。
【生成AIニュースメモ】Anthropicが新モデル「Claude 3.5 Sonnet」をリリース(2024/6/21)
Anthropic社は2024年6月21日、人工知能対話モデル「Claude」シリーズの最新版となる「Claude 3.5 Sonnet」の提供を開始しました。Claude 3.5 Sonnetは、現行の「Claude […]

