生成AIニュース
【生成AIニュースメモ】OpenAI、エージェント型コーディングモデルGPT-5.3-Codexを発表(2026/2/6)

OpenAIは2026年2月5日(米国時間)、これまでで最も高性能なエージェント型コーディングモデル「GPT-5.3-Codex」を発表しました。GPT-5.2-Codexの最先端のコーディング性能とGPT-5.2の推論・専門知識の強みを統合し、処理速度も25%向上しています。SWE-Bench ProとTerminal-Bench 2.0で業界最高水準を達成したほか、OSWorldやGDPvalでも優れた性能を示し、コーディングにとどまらずコンピュータ上のほぼすべての業務を担うエージェントへの進化を掲げています。有料のChatGPTプランで利用できます。

続きを読む
生成AIニュース
【生成AIニュースメモ】Anthropic、並列ClaudeのチームによるCコンパイラ自律開発の実験を公開(2026/2/6)

Anthropicは2026年2月5日(米国時間)、複数のClaudeインスタンスが人間の介入なしに共有コードベース上で並列に働く「エージェントチーム」の実験を紹介するエンジニアリング記事を公開しました。SafeguardsチームのNicholas Carlini氏が、Opus 4.6を使う16体のエージェントに、RustによるC言語コンパイラをゼロから開発させたものです。約2,000回のClaude Codeセッションと2万ドルのAPIコストを経て、x86・ARM・RISC-VでLinux 6.9をビルドできる10万行のコンパイラが完成しました。

続きを読む
生成AIニュース
【生成AIニュースメモ】Anthropic、AIエージェントの評価設計の実践手法を解説(2026/1/10)

Anthropicは2026年1月9日(米国時間)、AIエージェント向けの評価(eval)を設計・運用するための実践手法をまとめた技術記事を公開しました。自律性・知能・柔軟性というエージェントを有用にする性質そのものが評価を難しくすると指摘し、社内開発や顧客との協業で得た知見をもとに、評価の構成要素、グレーダーの種類と使い分け、エージェントの類型別の評価手法、そして評価をゼロから構築する8ステップのロードマップを整理しています。

続きを読む
生成AIニュース
【生成AIニュースメモ】Anthropic、Claudeを拡張するスキルとMCPの使い分けを解説(2025/12/20)

Anthropicは2025年12月19日(米国時間)、Claudeの能力を拡張する2つの仕組みであるスキルとMCP(Model Context Protocol)の関係と使い分けを解説する記事を公開しました。MCPはClaudeを外部のツールやデータに接続する役割を、スキルはその接続を効果的に使うための手順や専門知識を教える役割を担います。両者を組み合わせることで、汎用的な処理ではなくチーム固有のワークフローに従うエージェントを構築できるとし、金融分析と会議準備という実際のワークフローでの連携例を紹介しています。

続きを読む