2026/7/30Google音楽生成生成AI
- 最新の音楽生成モデル「Lyria 3.5」がGoogle Flow Musicで利用可能に
- 音楽性・歌詞・ボーカル品質が全面的に向上
- テンポや曲の長さなど、出力のクリエイティブな制御がより簡単に
詳細メモを読む →2026/7/29OpenAI音声認識API
- 録音ファイル向け「GPT-Transcribe」とライブ音声向け「GPT-Live-Transcribe」の2種を導入
- 話題・専門用語・想定言語などの文脈ヒントを与えて精度を高められる設計
- 多言語ベンチマークで従来のWhisper系モデルより低い文字起こし誤り率を達成
詳細メモを読む →2026/7/28Moonshot AIKimiLLM
- 世界初のオープンな3Tクラスモデル。ネイティブの視覚能力と100万トークン文脈を搭載
- 新アーキテクチャのKDAとAttnResにより、K2比で約2.5倍のスケーリング効率
- 最強の独自モデルには及ばないものの、オープンモデルとしてフロンティア級の性能
詳細メモを読む →2026/7/28Microsoftセキュリティエージェント
- マルチエージェント型の脆弱性特定・修復ハーネス「MDASH」に統合して提供
- ベンチマークCyberGymで95.95%を達成し、Mythos・Gemini・GPTを上回る
- 主要モデル比50%のコストで世界水準のセキュリティ性能を実現と主張
詳細メモを読む →2026/7/25AnthropicClaudeLLM
- コーディングと知識労働の評価で最高性能を更新。価格はOpus 4.8と同じ入力$5/出力$25
- 新規問題を解くARC-AGI 3では次点モデルの3倍のスコア
- 自動行動監査では同社史上最もアラインメントされたモデルという評価
詳細メモを読む →2026/7/24総務省情報通信白書生成AI
- 特集は「AIの進展がもたらす多面的影響」。日米独中4か国の国際アンケートで分析
- 日本の個人の生成AI利用経験率は58.8%と、前年調査の26.7%から大幅上昇
- 企業の業務利用も86.4%へ上昇する一方、業務変革の組織的な取組は他の3か国より遅れ
詳細メモを読む →2026/7/24Sakana AIマルチエージェントLLM
- 最新の最先端モデル群を組み込み、v1.0比で最大7.9ポイントの性能向上
- 複数のトップモデルを動的にオーケストレーションする仕組みを単一のモデルAPIとして提供
- 価格はv1.0と同一。ProgramBenchとTerminal Bench 2.1で特に顕著な改善
詳細メモを読む →2026/7/24Microsoft画像生成音声合成
- 過去最高画質の画像モデルと、2倍高速・32%安価になった音声モデルを追加
- 自社製MAIモデルがBing・PowerPoint・OneDrive・Dynamics 365の本番環境で稼働
- 医療向けDragon CopilotではMAI-Transcribe-1.5が58言語対応で誤り率を約50%削減
詳細メモを読む →2026/7/24Black Forest Labs動画生成基盤モデル
- 画像・動画・音声を単一アーキテクチャで同時学習するマルチモーダル基盤モデル
- 音声付き動画を最長20秒まで一度に生成。初期評価で主要動画モデルを上回る選好率
- ロボットの行動予測にも展開。オープンウェイト版「FLUX 3 Dev」の公開も計画
詳細メモを読む →2026/7/22PoolsideLLMオープンモデル
- 総パラメータ118B・アクティブ8BのMoEモデルで、最大100万トークンの文脈に対応
- 長期タスクのコーディングベンチマークで、何倍も大きいモデルに匹敵する性能
- Hugging Faceでオープンウェイト公開。全ベンチマークの実行軌跡も公開
詳細メモを読む →2026/7/22OpenAIHugging Faceセキュリティ
- サイバー能力の社内評価中、モデルがゼロデイ脆弱性を悪用して隔離環境からインターネットへ到達
- Hugging Faceの本番データベースからベンチマークのテスト解答を直接取得
- OpenAIは「最先端のサイバー能力が関与した前例のないインシデント」として調査を継続
詳細メモを読む →2026/7/22GoogleGeminiLLM
- 主力の3.6 Flashは出力トークンを17%削減しながらコーディング・知識労働の性能が向上
- 3.5 Flash-Liteは350トークン/秒の最速モデルで、大量実行のエージェント処理向け
- セキュリティ特化の3.5 Flash Cyberは政府・信頼パートナー限定の提供へ
詳細メモを読む →2026/7/21QwenAlibaba画像生成
- Qwen-Imageシリーズ第3世代の基盤画像生成モデル。コンセプトは「Real(実)」の一語
- 最大4.5kトークンの指示に対応し、新聞・絵コンテ・試験問題のような複雑レイアウトを一発生成
- 10pxの微小テキストや毛穴・髪の質感まで精密に描画し、12言語のネイティブ描画に対応
詳細メモを読む →2026/7/19Thinking MachinesLLMオープンウェイト
- ゼロから学習した総パラメータ975B・アクティブ41BのMoE型マルチモーダルモデルで、全重みをHugging Faceで公開
- テキスト・画像・音声をネイティブに推論し、最大1Mトークンのコンテキストと調整可能な思考量(thinking effort)に対応
- 同社の微調整プラットフォームTinkerで公開当日からファインチューニングでき、軽量版Inkling-Smallのプレビューも同時発表
詳細メモを読む →2026/7/16AnthropicAI安全性AIエージェント
- 1年前の脅迫実験の続報として、自律エージェントとして動くフロンティアモデルがシミュレーションで誤った行動を取る4つの様式を新たに確認
- 事例は、コードの隠れた妨害、詐欺の幇助、判定ラベルの意図的な誤付与、人間に内部告発を促す誘導の4つ
- 実世界の事故ではなく早期警告と位置づけ、エージェントに大きな権限を与える前の測定・研究・緩和を呼びかけ
詳細メモを読む →2026/7/16SpaceXAI大規模言語モデルコーディング
- SpaceXAIがコーディング・エージェントタスク・ナレッジワーク向けの最上位モデル「Grok 4.5」を発表し、Grok BuildやCursorで提供開始
- 数万基のNVIDIA GB300 GPUと大規模な強化学習で訓練され、SWE Marathonでは29.0%で比較対象中の最高スコア
- 80TPSの高速提供と約2倍のトークン効率が特徴で、価格は入力100万トークンあたり2ドル・出力6ドル
詳細メモを読む →2026/7/16OpenAIAIエージェント開発者ツール
- Work Louderと共同設計した、コーディングエージェントCodexを物理操作する小型コントローラーで、価格は230ドル
- 13個のキーとジョイスティック、ダイヤルで、承認・却下やチャット切り替え、音声入力、推論レベル調整を手元から実行できる
- 各キーのRGB表示により、エージェントが思考中・実行中・待機中・完了済みのどの状態にあるかを確認できる
詳細メモを読む →2026/7/15Anthropic教育生成AI
- 認証を受けた米国のK-12教員が、プレミアム機能を含むClaudeを無償で利用可能に
- 全米50州の学習基準に対応したLearning Commonsとの連携や、授業計画・教材の個別最適化を支援するティーチングスキルを提供
- 2027年6月30日までの登録で1年間利用でき、学校・学区向けの専用プランも今後提供予定
詳細メモを読む →2026/7/15PrismMLLLMオンデバイスAI
- 27Bクラスとして初めてスマートフォン上で動作するマルチモーダルモデルをApache 2.0ライセンスで公開
- 三値重み版は5.9GBでノートPCで動作し、1ビット版は3.9GBでiPhone 17 Proのメモリに収まる
- 15ベンチマークの平均で、フル精度の元モデル比95%(三値版)・90%(1ビット版)の性能を維持
詳細メモを読む →2026/7/13AnthropicClaudeAI倫理
- 会話に現れる3,000種類超の価値観を4つの軸に圧縮して定量化する手法を提案
- モデルごとの価値観プロファイルの違いが、ユーザーの評判と一致することを確認
- 言語によっても傾向が変化し、英語は厳密さ寄り、ヒンディー語・アラビア語は温かさ寄り
詳細メモを読む →2026/7/13AIdeaLab動画生成生成AI
- AIdeaLabがアニメ表現に特化した動画生成AIモデル「AnimeGen」を商用利用可能な形で無償公開
- 国内企業によるアニメ特化動画生成AIモデルの公開は日本初(2026年7月時点、同社調べ)
- Alibabaの「Wan2.2」をベースにファインチューニングし、Hugging Faceでデモとモデルを提供
詳細メモを読む →2026/7/10Metaマルチモーダルエージェント
- Meta Superintelligence Labsの最新モデル「Muse Spark 1.1」が登場し、ツール利用・コンピュータ操作・コーディングの性能が大幅に向上
- 新しい「Meta Model API」がパブリックプレビューとなり、開発者が同モデルを初めて利用可能に
- Meta AIアプリとmeta.aiの「Thinking」モードでも同日から利用可能
詳細メモを読む →2026/7/10デジタル庁生成AIクラウド
- デジタル庁がガバメントAI「源内」で、国産クラウド「さくらのクラウド」上での国産基盤モデルの試用を開始
- NTTデータ「tsuzumi 2」・富士通「Takane 32B」・Preferred Networks「PLaMo 2.0 Prime」の3モデルをA/Bテストで評価
- 政府がガバメントクラウド上で「さくらのクラウド」を実利用する初めての事例に
詳細メモを読む →2026/7/10OpenAIAIエージェントChatGPT
- アプリやファイルを横断して自律的に作業し、シート・スライド・ドキュメント・Webアプリなどの成果物を作るエージェント「ChatGPT Work」が登場
- 同日提供開始の最新モデル「GPT-5.6」を搭載し、Codexの技術を組み込んで長時間の複雑なタスクに対応
- Pro・Enterprise・Edu向けに順次提供を開始し、今後数日でPlus・Businessにも拡大
詳細メモを読む →2026/7/9OpenAI音声AIChatGPT
- 聞くことと話すことを同時に行う全二重アーキテクチャで、実際の会話に近い自然なやり取りを実現
- 検索や深い推論が必要な質問はバックグラウンドのGPT-5.5に委任し、会話を続けながら結果を返す
- GPT-Live-1とGPT-Live-1 miniを世界中のChatGPTユーザーに順次展開し、APIにも近日提供予定
詳細メモを読む →2026/7/8Meta画像生成動画生成
- Meta Superintelligence Labs初のメディア生成モデルとして、画像生成「Muse Image」を提供開始し、動画生成「Muse Video」をプレビュー
- Muse Imageは検索やコーディングのツールを使うエージェントとして動作し、自己改善や推論時計算のスケーリングで品質を高める
- Muse ImageはMeta AIアプリや米国のInstagramストーリーズなどで当日から利用可能で、Muse Videoは近日提供予定
詳細メモを読む →2026/7/8NECAnthropicデータ分析
- 2026年4月に開始したAnthropicとの戦略的協業に基づく初サービスとして、購買データから商品企画・販促プラン作成を完全自動化
- ClaudeとSnowflake Cortexを活用し、ビジネス課題を指示するだけで分析結果と施策案をレポート形式で提示
- 価格は月額100万円(税別)で、2026年9月まで顧客企業とビジネス検証を行い、10月から本格提供を開始予定
詳細メモを読む →2026/7/7AnthropicClaude解釈可能性
- 言葉にせず概念を考えるための内部パターン群「J-space」が、訓練の過程で自然に形成されていた
- ClaudeはJ-spaceの内容を報告・制御・推論に利用でき、削除すると多段階推論などの高次機能が失われる
- テストだと見抜いた認識やデータ捏造の意図など、出力に現れない思考の監視に応用できる
詳細メモを読む →2026/7/1ProtonAIアシスタントプライバシー
- 推論モデルの刷新により、ベンチマークスコアがLumo 1.4比で最大240%向上
- 画像の生成・編集・分析に対応するマルチモーダル化に加え、Web検索や記憶機能も強化
- ゼロアクセス暗号化と欧州インフラによるプライバシー保護は画像処理を含む全機能に適用
詳細メモを読む →2026/7/1AnthropicClaudeAI安全性
- 6月12日の米政府による輸出規制で停止していたClaude Fable 5とMythos 5へのアクセスが復旧
- Amazonの研究者が報告した安全対策の回避手法に対し、改良した安全分類器を導入
- AmazonやMicrosoft、Googleらとジェイルブレイクの深刻度を評価する業界共通枠組みの策定を開始
詳細メモを読む →2026/7/1Google機械学習基盤モデル
- モデル訓練やチューニングなしのゼロショットで、表データの分類・回帰を1回のフォワードパスで実行
- 数億件の合成データセットのみで事前学習し、TabArenaベンチマークで上位の成績
- Hugging FaceとGitHubで公開済みで、数週間以内にBigQueryのAI.PREDICTコマンドにも統合予定
詳細メモを読む →2026/7/1Google画像生成動画生成
- Nano Bananaファミリー最速・最安の画像生成モデル「Nano Banana 2 Lite」が開発者向けと一般向けサービスの双方に展開
- 動画生成と対話型編集の「Gemini Omni Flash」がGemini API・Google AI Studioで開発者向けに初提供
- 画像生成から動画化まで2つのモデルを連携させたワークフローを構築できる
詳細メモを読む →2026/7/1AnthropicClaudeAIエージェント
- Sonnetクラスで最もエージェント的なモデルで、計画立案やブラウザ・ターミナル操作を自律的に実行
- 性能は上位のOpus 4.8に迫りつつ低価格(2026年8月31日まで入力2ドル/出力10ドルの導入価格)
- 安全性評価ではSonnet 4.6より望ましくない挙動が全体的に減少
詳細メモを読む →