【生成AIニュースメモ】Google、音声同時翻訳モデル「Gemini 3.5 Live Translate」を発表(2026/6/10)
Googleは2026年6月9日(米国時間)、音声から音声へのライブ翻訳を行う最新の音声モデル「Gemini 3.5 Live Translate」を発表しました。70超の言語を自動検出し、話者の抑揚・ペース・声の高さを保った自然な翻訳音声をほぼリアルタイムに生成します。同日から、開発者向けにはGemini Live APIとGoogle AI Studioの公開プレビュー、企業向けには今月からGoogle Meetの限定プレビュー、一般向けにはAndroid/iOSのGoogle翻訳アプリを通じて順次展開されます。
【生成AIニュースメモ】Google、高速・低コストのGemini 3.1 Flash-Liteを一般提供(2026/5/9)
Google Cloudは2026年5月8日(米国時間)、Gemini 3シリーズで最速かつ最もコスト効率が高いモデル「Gemini 3.1 Flash-Lite」の一般提供(GA)をGemini Enterprise Agent Platformで開始したと発表しました。超低遅延・大量処理向けの設計で、ツール呼び出しやオーケストレーションといったエージェント的なタスクに必要な精度と、自動化パイプラインを大規模に動かすためのコスト効率を両立するとしています。発表では、JetBrainsやGladlyをはじめ、採用企業の活用事例が多数紹介されています。
【生成AIニュースメモ】Google、音声合成モデル「Gemini 3.1 Flash TTS」を発表(2026/4/16)
Googleは2026年4月15日(米国時間)、テキスト読み上げ(TTS)モデルの最新版「Gemini 3.1 Flash TTS」を発表しました。制御性・表現力・品質が向上した同社でもっとも自然なTTSモデルと位置づけられ、開発者向けにGemini APIとGoogle AI Studio、企業向けにVertex AIでプレビュー提供が同日から始まったほか、WorkspaceユーザーはGoogle Vids経由で利用できます。自然言語のコマンドを入力テキストに埋め込み、声のスタイルや話し方を細かく指示できる「音声タグ」の導入が特徴です。
【生成AIニュースメモ】Google、オープンモデル「Gemma 4」をApache 2.0ライセンスで公開(2026/4/3)
Google DeepMindは2026年4月2日(米国時間)、オープンモデルの最新世代「Gemma 4」を発表しました。高度な推論とエージェント型ワークフローに向けて設計され、E2B・E4B・26B MoE・31B Denseの4サイズを商用利用可能なApache 2.0ライセンスで提供します。Gemini 3と同じ研究・技術を基盤とし、31BモデルはArena AIテキストリーダーボードでオープンモデル世界3位を獲得。スマートフォンからラップトップGPU、ワークステーションまで、手元のハードウェアで動かせる点が特徴です。
【生成AIニュースメモ】Google、最も低コストな動画生成モデルVeo 3.1 Liteを公開(2026/4/1)
Googleは2026年3月31日(米国時間)、同社で最も費用対効果の高い動画生成モデル「Veo 3.1 Lite」を発表しました。Veo 3.1 Fastの50%未満のコストで同じ速度を保ち、開発者が大量の動画を扱う高ボリュームなアプリケーションを構築できるようにするモデルで、これによりVeo 3.1モデルファミリーが出揃い、ニーズに応じた柔軟な使い分けが可能になるとしています。同日からGemini APIとGoogle AI Studioの有料ティアで利用でき、4月7日にはVeo 3.1 Fastの値下げも予定しています。
