生成AIニュース
【生成AIニュースメモ】Microsoft、「MAI-Image-2.5-Pro」と「MAI-Voice-2-Flash」を公開プレビュー(2026/7/24)

Microsoft AIは2026年7月23日、画像生成モデル「MAI-Image-2.5-Pro」と音声モデル「MAI-Voice-2-Flash」のパブリックプレビューを発表しました。同社は1年前から、サードパーティモデルからの蒸留に頼らず、クリーンで追跡可能なエンタープライズ級のデータで目的特化モデルを内製する取り組みを進めており、その成果としてMAIモデルがBing・PowerPoint・OneDrive・Dynamics 365・Azureなど拡大中の製品群の本番環境で、数百万ユーザーの体験を効率的に支えるまでになったと説明しています。

続きを読む
生成AIニュース
【生成AIニュースメモ】Google、音声合成モデル「Gemini 3.1 Flash TTS」を発表(2026/4/16)

Googleは2026年4月15日(米国時間)、テキスト読み上げ(TTS)モデルの最新版「Gemini 3.1 Flash TTS」を発表しました。制御性・表現力・品質が向上した同社でもっとも自然なTTSモデルと位置づけられ、開発者向けにGemini APIとGoogle AI Studio、企業向けにVertex AIでプレビュー提供が同日から始まったほか、WorkspaceユーザーはGoogle Vids経由で利用できます。自然言語のコマンドを入力テキストに埋め込み、声のスタイルや話し方を細かく指示できる「音声タグ」の導入が特徴です。

続きを読む
Python
【音声合成】VOICEVOXで音声ファイルを作成する

オープンソースの音声合成ソフトであるVOICEVOXについて紹介します。実際に音声ファイルを作成してみましょう。Google colabを使用して簡単に実装することができますので、ぜひ最後までご覧ください。(Google […]

続きを読む