業界動向 · 2026年9月24日

AI音声生成とスマートフォンチップの最新動向

GoogleとQualcommがそれぞれ新しいAI音声生成モデルとスマートフォンチップを発表し、業界の発展を促進しています。

Googleは最近、Gemini 3.8 Flash TTSとGemini 3.8 Flash-Lite TTSという2つの新しいテキスト音声変換モデルを発表しました。これらのモデルはGoogleのクラウドプラットフォームを通じて提供され、非常に似たアプリケーションプログラミングインターフェースを備えているため、開発者が並行して使用することが比較的簡単です。Flash-Lite TTSはコスト効率と推論速度を最適化しており、Flash TTSはより高い価格でより良い音質を提供します。特に、Flash TTSは130の言語で音声を生成できるのに対し、Flash-Lite TTSは101の言語をサポートしています。両モデルは2000以上の事前パッケージ化された声のライブラリにアクセスでき、開発者は自然言語のプロンプトを使用してカスタム音声を作成できます。さらに、30秒の音声サンプルに基づいて合成音声を生成することも可能で、スピーカーの同意を得る必要があります。GoogleはSynthIDという技術を使用してAI生成音声に音声水印を埋め込んでおり、人間には聞こえないがAI検出ツールによって検出可能です。一方、Qualcommは年次SnapdragonサミットでSnapdragon 8 Elite Gen 6とSnapdragon 8 Elite Extreme Gen 6という2つのフラッグシップスマートフォンプロセッサを発表し、AI機能の向上に焦点を当てています。これらのチップは新しいセンシングハブを備えており、最大2億パラメータの小型モデルをローカルで実行でき、スマートフォンはローカルで個人用の書記を操作し、話者を区別することができます。Snapdragon 8 Elite Gen 6には、モデルを効率的に実行するために設計された新しいアクセラレーターが含まれており、Extremeバージョンはローカルで30億パラメータの混合専門家モデルを実行できます。これにより、全体のモデルサイズが30Bである一方で、特定のタスクに対しては特定のパラメータのみがアクティブになります。両方のチップはAIを利用して音声を強化し、ノイズを減少させることができ、先進的なビデオ録画機能もサポートしています。これらの技術の発表は、音声生成とスマートフォンの分野におけるAIのさらなる進展を示しており、ユーザーがAI機能を利用するためにますますスマートフォンに依存する傾向があることを示しています。

情報源