マルチモーダル・サービス

音声生成AIとは?

読み: おんせいせいせいえーあい英語: Audio Generation AI更新日: 2026-09-11

音声生成AIとは、音声合成、声の変換、ナレーション生成などを行うAIです。

生成AIパスポートG検定

別名・表記: 音声生成AI / 音声生成

試験で問われるポイント

  • TTS(Text-to-Speech)は文章から音声を作り、ボイスクローンは特定の話者の声の特徴を再現します。
  • 音声認識は音声を文字等へ変換する技術で、音声を作る処理とは区別します。
  • 声の再現では本人同意や、なりすまし・詐欺のリスクに注意します。

具体例

研修動画のナレーション案を作る一方、なりすまし詐欺への対策も必要です。

混同しやすい点

  • 本人の声を無断で再現しても問題ないと考える。
  • TTS、ボイスクローン、音声認識を同じ処理だと考える。

関連問題で復習

関連用語