# 音声認識

> Implement speech-to-text transcription with Vivox.

音声認識オーディオトランスクリプションは、接続された 1 つ以上のノンポジショナルまたはポジショナル音声チャンネルでユーザーごとに音声認識トランスクリプションを有効にする、Vivox の有料のオプションサービスです。利用料金および組織におけるこのサービスの有効化については、販売担当者にお問い合わせください。

このサービスは、Communications and Video Accessibility Act (CVAA) への準拠を目指している開発者をサポートします。

音声認識トランスクリプションが有効になっている顧客は、チャンネルごとに受け取るように設定しているすべてのユーザーにトランスクライブされたオーディオを提供できます。トランスクライブされたオーディオが、テキストメッセージの形式で返され、メッセージが音声からトランスクライブされたことが示されます。これらのメッセージは、トランスクライブされたテキストがトランスクリプションをリクエストしたユーザーからのものであるかどうかを示す場合もあります。

| トピック                                                                     | 説明                                   |
| ------------------------------------------------------------------------ | ------------------------------------ |
| [オーディオトランスクリプションの状態](/vivox-unity/speech-to-text/stt-conditions.md)      | トランスクリプションが行われる条件の詳細。                |
| [音声認識 API](/vivox-unity/speech-to-text/stt-api.md)                       | 音声認識トランスクリプションを管理するために使用される API の詳細。 |
| [音声認識とオーディオインジェクション](/vivox-unity/speech-to-text/stt-audio-injection.md) | 音声認識での挿入されたオーディオの使用。                 |
