関連動画

ChatGPTの音声モード:友人のようにAIと話す — 関連動画

この記事では、音声モードが得意なこと、苦手なこと、文字入力ではなく声に出して行う価値のある会話を説明しています。この2本の動画では、実際に機能が動く様子を確認できます。短い動画では、2つの音声モードのインスタンスを会話させ、「リアルタイムで、割り込みができ、感情表現を伴う」とは実際にどのように聞こえるのかを体験できます。もう一本は、多くの人がこの機能を初めて目にした2024年の発表基調講演です。

主な選択肢

3:25
2つのGPT-4oが対話して歌うデモ

OpenAI

音声モードの2つのインスタンスが互いに会話し、そのうち一方はカメラを使って部屋の様子を説明します。わずか3分で、音声モードが従来の「マイクを押し、待って、聞く」インターフェースとどう違うのかを直感的に理解できます。割り込み、声の調子、音楽、リアルタイムの視覚認識を1本で確認できます。

このセクションから得られるもの: 特に割り込み、声の調子、カメラで認識した情報を踏まえた会話など、マルチモーダルな音声対話を短時間で確認できます。

視聴または事前に知っておくべきもの: デモの動作は、利用できる製品、地域、アカウントのプランによって異なる可能性があることを理解しておいてください。

AI Expertの注記: 短時間で直感をつかむための動画としてのみ利用してください。本番環境の音声エージェントが、情報開示、ログの範囲設定、代替手段、人による対応への切り替えを備えずに、実際のユーザーへ安全に対応できることの根拠にはなりません。

動画ページを開く

あわせて見たい動画

26:13
GPT-4oの紹介

OpenAI

2024年5月にChatGPTのリアルタイム音声モードが初めて実演された基調講演です。Mark Chenが呼吸法を、Barrett Zophが数学の個別指導を実演し、その後、リアルタイムのイタリア語・英語通訳に切り替えます。26分間を通して、「AIと友人のように話す」とはこういうことか、と実感できます。紹介されたモデルと機能は、その後さらに向上しています。

このセクションから得られるもの: リアルタイムの会話型音声が、音声入力や従来型の音声アシスタントと異なる感覚をもたらす理由を理解できます。

視聴または事前に知っておくべきもの: ありません。ただし、現在の製品マニュアルではなく、発表時のデモとしてご覧ください。

AI Expertの注記: 歴史的な参考資料としては有用ですが、現在の機能仕様ではありません。実際の顧客や従業員の業務で音声機能を使う前に、同意、録音、データ保持、言語、アクセシビリティ、人による対応への切り替えに関する現在の設定を確認してください。

動画ページを開く