2つのGPT-4oが対話して歌うデモ

3 分AI初心者基礎OpenAIChatGPTと大規模言語モデル

OpenAI. 音声モードの2つのインスタンスが互いに会話し、そのうち一方はカメラを使って部屋の様子を説明します。わずか3分で、音声モードが従来の「マイクを押し、待って、聞く」インターフェースとどう違うのかを直感的に理解できます。割り込み、声の調子、音楽、リアルタイムの視覚認識を1本で確認できます。

AI Expertの注記

短時間で直感をつかむための動画としてのみ利用してください。本番環境の音声エージェントが、情報開示、ログの範囲設定、代替手段、人による対応への切り替えを備えずに、実際のユーザーへ安全に対応できることの根拠にはなりません。

このセクションから得られるもの

特に割り込み、声の調子、カメラで認識した情報を踏まえた会話など、マルチモーダルな音声対話を短時間で確認できます。

視聴または事前に知っておくべきもの

デモの動作は、利用できる製品、地域、アカウントのプランによって異なる可能性があることを理解しておいてください。

最終確認日:2026年5月18日

次の動画を視聴

同じ学習パスで次のキュレーション済みの補完動画を続けて視聴してください。

さらに深く学ぶ

このトピックについてさらに詳しく学べる、厳選された外部コースです。

ChatGPTと大規模言語モデルのすべてのコースを確認