OpenAI、聞きながら話せる音声AI「GPT-Live-1」を公開 同時通訳にも対応 同時通訳などの用途で人間同士のような自然な対話テンポを実現|ビジネス+IT

同時通訳などの用途で人間同士のような自然な対話テンポを実現

Google preferred source

1

会員(無料)になると、いいね!でマイページに保存できます。

共有する

米OpenAIは2026年7月8日、ChatGPT向けの新しい音声AIモデル「GPT-Live-1」および小型版「GPT-Live-1 mini」を公開した。情報の受け取りと出力を同時に行う「全二重通信」を採用し、利用者が話している最中でもAIが発言や割り込みに対応できる。無料ユーザーを含む全利用者を対象に提供され、同時通訳などの用途で人間同士のような自然な対話テンポを実現する。

photo

(画像:ビジネス+IT)

 米OpenAIが公開した「GPT-Live-1」は、従来のターン制の会話プロセスを根本から変える音声モデルである。情報の受け取りと出力の生成を同時に行う全二重通信(フルデュプレックス)アーキテクチャを採用し、利用者が話している最中でもAIが発言し、会話への割り込みにも低遅延で対応する。相槌や言葉のつかえを認識するほか、名前をウェイクワードとして呼ばれるまで聞き役に徹する設定も可能となった。このリアルタイム処理により、同時通訳などの用途においても実用的な対話環境を構築する。

 技術的な中核となるのが「推論委譲」と呼ばれる仕組みである。音声モデル本体は会話のテンポ維持に特化し、複雑な推論や高度な問題解決が必要な要求に対しては、バックグラウンドで稼働する「GPT-5.5」に処理を委譲する。これにより、音声応答の速度を維持したまま、深い思考を伴う回答を成立させている。

画像

【図版付き記事はこちら】OpenAIが次世代音声モデル「GPT-Live-1」発表、同時通訳にも対応(図版:ビジネス+IT)

 本機能は段階的に提供され、利用者のプランによって割り当てられるモデルが異なる。PlusおよびProプランのユーザーには上位モデルの「GPT-Live-1」が提供され、無料ユーザーには小型版の「GPT-Live-1 mini」がデフォルトで適用される。一方、Businessプラン向けへの展開については現時点で限定的となっている。また、提供開始当初は計算資源の配分調整に伴う利用制限が設けられており、一部の有料ユーザー間で1日1時間程度の利用上限が設定されている。今後は開発者向けのAPI提供も予定している。

 プライバシーおよび安全性に関する仕様も更新された。音声モードでの会話データはAIの学習利用から自動的にオプトアウトされる。文脈保持の目的でデータは30日間保存されるが、手動での即時削除も可能である。加えてOpenAIは、新モデルの展開にあたり安全対策を拡充し、自傷行為、精神的健康に関する問題、暴力的なコンテンツといった主要な領域において、従来モデルを上回る安全基準を満たしていると発表した。

AI・生成AIのおすすめコンテンツ

Googleで見つけやすく

Google preferred source

評価する

いいね!でぜひ著者を応援してください

会員(無料)になると、いいね!でマイページに保存できます。

関連タグ
タグをフォローすると最新情報が表示されます