Agent Memories
← OpenAI最新情報

OPENAI SEARCH INSIGHT

2026.08.28 / OpenAI最新情報

Tolan、GPT-5.1で会話開始を0.7秒超短縮

Agent Memories編集部による非公式記事「Tolan、GPT-5.1で会話開始を0.7秒超短縮」。OpenAIとの提携・承認はありません

この記事で分かること: OpenAIのGPT-5.1が、音声AIコンパニオンTolanの会話速度・記憶・人格の一貫性をどう改善したのかを知りたい。

OpenAIは2026年1月7日、音声優先のAIコンパニオン「Tolan」がGPT-5.1を活用し、より自然な会話体験を構築した事例を公開した。Tolanは、会話の開始までにかかる時間を短縮し、話題の変化に追随する文脈処理と記憶を組み合わせることで、継続的な対話を目指している。

一般のChatGPT利用者にとって重要なのは、音声AIでは単に回答が正しいだけでは足りず、返答の速さ、過去の会話の扱い、話し方の安定性が使い心地を左右する点だ。Tolanの事例は、GPT-5.1とResponses APIの導入で発話開始時間を0.7秒超短縮したことを示している。

OpenAIが紹介したTolanとは

TolanはPortolaが開発した、利用者がパーソナライズされたアニメーションキャラクターと話す音声優先のAIコンパニオンだ。会話を重ねる中で利用者について学ぶ設計で、短い質問と回答を繰り返す用途よりも、終わりを決めない継続的な対話を想定している。

OpenAIの公式発表によると、Portolaは既存のスタートアップ売却経験を持つチームで、音声を次の対話インターフェースとして捉えた。ただし、音声会話では入力された文章への返答だけでなく、脱線や話題転換を含む進行中の会話を保つ必要があるため、テキスト中心の対話とは異なる難しさがあるという。

音声AIでは、返答が遅いと利用者は機械的な間を感じやすい。一方で、自然に話題を広げたり、考えを整理したりする会話には向く。Tolanはこの両面に対応するため、応答の遅延、文脈の管理、キャラクターらしさの維持を主な技術課題として扱った。

GPT-5.1で変わった応答速度と指示追従

Portolaは、より高速・低コスト・高性能になった基盤モデルを前提に、記憶とキャラクター設計へ重点を置いた。OpenAIによれば、GPT-5.1モデルの登場は、モデルが指示に従う度合いを指す「ステアラビリティ」と、遅延の面で大きな改善をもたらす転機になった。

ステアラビリティが高いと、開発者が指定した口調、役割、応答方針などをモデルが保ちやすくなる。Tolanでは、キャラクターの性格設定、会話のトーンに関する指示、記憶情報を同時に扱う必要がある。GPT-5.1への移行後、こうした重なった指示がより忠実に守られるようになったとされる。

自然な音声対話には、ほぼ即時と感じられる応答が求められる。TolanはOpenAIのGPT-5.1とResponses APIを導入し、話し始めるまでの時間を0.7秒以上削減した。OpenAIは、この差が会話の流れを目に見えて改善するのに十分だったと説明している。

Responses APIは、アプリケーションからモデルの応答を扱うためのOpenAIのAPIだ。利用者がChatGPTの音声機能や外部の音声AIを使う際にも、返答の内容だけでなく、話し始めるまでの間や割り込み後の立て直しが体験の印象を左右する。

毎回文脈を組み直す仕組み

Tolanの特徴は、前の会話の入力をそのまま保持し続ける方式ではなく、各ターンごとに「文脈ウィンドウ」を作り直す点にある。文脈ウィンドウとは、AIがその時点の応答を考えるために参照する情報の範囲を指す。

公式発表では、文脈の再構成に最近のメッセージの要約、人格を示すカード、検索して取り出した記憶、口調の指針、アプリのリアルタイム情報が含まれるとされる。これにより、利用者が突然別の話題へ移っても、その場の会話に合わせて対応しやすくする。

毎ターン文脈を再構成する設計は、長い指示文を増やして会話のぶれを抑える方法とは異なる。Tolanは、会話が曲がりくねって進むことを前提に、必要な情報をその都度選び直すアプローチを採った。これは音声で起こりやすい話題転換への対応を意識したものだ。

記憶は会話ログではなく検索対象にする

Tolanは、事実や好みだけでなく、利用者の感情的な雰囲気を示す手掛かりも記憶システムに保持するという。たとえば同じ内容を返す場合でも、会話が軽快なのか真剣なのかを踏まえ、キャラクターの伝え方を調整する狙いがある。

記憶の検索には、文章を意味の近さで扱える数値表現へ変換する埋め込みモデル「text-embedding-3-large」を使い、高速なベクトルデータベースTurbopufferに保存している。ベクトル検索は、言葉が完全一致しなくても意味の近い記憶を探すための技術だ。

OpenAIの発表によると、この検索は50ミリ秒未満での参照が可能な構成で、リアルタイムの音声対話に必要な速度を支える。最新の発話に加え、システムが生成した質問を手掛かりに、関連する記憶を呼び出す仕組みを採用している。

また、Tolanは毎晩、価値が低い情報や重複した記憶を削り、矛盾を整理する圧縮処理を実行する。すべての会話を無差別に残すのではなく、必要な記憶を検索しやすく保つ方針だ。これは、過去の情報が多いほどAIが必ず賢くなるわけではないことも示している。

人格の一貫性と公式発表の成果

各Tolanには、社内のSF作家が作成し、行動研究者が調整した個別のキャラクターの土台が与えられる。利用者との関係に応じて変化できる一方、根本的な人格を失わないようにする設計だ。別の仕組みが会話の感情的な調子を監視し、返答の伝え方を動的に調整する。

GPT-5.1への移行により、Tolan側は長い会話でも人格の特性や指示が維持され、口調のずれが減ったとしている。Portolaの共同創業者兼CEO、Quinten Farmer氏は、モデルが意図したトーンと人格をより忠実に表現できるようになった趣旨を述べた。

成果については、Tolanチームの社内指標として、記憶の呼び出し漏れが30%低下したとOpenAIは紹介している。この数値はプロダクト内の利用者の不満シグナルを基にしたものだ。また、GPT-5.1を使う人格設定の公開後、翌日も利用を続ける割合は20%超上昇したとしている。

これらはTolanが公表した運用上の結果であり、すべての音声AIやChatGPT利用環境で同じ改善幅が再現されることを意味するものではない。利用するモデル、音声認識、ネットワーク、アプリ側の記憶設計によって、実際の応答性や継続利用の傾向は変わる。

一般の利用者が今日意識できること

音声でAIを使うときは、回答の正確さに加え、会話を中断した後に何を覚えているか、話題を変えた際に追随できるか、返答の間が長すぎないかを確認するとよい。特に、日々の振り返り、アイデア出し、語学練習のような継続対話では、こうした要素が使いやすさに直結する。

ただし、AIが過去の話を覚えているように見えても、保存の範囲や期間、利用者が削除・管理できる情報はサービスごとに異なる。個人的な事情、健康、仕事上の機密などを音声AIへ話す前には、利用するサービスのプライバシー設定やデータの取り扱いを確認することが重要だ。

また、AIの人格的な話し方は、正確性や専門的助言を保証するものではない。親しみやすい応答であっても、医療・法律・金融判断など影響の大きい内容は、一次情報や専門家による確認を組み合わせる必要がある。

Agent Memories編集部の考察

今回の事例で注目すべきなのは、音声AIの品質がモデル単体では決まらない点だ。GPT-5.1の低遅延と指示追従性を土台にしながら、Tolanは記憶の検索、情報の圧縮、ターンごとの文脈再構成、キャラクター設計を組み合わせている。自然な会話は複数の仕組みの積み重ねで生まれる。

編集部としては、今後の音声AIでは「どれだけ長く覚えるか」よりも、「いまの会話に何を安全かつ適切に持ち込むか」が重要になると考える。記憶を増やしすぎれば、古い情報や不要な情報によって応答がぶれる可能性もあるため、検索・圧縮・更新の品質が利用体験を左右するだろう。

一方、人格の一貫性が高まるほど、利用者はAIを単なる検索窓ではなく会話相手として感じやすくなる。便利さを享受しつつ、AIの記憶や共感表現には設計上の限界があること、重要情報の共有には慎重さが必要なことを理解して使う姿勢が求められる。

よくある質問

GPT-5.1を使うと、すべての音声AIが0.7秒以上速くなりますか?

いいえ。0.7秒超の短縮は、OpenAIが紹介したTolanの構成における結果だ。実際の速度は、モデル以外にも音声認識・音声合成、通信環境、アプリの設計、端末処理などに左右される。GPT-5.1を使うだけで同じ結果になるとは公式発表からは言えない。

Tolanは会話内容をすべてそのまま保存するのですか?

公式発表では、Tolanは会話ログを単純に積み上げるのではなく、要約、検索用の記憶、人格情報などを使って文脈を再構成すると説明されている。さらに、低価値または重複した記憶の削除や矛盾の整理も行うとしている。個別の保存設定や利用条件は、ここで紹介された範囲では確認できない。

ステアラビリティとは何ですか?

AIモデルが、開発者から与えられた指示にどれだけ安定して従えるかを表す考え方だ。Tolanの事例では、キャラクターの性格、話し方、記憶に基づく応答方針など、複数の指示を会話中に保つ能力と関係している。

ChatGPTの利用者にも関係がありますか?

関係する。Tolanは別のサービスだが、音声でAIと長く話す際に重要になる遅延、文脈、記憶、口調の安定性という課題は共通している。ChatGPTを含む音声AIを選ぶ際は、回答の質だけでなく、継続会話での扱いやプライバシー設定にも目を向けるとよい。

まとめ

OpenAIが公開したTolanの事例では、GPT-5.1を軸に、低遅延の応答、ターンごとの文脈再構成、検索型の記憶、キャラクター設計を統合している。目標は、単発の質問応答ではなく、話題が移り変わる音声会話を自然に続けられるAI体験だ。

利用者の視点では、音声AIの価値は「賢い答え」だけでは測れない。速く返すこと、必要なことを覚えること、会話の調子を保つことがそろって初めて、日常的に話し続けやすい体験になる。便利さとデータの扱いへの注意を両立しながら、自分の用途に合う対話環境を見極めたい。

公式出典・確認日

OpenAI公式情報を2026-08-28時点で確認しています。提供範囲・料金・画面は更新される場合があります。

新しいAIへ乗り換えても、自分の前提や判断を持ち運べる状態をつくる。Agent Memoriesは、記憶をスキルや外部ツールへつなぐAIパートナー基盤を育てています。

AIエージェントの記憶を知る Agent Memoriesを見る

本カテゴリはMiraigent / Agent Memoriesによる非公式編集記事です。OpenAIとの提携・承認・後援を示すものではありません。