サム・オルトマン氏、究極のAIアシスタントはあと1世代のモデルで実現すると語る
OpenAIのCEOサム・オルトマン氏は再び、野心的な未来のAIアシスタント像を描いた。最近のシリコンバレーのインターン生との対話の中で、オルトマン氏は、あるシステムを説明した。それは、...

Sam Altman:究極のAIアシスタントは、あと一世代のモデル先にある
はじめに
OpenAIのCEOであるSam Altman氏は、再び未来のAIアシスタントに対する壮大なビジョンを描いた。
シリコンバレーのインターン生との最近の対話の中で、Altman氏は、あなたのコンピュータで起きていることを継続的に把握し、共有したい会議や通話を追跡し、あなたのデジタルライフ全体の文脈を理解するのに十分なコンテキストを蓄積できるシステムについて説明した。
彼の見積もりは驚くべきものだ。この種のアシスタントが実際に実用的になるまで、あと一世代のモデル先、おおよそ6ヶ月程度のタイムラインかもしれないというのだ。
これは単なるメモリのアップグレードや、より大きなコンテキストウィンドウの問題ではない。このビジョンが描くのは、もはやチャットウィンドウを開いたときにだけ現れるAIではない。その代わりに、常にコンテキストを認識し、あなたがこれまで何をしてきたかを理解し、同じ人、プロジェクト、ファイル、決定、背景を繰り返し説明する必要なく支援を提供するものだ。
この方向性が実現可能になれば、人間とAIの関係は大きく変わるかもしれない。断続的な会話から継続的な支援へ、孤立したタスクから継続的に蓄積される個人的な背景情報へ。
より重要な問題は、Altman氏のタイムラインが現実的かどうか、そしてユーザーが本当にAIシステムにそこまで多くのことを知られたいと思っているかどうかだ。
Altman:AIにあなたの人生全体の文脈を記憶させる
Altman氏は、超長期的なAIメモリについてしばらく前から語ってきた。
このアイデアのあるバージョンは驚くほどシンプルだ。小型で効率的な推論モデルが、数年分の会話、ファイル、好み、プロジェクト、活動を網羅する可能性のある大規模な個人的背景情報リポジトリに接続される。新しい情報は毎回ゼロから始めるのではなく、継続的に追加されていく。
Sequoia CapitalのAI Ascentイベントで、Altman氏は異なる年齢層の人々がChatGPTを大きく異なる方法で使用していることについても述べた。
彼の大まかな区分は以下の通りだ:
- 年配のユーザーは通常、ChatGPTを検索エンジンの代替として捉えている。
- 20代から30代の人は、ライフアドバイザーとして使用する可能性が高い。
- 大学生は、仕事や意思決定のためのオペレーティングシステムとしてますます捉えている。
この傾向は、若いユーザーの間でさらに興味深いものになる。Altman氏は、システムが人、人間関係、プロジェクト、以前の議論に関する背景情報をすでに把握しているため、重要なライフデシジョンを下す前にChatGPTに相談する人が増えていると指摘した。
この行動は、より持続的なAIがどのようなものになり得るかを示唆している。
しかし、今回Altman氏の説明は会話メモリを超えている。彼が語ったのは、あなたの画面での活動、会議、通話、テキストメッセージ、メール、ドキュメント、Slack、そしてあなたが明示的に接続したその他の情報源を理解できるAIについてだ。
目標は必ずしも、AIにあなたのあらゆる決定を代行させることではない。より合理的な役割は、継続的に情報を把握する
協力者だ。あなたが何をしているかを知り、以前に何が起こったかを覚え、次のステップを計画し、不整合を発見し、全体のコンテキストを再構築することなく作業を継続できるように支援する存在。
これは**「必要なときにAIを使う」から「AIが継続的に利用可能で、関連するコンテキストを把握している」**への大きな転換となるだろう。
しかし、自分の仕事や個人史をこのようなシステムに多く預ければ預けるほど、そのシステムはより価値を持つ—そして、より代替が難しくなる。
メモリは受動的な保存から能動的な統合へ
この未来の一部は、すでに既存の製品に兆しが見えている。
ChatGPTは過去の会話のメモリを活用でき、その音声体験はサポート環境で画面コンテキストも受け取れる。ChatGPT Recordは、サポートされているプラットフォームで会議、ブレインストーミング、音声メモを文字起こしし、要約することもできる。
プログラミングの分野では、OpenAIは以前、Chronicleと呼ばれる実験的なCodex機能を発表した。
Chronicleは、ユーザーが最近コンピュータで行った操作のメモリをCodexに提供することを目的としていた。画面コンテキストを利用して、Codexが「これ」「それ」やユーザーが以前に作業していたプロジェクトなどの指示を理解できるようにし、背景情報を繰り返し説明する必要性を減らした。
Greg Brockman氏はこの体験を**「不思議なくらい魔法のようだ」**と表現した。

Chronicleは決して「完全な人生の記憶」と同等ではなかった。これはオプトイン式の研究プレビューであり、Codexワークフローにおける最近のコンピュータコンテキストに焦点を当てたものだった。
また、重大なセキュリティ上の考慮事項も伴っていた。OpenAIのドキュメントは、スクリーンショット由来のコンテキストがプロンプトインジェクションのリスクを高める可能性があると警告し、Chronicleは生成されたメモリをデバイスローカルに保存していた。この機能はユーザーが制御でき、いつでも一時停止できた。
ChronicleはComputer Historyへと進化
元記事には重要なアップデートがある。
2026年8月14日現在、OpenAIの現在のドキュメントでは、Computer Historyが以前のChronicle研究プレビューに取って代わったことが示されている。ただし、OpenAIはこれを単なる名称変更ではなく、再構築されたシステムとして説明している。
この違いは重要だ。
Chronicleはスクリーンショットを使用していた。Computer Historyは、ユーザーが許可したアプリやウェブサイトでのインタラクションイベント(クリック、入力、キーボードショートカット、アプリ切り替え、macOSアクセシビリティAPIを通じて公開されるコンテキストなど)を記録する。そして、これらのイベントを定期的にテキスト要約とローカルメモリファイルに変換する。
OpenAIによると、現在のComputer Historyシステムは、スクリーンショット、スクリーンレコーディング、マイク入力、システムオーディオをキャプチャしない。
これは依然としてオプトイン式であり、ユーザーはデータを提供するアプリやウェブサイトを制御し、収集を一時停止し、履歴を表示し、保存された項目を削除できる。
この進化は、この分野の変化の速さを示している。高レベルの目標は変わらない—AIに最近の作業に関する永続的なコンテキストを提供すること—しかし、実装方法はすでにより明確な制御とより狭いデータキャプチャモデルへと移行している。
ドリーミングによりChatGPTのメモリがより動的に
もう一つの大きな進展は
Dreamingだ。OpenAIがChatGPT向けに開発した次世代メモリアーキテクチャである。
Dreamingは、静的な事実のリストに限定されない。その代わりに、ChatGPTは会話履歴から情報を抽出し、統合してメモリ状態を形成し、時間の経過とともにこの状態を継続的に更新できる。

簡単な例でその違いを説明できる。
あなたがChatGPTにこう伝えたとしよう。「7月にシンガポールに行きます」。
従来の静的メモリシステムは、7月が過ぎた後もこの旅行を今後起こることとして保持するかもしれない。一方、Dreamingは時間の経過を理解し、メモリを修正するように設計されており、システムがその後これを将来の計画ではなく過去の旅行として解釈できるようにする。
これは些細なことに聞こえるかもしれないが、永続的なアシスタントが直面する実際的な問題を解決している。古いメモリが更新されなければ、誤解を招く可能性があるのだ。
OpenAIは、このシステムが関連する事実の呼び出し、ユーザーの好みへの準拠、そして時間がメモリ情報の意味を変える場合の正確性の維持において、より優れたパフォーマンスを発揮すると述べている。
引用元の記事で参照された内部評価データによると、このシステムは事実のリコール、好みの遵守、時間に敏感な正確性のすべてで改善を示している。最も明確な公開比較の1つは、時間に敏感なタスクの正確性が2025年の52.2%から2026年の75.1%に向上したことを示している。

OpenAIはまた、最近の改善により、無料ユーザーにDreamingを提供するために必要な計算量が約5分の1に削減され、より大規模な展開が現実的になったと述べている。
核心となる考え方は、メモリがますますメモ帳ではなくなり、ユーザーの現在の状況を反映する継続的に保守されたモデルのようになっているということだ。
ユーザーは依然としてコントロールを保持している。OpenAIは閲覧・編集可能なメモリの要約を提供し、メモリ機能を無効にすることもできる。一時的なチャットモードは、永続的なメモリに含めるべきでない会話にも利用できる。
Dreamingとコンピュータ履歴は異なるシステムですが、両者はオルトマンが説明した方向性を共通して指し示しています。
- Dreamingは、会話から長期的なパーソナライズ情報を構築します。
- コンピュータ履歴は、ユーザーのPC上での最近のアクティビティコンテキストを補完します。
- 録音モードは、会議や口頭での議論をキャプチャして要約できます。
- 画面コンテキストは、サポートされているシナリオでChatGPTがユーザーの現在見ている内容を理解するのに役立ちます。
これらの機能はそれぞれ単独では、「あなたの生活全体を知るAI」の完全な姿にはなりません。しかし、それらが合わさることで、このアーキテクチャーの認識可能な各部分を構成します。
メモリが新たな競争上の堀になる
OpenAIだけが、永続的なメモリを重要なプロダクトレイヤーと見なしているわけではありません。
ほぼすべての主要なAIプラットフォームが同じ方向に進んでいます。
Google:メモリをエージェント基盤として
Googleのアプローチは、エンタープライズエージェントと密接に関連しています。
その Agent Platform メモリーバンク(Agent Platform Memory Bank)は、ユーザーとエージェントの会話から長期メモリを作成できます。これらのメモリはセッションをまたいで永続化でき、エージェントは完全な会話履歴をアクティブなモデルコンテキストに保持することなく、ユーザーの好み、重要な事実、以前のコンテキストを呼び出すことができます。
GoogleはMemory Bankを、ステートフルで長期間稼働するエージェントを構築するための開発者向けインフラストラクチャとして位置づけています。
これにより、消費者向けのChatGPTのメモリ機能とは少し異なりますが、根本的な目標は似ています:エージェントは1回のセッションが終わったらすべてを忘れてしまうべきではない、ということです。
Anthropic:Claude全体にわたる永続メモリ
AnthropicもClaudeのメモリ機能を拡張しています。
2026年3月に、チャット履歴からのメモリがすべてのClaudeユーザー(無料ユーザーを含む)に開放されました。Claudeは過去の会話を利用してチャット間の連続性を構築でき、ユーザーはメモリを管理し、シークレットチャットなどのプライバシー重視のオプションを使用できます。
Anthropicはまた、エージェントアプリケーションを構築する開発者向けのメモリツールも提供しています。このツールにより、Claudeはセッションをまたいで永続的なメモリファイルを作成、読み取り、更新、削除できます。
実際の結果は同じ競争圧力です:アシスタントは最新のプロンプトに答えるだけでなく、ユーザーを記憶する必要がある、ということです。
Mem0:クロスプラットフォームメモリレイヤー
サードパーティのプロジェクトは異なるアプローチを取っています。
Mem0は、AIアシスタントとエージェントのための汎用メモリレイヤーとして位置づけられています。開発者はメモリを単一のモデルプロバイダーに縛るのではなく、異なるAIシステムの周りに独立したメモリレイヤーを使用できます。
これは重要です。なぜなら、プラットフォーム固有のメモリは明らかな移植性の問題を生み出すからです。
あなたの最も有用なコンテキストがChatGPTに保存されている場合、Claudeに移行することはゼロから始めることを意味するかもしれません。ChatGPT、Claude、Geminiを並行して使用している場合、各システムは自分が見た会話とデータに基づいて、あなたに対する異なる理解を徐々に構築する可能性があります。
クロスプラットフォームメモリレイヤーは、ユーザーの永続的なコンテキストをモデル自体から分離しようとします。

AIメモリの暗黙のロックイン効果
モデルの品質は急速に変化します。
今日ベンチマークでリードしているモデルも、数ヶ月後には追い越されるかもしれません。ユーザーが生の推論能力やコーディング品質だけを気にするなら、通常は比較的簡単にモデルを切り替えることができます。
メモリは異なります。
メモリの価値は時間とともに蓄積されます。あなたの好み、仕事習慣、進行中のプロジェクト、重要な人間関係、ライティングスタイル、ツール、過去の意思決定をすでに理解しているシステムの利点は、別のモデルに切り替えただけでは即座に再現できません。
これは、より巧妙なプラットフォームロックインの形態を生み出します。
本当の切り替えコストは、最終的には特定のモデルへのアクセスを失うことではなく、何年にもわたって蓄積されたコンテキストを失うことにあるかもしれません。
だからこそ、移植性、エクスポートコントロール、プライバシー設定、およびメモリを削除または隔離する能力がますます重要になります。
これはまた、オルトマンのビジョンが単なる製品予測ではない理由も説明しています。それは大きな商業的意味を持っています。
ユーザーの長期的なAIメモリの保管場所となる企業は、モデルの性能だけに基づいて構築された関係よりもはるかに持続的な関係を得る可能性があります。
一方、メモリが完全であればあるほど、プライバシーとセキュリティのリスクも高まります。あなたを理解している——
進行中のことを理解するシステムは非常に役立ちますが、明確なオプトインコントロール、厳格な境界、透明な保存動作、そしてユーザーが記憶された内容を簡単に確認および削除できる方法も必要です。
したがって、将来の「究極のAIアシスタント」は、より良いモデルだけに依存するのではありません。
それはユーザーがメモリレイヤーを信頼するかどうかにも依存します。
よくある質問
サム・オルトマンはChatGPTの未来について何と言いましたか?
オルトマンは、ユーザーの画面アクティビティ、会議、通話、メッセージ、ドキュメント、その他の接続されたコンテキストを理解できる将来のAIアシスタントを説明しました。彼は、この機能を本当に役立つものにするには、あともう1世代のモデルイテレーションが必要であり、おおよそ6ヶ月程度のタイムラインであると述べました。
ChatGPTは現在、常に私の画面を見ていますか?
いいえ。現在の画面コンテキストとコンピュータ履歴機能はユーザーが制御し、サポートされている環境に限定されています。OpenAIの現在のコンピュータ履歴ドキュメントでは、この機能はオプトインであり、スクリーンショット、画面ビデオ、マイク入力、システムオーディオを録画しないと説明されています。
OpenAI Chronicleとは何ですか?
Chronicleは、最近の画面コンテキストからメモリを構築するオプトインのCodex研究プレビューでした。OpenAIは現在、コンピュータ履歴がスクリーンショットではなくインタラクションイベントに基づく再構築されたシステムでChronicleを置き換えたと述べています。
ChatGPTのDreamingとは何ですか?
Dreamingは、OpenAIがChatGPT向けに導入した新しいメモリアーキテクチャです。以前の会話から有用なコンテキストを統合し、時間の経過とともにメモリを更新できるため、将来の旅行計画などの一時的な情報が恒久的に古くなることがありません。
ChatGPTのメモリ機能をオフにしたり、記憶された内容を編集したりできますか?
はい。OpenAIはメモリの表示、編集、削除、無効化のコントロールを提供しています。永続メモリを使用または更新しない会話を行いたい場合は、一時的なチャット機能も使用できます。
Googleメモリーバンクは何に使用されますか?
Google Agentプラットフォームのメモリーバンクは、AIエージェントに複数のセッションにわたる永続的な長期メモリを提供します。これは主に、パーソナライズされたステートフルなエージェントシステムを構築するための開発者向けインフラストラクチャとして機能します。
Claudeには永続メモリ機能がありますか?
はい。AnthropicはClaudeアプリでチャット履歴からのメモリを保有し、エージェントシステムを構築する開発者向けのメモリツールも提供しています。これらの機能は、異なる会話全体で関連するコンテキストを保持することを目的としています。
AIメモリがプラットフォームロックインを引き起こす可能性があるのはなぜですか?
ユーザーがプラットフォームに滞在する時間が長いほど、長期メモリの価値は高まります。メモリをエクスポートしたりシステム間で共有したりできない限り、別のアシスタントに切り替えることは、蓄積された好み、履歴、プロジェクトコンテキスト、パーソナライズ設定を失うことを意味する可能性があります。
関連ツール
- ChatGPT:OpenAIのアシスタントプラットフォーム。会話メモリ、音声、画面コンテキスト、録音モード、エージェント機能を備えています。
- Codex / コンピュータ履歴:OpenAIの現在のシステム。許可されたコンピュータアクティビティを検索可能なタイムラインと再利用可能なコンテキストに変換できます。
Claude:Anthropicのアシスタント。クロス会話メモリとユーザー制御可能なコンテキスト機能を備えています。
- Mem0:AIアシスタントとエージェント向けのオープンソースの汎用メモリレイヤーです。
com/index/chatgpt-memory-dreaming/):OpenAIによる新しいメモリーアーキテクチャと時間認識アップデートに関する公式説明。
- OpenAIメモリーFAQ:ChatGPTメモリーの公式な制御方法と動作説明。
- OpenAIコンピュータ履歴ドキュメント:Chronicle研究プレビュー版を置き換えるシステムの現在のドキュメント。
- ChatGPTレコード:会議、ブレインストーミング、ボイスメモの文字起こしと要約に関する公式ドキュメント。
- Googleエージェントプラットフォームメモリーバンク:永続的なエージェントメモリーに関するGoogleの公式ドキュメント。
- Anthropic Claudeメモリーリリースノート:無料ユーザーも利用可能なメモリー機能を含むAnthropicの公式リリース履歴。
- Anthropicメモリーツール:Claudeセッションをまたいで永続化するメモリーファイルに関する開発者向けドキュメント。
- Mem0 GitHubリポジトリ:Mem0クロスプラットフォームエージェントメモリーレイヤーの公式オープンソースリポジトリ。
要約
Sam Altmanの6ヶ月予測は、ChatGPTが文字通りユーザーの生活におけるすべての決定を行うという意味ではない。より具体的な構想は、十分に永続的な文脈を持つAIアシスタントが、ユーザーが会話、ファイル、会議、コンピュータ上の活動で何をしてきたかを、いちいち説明し直すことなく理解できるようにするというものだ。
このビジョンの一部はすでに実現している。Dreamingは長期的な会話メモリーを維持し、Computer Historyは最近の活動文脈を提供し、Recordモードは会議を要約できる。また、Google、Anthropic、Mem0の競合システムもそれぞれの形式の永続メモリーを構築している。
したがって、技術競争はモデル競争と同様に、記憶競争になりつつある。より強力なモデルが登場すれば、より優れた推論能力を代替できるかもしれない。しかし、長年にわたる個人の文脈は容易に再構築できない。
最も重要な問題は、AIがユーザーのデジタルライフを記憶できるかどうかではなく、そのような記憶が価値を持つようになったとき、ユーザーがその制御を維持できるかどうかかもしれない。