萨姆·奥特曼表示,终极AI助手距离仅一代模型之遥

OpenAI首席执行官萨姆·奥特曼再次描绘了一个雄心勃勃的未来AI助手愿景。在最近与硅谷实习生的对话中,奥特曼描述了一个系统,该系统...

发布于 2026年8月14日generalGEO 评分: 0
萨姆·奥特曼表示,终极AI助手距离仅一代模型之遥

Sam Altman:终极AI助手离我们只有一代模型之遥

引言

OpenAI首席执行官Sam Altman再次描绘了未来AI助手的宏大愿景。

在与硅谷实习生的一次近期对话中,Altman描述了一个能够持续理解你电脑上正在发生的事情、跟踪你选择分享的会议和通话、并积累足够上下文来理解你数字生活整体脉络的系统。

他的预估令人震惊:这类助手距离真正实用可能只有一代模型之遥,大致时间线约为六个月。

这不仅仅是简单的记忆升级或更大的上下文窗口。这个愿景描述的是一个不再局限于你打开聊天窗口才出现的AI。相反,它始终保持对上下文的感知,理解你一直在做什么,并且无需你反复解释相同的人、项目、文件、决策和背景就能提供帮助。

如果这一方向变得可行,人与AI之间的关系可能发生重大变化:从偶尔的对话到持续的辅助,从孤立的任务到持续积累的个人背景信息。

更关键的问题在于,Altman的时间表是否现实——以及用户是否真的希望一个AI系统了解那么多。

Altman:让AI记住你整个人生的脉络

Altman谈论超长期AI记忆已经有一段时间了。

这个想法的一个版本出人意料地简单:一个小型高效的推理模型,连接到一个庞大的个人背景信息存储库,可能涵盖数年的对话、文件、偏好、项目和活动。新信息会不断被添加,而不是每次交互都从零开始。

在红杉资本的AI Ascent活动上,Altman还描述了不同年龄段的人如何在显著不同的方式中使用ChatGPT。

他粗略的划分是:

  • 年长的用户通常将ChatGPT视为搜索引擎的替代品。
  • 二三十岁的人更可能将其用作生活顾问。
  • 大学生越来越多地将其视为工作和决策的操作系统。

这一趋势在年轻用户中变得更加有趣。Altman指出,一些人在做出重要生活决策之前越来越多地咨询ChatGPT,因为该系统已经掌握了关于人、关系、项目和之前讨论的背景信息。

这种行为暗示了一个更具持续性的AI可能成为的样子。

然而,这一次Altman的描述超越了对话记忆。他谈到的是一个能够理解你屏幕活动、会议、通话、短信、邮件、文档、Slack以及你明确连接的其他信息源的AI。

目标不一定是让AI替你做出每一个决定。一个更合理的角色是持续掌握信息的

协作者:一个知道你在做什么、记得之前发生了什么、规划下一步、发现不一致之处,并帮助你无需重建整个上下文就能继续工作的存在。

这将是从**“在需要时使用AI”“AI持续可用并掌握相关上下文”**的重大转变。

然而,你将自己的工作和个人历史越多地放入这样的系统,该系统就越有价值——也越难以被替代。

记忆正从被动存储走向主动综合

这个未来的某些部分已经在现有产品中初现端倪。

ChatGPT可以利用过往对话中的记忆,其语音体验在受支持的环境中也能接收屏幕上下文。ChatGPT Record还可以在受支持的平台上转录和总结会议、头脑风暴和语音备忘。

在编程方面,OpenAI此前推出了一个实验性的Codex功能,名为Chronicle

Chronicle旨在为Codex提供用户最近在电脑上所做操作的记忆。它利用屏幕上下文帮助Codex理解“这个”“那个”或用户之前正在处理的项目等指代,减少了重复说明背景信息的需要。

Greg Brockman将这种体验描述为**“出奇地神奇。”**

Chronicle从来不等同于“完整的人生记忆”。它是一个选择性加入的研究预览版,专注于Codex工作流程中的近期电脑上下文。

它同时也伴随着重大的安全考量。OpenAI的文档警告说,源自截图的上下文可能增加提示注入的风险,而Chronicle将生成的记忆存储在设备本地。该功能由用户控制,可以随时暂停。

Chronicle现已演进为Computer History

原文章有一个重要更新。

截至2026年8月14日,OpenAI当前的文档显示Computer History取代了之前的Chronicle研究预览版,不过OpenAI将其描述为一个重建的系统,而非简单的更名。

这一区别意义重大。

Chronicle使用截图。Computer History则记录用户允许的应用和网站的交互事件,例如点击、输入、键盘快捷键、应用切换,以及通过macOS辅助功能API暴露的上下文。它会定期将这些事件转换为文本摘要和本地记忆文件。

OpenAI表示,当前的Computer History系统不会捕获截图、屏幕录制、麦克风输入或系统音频。

它仍然是选择性加入的,用户可以控制哪些应用和网站提供数据、暂停收集、查看其历史记录以及删除存储的项目。

这种演进表明该领域变化之快。高层目标保持不变——为AI提供关于近期工作的持久上下文——但实现方式已经在向更明确的控制和更窄的数据捕获模型转变。

梦境让ChatGPT记忆更加动态

另一个重大进展是

Dreaming,OpenAI 为 ChatGPT 打造的新一代记忆架构。

Dreaming 不再局限于静态的事实列表。相反,ChatGPT 能够从对话历史中提炼信息,综合形成一种记忆状态,并随着时间推移持续更新这一状态。

一个简单的例子可以说明其中的区别。

假设你告诉 ChatGPT:“我七月份要去新加坡。”

传统的静态记忆系统可能会在七月过去之后,仍然将这次旅行视为即将发生的事。而 Dreaming 的设计目标则是理解时间的流逝并修正记忆,使系统之后能够将其解读为一次过去的旅行,而非未来的计划。

这听起来似乎微不足道,但它解决了持久化助手面临的一个实际问题:如果旧记忆从不更新,就可能变得具有误导性。

OpenAI 表示,该系统在调用相关事实、遵循用户偏好,以及当时间改变记忆信息含义时保持准确性方面表现更佳。

来源文章引用的内部评估数据表明,该系统在事实召回、偏好遵从和时间敏感准确性方面均有提升。其中一项最清晰的公开对比显示,时间敏感任务的准确率从 2025 年的 52.2% 提升至 2026 年的 75.1%

OpenAI 还表示,近期的改进使得向免费用户提供 Dreaming 服务所需的计算量减少了约 5 倍,从而使更大范围的推广变得切实可行。

核心思想在于,记忆正变得越来越不像一个记事本,而更像一个持续维护的、反映用户当前状况的模型。

用户仍然保留控制权。OpenAI 提供了可供查看和编辑的记忆摘要,并且可以禁用记忆功能。临时聊天模式也可用于那些不应被纳入持久记忆的对话。

Dreaming 和计算机历史记录是两个不同的系统,但它们共同指向了奥特曼所描述的方向:

  • Dreaming 从对话中构建更长期的个性化背景信息。
  • 计算机历史记录补充用户电脑上的近期活动背景。
  • 录音模式可以捕捉并总结会议或口头讨论内容。
  • 屏幕上下文可以帮助 ChatGPT 在受支持的场景下理解用户当前正在查看的内容。

这些功能单独来看,都不等于一个完整的“了解你全部生活的 AI”。然而,它们合在一起,便构成了该架构中可辨识的各个部分。

记忆正成为新的竞争护城河

OpenAI 并非唯一将持久记忆视为重要产品层的公司。

几乎所有主流 AI 平台都在朝着同一方向发展。

谷歌:将记忆作为智能体基础设施

谷歌的方法与企业智能体紧密关联。

Agent Platform 记忆库(Agent Platform Memory Bank)能够从用户与智能体的对话中创建长期记忆。这些记忆可以跨会话持久保存,使智能体能够调用用户偏好、重要事实和之前的背景信息,而无需将完整对话历史保留在活动模型上下文中。

谷歌将Memory Bank定位为面向开发者的基础设施,用于构建有状态且可长期运行的智能体。

这使得它与面向消费者的ChatGPT记忆功能略有不同,但根本目标相似:智能体不应在一次会话结束时忘记所有内容。

Anthropic:跨越Claude的持久记忆

Anthropic也扩展了Claude的记忆能力。

2026年3月,来自聊天历史的记忆向所有Claude用户开放,包括免费用户。Claude可以利用过往对话来建立跨聊天的连续性,同时用户可以管理记忆,并使用诸如隐身聊天等注重隐私的选项。

Anthropic还为构建智能体应用的开发者提供了一款记忆工具。该工具允许Claude跨会话创建、读取、更新和删除持久记忆文件。

实际结果是相同的竞争压力:助手需要记住用户,而不仅仅是回答最新的提示。

Mem0:跨平台记忆层

第三方项目正采取不同的方法。

Mem0将自身定位为AI助手和智能体的通用记忆层。开发者无需将记忆绑定到单一模型提供商,而是可以围绕不同的AI系统使用独立的记忆层。

这很重要,因为特定于平台的记忆会产生明显的可移植性问题。

如果你最有用的上下文保存在ChatGPT中,迁移到Claude可能意味着从头开始。如果你并行使用ChatGPT、Claude和Gemini,每个系统可能会基于它所看到的对话和数据,逐渐构建出对你的不同认知。

跨平台记忆层试图将用户的持久上下文与模型本身分离开来。

AI记忆的隐性锁定效应

模型质量变化迅速。

今天在基准测试中领先的模型,几个月后可能就被超越。如果用户只关心原始推理能力或编码质量,通常可以相对轻松地切换模型。

记忆则不同。

记忆的价值会随时间累积。一个已经了解你的偏好、工作习惯、常驻项目、重要人际关系、写作风格、工具以及以往决策的系统,其优势无法通过切换到另一个模型即时复制。

这就造成了一种更隐蔽的平台锁定形式。

真正的切换成本最终可能不在于失去对特定模型的访问权,而在于失去多年积累的上下文。

这就是为什么可移植性、导出控制、隐私设置以及删除或隔离记忆的能力将变得越来越重要。

这也解释了为什么奥特曼的愿景不仅仅是对产品的预测。它具有重大的商业意义。

成为用户长期AI记忆存放之所的公司,可能获得一种远比仅基于模型性能建立的关系更持久的关系。

与此同时,记忆越完整,隐私和安全方面的风险就越高。一个了解你——

正在做的事情可以极其有帮助,但它也需要明确的选择加入控制、严格的边界、透明的存储行为,以及让用户轻松检查和删除已记住内容的简便方式。

因此,未来的“终极人工智能助手”将不仅仅依赖于更好的模型。

它还将依赖于用户是否信任记忆层。

常见问题

萨姆·奥尔特曼对ChatGPT的未来说了什么?

奥尔特曼描述了一个未来的人工智能助手,它能够理解用户的屏幕活动、会议、通话、消息、文档以及其他连接的上下文。他表示,要让这一功能真正有用,可能只需要再迭代一代模型,大致时间线约为六个月。

ChatGPT目前会一直盯着我的屏幕吗?

不会。当前的屏幕上下文和计算机历史功能由用户控制,并且仅限于受支持的环境。OpenAI当前的计算机历史文档说明,该功能是选择加入的,不会录制截图、屏幕视频、麦克风输入或系统音频。

什么是OpenAI Chronicle?

Chronicle是一个选择加入的Codex研究预览版,它从最近的屏幕上下文中构建记忆。OpenAI现在表示,计算机历史已用一套基于交互事件而非截图的重建系统取代了Chronicle。

什么是ChatGPT梦游(Dreaming)?

Dreaming是OpenAI为ChatGPT推出的较新的记忆架构。它从先前的对话中综合有用的上下文,并能随时间更新记忆,从而使临时性信息——例如未来的旅行计划——不会永久过时。

我可以关闭ChatGPT的记忆功能或编辑它记住的内容吗?

可以。OpenAI提供了查看、编辑、删除和禁用记忆的控件。当你希望进行不使用或不更新持久记忆的对话时,也可以使用临时聊天功能。

Google记忆库有什么用途?

Google Agent平台的记忆库为AI代理提供跨多个会话的持久长期记忆。它主要作为面向开发者的基础设施,用于构建个性化和有状态的代理系统。

Claude有持久记忆功能吗?

有。Anthropic在Claude应用中拥有来自聊天历史的记忆,并为构建代理系统的开发者提供了记忆工具。这些功能旨在跨不同对话保留相关上下文。

为什么AI记忆可能导致平台锁定?

用户在一个平台上停留的时间越长,长期记忆就越有价值。除非记忆能被导出或在系统间共享,否则切换到另一个助手可能意味着失去积累的偏好、历史、项目上下文和个性化设置。

相关工具

  • ChatGPT:OpenAI的助手平台,具备对话记忆、语音、屏幕上下文、录音模式和代理功能。
  • Codex / 计算机历史:OpenAI的当前系统,允许将许可的计算机活动转化为可搜索的时间线和可重复使用的上下文。
  • Google Agent平台记忆库:Google托管的长期记忆层,用于有状态的AI代理。

Claude:Anthropic 的助手,具备跨对话记忆和用户可控上下文功能。

  • Mem0:面向 AI 助手和智能体的开源通用记忆层。

相关链接

摘要

Sam Altman 的六个月预测并非指 ChatGPT 会字面意义上替用户做生活中的每一个决定。更具体的构想是一个具备足够持久上下文的 AI 助手,能够理解你在对话、文件、会议和计算机活动中一直在做什么,而无需你不断重复解释。

这一愿景的部分内容已经实现。Dreaming 维护长期对话记忆,Computer History 提供近期活动上下文,Record 模式可以总结会议,而来自 Google、Anthropic 和 Mem0 的竞品系统也正在构建各自形式的持久记忆。

因此,技术竞赛正在变成一场记忆竞赛,而不亚于模型竞赛。更强的模型出现时可以替代更好的推理能力;但多年的个人上下文却难以重建。

最重要的问题或许不是 AI 能否记住你的数字生活,而是一旦这种记忆变得有价值,用户是否还能保持对它的控制。

萨姆·奥特曼表示,终极AI助手距离仅一代模型之遥