샘 올트먼, 궁극의 AI 비서가 단 한 세대의 모델만 남았다고 밝혀

OpenAI CEO 샘 올트먼이 다시 한 번 야심 찬 미래 AI 비서 비전을 제시했습니다. 최근 실리콘밸리 인턴들과의 대화에서 올트먼은 다음과 같은 시스템을 설명했습니다...

发布于 2026年8月14日generalGEO 评分: 03 次阅读
萨姆·奥特曼表示,终极AI助手距离仅一代模型之遥

Sam Altman: 궁극의 AI 어시스턴트는 단 한 세대의 모델만 남았다

서론

OpenAI CEO Sam Altman이 다시 한번 미래 AI 어시스턴트의 거대한 비전을 그려냈다.

실리콘밸리 인턴과의 최근 대화에서 Altman은 사용자의 컴퓨터에서 벌어지는 일을 지속적으로 이해하고, 공유하기로 선택한 회의와 통화를 추적하며, 디지털 생활의 전체적인 흐름을 파악할 수 있는 충분한 맥락을 축적하는 시스템을 설명했다.

그의 예측은 놀랍다: 이러한 어시스턴트가 실제로 유용해지기까지 단 한 세대의 모델만 남았다는 것이다. 대략적인 시간선은 약 6개월이다.

이는 단순한 메모리 업그레이드나 더 큰 컨텍스트 창이 아니다. 이 비전이 묘사하는 것은 더 이상 사용자가 채팅 창을 열었을 때만 나타나는 AI가 아니다. 대신, 항상 맥락을 인지하고, 사용자가 계속 무엇을 해왔는지 이해하며, 같은 사람, 프로젝트, 파일, 결정, 배경을 반복해서 설명할 필요 없이 도움을 제공하는 AI다.

이 방향이 실현 가능해지면 인간과 AI의 관계는 중대한 변화를 맞을 수 있다: 가끔의 대화에서 지속적인 보조로, 고립된 작업에서 지속적으로 축적되는 개인 배경 정보로.

더 중요한 질문은 Altman의 일정표가 현실적인지, 그리고 사용자들이 정말로 그렇게 많은 것을 아는 AI 시스템을 원하는지 여부다.

Altman: AI가 당신의 인생 전체 맥락을 기억하게 하라

Altman은 초장기 AI 메모리에 대해 한동안 이야기해왔다.

이 아이디어의 한 버전은 놀라울 정도로 단순하다: 수년간의 대화, 파일, 선호도, 프로젝트, 활동을 포괄할 수 있는 방대한 개인 배경 정보 저장소에 연결된 소형 고효율 추론 모델. 새로운 정보는 매번 상호작용을 처음부터 시작하는 대신 지속적으로 추가된다.

Sequoia Capital의 AI Ascent 행사에서 Altman은 또한 다양한 연령대의 사람들이 ChatGPT를 현저하게 다른 방식으로 사용한다고 설명했다.

그의 대략적인 구분은 다음과 같다:

  • 나이가 많은 사용자들은 일반적으로 ChatGPT를 검색 엔진의 대체재로 본다.
  • 20~30대는 생활 상담사로 사용할 가능성이 더 높다.
  • 대학생들은 점점 더 업무와 의사결정의 운영체제로 사용하고 있다.

이러한 추세는 젊은 사용자들 사이에서 더욱 흥미로워진다. Altman은 일부 사람들이 중요한 인생 결정을 내리기 전에 점점 더 ChatGPT에 조언을 구한다고 지적했다. 시스템이 이미 사람, 관계, 프로젝트, 이전 논의에 대한 배경 정보를 파악하고 있기 때문이다.

이러한 행동은 더 지속적인 AI가 어떤 모습이 될 수 있는지를 암시한다.

하지만 이번에 Altman의 설명은 대화 메모리를 넘어선다. 그는 화면 활동, 회의, 통화, 문자, 이메일, 문서, Slack, 그리고 사용자가 명시적으로 연결한 기타 정보 소스를 이해할 수 있는 AI에 대해 이야기했다.

목표는 반드시 AI가 사용자의 모든 결정을 대신 내리게 하는 것이 아니다. 더 합리적인 역할은 지속적으로 정보를 파악하는 협력자다: 사용자가 무엇을 하고 있는지 알고, 이전에 무엇이 있었는지 기억하며, 다음 단계를 계획하고, 불일치를 발견하며, 전체 맥락을 재구축할 필요 없이 작업을 계속할 수 있도록 돕는 존재.

이는 **"필요할 때 AI 사용"**에서 **"AI가 지속적으로 사용 가능하고 관련 맥락을 파악"**하는 중대한 전환이다.

하지만 사용자가 자신의 업무와 개인 역사를 그러한 시스템에 더 많이 넣을수록, 그 시스템은 더 가치 있어지고—대체하기도 더 어려워진다.

메모리는 수동 저장에서 능동적 종합으로 진화 중

이 미래의 일부는 이미 기존 제품에서 조짐을 보이고 있다.

ChatGPT는 과거 대화의 메모리를 활용할 수 있으며, 음성 경험은 지원되는 환경에서 화면 맥락도 수신할 수 있다. ChatGPT Record는 지원되는 플랫폼에서 회의, 브레인스토밍, 음성 메모를 전사하고 요약할 수 있다.

프로그래밍 분야에서 OpenAI는 이전에 Chronicle이라는 실험적인 Codex 기능을 출시했다.

Chronicle은 Codex에게 사용자가 최근 컴퓨터에서 수행한 작업에 대한 메모리를 제공하도록 설계되었다. 화면 맥락을 활용해 Codex가 "이것", "저것" 또는 사용자가 이전에 작업 중이던 프로젝트와 같은 지시 대상을 이해하도록 돕고, 배경 정보를 반복해서 설명할 필요를 줄인다.

Greg Brockman은 이 경험을 **"놀랍도록 신기하다"**고 묘사했다.

Chronicle은 결코 "완전한 인생 메모리"와 같지 않았다. 이는 선택적 참여 방식의 연구 미리보기 버전으로, Codex 작업 흐름 내 최근 컴퓨터 맥락에 초점을 맞췄다.

또한 중대한 보안 고려 사항이 수반되었다. OpenAI의 문서는 스크린샷에서 비롯된 맥락이 프롬프트 인젝션 위험을 증가시킬 수 있다고 경고했으며, Chronicle은 생성된 메모리를 기기 로컬에 저장했다. 이 기능은 사용자가 통제할 수 있었고 언제든지 일시 중지할 수 있었다.

Chronicle은 이제 Computer History로 진화

원문 기사에 중요한 업데이트가 있다.

2026년 8월 14일 기준, OpenAI의 현재 문서는 Computer History가 기존의 Chronicle 연구 미리보기를 대체했다고 명시하고 있다. 다만 OpenAI는 이를 단순한 이름 변경이 아닌 재구축된 시스템으로 설명한다.

이 구분은 중요한 의미를 지닌다.

Chronicle은 스크린샷을 사용했다. Computer History는 사용자가 허용한 앱과 웹사이트의 상호작용 이벤트(예: 클릭, 입력, 키보드 단축키, 앱 전환, macOS 보조 기능 API를 통해 노출된 맥락)를 기록한다. 이러한 이벤트를 주기적으로 텍스트 요약과 로컬 메모리 파일로 변환한다.

OpenAI에 따르면 현재 Computer History 시스템은 스크린샷, 화면 녹화, 마이크 입력 또는 시스템 오디오를 캡처하지 않는다.

여전히 선택적 참여 방식이며, 사용자는 어떤 앱과 웹사이트가 데이터를 제공할지 제어하고, 수집을 일시 중지하고, 기록을 확인하고, 저장된 항목을 삭제할 수 있다.

이러한 진화는 이 분야가 얼마나 빠르게 변화하는지 보여준다. 최상위 목표는 동일하게 유지된다 — AI에게 최근 작업에 대한 지속적인 맥락을 제공하는 것 — 하지만 구현 방식은 이미 더 명확한 통제와 더 좁은 데이터 캡처 모델로 전환되고 있다.

Dreaming이 ChatGPT 메모리를 더욱 동적으로 만들다

또 다른 중대한 진전은 Dreaming이다. OpenAI가 ChatGPT를 위해 구축한 차세대 메모리 아키텍처다.

Dreaming은 더 이상 정적인 사실 목록에 국한되지 않는다. 대신 ChatGPT는 대화 기록에서 정보를 추출해 메모리 상태를 종합하고, 시간이 지남에 따라 이 상태를 지속적으로 업데이트할 수 있다.

간단한 예로 그 차이를 설명할 수 있다.

ChatGPT에게 "저는 7월에 싱가포르에 갑니다"라고 말했다고 가정해보자.

전통적인 정적 메모리 시스템은 7월이 지난 후에도 이 여행을 다가올 일로 계속 취급할 수 있다. 반면 Dreaming의 설계 목표는 시간의 흐름을 이해하고 메모리를 수정하여, 시스템이 이후에 이를 미래의 계획이 아닌 지난 여행으로 해석할 수 있게 하는 것이다.

이는 사소해 보일 수 있지만, 지속형 어시스턴트가 직면한 실질적인 문제를 해결한다: 오래된 메모리가 업데이트되지 않으면 오해를 불러일으킬 수 있다.

OpenAI는 이 시스템이 관련 사실 호출, 사용자 선호도 준수, 그리고 시간이 메모리 정보의 의미를 바꿀 때 정확성 유지에서 더 나은 성능을 보인다고 밝혔다.

출처 기사가 인용한 내부 평가 데이터에 따르면, 이 시스템은 사실 회상, 선호도 준수, 시간 민감 정확도 모두에서 개선을 보였다. 가장 명확한 공개 비교 중 하나는 시간 민감 작업의 정확도가 2025년 52.2%에서 2026년 75.1%로 향상된 것이다.

OpenAI는 또한 최근 개선을 통해 무료 사용자에게 Dreaming 서비스를 제공하는 데 필요한 연산량이 약 5배 줄어들어, 더 넓은 범위의 보급이 현실적으로 가능해졌다고 밝혔다.

핵심 아이디어는 메모리가 점점 더 메모장이 아니라 사용자의 현재 상태를 반영하는 지속적으로 유지 관리되는 모델이 되어가고 있다는 것이다.

사용자는 여전히 통제권을 유지한다. OpenAI는 확인하고 편집할 수 있는 메모리 요약을 제공하며, 메모리 기능을 비활성화할 수 있다. 임시 채팅 모드는 지속 메모리에 포함되어서는 안 되는 대화에도 사용할 수 있다.

Dreaming과 컴퓨터 기록은 서로 다른 두 시스템이지만, 둘 다 올트먼이 설명한 방향을 함께 가리키고 있습니다:

  • Dreaming은 대화에서 더 장기적인 개인화 배경 정보를 구축합니다.
  • 컴퓨터 기록은 사용자 PC에서의 최근 활동 배경을 보완합니다.
  • 녹음 모드는 회의나 구두 토론 내용을 캡처하고 요약할 수 있습니다.
  • 화면 컨텍스트는 지원되는 시나리오에서 ChatGPT가 사용자가 현재 보고 있는 내용을 이해하도록 도와줍니다.

이러한 기능들은 각각单独으로는 완전한 '사용자의 모든 삶을 아는 AI'와 같지 않습니다. 그러나 함께 결합되면 해당 아키텍처에서 식별 가능한 각 부분을 구성합니다.

메모리가 새로운 경쟁 해자로 부상하다

OpenAI만이 지속적 메모리를 중요한 제품 계층으로 보는 것은 아닙니다.

거의 모든 주요 AI 플랫폼이 같은 방향으로 나아가고 있습니다.

구글: 메모리를 에이전트 인프라로 활용

구글의 접근 방식은 기업 에이전트와 밀접하게 연결되어 있습니다.

에이전트 플랫폼 메모리 뱅크(Agent Platform Memory Bank)는 사용자와 에이전트의 대화에서 장기 메모리를 생성할 수 있습니다. 이러한 메모리는 세션을 넘어 지속되어 에이전트가 전체 대화 기록을 활성 모델 컨텍스트에 유지하지 않고도 사용자 선호도, 중요한 사실, 이전 배경 정보를 호출할 수 있게 합니다.

구글은 메모리 뱅크를 상태를 가지며 장기적으로 실행 가능한 에이전트를 구축하기 위한 개발자 대상 인프라로 위치시키고 있습니다.

이는 소비자 대상 ChatGPT 메모리 기능과는 약간 다르지만, 근본적인 목표는 유사합니다: 에이전트는 한 세션이 끝날 때 모든 것을 잊어서는 안 된다는 것입니다.

Anthropic: Claude 전반에 걸친 지속적 메모리

Anthropic도 Claude의 메모리 기능을 확장했습니다.

2026년 3월, 채팅 기록에서 비롯된 메모리가 무료 사용자를 포함한 모든 Claude 사용자에게 공개되었습니다. Claude는 과거 대화를 활용하여 채팅 간 연속성을 구축할 수 있으며, 사용자는 메모리를 관리하고 시크릿 채팅과 같은 프라이버시 중심 옵션을 사용할 수 있습니다.

Anthropic은 또한 에이전트 앱을 구축하는 개발자를 위한 메모리 도구를 제공합니다. 이 도구는 Claude가 세션 간에 지속적 메모리 파일을 생성, 읽기, 업데이트, 삭제할 수 있게 합니다.

실질적인 결과는 동일한 경쟁 압력입니다: 어시스턴트는 최신 프롬프트에 응답하는 것 이상으로 사용자를 기억해야 합니다.

Mem0: 크로스 플랫폼 메모리 계층

서드파티 프로젝트는 다른 접근 방식을 취하고 있습니다.

Mem0은 AI 어시스턴트와 에이전트를 위한 범용 메모리 계층으로 자리매김합니다. 개발자는 메모리를 단일 모델 제공업체에 묶지 않고 다양한 AI 시스템을 중심으로 독립적인 메모리 계층을 사용할 수 있습니다.

이는 플랫폼 특정 메모리가 뚜렷한 이식성 문제를 만들기 때문에 중요합니다.

가장 유용한 컨텍스트가 ChatGPT에 저장되어 있다면, Claude로 전환하는 것은 처음부터 다시 시작하는 것을 의미할 수 있습니다. ChatGPT, Claude, Gemini를 병렬로 사용한다면, 각 시스템은 자신이 본 대화와 데이터를 기반으로 사용자에 대한 서로 다른 이해를 점진적으로 구축할 수 있습니다.

크로스 플랫폼 메모리 계층은 사용자의 지속적 컨텍스트를 모델 자체와 분리하려고 시도합니다.

AI 메모리의 잠재적 락인 효과

모델 품질은 빠르게 변화합니다.

오늘 벤치마크에서 선두를 달리는 모델은 몇 달 후에 추월될 수 있습니다. 사용자가 단순히 원시 추론 능력이나 코딩 품질에만 관심이 있다면, 일반적으로 상대적으로 쉽게 모델을 전환할 수 있습니다.

메모리는 다릅니다.

메모리의 가치는 시간이 지남에 따라 누적됩니다. 이미 사용자의 선호도, 업무 습관, 상주 프로젝트, 중요한 인간 관계, 글쓰기 스타일, 도구, 이전 결정을 알고 있는 시스템의 이점은 다른 모델로 전환한다고 해서 즉시 복제할 수 없습니다.

이는 더 은밀한 형태의 플랫폼 락인을 만듭니다.

실제 전환 비용은 궁극적으로 특정 모델에 대한 접근 권한을 잃는 것이 아니라 수년간 축적된 컨텍스트를 잃는 데 있을 수 있습니다.

이것이 이식성, 내보내기 제어, 개인정보 설정, 메모리 삭제 또는 격리 기능이 점점 더 중요해지는 이유입니다.

또한 올트먼의 비전이 단순한 제품 예측이 아닌 이유를 설명합니다. 이는 중대한 상업적 의미를 지닙니다.

사용자의 장기 AI 메모리 저장소가 되는 회사는 단순히 모델 성능만으로 구축된 관계보다 훨씬 더 지속적인 관계를 얻을 수 있습니다.

한편, 메모리가 더 완전할수록 개인정보 보호와 보안 위험이 더 높아집니다. 사용자를 아는——

正在做的事情은 매우 유용할 수 있지만, 명확한 옵트인 제어, 엄격한 경계, 투명한 저장 동작, 사용자가 기억된 내용을 쉽게 검사하고 삭제할 수 있는 간편한 방법도 필요합니다.

따라서 미래의 '궁극적 AI 어시스턴트'는 더 나은 모델에만 의존하지 않을 것입니다.

또한 사용자가 메모리 계층을 신뢰하는지 여부에도 의존할 것입니다.

자주 묻는 질문

샘 올트먼이 ChatGPT의 미래에 대해 무엇을 말했나요?

올트먼은 사용자의 화면 활동, 회의, 통화, 메시지, 문서 및 기타 연결된 컨텍스트를 이해할 수 있는 미래의 AI 어시스턴트를 설명했습니다. 그는 이 기능이 실제로 유용해지려면 약 6개월 정도의 모델 한 세대만 더 반복하면 될 수 있다고 말했습니다.

ChatGPT가 현재 내 화면을 계속 보고 있나요?

아니요. 현재 화면 컨텍스트와 컴퓨터 기록 기능은 사용자 제어하에 있으며 지원되는 환경에서만 제한적으로 작동합니다. OpenAI의 현재 컴퓨터 기록 문서에 따르면 이 기능은 옵트인 방식이며 스크린샷, 화면 비디오, 마이크 입력 또는 시스템 오디오를 녹화하지 않습니다.

OpenAI Chronicle이란 무엇인가요?

Chronicle은 옵트인 방식의 Codex 연구 프리뷰로, 최근 화면 컨텍스트에서 메모리를 구축합니다. OpenAI는 이제 컴퓨터 기록이 스크린샷이 아닌 상호작용 이벤트 기반의 재구성 시스템으로 Chronicle을 대체했다고 밝히고 있습니다.

ChatGPT 드리밍(Dreaming)이란 무엇인가요?

Dreaming은 OpenAI가 ChatGPT를 위해 도입한 최신 메모리 아키텍처입니다. 이전 대화에서 유용한 컨텍스트를 종합하고 시간이 지남에 따라 메모리를 업데이트할 수 있어, 미래 여행 계획과 같은 일시적 정보가 영구적으로 오래되지 않도록 합니다.

ChatGPT의 메모리 기능을 끄거나 저장된 내용을 편집할 수 있나요?

네. OpenAI는 메모리를 확인, 편집, 삭제 및 비활성화할 수 있는 제어 기능을 제공합니다. 지속적 메모리를 사용하지 않거나 업데이트하지 않으려는 대화를 원할 때는 임시 채팅 기능도 사용할 수 있습니다.

Google 메모리 뱅크는 무엇에 사용되나요?

Google 에이전트 플랫폼의 메모리 뱅크는 AI 에이전트에게 여러 세션에 걸친 지속적 장기 메모리를 제공합니다. 주로 개인화되고 상태를 가진 에이전트 시스템을 구축하기 위한 개발자 대상 인프라로 사용됩니다.

Claude에도 지속적 메모리 기능이 있나요?

네. Anthropic은 Claude 앱에 채팅 기록에서 비롯된 메모리를 보유하고 있으며, 에이전트 시스템을 구축하는 개발자를 위한 메모리 도구도 제공합니다. 이러한 기능은 다양한 대화에서 관련 컨텍스트를 유지하도록 설계되었습니다.

AI 메모리가 플랫폼 락인을 초래할 수 있는 이유는 무엇인가요?

사용자가 한 플랫폼에 오래 머물수록 장기 메모리의 가치는 더 커집니다. 메모리를 내보내거나 시스템 간에 공유할 수 없는 한, 다른 어시스턴트로 전환하면 축적된 선호도, 기록, 프로젝트 컨텍스트 및 개인화 설정을 잃을 수 있습니다.

관련 도구

  • ChatGPT: OpenAI의 어시스턴트 플랫폼으로, 대화 메모리, 음성, 화면 컨텍스트, 녹음 모드 및 에이전트 기능을 갖추고 있습니다.
  • Codex / 컴퓨터 기록: OpenAI의 현재 시스템으로, 허용된 컴퓨터 활동을 검색 가능한 타임라인과 재사용 가능한 컨텍스트로 변환합니다.
  • Google 에이전트 플랫폼 메모리 뱅크: 상태를 가진 AI 에이전트를 위한 Google 관리 장기 메모리 계층입니다.

Claude: 대화 간 메모리와 사용자 제어 컨텍스트 기능을 갖춘 Anthropic의 어시스턴트입니다.

  • Mem0: AI 어시스턴트와 에이전트를 위한 오픈소스 범용 메모리 계층입니다.

관련 링크

  • [OpenAI: Dreaming – ChatGPT를 위한 더 나은 메모리](https://openai.

com/index/chatgpt-memory-dreaming/): OpenAI의 최신 메모리 아키텍처와 시간 인식 업데이트에 대한 공식 설명입니다.

요약

Sam Altman의 6개월 예측은 ChatGPT가 문자 그대로 사용자의 삶의 모든 결정을 대신 내려준다는 의미가 아닙니다. 더 구체적인 구상은 대화, 파일, 회의, 컴퓨터 활동 전반에 걸쳐 사용자가 무엇을 하고 있는지 이해할 수 있을 만큼 충분한 지속적 맥락을 갖춘 AI 비서로, 사용자가 반복해서 설명할 필요가 없도록 하는 것입니다.

이 비전의 일부는 이미 구현되었습니다. Dreaming은 장기 대화 메모리를 유지하고, Computer History는 최근 활동 맥락을 제공하며, Record 모드는 회의를 요약할 수 있습니다. Google, Anthropic, Mem0의 경쟁 시스템도 각자 형태의 지속형 메모리를 구축하고 있습니다.

따라서 기술 경쟁은 모델 경쟁 못지않게 메모리 경쟁으로 변모하고 있습니다. 더 강력한 모델이 등장하면 더 나은 추론 능력을 대체할 수 있지만, 수년간의 개인적 맥락은 재구성하기 어렵습니다.

가장 중요한 질문은 AI가 사용자의 디지털 삶을 기억할 수 있는지 여부가 아니라, 그러한 메모리가 가치를 갖게 되었을 때 사용자가 여전히 그에 대한 통제권을 유지할 수 있는지입니다.