社区所有版块导航
Python
python开源   Django   Python   DjangoApp   pycharm  
DATA
docker   Elasticsearch  
aigc
aigc   chatgpt  
WEB开发
linux   MongoDB   Redis   DATABASE   NGINX   其他Web框架   web工具   zookeeper   tornado   NoSql   Bootstrap   js   peewee   Git   bottle   IE   MQ   Jquery  
机器学习
机器学习算法  
Python88.com
反馈   公告   社区推广  
产品
短视频  
印度
印度  
Py学习  »  chatgpt

奥特曼震撼预言:6个月后,ChatGPT将彻底接管你的人生

新智元 • 2 周前 • 48 次点击  

  新智元报道  


OpenAI首席执行官奥特曼,再次震惊科技圈。


在最近面对硅谷实习生的对话中,他直言「终极AI助理」只差「一次模型迭代 / 6个月」。


在接下来的6个月里,我们即将迎来这样一个世界:ChatGPT的后代可以观看你的屏幕,记录每一次会议和通话,并完美掌握你生活的全部背景。


我们距离这一功能变得极其实用,仅差一代模型的迭代。



注意,他说的不是「更强的记忆」或「更大的上下文」,而是持续观看你的屏幕、记录每一场会议与通话、掌握你整个人生的完美上下文。


这将是人机关系的质变:从对话走向共生。但这一次,奥特曼预言靠谱吗?



奥特曼:让AI记下你所有的生活


过去两年,奥特曼反复畅想过一个愿景:希望有一个极小的推理模型,却拥有万亿token的上下文,能记住你的所有生活,然后持续追加。



去年五月Sequoia AI Ascent大会,奥特曼给出了一个很有说服力的观察。


他做了一个粗略却清晰的划分:


年长者把ChatGPT当Google的替代品;


20到30岁的人把它当人生顾问;


大学生则直接当操作系统。


更进一步的趋势是,年轻人「人生大事,先问ChatGPT」。



这些都是未来AI新形态的信号。但这一次,他不再只是说「记忆」,而是直接点名屏幕感知与会议全量记录。


奥特曼豪言:未来6个月内,下一代AI将彻底看懂你

这将是真正的跃迁,从「偶尔使用」变成「持续在场」,从「单次任务」变成「整个人生级别的上下文积累」。你在这个AI身上投入的人生越多,离开它的代价就越大。


记忆从被动保存到主动合成

雏形其实已经开始浮现:ChatGPT桌面端在语音模式下已能获取屏幕上下文,企业版也早有会议记录与总结功能。

今年4月21日,OpenAI在编程产品Codex中上线了一个名为Chronicle的研究预览版功能。

它通过后台间歇性屏幕截图 + OCR,生成关于「你最近在做什么」的记忆,保存为本地加密Markdown文件,帮助Codex理解「这个「那个」或两周前的项目,而无需用户反复重述。

上手体验后,OpenAI主席Greg Brockman说了两个词:「surprisingly magical」(意外地奇妙)。

它的内部代号叫 「telepathy」心灵感应。奥特曼本人直言:「字如其名,就是这种感觉。」

但Chronicle ≠ 全面「人生上下」。它主要服务于Codex编程工作流,捕捉最近屏幕内容以补全上下文,而非持续录制会议/通话或构建完整个人档案。用户可随时暂停。

而且风险较大,官方文档明确警告提示注入、本地未加密存储、需用户授权。

OpenAI的另一个动作是今年6月ChatGPT上线的Dreaming V3。

Dreaming V3是ChatGPT记忆系统的最新架构:后台自动从对话历史合成记忆状态,具备时间感知,减少过时信息,提升事实回忆与偏好遵循。

用户可通过记忆摘要页查看/编辑。

最有意思的是,它具备自动演化能力。如果你说过「七月要去新加坡」,等时间过了,系统会自动把记忆改成「你七月去了新加坡」。记忆不再是静态的,而是跟着时间走的。

在OpenAI内部评估中,这次更新性能提升明显

事实召回率从2025年的67.9%提升到 82.8%;

偏好遵循从55.3%提升到71.3%;

时间敏感准确性从52.2%提升到75.1%。

而且计算效率提升了约5倍,这也是它能下放到免费用户层的原因。

Dreaming V3与Chronicle是并行但不同产品线的进展——一个侧重屏幕上下文(Codex编程场景),一个侧重对话合成(ChatGPT通用)。

合在一起更接近奥特曼描述的「始终在线、深度个性化」方向,但仍处于研究预览/分阶段推送阶段。


记忆,正在成为新的护城河


奥特曼这套愿景不是单打独斗。把镜头拉远一点会发现,过去几个月,几乎整个AI行业在同一时间下注同一个方向。


谷歌那边走的是企业路线。


Memory Bank在Gemini的企业级Agent平台上上线。开发者可给自己搭的AI agent接上一层能跨会话记忆的能力池,自动从对话里提炼用户偏好、关键节点、显式指令。


这条线目前更偏开发者基础设施,还没铺到普通消费者的Gemini对话框里,但方向和OpenAI是一致的。


Anthropic也没闲着。


今年3月,持久记忆直接全量给了Claude的所有用户,免费版付费版都有,后台悄悄根据对话总结出你的数据。


4月,又给开发者侧的Managed Agents加上了持久记忆公测版,Netflix等企业客户已经拿去跑生产环境,有企业用户的错误减少了97%。


第三方也在下场,但打法正好相反。


Mem0这类记忆层项目想做的,是变成一层跨平台的记忆中间件,同时对接OpenAI、Anthropic、开源模型,让开发者不必被锁死在某一家。


这恰恰说明行业已经意识到问题所在——如果每家巨头都各自为政建自己的记忆孤岛,最后受苦的会是被困在里面的用户和开发者。



现在几乎所有巨头都在往这个方向冲刺。


但真正没人愿意摆到台面上说的是,你的AI记忆现在被锁定在你最常用的那个平台里。从ChatGPT换到Claude,记忆是空的,一切从头开始。三个工具一起用,你就同时养着三个互不相通、发展轨迹完全不同的「你」。


这才是比模型性能更隐蔽的护城河。


模型的强弱可能三个月就翻一轮排名,但记忆这东西是越攒越厚的,攒得越久,离开的成本就越高。谁先把用户的记忆攒得足够厚,谁就先把用户焊在自己的平台上。


看懂这一层,就能明白奥特曼这句话不只是产品愿景,还有商业预判。


参考资料:

https://x.com/OpenAIDevs/status/2046288243768082699
https://x.com/haider1/status/2087219995466224120
https://x.com/cory/status/2087060650870907170
https://www.youtube.com/watch?v=gXsutRiJbZI
https://inferencebysequoia.substack.com/p/openais-sam-altman-on-building-the?utm_source=publication-search

编辑:大卫


秒追ASI
点赞、转发、在看一键三连
点亮星标,锁定新智元极速推送!

Python社区是高质量的Python/Django开发社区
本文地址:http://www.python88.com/topic/199693