社区所有版块导航
Python
python开源   Django   Python   DjangoApp   pycharm  
DATA
docker   Elasticsearch  
aigc
aigc   chatgpt  
WEB开发
linux   MongoDB   Redis   DATABASE   NGINX   其他Web框架   web工具   zookeeper   tornado   NoSql   Bootstrap   js   peewee   Git   bottle   IE   MQ   Jquery  
机器学习
机器学习算法  
Python88.com
反馈   公告   社区推广  
产品
短视频  
印度
印度  
Py学习  »  chatgpt

ChatGPT搜索site指令飙到16%,Reddit引用暴跌

每日AIGC探索 • 1 周前 • 125 次点击  

Simon Willison 扒了追踪数据,发现 OpenAI 暗改 ChatGPT 搜索逻辑,Reddit 成了最大输家。

这可不是简单的接口升级。大模型正在收拢信息源,把流量导向他们认定的高质量域名。做内容分发和 GEO 的人,如果不赶紧调整阵地,之前的优化全得打水漂。

先说结论:

  • ChatGPT 搜索底层调用 site: 指令的比例从 0.3% 暴涨到 16%。
  • OpenAI 官方只 vague 地说 GPT-5.6 Sol in Chat 更可靠,没提具体改动。
  • Reddit 等社区内容的引用率大幅下跌,但系统提示词泄露库里没发现相关修改。

做 GEO(Generative Engine Optimization)的 Promptwatch 一直在用自动化盯着 ChatGPT、Claude 和 Gemini 的回复。他们 8 月 18 日发了个报告,顺便把 8 月初的数据也抖出来了。数据很直接:8 月 8 日之后,ChatGPT 搜索 fanout queries 里带 site: 操作符的比例,直接从平时的 0.3% 到 0.5%,原地起飞到了 16% 到 17%。中间 8 月 3 日到 5 日还掉到过 0.15%,明显是在搞灰度测试。

这时候 OpenAI 在干嘛呢?8 月 6 日发了个含糊其辞的公告(https://openai.com/index/improving-gpt-5-6-sol-in-chatgpt/):

For Plus and Pro users, we’re updating GPT‑5.6 Sol in Chat to be more reliable with facts and provide more focused answers.

原文作者去扒了一下,发现 OpenAI 把系统提示词藏得死死的。他推测现在的搜索工具根本不是在提示词里鼓励用 site:,而是底层接口变成了类似 search(query, recency, domains) 的形状。


为什么突然狂用 site: 指令?因为大模型搜索要 更可靠,直接给模型喂特定域名的数据,比让它自己在茫茫互联网里捞针要准得多。更劲爆的反转在后面。Promptwatch 在 8 月 18 日的跟进报告(https://promptwatch.com/data/reddit-citations-are-dropping-in-chatgpt)里指出,ChatGPT 搜索 大幅降低了引用 Reddit 的概率。

大家第一反应肯定是:OpenAI 是不是在系统提示词里加了不准用 Reddit 的禁令?结果 Simon Willison 去翻了最全面的系统提示词泄露库(https://github.com/asgeirtj/system_prompts_leaks/commits/main/OpenAI),根本没发现相关改动。

这就触及到 GEO 行业的一个致命盲区。很多人以为优化 AI 搜索就是去猜系统提示词,或者在提示词泄露库里找规律。但这次事件证明,平台限制特定社区的内容,根本不靠明面上的提示词,而是靠底层检索逻辑的权重调整,甚至是直接拉黑某些域名的召回。这种暗改对靠猜提示词吃饭的咨询公司是降维打击。你拿着最新的泄露提示词去给客户做优化,发现完全无效,因为规则在代码层和检索层,不在文本层。排查方向全错,做再多无用功。


这事对做内容运营的人来说,是个明确的警告。以前大家觉得把内容铺到 Reddit 这种高权重社区,就能被大模型抓取。现在规则变了。如果你还在死磕 Reddit 的帖子来优化 AI 搜索展现,必须马上建立多域名内容矩阵。决策框架很简单:第一步,停止在单一高权重社区押注,把内容分发到 OpenAI 认为更可靠的垂直域名或官方媒体。第二步,放弃手动测试提示词,直接订阅 Promptwatch 这类第三方追踪工具的 aggregate reports。第三步,每周对比自己品牌域名和竞品域名的引用率变化。哪涨往哪扑,用数据指导内容分发,而不是靠玄学猜大模型的喜好。不这么做,你的内容在 AI 搜索里就会彻底隐形。

大模型搜索正在从开放互联网抓取变成白名单域名投喂。OpenAI 用 site: 指令的飙升和 Reddit 引用的暴跌,清晰地画出了这条界线。对于行业吃瓜群众和从业者来说,别再去纠结 GPT-5.6 Sol in Chat 到底更新了哪个参数,去看看 Promptwatch 的数据报告(https://promptwatch.com/data/chatgpt-site-operator-fanouts)。想摸清大模型搜索的脾气,别去翻提示词库,去盯第三方追踪工具的域名引用报表,哪涨往哪扑。


评论区唠唠
大模型搜索拒用Reddit,是怕幻觉还是怕社区水军?

— 这些也值得一看 —

  • ·比尔盖茨警告AI越过危险阈值,小扎却锁死孩子账号
  • ·Anthropic 放弃大模型内卷,反手甩出物理世界标准
  • ·原作者给高中生换苹果手机,发现硬扛AI时代根本行不通

想翻更多?点头像进公众号看历史

Python社区是高质量的Python/Django开发社区
本文地址:http://www.python88.com/topic/200318