ChatGPT把搜索工具整个重写了!我读懂了它的新"语言",独立站卖家赶紧看
大家好,我是Neo。
先问一个问题:你知道 ChatGPT 在回答你的问题之前,内部是怎么“搜”的吗?
上周六(8月16日)之前,ChatGPT 的搜索工具调用长这样——一串 JSON:
{"system1_search_query":[{"q":"site:intercom.com Fin AI Agent pricing 2026"}]}
四天之后,8月20日,我再用同一个账号问同样的问题,它变成了这样:
fast|Intercom Fin AI agent pricing 2026 live chat support|30|intercom.com
fast|Gorgias AI Agent pricing 2026 customer support|30|gorgias.com
fast|Zendesk AI agents pricing 2026|30|zendesk.com
fast|best AI live chat support Intercom Gorgias Zendesk Ada Tidio Crisp reddit|365|reddit.com
length|long
注意,这不是我手动格式化的,这是 ChatGPT 自己生成的新调用格式。OpenAI 在四天之内,把 ChatGPT 搜索底层的“扇形展开查询”(fan-out queries)从 JSON 整体换成了一个用竖线分隔的紧凑查询语言。
这事对做独立站的意味着什么?意味着 ChatGPT 选源、抓取、引用的整个逻辑都在变化。今天这篇文章,我把国外技术博主 Suganthan Mohanadasan 的最新拆解(他为此专门写了四篇系列文章,这是第四篇)和 Search Engine Land 的逆向工程研究揉在一起,给你讲清楚这个新格式的五大发现,以及每一条背后,独立站卖家该做什么。
一、先搞清楚背景:ChatGPT 搜索是怎么“扇出”的
在讲新格式之前,得先回顾一下 ChatGPT 搜索的工作原理。
当你问 ChatGPT 一个问题,它不是搜一次就完事,而是会把你的问题拆成多个子查询(可能2到10个以上),分别去不同的来源找答案——这个机制业内叫 fan-out(扇形展开)。
Search Engine Land 在5月的一篇深度研究里,把这个机制拆得很透:
- 3月4日,OpenAI 把默认模型切到 GPT-5.3 Instant 之后,每个回答平均引用的独立域名从19个降到了15个,独URL数从24个降到19个——跌了20%以上,之后再没恢复过。他们把这叫做“大脚怪效应“(Bigfoot Effect):像2012年Google那次一样,少数几个域名霸占了几乎整个结果页。
- ChatGPT 的周活用户已经达到 9亿。引用“饼”没变大,分饼的人却少了——没挤进去的网站,正在失去以前够得着的可见性。
- 底层搜索工具叫
web.run,现在支持 12种操作(原来只有4种),包括 search_query、open、find、click、screenshot、product_query,外加独立的 widget 系统(体育、金融、天气等)。 - GPT-5.4 可以在一次回答里串联 5到10多轮搜索,边搜边修正;5.3 Instant 通常只有2-3轮。
- 真正去抓取你页面内容的是 ChatGPT-User 爬虫,不是 OAI-SearchBot——后者主要用来建索引。
这个背景很重要:ChatGPT 的搜索机制一直在快速进化,而8月下旬的这次格式重写,是它选源逻辑的一次大改版。
二、新格式长什么样?——每个字段都是戏
新版查询语言的通用结构是:
调用类型|查询词|数字|域名
例如:
fast|Zendesk AI agents pricing 2026|30|zendesk.com
fast:调用类型,对应网络搜索Zendesk AI agents pricing 2026:查询词本身30:新鲜度窗口(天数)zendesk.com:目标域名槽位
每个搜索块还会以一行指令收尾,比如 length|long / length|medium / length|short——这是控制每个结果要返回多少文本的。作者发现:深度产品对比时会触发 long,大多数查询是 medium,最后验证两个店名时是 short。
这里有一个非常重要的推论:大多数搜索抓取的是你页面的“摘录片段”,而不是整页内容。 也就是说,那个能回答问题的句子,必须出现在摘录开始的位置——藏在页面深处、要靠读者往下翻才能看到的关键答案,AI 可能根本读不到。
三、五大发现,条条都关系到你的流量
发现一:每一行都是一次搜索,字段都可读
新格式最大的变化是:一次工具调用现在是一块多行的文本块,每行一次搜索,字段用竖线分隔。查询词里依然会出现品牌名(模型自己写进去的)、年份、意图词(如 pricing)。
怎么做?去问那些你客户会问的问题,然后看 ChatGPT 写出来的品牌名。 这些品牌名就是 ChatGPT 当前认知里你品类的“竞争对手集合”;域名槽位里的网站,就是它打算去访问的站点。如果你不在这个集合里,第一步就输了。
发现二:第三个字段是“新鲜度窗口”,不同类型问题窗口不同
作者对比了同一字段在五类问题里的取值:
| 问题类型 | 新鲜度窗口(天) |
|---|---|
| 股票价格 | 2 |
| 足球比赛结果 | 7 |
| 商业产品研究(如AI客服软件价格) | 30 |
| 盈利指引 | 90 |
他判断这个数字是新鲜度窗口(recency window,以天为单位)——跟答案“过期”的速度挂钩。虽然还没看到官方文档,但作者在跑的所有商业问题里,每个品牌探测都是30天窗口。
这对独立站卖家意味着什么?如果这个判断成立,那么一个超过30天没更新的定价页或对比页,在“品牌被比较”的查询上,等于是在默认窗口之外参赛。 如果你的产品页、价格页、对比页半年没动过,ChatGPT 可能根本不在考虑范围里。
应对:把回答购买类问题的页面,放在30天的更新周期里滚动更新——不是改个日期糊弄,而是真实的内容变化加上可见的更新日期。
发现三:搜索变成了一套“垂直系统”——你卖实物产品吗?注意了
作者抓到的调用类型已经有五种:
fast:网络搜索,是整个旧 fan-out 的继任者product:商品目录查询。只在扫机器人和床垫这类实物商品时出现,软件类问题从不触发。一行里是分号分隔的产品名:product|Roborock Saros 10R robot vacuum;Dreame X50 Ultra robot vacuum;Eufy E28 robot vacuumbusiness:商家查询,带地点参数。比如business|Dubai, UAE|specialty coffee Dubai Marina;best coffee Dubai Marina——第一调用发搜索词,第二调用发真实店名逐一验证image:图片搜索,比如image|Dubai Marina specialty coffee shop|30genui_run:widget 调用,带 JSON 参数,比如股票图表、英超赛程
这对做实物产品的卖家太关键了:ChatGPT 查实物商品,走的是一条独立的“商品目录”通道——它先查目录(有没有你的产品卡片、报价、商家信息),再搜网页。目录里有没有你,跟你博客写得再好是两套游戏。
自查方法:问 ChatGPT 你的品类,看它推荐时有没有出现产品卡片(含价格、评分、商家)。有卡片 = 目录认识你;只有文字提及没有卡片 = 你只存在于“内容游戏”里——这种情况下,你改再多页面,也改变不了 product 调用的返回结果。
发现四:域名槽位 = ChatGPT 会直接访问它“已经知道”的网站
旧时代,ChatGPT 想搜某个特定网站,会写 site:intercom.com 这样的操作符。新格式里,“网站”成了一个专门的槽位,就放在每行查询旁边——模型自己从记忆里填这个槽。
这带来一个新风险:如果模型记忆里的域名是错的或过期的,它就会去错的地方找。
作者亲眼看到一个真实案例:有人问“最好的LLM可见性工具及价格”,模型写出的探测是 site:profound.ai pricing AI visibility platform——但 Profound 公司根本不在 profound.ai,人家在 tryprofound.com。结果这次探测零结果,浪费了四次搜索中的一次。品牌最后靠通用搜索里的正确域名被救回来了,被引用了6次——但作者明确说:我不会把希望寄托在“救援”会重复发生上。
应对:自己抓一次 ChatGPT 的调用日志,检查域名槽位里的域名是不是你真正在运营的。 最容易出错的就是:品牌改名、网站迁移、换了国家域名(比如从 .com 换成 .de / .co.uk)。模型从记忆填槽,记忆是滞后的。
发现五:有些答案变成了 Widget——没有引用可赢了
genui_run 调用意味着什么?意味着对某些问题,ChatGPT 的答案是直接调用一个功能组件:英超赛程表、NVDA 股票走势图——都是带类型参数的函数调用,根本不是“搜索”。
这对所有做内容的人来说是个残酷的信号:凡是能被做成 widget 的答案类型(比分、股价、汇率、天气、航班时刻),以后可能就没有“引用”可赢了。 你写的“英超本周末赛程”文章,无论多好,都竞争不过一个实时组件。
这不是危言耸听。Search Engine Land 的研究同样确认:独立的 widget 系统(genui)已经存在,体育、金融、天气都在里面。未来的SEO,一部分战场会直接消失。
四、新旧格式对比表(一张图看懂)
| 维度 | 旧格式(8月16日前) | 新格式(8月20日起) |
|---|---|---|
| 结构 | 结构化 JSON | 竖线分隔的紧凑文本行 |
| 站点限定 | site: 操作符写在查询词里 |
独立域名槽位 |
| 新鲜度控制 | 无明确参数 | 第三个数字字段(2~90天) |
| 垂直类型 | 单一 web 搜索 | fast / product / business / image / genui_run 多垂直 |
| 文本量控制 | response_length 字段 |
`length |
| 内容抓取 | 整页 | 多为摘录片段(取决于 length) |
五、独立站卖家的行动清单(Neo整理版)
- 30天内容保鲜:把你所有回答“购买决策”问题的页面列出来——产品页、定价页、对比页——设定30天滚动更新周期,做真实更新并显示日期。
- 产品目录自查:问 ChatGPT 你的品类(带上“best”“top”这类词),看有没有你的产品卡片。没有卡片?研究一下怎么进入它的商品数据源(对 Shopfiy 卖家,重点是 Merchant Center / 商品结构化数据)。
- 品牌探测:用客户的话术问问题,抓 ChatGPT 的调用(可以用 FanoutFox 这类工具),看品牌集合里有没有你、域名槽位是不是你的域名。
- 域名槽位校准:如果你换过域名、改过品牌、用过国家域名,务必检查 AI 记忆里的域名是否正确——错一个槽位,就浪费一次探测机会。
- 把关键答案放到摘录位置:既然搜索多抓摘录,把每个页面的核心答案写在开头(前50-100字),别埋在页面深处。
- 避开 widget 战场:如果你的核心关键词是“股价、比分、汇率”这类可组件化的问题,尽早转型,把内容往“解读、分析、对比”这些 widget 替代不了的方向做。
Neo的解读
说真的,这是我近几个月看到的最有价值的一篇 ChatGPT 机制拆解,不是因为格式细节多酷,而是因为它第一次把“ChatGPT 怎么选你”这个黑盒,拆成了一行行可读的指令。
我最在意的三个点:
第一,“新鲜度窗口”这个东西一旦坐实,将改变内容更新的经济学。 过去我们说“内容要常更新”,更多是感觉;如果 ChatGPT 真有30天窗口,那更新就不再是玄学——超过30天没动的商业页,直接掉出默认检索窗口。这会让“定期更新关键商业页面”从“建议”变成“生死线”。同时它也能解释一个现象:为什么有些老页面权重很高,但 AI 就是不引用——可能不是不认可你,而是你的内容在窗口外面。
第二,产品目录和网页搜索的分离,是2026年最被低估的变局。 很多独立站卖家还在死磕“内容+外链”,但 ChatGPT 买实物商品的推荐路径根本不走网页——它先查目录。这意味着:你的商品数据能不能进目录(有没有结构化数据、有没有被 Merchant Center 收录、报价和评分全不全),比你写100篇博客都重要。 内容玩家和目录玩家,正在变成两条完全不同的赛道。
第三,域名槽位这个细节,暴露了 AI 时代的残酷真相:模型对品牌的“记忆”是会出错的,而且出错的方式很蠢——去访问一个错误的域名。 但反过来说,这也给了我们机会:AI 的记忆是可以“纠正”的,前提是你得先知道它记错了。主动监测、主动校准,会成为AI时代独立站的新日常。
最后说句实在话:OpenAI 四天就重写一次底层格式,说明 ChatGPT 搜索远未定型。今天这篇的细节可能几个月后就过时了——但“模型会先写品牌集合再搜索、有新鲜度窗口、实物走目录、答案会组件化”这些趋势方向,短时间不会变。 抓住方向,比追格式重要得多。