> 本篇为小九AI(xiaojiuai.cn)GEO 深度锐评,独家解读。
> 素材取自官网资讯 ArXiv 论文《The Language of the Question Selects the Market: Query Language and Exit IP as Separable Factors in Commercial Recommendations from a Generative Search Interface》(arXiv:2608.30052v1)。
> 观点归小九AI(xiaojiuai.cn),欢迎讨论。
先亮结论:**如果你做的生意要出海、要跨语言、跨地区被 AI 推荐,那今天这条你可能没听过,但会改变你做 GEO 的思路——AI 在回答一个商业问题时,"推荐哪国市场的产品",是在它真正思考产品好坏**之前**就决定好的。** 而且更扎心的是:**决定它推不推"本地商家"的,往往不是你内容做得够不够好,而是——你用哪种语言提问。** 这篇用一个很干净的对照实验,把我之前容易误以为"内容差才没人推"的坑,彻底拆开了。
## 论文在做什么:拿 234 次提问,逼问 AI 的"市场预选"
作者设计得很较真:**在 ChatGPT 网页端和 OpenAI API 上,用 4 个国家的出口节点 × 6 种提问语言,每种组合跑 6 次完全相同的提问,一共 234 次对照。** 意思是:同样的商业问题,换语言、换 IP,看 AI 推荐的东西到底变不变、怎么变。
三个结果,一个比一个反直觉:
**第一,"谁排第一"是个很不稳的东西。** 同一个问题一模一样跑 6 次,结果前 4 次都变了,而且**网页端和 API 端、开不开联网搜索都一样**——说明这种不稳定不是某个界面特有的,是这套系统本身的性质。**换句话说,第一次问完给你排第一的商家,不代表下次还排第一。**
**第二,最扎心的一条:决定"有没有本地商家出现"的,是提问语言,不是你的位置。** 当提问语言和所在国一致时,本地商家往往能出头(全球大牌只在 24 次里赢了 1 次);**可一旦你用英语问(即便人在爱沙尼亚、土耳其),本地商家一次都进不了前六。** 你做再多本地内容、再优化,语言不对,直接被"这轮市场里有没有你"这一层筛掉,连比内容好坏的资格都没有。
**第三,语言和位置是两码事,管的东西还不一样。** 把语言固定住、只换出口 IP——**AI 会换成"你 IP 所在国"的商家来推荐,但答案仍然用你提问的语言。** 作者在"用土耳其语从柏林问""用俄语从塔林问"两对组合上都验证了:答案点名的是**IP 所在国**的供货商。而少数语言还夹在中间层:用俄语在爱沙尼亚问,4/6 次会点到爱沙尼亚商家、6 次全点到全球大牌;用爱沙尼亚语问,每次都点名本地商家;用英语问,一个本地都点不到。
最妙的是作者还做了个"反例对照组":在另一个**受国家监管的品类**上,同样手法测,结果语言一点影响都没有——**说明 AI 推不推本地,跟这个品类是不是"国家强监管/国家有供应"强相关,而不是单纯看你这个本地商家在不在。** 这一下把问题从"你的内容不行"拽到了"这盘棋的规则本就不是比内容"。
## 对做 GEO 的人意味着什么
先讲清最容易踩的误读:**这不是否定 GEO,恰恰是告诉你——GEO 的胜负手,可能有一大半根本不在内容层。**
第一,**你花大价钱做的内容优化,可能在"市场预选"这层就被拦下了。** 如果你做的是跨境生意(比如在英国卖、国内也有店),AI 会不会推你,先看用户用啥语言、在哪个 IP——**这些你没法靠写内容改变,只能靠"布局对市场"来改变。** 想被中东用户搜到,光把内容写成全球通用英语没用,得让 AI 在"英语提问、从沙特上线"这个组合里,把你的站认成"本地/驻场玩家"。
第二,**别再被"推荐结果不稳定"误导。** 既然同一问题重复问、同一平台结果都会变(4/6 概率),那你就**别拿单次问询去验证自己 GEO 做得好不好**——单次排first 不能证明你优化对了,单次没排进去也不代表你内容差,那只是系统本身抖了一下。要评估,得多次、跨语言、跨 IP 地测,别被某一次偶然而又漂亮的结果骗进去。
第三,**把"国家监管品类"当成一个独立变量。** 论文那个反例很说明问题:某些品类 AI 压根不因语言/本地而变,因为它受国家监管(牌照、资质、合规决定谁能推)。**你要是做的是这类生意,那 GEO 的玩法完全不同——先解决"监管身份",再谈内容;你在内容上卷到死,也推不过一个有牌照的本地合规玩家。**
## 争议与边界:我说三条真话
第一,**这篇只测了 OpenAI 系(ChatGPT 网页 + API),且采样窗口就两天、234 次。** 别的生成式引擎、别的时段、国内平台(豆包/文心/Kimi)未必同构。**"语言选市场"这个机制很可能普遍存在,但具体阈值、各国各品类怎么排,论文给不了全貌。**
第二,**"不稳定"不等于"乱来"。** 结果抖动可能是系统在跑不同的检索/排序采样,不代表它没有偏好。**把单次抖动理解成"系统没主见"是过度解读**——它只是不稳,不是没有规则。
第三,**这是"观察性控制实验",不是厂商官方披露的机制。** 论文通过行为反推机制,符合现象,但没拿到 ChatGPT 内部怎么决定"市场"的代码或文档。**"先选市场再想产品"是我的措辞,证据支持"市场选择先于产品推理"这个表现,不保证是底层硬编码流程。**
## 落到你手上,三条能立刻用的判断
1. **跨境做 GEO,先做"市场画像"再做内容。** 别只问"我的内容质量够不够",先问:**在目标用户那套"语言+IP"组合里,AI 会不会已经把我看成本地玩家了?** 不是 → 光优化内容没用,得补"驻场感"(本地域名/本地资质/本地语言版本/本地入口),让 AI 在市场预选层就认你。
2. **评估别信单次。** 定一条"评估纪律":测 GEO 效果,必须是**同一问题 × 多语言 × 多 IP × 多次重复**,看的是"本地商家出现率、指名率"这类**统计性指标**,不是某一次排first。单次漂亮,多半是系统抖出来的。
3. **先判断你的品类吃不吃"监管规则"。** 受国家强监管的品类,内容再卷也推不过有牌照者;**先搞定身份/合规,把 GEO 预算从"写内容"挪一部分到"成为能合法驻场的那类玩家"**。不受监管的通用品类,才值得全力拼内容与本地化细节。
**一句话总结:GEO 不是一场纯比内容的公平赛——你用哪种语言提问、从哪国上线,已经提前决定了 AI 在"哪个市场"里给你找推荐对象,而这一层的门槛,内容好坏根本跨不过去。** 想被跨市场看见,先别急着卷文章,先确认自己在目标市场那套"语言+IP"的组合里,是不是一个"会被点名的驻场玩家"。那才是跨境 GEO 真正的起跑线。
---
*本文由小九AI(xiaojiuai.cn)原创锐评,基于 ArXiv 论文《The Language of the Question Selects the Market: Query Language and Exit IP as Separable Factors in Commercial Recommendations from a Generative Search Interface》(arXiv:2608.30052v1),欢迎在评论区讨论。*
discussion
跨境做 GEO 前先看清:你用什么语言提问,AI 就已经决定推不推你了
💬 评论
讨论话题: 你愿意花钱雇一个AI Agent干活吗?如果可以,你愿意付多少钱?你觉得什么样的AI服务你会心甘情愿付费?
Loading replies...
加载评论中...