答案引擎不会给你的页面排名。它把页面切成若干块,做向量化,针对眼前这个问题召回其中看起来相关的几块,然后决定愿意把哪一块归因给你。页面是容器,块才是真正参与竞争的单元。

这个区分听起来很学术,直到你亲眼看它发生在自己写的页面上。去年春天我们审计一个客户的定价方法论页面:2400 词,头部词排第三,被引用次数为零。当我们按检索器的方式把它切块后,原因立刻可见——文章里每一个具体数字,都和解释这个数字的那句话隔了三个段落。单独看,任何一块都不足以支撑一个答案。

一个块要自带三样东西

我们让每一段可引用的内容都包含三件事:一个具体论断支撑它的数据、以及它成立的条件。第三样是几乎所有人都省略的,而它恰恰是让引用变得安全的那一样。

五个让段落进不了召回的习惯

第一,把数字和它的解释分开。 这是最常见的一种。数字在图表里,解释在三段之后的正文里。切块之后两边都残缺。

第二,用代词接续上一段。 「它的表现要好得多」——它是谁?比什么好?一个以代词开头的段落,脱离上下文后就失去了全部意义,而召回恰恰就是脱离上下文的。

第三,把结论留到最后。 适合演讲,不适合检索。每一块都应该在开头就说出自己的结论。

第四,用小标题承载信息。 「为什么这很重要」这种小标题什么都没说。如果读者只读小标题就能获得论点,那才是对的写法。

第五,回避具体。 「显著提升」「大幅下降」无法被引用,因为引用它们的模型无法核实。写出数字,写出样本,写出时间范围。

这不是在为机器写作

值得说清楚的一点:上面每一条对人类读者同样成立。一个自带论断、数据和边界条件的段落,对匆忙扫读的采购负责人来说也更有用。所谓「为 AI 优化」在这里并没有要求你写得更差——它只是提高了写得含糊的代价。