什么时候必须让它联网,什么时候不能
- 能对着一个具体问题当场分档:这个必须联网、这个联网也没用、这个联网反而更糟
- 会把联网拿回来的每条信息追到一手来源,并识别「二手转述」和「日期错位」这两种最常见的污染
- 会用三个探针验证它这次到底有没有真的查成,而不是被一句「我已为您检索」骗过去
你问它某消费公司上一季的营收增速。
它答了。数字带小数点,还顺手补了一句「同比放缓主要受渠道去库存影响」。你盯着这行字看了两秒,心里冒出一个念头:这个数,它是刚查的,还是背出来的?
这个念头很重要,因为两种情况下你该做的事完全不同。如果是刚查的,你要问的是「从哪查的、原文在哪」;如果是背出来的,你要问的是「它背的是哪一年的版本」。而最麻烦的地方在于——这两种回答长得一模一样。同样的语气,同样的自信,同样的小数点后一位。
这一节就讲这件事:联网检索和训练时记住的东西,是两种性质完全不同的信息来源,各有各的错法。搞不清手上这句话来自哪一种,后面的核对全是瞎核。
生活层:一个是背书的人,一个是跑腿的人
把这两种来源想成两个不同的助理。
第一个助理记性极好。 他把入职前能找到的所有资料都背下来了,你问什么他都能答,答得又快又流畅。但他入职之后就再没读过新东西——公司改了规章,他不知道;行业出了大事,他也不知道。更要命的是,他不知道自己不知道。 他不会说「这个我可能过时了」,他会用背旧版规章的那种笃定语气,告诉你一件已经变了的事。
第二个助理没什么记性,但腿快。 你问他什么,他跑出去打听一圈回来告诉你。听起来更靠谱?未必。因为他打听的方式是:抓住路上碰到的头几个人问一嘴,然后把这几个人的说法综合成一段话讲给你。他没有能力判断路边这几个人可不可信。 如果头几个人恰好都是在转述同一个不准确的传闻,他给你的就是一段被交叉印证过的错话——听起来比一个人说更可信,实际上更危险。
现在你手上这个工具,是这两个助理的合体。它有时候用第一个的方式答你,有时候用第二个的方式答你,而它并不总是告诉你这次用的是哪一个。
这两种错法值得单独记一下,因为它们的表现完全相反:
- 背书那个的错,是「旧」。 内容本身可能一度是对的,只是过期了。它错得很自然,因为它当年确实见过这个说法。
- 跑腿那个的错,是「脏」。 内容可能是今天新鲜出炉的,但来源是个不知道从哪抄来的地方,中间转了三道手,数字在转述里已经变了形。
一个是旧的真话,一个是新的假话。你要用两套不同的动作去防。
关于第一种错——训练知识过期这件事到底有多隐蔽、它眼里的「现在」和你的现在差多远——AI 眼里的「现在」不是你的现在 那节讲透了,这里不重复。本节的重点在第二种,以及一个更隐蔽的第三种:它其实没查成,但话说得像查成了。
投资层:先分档,别一上来就纠结怎么用
对你的决策来说,第一个动作不是「打开联网开关」,也不是「关掉联网开关」,而是先看你问的是哪一类问题。这个分档只要做一次就成了习惯,而且它比任何提示词技巧都管用。
第一档:必须联网,不联网的答案一律作废。
判据很简单——这件事的答案,会随时间变吗? 会变的,全部归到这一档:
- 最新一期的经营数据、任何带「最新」「今年」「上季度」字样的问题
- 某项政策、行业规定的当前状态
- 某家公司近期出了什么公告、发生了什么事
- 任何你打算写进研究笔记、并且以后要拿来做判断依据的具体数字
这一档里,凭记忆作答的输出不是「可能不准」,而是「结构上不可用」。它答对了也是蒙的,你没法区分蒙对和真知道,所以只能整条丢掉。
第二档:联网帮不上忙,问了也白问。
- 概念解释、原理推导、方法论。「什么是自由现金流」这种问题,答案十年没变过,联网只会让它多引几篇质量参差的科普文章,反而不如它自己那份被反复训练过的表述干净。
- 对你自己投喂的文件做分析。你把一份完整的年报塞给它,让它定位应收账款的相关段落——这时候联网是纯噪音,甚至可能让它把网上找到的别的年份数据混进来。这类操作的完整纪律在 让 AI 读原文,和让它凭记忆说,是两回事 里。
第三档:联网反而更糟,要主动关掉。
这一档最容易被忽略。有两种典型情况:
一是你在测它有没有真本事的时候。你想知道它对某个逻辑的推演能力,结果它一联网,把网上现成的结论抄回来了。你以为看到的是推理,其实看到的是检索。
二是你问的是带方向性的问题,比如「某某板块现在值不值得看」。这种问题一联网,它抓回来的大概率是最近声量最大的那批内容——而声量最大不等于说得对,往往只等于最近这类内容发得最多。你以为你在问一个中立工具,实际上你在问「最近谁的稿子铺得最广」。 这个坑跟共识和超额收益的关系,可以顺带看一眼 有效市场 那篇——已经被广泛传播的看法,价格里通常已经反映了。
分档表落成一句话:问事实且事实会变,必须联网;问原理、问你给的材料、问它的推演能力,别联网。
机制层一:联网这一步,实际发生了什么
搞清楚这个流程,你才知道坑长在哪。
它并不是像人一样「上网冲浪」。粗略地说,中间多了三步:
第一步,把你的问题改写成搜索词。 你问的是一整句话,检索系统吃的是关键词,所以中间有一次转换。这次转换你看不见,而它会决定后面抓回什么。 你问得含糊,转出来的词就宽泛,抓回来的东西就散。
第二步,抓回有限的几条内容,塞进上下文。 注意「有限」两个字:它不会读完全网,它取回排在前面的若干条,把这些内容的文字放进这轮对话的工作区里(这个工作区就是所谓上下文,容量有限,装不下太多东西)。排在前面 ≠ 说得对。 排在前面的判据是搜索系统那套排序逻辑,跟财务数据准不准没有关系。
第三步,还是那台接话机器,基于这几条内容组织一段话给你。 这一步很关键:它并不是把原文复制给你,而是重新表述了一遍。 重新表述的过程中,数字可能被换算、口径可能被合并、限定条件可能被丢掉。
三步连起来,问题就明确了:风险不在「联网」本身,而在「取回哪几条」和「怎么转述」这两处。 你能干预的,恰好也是这两处。
干预取回哪几条,靠把来源要求写进问题里:明确说「优先使用交易所官方披露渠道、监管备案文件、公司官网投资者关系栏目的原始文档,数据聚合类网站只能作为交叉验证的第二来源,自媒体转述不采用」。这句话不是玄学,它确实会影响改写出的搜索词和采信顺序。
干预怎么转述,靠要求它区分原文和复述:让它把关键数字以原文摘录的形式给出来,加上出处链接,转述部分另起一段。摘录和复述一分开,篡改就很难藏。
机制层二:二手转述和日期错位,两种最常见的污染
联网拿回来的东西,最常见的两种脏法都跟「链条」有关。
第一种,二手转述。 一个数字从公司公告出来,被财经媒体报道一次(第一次转述),被聚合平台改写一次(第二次转述),被内容号加个标题再发一次(第三次转述)。你的助理跑出去打听,最可能撞见的是第三层——因为这一层内容最多、更新最快、也最容易被抓到。
三次转述里,数字有大把机会走样:单位从万元变成亿元、口径从扣非前变成扣非后(扣非就是把跟主营业务无关的一次性收支剔掉之后的利润)、区间被写成点值、「预计」被写成了「实现」。每一层转述都是一次可能的形变,而最终给你的那段话里,看不出转了几层。
对策是硬性的:任何要进你研究笔记的数字,必须能追到发布它的那个原始文件。 官方披露渠道上的公告原件、监管备案的报表原文,这一层叫一手;财经媒体报道叫二手;其余都叫来路不明。工作流里那套「关键数据必须来自两个独立来源、误差超过阈值就标记存疑、差异过大必须回查原始报表」的规矩,本质就是不让二手数据单独定案。
第二种,日期错位。 这个更阴。你看到一个页面写着某年某月的数据,但那个页面本身是去年发的,讲的是前年的事;或者一个转载页面上显示的时间,其实是它被抓取或重新发布的时间,不是内容原本的时间。AI 在整合的时候,很可能把页面上出现的最新日期,当成了内容所描述事件的日期。
这一条在归因类问题上杀伤力最大——你问「某公司最近为什么跌」,它捞回一篇三年前的负面报道,讲得头头是道,而那件事早就翻篇了。防这个只有一个动作:让它对每条信息同时标出「事件发生时间」和「这条信息的发布时间」,两个时间都要有出处。 标不出来的,当作没查到。
坑:以为「它给了链接」就等于「这条信息核过了」。 链接只证明存在一个页面,不证明这个页面说了它转述的那句话,更不证明这个页面是一手来源。怎么避:至少点开一条自己看,尤其是你打算写进笔记的那个关键数字对应的那一条。抽查一条的成本是三十秒,不抽查的代价是整条推理链要重来。这个动作该卡在流程的哪个位置,见 核对这件事,放到最后做就已经晚了。
机制层三:它可能声称查了,但其实没查成
这是本节最想让你记住的一段,因为它最隐蔽。
联网这件事,中间有一堆环节会失败:搜索请求没发出去、发出去了没返回、返回了但目标页面拒绝抓取、页面内容在登录墙或付费墙后面只抓到了标题、抓到了但内容是脚本动态生成的所以取到一片空白。这些失败,你在对话框里通常看不到。
而失败之后会发生什么?那台接话机器还是要接话的。 它前面的上下文里有一句「正在为您检索」,接下来最符合语境的续写就是一段有模有样的答案。于是它用记忆里的东西补上了缺口——这段话在形式上完全符合「检索之后的回答」的样子,但内容其实来自记忆。
这不是它在骗你,这是它的产出方式决定的:空白处它不会留白,它会填。
有几个可以直接观察的信号,看到就别信这轮结果:
- 给不出具体链接,只说「据公开资料」「多家媒体报道」。 真检索回来的内容通常带得出出处;给不出,多半是没有。
- 给了链接但打不开,或者打开后压根没有它说的那句话。 这种情况比给不出链接更值得警惕,因为它已经开始编造出处的形态了。编造数字这件事长什么样,编造的财务数字长什么样 讲得更细。
- 对「你这次一共取回了几条、分别是哪几条」答不上来,或者每次问答案都不一样。
- 数字精确到不合理的程度。 真从公告里摘的数会带着公告的口径和单位;凭记忆生成的数往往过于圆润或者过于精细,且没有单位说明。
光靠信号还不够,你需要能主动验的动作。三个探针,从轻到重:
探针一:锚点问题。 你自己先准备一两个你确知答案、且发生在近期的小事实,作为标尺。开工前先拿这个问它一句。答不上来或者答错,说明这一轮它的联网能力没在工作,后面所有「查到的」内容都要打问号。这个探针的价值在于你知道正确答案,所以判断成本是零。
探针二:原句复述。 针对某个关键数字,问它「这个数在原文里的完整句子是什么,出现在哪个章节」。凭记忆生成的内容,答不出带上下文的完整原句;真抓到原文的,能给出来。这一招和一手资料纪律里验证「它是不是真读了你给的文件」的思路是同一个:逼它交出复述之外的东西。
探针三:反向陷阱。 问一件你确知不存在的事,比如让它查某家公司某个根本没发过的公告。正确的反应是明确说没找到。 如果它顺着编出内容,那这一轮的所有结果都不能用——不是这一条不能用,是所有条都不能用,因为它已经证明了在空白处会填。
这三个探针都不是一次性的。同一个工具、同一天、不同的问题,联网可能一次成功一次失败,因为失败往往取决于目标网站那一侧的状态。所以探针要跟着关键结论跑,而不是开工时做一次就一劳永逸。另外提醒一句:本文所有方法只用于提高你手上材料的可靠性,材料本身不构成任何买卖建议,完整边界见 免责声明。
把这套东西压成一段可以直接用的提问骨架
不用背,照着这几件事说就行:
说清时效要求。 「这个问题涉及最新数据,请检索后回答,不要使用你记忆中的内容。」
说清来源等级。 「优先使用官方披露渠道和监管备案文件的原始文档;数据聚合网站只作为第二来源用于交叉验证;自媒体和转载内容不采用。」
说清呈现格式。 「每个关键数字请给出:数值、单位、口径、原文摘录一句、出处链接、事件发生时间、该信息的发布时间。摘录和你的分析请分开两段写。」这一条为什么要强制成结构化格式,让它吐表格,别让它写散文 有更完整的说法——能填进表格的东西,缺了哪一格是一眼可见的。
给它退路。 「如果检索没有返回可用结果,请直接说明检索失败,不要用你记忆中的内容替代。」这句话看着客气,其实是整段里最有用的一句:你必须显式地允许它说「没查到」,否则它默认会去填空白。
最后你自己做一个动作。 抽一条链接点开,看那句话在不在。就这一下,不到一分钟。
小结
- 凭记忆答和联网查回来答,是两种性质不同的来源,错法相反:记忆的错是「旧的真话」,检索的错是「新的假话」,而两者的输出长得一模一样。
- 先分档再决定联不联网:答案会随时间变的必须联网;概念原理、你自己投喂的文件不必联网;测它的推演能力、问带方向性的看法时应主动关掉,否则你测到的是检索、问到的是最近谁的稿子铺得最广。
- 联网中间有三步:问题改写成搜索词、取回有限的几条、重新表述给你。风险全在「取回哪几条」和「怎么转述」,对策分别是把来源等级写进问题、要求摘录与分析分开。
- 两种最常见的污染是二手转述(数字每转一手就多一次形变机会)和日期错位(页面时间不等于事件时间),对策是每个数字追到一手原始文件、每条信息标注事件时间与发布时间。
- 它可能声称查了但其实没查成,因为空白处它不会留白只会填。三个探针:拿你已知答案的锚点问题当标尺、要求给出原文完整句子、用一件不存在的事做反向陷阱。任何一个探针失败,这一轮全部结果作废。
一句话总结:它记得的东西可能是旧的,它查回来的东西可能是别人转了三手的,所以只有一条规矩靠得住——凡是要写进你笔记里的数字,你都得能顺着链子摸回它最开始被公布的那份文件,摸不回去的就别往笔记里写。
本文为投资教育整理,关键数据与结论请结合下列权威来源验证。