它不检索事实,它预测下一个最可能的词
理解「概率生成」这四个字,就理解了大模型为什么会一本正经地编造 —— 以及为什么它能做创造性工作。
生成式模型的工作方式是按概率预测下一个单元,而不是到数据库里查一条记录。这个区别解释了两件事:它的输出流畅但不必为真;同时它在「没有唯一正确答案」的任务上反而更强。
实务上的直接推论:凡是要求可核查的任务(数字、法规条文、客户信息、价格),输出必须回到原始来源对账;凡是要求发散的任务(方案、类比、翻译初稿、结构化整理),可以放心用它起手。把这两类混在一起用,是绝大多数「AI 不可靠」抱怨的真实来源。