
TL;DR
大模型能回答人类提问,靠的并非单一魔法,而是参数、推理、联网三种机制的协同组合。
你有没有想过,AI 凭什么能回答你的问题?它又不是百科全书,怎么什么都知道?
其实,大模型的秘密就藏在三个机制里。理解了这三个机制,你对 AI 就有了基本概念。
参数机制:把知识压缩进数字
所有大模型干的事,就是把人类知识“建模”。怎么建模?它把文字拆成一个个小碎片(叫“词元”),再算出这些碎片之间的数学关系。
这种关系用海量参数表示。比如 GLM 5.3 有 7440 亿个参数,训练就是找出这些参数的最优值,好让词元之间的关系最准确。
回答问题时,模型就靠这些参数,算出最有可能的下一个词。所以大模型本质上是个“压缩-生成”机制:先把知识压缩进参数,再按概率生成答案。
推理与联网:补上知识盲区
参数多固然好,但不可能什么都知道,而且也不必要。很多知识可以推理出来。比如知道出生率和死亡率,就能算出净增长率,不用死记。
还有些知识,参数里没有,也推理不出来,比如今天股票的收盘价。这时就靠联网机制——让 AI 自动去网上搜索来获取答案。
这三种机制各有分工:参数提供基础,推理补充逻辑,联网搞定实时信息。它们合在一起,才让 AI 显得无所不知。
从全球优质信息源中筛选,几分钟了解当天最值得关注的观点。