为什么我们的 AI 不说人话?

最近尝试用 LLM 进行一些知识的学习,也会在博客记录一些学习的过程,但发现抛开代码后, LLM 的回答的用词有时候非常奇怪,甚至有些不符合人类的表达习惯。最近学习了一些 Transformer 原理后,对这个事情有了进一步认知,也写了个可视化小工具探索词表,并用它找到了词表里的近义词! 原理 我们以 DeepSeek v4 Flash 为例,来看看它的模型结构,其他 Transformer 模型的结构也大同小异: flowchart TB IN(["input_ids"])…

Back to Top