女孩和机器人一起思考

一起动脑筋 · 先看一个小故事

女孩看回答一点点出现,以为模型一次只想一个完整的词。实际生成单位未必是词。

把过程摊开来看

沿着编号看一遍,再用自己的话讲一遍
  1. 已有内容当前上下文
  2. 计算分布下一 token 的可能性
  3. 选择得到一个 token
  4. 重复接入上下文继续

常见自回归语言模型逐步生成 token,并利用已经生成的内容继续计算。

一个 token 可能只是词的一部分;屏幕上的显示还可能经过缓冲,因此可见节奏不等于内部每一步。

前面若出现错误,后面可能沿着错误继续展开,所以长回答也需要核查。

轮到你来试一试

屏幕一次跳出一整句,能证明模型一次只进行了一次计算吗?

想好了吗?点开看解释

不能,显示可能把多个生成片段合并后呈现。

带走一个发现

常见自回归语言模型逐步生成 token,并利用已经生成的内容继续计算。

试着遮住上面的图,把每一步讲给家人听。如果某一步说不清楚,就回到那张卡片再看一遍。