
一起动脑筋 · 先看一个小故事
一个会续写文章的模型,为什么后来能按“请用三句话解释”的要求回答?
把过程摊开来看
- 基础学习语言与知识模式
- 示范任务学习指令形式
- 反馈改进偏好与质量信号
- 对话使用结合当前要求
聊天能力常在基础模型之上,通过指令示范和其他后续训练进一步改善。
模型学习怎样回应请求、保持格式与处理对话,但仍可能忽略要求或生成错误信息。
当前对话也提供上下文,让它知道你说的“上一题”是什么。
轮到你来试一试
回答严格分成三句话,就说明其中的科学结论一定正确吗?
想好了吗?点开看解释
不能。格式完成得好,还需要单独核查内容。
带走一个发现
聊天能力常在基础模型之上,通过指令示范和其他后续训练进一步改善。
试着遮住上面的图,把每一步讲给家人听。如果某一步说不清楚,就回到那张卡片再看一遍。