10 期计划
大语言模型前史
从图灵、冯·诺依曼到 GPT-1
这是一条从形式计算、机器记忆、信息概率、学习与注意力一路走到生成式预训练的节目线索。它不把大语言模型讲成突然出现的发明,也不把八十多年的计算史压成一条注定抵达今天的直线。
围绕同一个问题持续推进的节目线索,保留人物、技术对象和当前公开状态。
从图灵、冯·诺依曼到 GPT-1
这是一条从形式计算、机器记忆、信息概率、学习与注意力一路走到生成式预训练的节目线索。它不把大语言模型讲成突然出现的发明,也不把八十多年的计算史压成一条注定抵达今天的直线。