大模型 · 6 篇
规模涌现
GPT、Scaling Laws、RLHF——理解大语言模型为什么能「涌现」智能。
1 / 6 published · 持续更新中
- 01GPT 与 BERT:预训练范式
- 02Scaling Laws 与涌现
- 03Tokenizer 与嵌入空间
- 04后训练:RLHF 与 DPO
- 05Mixture of Experts
- 06推理优化:量化与投机解码
大模型 · 6 篇
GPT、Scaling Laws、RLHF——理解大语言模型为什么能「涌现」智能。
1 / 6 published · 持续更新中