大模型 · 6

规模涌现

GPT、Scaling Laws、RLHF——理解大语言模型为什么能「涌现」智能。

1 / 6 published · 持续更新中

  • 01GPT 与 BERT:预训练范式
  • 02Scaling Laws 与涌现
  • 03Tokenizer 与嵌入空间
  • 04后训练:RLHF 与 DPO
  • 05Mixture of Experts
  • 06推理优化:量化与投机解码