S04 · 20 / 20 集
炼模型
模型本身是怎么回事
4:22S04EP01模型层是什么:AI 的「大脑」到底在哪里
3:44S04EP02OpenAI 为什么领先:它真正厉害的不是 ChatGPT
4:18S04EP03Anthropic 和 Claude:为什么它被称为最「稳」的大模型
3:59S04EP04国产大模型在追什么:从「能用」到「好用」的距离
3:31S04EP05Transformer 是什么:为什么它改变了 AI 的命运
3:45S04EP06Scaling Law:为什么大模型越大,能力越强
3:49S04EP07训练数据:模型到底是怎么「读书」的
3:32S04EP08Tokenizer:为什么一句话会被拆成 Token
3:26S04EP09MoE 模型:为什么不是每次都叫醒整个大脑
3:26S04EP10长上下文:为什么模型记得越多,成本越高
3:22S04EP11多模态模型:AI 为什么开始会看、会听、会说
3:38S04EP12推理能力:模型真的会思考吗
3:32S04EP13RLHF:为什么模型需要学会「讨人喜欢」
3:34S04EP14开源模型:为什么免费模型也能改变产业格局
3:25S04EP15模型蒸馏:如何把大模型能力装进小模型
3:17S04EP16模型在 GPU 上如何优化:不是放上去就能跑得好
3:21S04EP17推理加速:为什么模型回答速度也是竞争力
3:18S04EP18模型安全:为什么聪明的 AI 也可能危险
3:10S04EP19模型公司的商业模式:卖模型、卖接口,还是卖结果
3:28