S02 · 20 / 20 集
Infra 层
集群、网络、调度:算力怎么被组织起来
6:37S02EP01Infra 层是什么:AI 为什么不只是模型公司
6:33S02EP02Token 经济学:一次 AI 回答到底花了多少钱
5:32S02EP03算力租赁是什么:租 GPU,还是租时间
5:22S02EP04AI 工厂怎么赚钱
4:39S02EP05AI 工厂怎么亏钱
4:52S02EP06GPU 利用率为什么是生死线
4:56S02EP07Token 成本怎么拆
5:06S02EP08如何判断一家 AI 工厂质量好不好
4:48S02EP09AI 工厂的回本周期怎么算
4:43S02EP10算力租赁的分成模式
4:37S02EP11推理服务为什么比训练更像生意
4:55S02EP12云厂商、模型公司、算力商到底谁赚什么钱
4:14S02EP13Prefill 和 Decode:大模型推理的两段式结构
4:25S02EP14PD 分离是什么
4:54S02EP15PD 分离如何提高效率
4:50S02EP16KV Cache 是推理系统的隐形资产
4:48S02EP17Continuous Batching 是什么
4:18S02EP18Speculative Decoding 是什么
5:19S02EP19量化如何影响商业模型
5:41