S02 · 20 / 20 集

Infra 层

集群、网络、调度:算力怎么被组织起来

6:37

S02EP01Infra 层是什么:AI 为什么不只是模型公司

6:33

S02EP02Token 经济学:一次 AI 回答到底花了多少钱

5:32

S02EP03算力租赁是什么:租 GPU,还是租时间

5:22

S02EP04AI 工厂怎么赚钱

4:39

S02EP05AI 工厂怎么亏钱

4:52

S02EP06GPU 利用率为什么是生死线

4:56

S02EP07Token 成本怎么拆

5:06

S02EP08如何判断一家 AI 工厂质量好不好

4:48

S02EP09AI 工厂的回本周期怎么算

4:43

S02EP10算力租赁的分成模式

4:37

S02EP11推理服务为什么比训练更像生意

4:55

S02EP12云厂商、模型公司、算力商到底谁赚什么钱

4:14

S02EP13Prefill 和 Decode:大模型推理的两段式结构

4:25

S02EP14PD 分离是什么

4:54

S02EP15PD 分离如何提高效率

4:50

S02EP16KV Cache 是推理系统的隐形资产

4:48

S02EP17Continuous Batching 是什么

4:18

S02EP18Speculative Decoding 是什么

5:19

S02EP19量化如何影响商业模型

5:41

S02EP20AI Infra 公司怎么估值:谁掌握算力,谁掌握 AI 的地基

← 全部系列