YouTube15 Feb 2025
3h 20m

逐篇讲解DeepSeek关键9篇论文及创新点(含投屏)——“勇敢者的游戏”

Podcast cover

Zhang Xiaojun Podcast

DeepSeek 通过一系列技术创新改写了全球 AGI 叙事。香港科技大学助理教授何俊贤深入解读了其从 DeepSeek LLM 到 R1 的演进逻辑。该团队展现出极强的科研基因,坚持开源与透明,通过 MLA、GRPO 等原创算法及 FP8 训练等工程优化,在保持高性能的同时显著降低了训练与推理成本。其技术路线具有高度一致性,从早期的 Dense 模型转向 MOE 架构,并率先探索了基于规则的强化学习路径,摒弃了复杂的奖励模型。DeepSeek 的成功不仅源于其对 Scaling Law 的严谨科学态度,更在于其在行业浮躁中保持务实,通过持续的降本增效实现了技术突破,为 AI 领域提供了独特的创新范式。

Outlines

Sign in to continue reading, translating and more.

Open full episode in Podwise