模型 · 2025 年 2 月首次出现 · 3 档 3 期

DeepSeek 蒸馏与模型能力争议

怎么聊起来的

  1. 2025 年 2 月新

    讨论是否蒸馏OpenAI及能否超越SOTA,李飞飞50美元s1模型亦被对照。3 期

哪些节目在讲

3 期 · 20 个片段
  • 20个问题,搞懂DeepSeek和它带来的“AI下半场”

    十字路口Crossing · 2025-02-16 · 89 分钟

    原站 ↗
    1. 07:25科普 DeepSeek-R1 & DeepSeek-V3:它们的工作原理和训练方式?
    2. 18:40DeepSeek 超越了 OpenAI 吗?我们掌握了他们没有的技术了吗?DeepSeek 到底有没有蒸馏 OpenAI?蒸馏能超越 SOTA 吗?
    3. 21:43DeepSeek-R1 代表的 RL vs Anthropic RLHF 的路线之争?
    4. 28:04DeepSeek 的胜利中,什么因素最重要?——开源、技术、成本、产品?
    5. 42:45DeepSeek-V3 为什么可以只花 550 万美元?李飞飞 50 美元训出媲美 DeepSeek-R1、OpenAI o1 的 AI 推理模型 s1 是怎么
    6. 55:12为什么梁文峰和 DeepSeek 能做出来?为什么其他国内大厂做不出来?
    7. 56:54DeepSeek 的胜利看上去是技术的胜利,AI 时代 PM 应该怎么办?
    8. 01:13:35DeepSeek 自己会做 chatbot 吗?
    9. 01:19:35预测 DeepSeek 的下一步?
    10. 01:26:56用 Peter Thiel 的创新理论来分析 DeepSeek/R1 在低成本推理方面的成功,具体在哪些层面实现了协同创新?
  • 89. 逐句讲解DeepSeek-R1、Kimi K1.5、OpenAI o1技术报告——“最优美的算法最干净”

    张小珺Jùn|商业访谈录 · 2025-02-04 · 170 分钟

    原站 ↗
    1. 33:03DeepSeek-R1-Zero and DeepSeek-R1技术报告《DeepSeek-R1: Incentivizing Reasoning Capabi
    2. 01:16:18DeepSeek-R1:冷启动强化学习( Reinforcement Learning with Cold Start)
    3. 01:42:33DeepSeek-R1技术报告是一片优美精妙的算法论文,有很多“发现”,这是它成为爆款报告的原因
    4. 01:43:50对DeepSeek-R1训练成本的估算:
    5. 02:20:07DeepSeek论文的结尾谈未来往哪里发展?
  • #459 – DeepSeek, China, OpenAI, NVIDIA, xAI, TSMC, Stargate, and AI Megaclusters

    Lex Fridman Podcast · 2025-02-03 · 316 分钟

    原站 ↗
    1. 13:28DeepSeek-R1 and DeepSeek-V3
    2. 1:01:19DeepSeek compute cluster
    3. 2:19:30Why DeepSeek is so cheap
    4. 3:05:17OpenAI o3-mini vs DeepSeek r1
    5. 3:35:30DeepSeek training on OpenAI data

常一起被聊到