模型 · 2026 年 4 月首次出现 · 2 档 3 期

DeepSeek V4

怎么聊起来的

  1. 2026 年 4 月新

    弃MLA转向混合稀疏注意力(SWA+CSA+HCA),百万上下文落地,融资100亿美金绕CUDA做国产适配3 期

哪些节目在讲

3 期 · 6 个片段
  • 163: 详解DeepSeekV4:Infra巨鲸、百万上下文走进现实、极致效率优化

    晚点聊 LateTalk · 2026-04-30 · 94 分钟

    原站 ↗
    1. 03:01编程能力与“御三家”有差距;不再采用 DeepSeek 自己提出的 MLA
    2. 16:41坦诚的内部评测:9% DeepSeek 工程师不会把V4 Pro 作为编程首选
  • 因为我善?DeepSeekV4 国产适配和100 亿美金融资背后的阳谋,黄仁勋最怕的噩梦成真了!

    人民公园说AI · 2026-04-30 · 34 分钟

    原站 ↗
    1. 11:57为什么是DeepSeek?不是BAT(B=Bytedance)
    2. 17:18DeepSeek 选了一条最纯粹但也最危险的路
  • 158: V4发布前的DeepSeek:人才竞争、组织特点和独特的AGI目标|Solo

    晚点聊 LateTalk · 2026-04-06 · 31 分钟

    原站 ↗
    1. 04:27AI 人才竞争激烈,DeepSeek 要解决公司定价问题
    2. 07:54张力的底层来源:DeepSeek 的目标不是最主流的目标