DeepSeek V4新3 期 · 6 段
弃MLA转向混合稀疏注意力(SWA+CSA+HCA),百万上下文落地,融资100亿美金绕CUDA做国产适配
- 03:01编程能力与“御三家”有差距;不再采用 DeepSeek 自己提出的 MLA
- 16:41坦诚的内部评测:9% DeepSeek 工程师不会把V4 Pro 作为编程首选
- 11:57为什么是DeepSeek?不是BAT(B=Bytedance)
- 17:18DeepSeek 选了一条最纯粹但也最危险的路
- 04:27AI 人才竞争激烈,DeepSeek 要解决公司定价问题
- 07:54张力的底层来源:DeepSeek 的目标不是最主流的目标