PODCAST · 张小珺Jùn|商业访谈录
2025 年 4 月节目
2 期 · 2 期带分节
- 04-2899. 对能量奇点创始人杨钊3小时访谈:人类驯服可控核聚变还有多少路程?155 分钟
- 13:22多国联合推出的“国际热核聚变实验堆计划”(ITER), 一个超大型托卡马克装置,已投入资金250亿欧元,建设周期30年
- 14:47高温超导材料和低温超导材料都是低温(高温超导在的能量增益的条件下,可以将装置体积缩小两个数量级,也意味建造成本大约缩小两个数量级)
- 19:17一个关键指标:Q值/能量增益由三乘积(等离子体的密度×温度×约束时间)决定,Q值全球最高刚过1,目前追求Q>10
- 27:09从氢弹到惯性约束到磁约束,不同磁场形状对应不同磁约束分叉技术路线
- 27:50上个世纪60年代,苏联想到用甜甜圈一样的磁场位形托卡马克路线
- 28:50全世界大概有100台以上托卡马克装置
- 29:11从用铜做托卡马克的时代过渡到用超导做托卡马克
- 30:172024年,我们建成全世界第一台全高温超导托卡马克(“洪荒70”装置)
- 39:43想清楚以后搭团队,最开始4个人
- 41:05杨钊的个人背景:斯坦福博士方向是比较底层的物理,量子引力、弦论、量子引力和量子信息的交叉,离这个世界比较远的基础物理
- 46:36人类科学的“明珠”和“有生之年”系列
- 51:05从博士毕业到核聚变创业之间?在金沙江创投美国做EIR(驻场准创业者)、第一段人工智能和音乐教育结合的创业
- 55:362021年初,针对核聚变科研院所和供应商的市场调研
- 01:07:33每个环节都在不断出问题,你越接近实物状态,你的问题越大、问题越多,改动修补成本越高
- 01:15:43“洪荒70”的意义
- 01:18:49通往第一个可控核聚变商品的“三步走”
- 01:21:10经天磁体(大孔径磁体)和“洪荒170”的意义
- 01:35:18点评世界上3台全低温超导装置(中国合肥的EAST、韩国的KSTAR、日本的JT-60SA)
- 01:38:40“洪荒380”,按照完整能长时间运行的示范电站的要求做
- 01:45:06核聚变和AI的关系是什么?
- 01:52:13中美核聚变市场格局的分割与差异
- 01:54:10我们和CFS(Commonwealth Fusion Systems,美国麻省理工学院分拆出来的联邦核聚变系统公司)技术路线是相似的
- 01:56:40真正聚变商业化的原料需要用氘氘去发电,而不是氘氚
- 02:03:16当能源无限,世界会怎么样?
- 02:04:57聊聊自我与组织、登山与跌落
- 02:30:57最后的快问快答
- 04-0698. 逐篇讲解机器人基座模型和VLA经典论文——“人就是最智能的VLA”150 分钟
- 04:11讲解开始前,先提问几个小问题
- 17:36当下最大变量:从专用模型到通用模型(robot foundation model)的可能性
- 21:12大模型浪潮爆发后,机器人领域经历了两个阶段:从利用基础模型进行机器人研究(leveraging foundation models in robotics)到为
- 23:54由Google Robotics团队提出的具身智能开创性论文Say Can《Do As I Can, Not As I Say: Grounding Langu
- 27:03第二步,用VLM(Vision-Language Models,视觉语言模型)替代Perception
- 27:52来自Google的论文《Inner Monologue: Embodied Reasoning through Planning with Language M
- 29:51由清华和上海姚期智研究院提出的《DoReMi: Grounding Language Model by Detecting and Recovering fro
- 32:47第三步,想把Actuation进一步自动化,用Code LM(专门用于代码相关任务的大型语言模型)来替代Actuation
- 32:24由李飞飞团队提出的《VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Langu
- 39:53关于VLA的经典论文及分类:
- 40:17Aloha论文《Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware》
- 47:36Mobile Aloha论文《Mobile ALOHA: Learning Bimanual Mobile Manipulation with Low-Cost
- 50:15论文《A Generalist Agent》介绍了一个名为Gato的通用型人工智能代理
- 52:45RT-1论文《RT-1: Robotics Transformer for Real-World Control at Scale》
- 59:02Octo论文《Octo: An Open-Source Generalist Robot Policy》
- 01:02:20CrossFormer论文《Scaling Cross-Embodied Learning: One Policy for Manipulation, Navi
- 01:06:58字节跳动AI Lab的两个工作GR-1和GR-2:
- 01:15:02Palm-E论文《PaLM-E: An Embodied Multimodal Language Model》
- 01:20:02当前VLA最有名的开山工作:Google推出的RT-2论文《RT-2:Vision-Language-Action Models Transfer Web Kn
- 01:26:05RT-X论文《Open X-Embodiment: Robotic Learning Datasets and RT-X Models》
- 01:31:16《OpenVLA: An Open-Source Vision-Language-Action Model》(约等于开源版RT-2)
- 01:32:56陈建宇课题组《HiRT: Enhancing Robotic Control with Hierarchical Robot Transformers》
- 01:38:40Figure AI Helix,没发论文,但是今年Figure最新架构
- 01:39:28Pi0论文《π₀: A Vision-Language-Action Flow Model for General Robot Control》
- 01:41:36英伟达最近发布的GROOT N1模型《GR00T N1: An Open Foundation Model for Generalist Humanoid Ro
- 01:42:32《Diffusion Policy: Visuomotor Policy Learning via Action Diffusion》
- 01:47:39清华发布的《RDT-1B: A Diffusion Foundation Model for Bimanual Manipulation》
- 01:51:04《Prediction with Action: Visual Policy Learning via Joint Denoising Process》(动作预
- 02:03:06两个未来方向:《UP-VLA: A Unified Understanding and Prediction Model for Embodied Agent》
- 02:09:22最后的提问