导语
在本期Lex Fridman播客中,SemiAnalysis创始人迪伦·帕特尔与艾伦人工智能研究所研究员内森·兰伯特,深入剖析了中国AI实验室DeepSeek及其模型引发的全球震动。他们从技术内核出发,拆解了DeepSeek V3与R1模型的区别、其高效训练背后的关键创新(如混合专家模型与MLA注意力机制),并探讨了DeepSeek这家脱胎于对冲基金的公司如何以相对有限的硬件资源,在前沿模型竞争中取得突破。对话进一步延伸至AI硬件供应链、中美地缘政治博弈下的出口管制,以及对AGI时间线的冷静评估。
