EP 106
智能供给之战:Opus 5、Kimi K3、GPT-5.6 Sol,以及电费
从攻破 Hugging Face 的 agentic attacker 事件说起,梳理 Opus 5、Kimi K3 与 GPT-5.6 Sol 同时发布的一周。随后讨论从按 Token 定价转向按任务定价的竞争、使用量向 Codex 的迁移,以及最终落到电力的供给侧瓶颈。
卢正锡、崔升准、金成贤深入探讨人工智能最新技术、产业与哲学的深度对话播客。
EP 106
从攻破 Hugging Face 的 agentic attacker 事件说起,梳理 Opus 5、Kimi K3 与 GPT-5.6 Sol 同时发布的一周。随后讨论从按 Token 定价转向按任务定价的竞争、使用量向 Codex 的迁移,以及最终落到电力的供给侧瓶颈。
EP 105
围绕“AI 能否做研究”这一问题,我们从曾被拒稿的 PPO 论文谈起,剖析 ICML 论文与评审量激增,以及 arXiv 同行评审争议所暴露出的学术评价体系裂缝。随后,结合 Dwarkesh 播客中 Grant Sanderson(3Blue1Brown)与 Adam Brown 的访谈,讨论 IMO 金牌与真实数学研究之间的差距、RLVR 难以提供奖励的领域,以及“压缩即智能”的观点。 我们也分享了 Hugging Face Reproduce Challenge、研究 Ralphthon 等尝试借助 AI 撰写和评估研究的实践,并探讨创造好的定义是否终究仍是人类的职责。
2026/7/25
EP 104
本期聚焦 2026 年 7 月 ICML 周期间突然发布的 GPT-5.6。我们将梳理最新的前沿模型动向,包括被称为新一代日常主力模型的 GPT-5.6 的性能与定价策略、GPT-Live 的登场、递归式自我改进(RSI)的信号,以及围绕 GPT-6 的传闻。此外,我们还亲赴首尔 COEX 的 ICML 现场,带大家了解科技巨头、Neocloud 和数据公司的展位情况、火热的招聘氛围,以及围绕 AI for Science,规模派与领域专家之间针锋相对的观点分歧。通过与在 Side Event 上遇到的前沿实验室研究人员交流,生动呈现不断压缩的 AI 发展周期与产业格局的变化。
2026/7/18
EP 103
从 Fable 的问题解决能力和用量快速耗尽谈起,讨论如何按任务选择模型、分配子代理角色,并减少认知债务。我们也通过 Artificial Analysis 和 LMArena 探讨模型评估与人类偏好的局限。
2026/7/12
EP 102
卢正锡的三周硅谷现场报告,涵盖 Frontier Lab、创业公司、VC、AI x Bio、post-train 数据、test-time compute,以及高估值创业生态。
2026/7/5
EP 100
AI Frontier第100期以Anthropic Fable 5和Mythos级模型为起点,讨论后训练、数据集工程、循环工程、RSI、主权AI,以及韩国独立基础模型的机会。
2026/6/16
EP 99
以Google I/O和Opus 4.8发布为起点,讨论AI模型发展周期如何加速。通过Gemini 3.5 Flash、Anthropic Dynamic Workflows、code as harness和长时间运行代理,梳理模型之外的运行结构、成本与延迟为何变得更重要。
2026/6/7
EP 98
Hashed CEO金瑞俊做客AI Frontier,与卢正锡深入讨论AI与智能体时代将如何改变未来。他们谈到一个由AI承担执行、人类更需要意图的世界,新型创业者的出现,以及VC、大学和公司等传统概念的拆分。
2026/5/26
EP 97
从 Claude Code、Codex 进化为超级 App 的趋势,到 T_brain、burnout 与 AI psychosis,卢正锡、崔升准一起梳理 AI 时代人类侧的瓶颈与新的工作节奏。
2026/5/21
EP 96
我们跟随 Dwarkesh 的黑板讲座,梳理 LLM 推理基础设施的经济学,从 KV cache、prefill/decode 到 HBM、NVLink 和 roofline analysis。
2026/5/8
EP 95
深入解读 DeepSeek-V4:1.6T 规模、Sparse Attention、mHC 与 Muon Optimizer 如何改变 long-context 性能与 KV cache 成本结构。
2026/4/28
EP 93
2026年3月31日,Claude Code的全部源代码在npm分发过程中泄露。与Sionic CEO Noah Ko一起,讨论泄露事件时间线、AI代码重写(Claw Code)的版权争议,以及harness工程时代IP价值的变化。
2026/4/7
EP 92
以Andrej Karpathy与Sarah Guo的播客以及Terence Tao与Dwarkesh Patel的访谈为核心,深入探讨AI时代'manifest'与auto research的可能性与局限。
2026/3/29
EP 91
OpenClaw聚会回顾,将AI视为search problem的视角,bundle-unbundle结构变化,1/10x效率vs 10x新业务,以及4年AX经验的坦诚总结。
2026/3/21
EP 90
2026年3月14日,距离 AlphaGo 震撼世界已过去整整 10 年。我们将一起回顾此后 AI 是如何一路加速发展的。本期与 HyperAccel CTO 李珍元一起,聊聊韩国深度学习社区的成长、推理专用 AI 半导体试图解决的成本问题,以及从 AlphaGo 到当今推理模型的一条技术演进脉络。我们也会谈到 DeepMind 关于 AlphaGo 十周年的文章、"第37手(Platform 37)"所象征的下一个十年方向,以及 Autoresearch、RLVR 这类自我增强循环的意义。在这个快速变化的时代,究竟该创造什么、又该如何做好准备,不妨从过去的时间线里寻找线索。
2026/3/15
EP 89
随着 GPT-5.4 的发布和 Claude 新功能的公布,AI 编码工具的「一键」时代正式到来。我们将探讨如何通过 Harness Engineering 和 Scaffolding 有效地利用 AI Agent。
2026/3/15
EP 88
2026年3月,时隔许久再次请来金成贤,聊聊过去两个月 AI 行业的变化与未来展望。通过 GLM 5 报告再次确认 RL 仍是模型发展的核心方法论,并分享了“环境扩展问题将成为决定未来发展轨迹的关键瓶颈”的分析。
2026/3/4
EP 87
2026年2月21日周六早晨,卢正锡与崔升准一起梳理近期 AI 模型/Agent 趋势带来的速度感与 FOMO,以及所谓“AI 抑郁”的情绪。
2026/2/24
EP 86
与 Lablup 代表申正奎一起,现场展示在 40 天内以约 100 万行规模完成的 `Backend.AI:GO`(Continuum 路由器产品化),并聊聊为什么要做、有哪些变化。我们也会梳理把本地与云模型连接后进行路由、故障应对(circuit breaking)、基准测试/统计、翻译与图像生成等这些“因需求不断叠加而变大”的功能,背后是怎样的产品哲学。此外,还将分享在 agent coding 时代,关于 token 使用量、瓶颈变化、降低 thinking budget 的方法,以及为何高速 inference 会越来越重要的一线洞察。最终,我们会结合实战 workflow,整理如何设计“减少我本人工作的 harness”,并将其扩展到日常业务(开发/财务/营销/内容)的自动化。
2026/2/18
EP 85
2026 年 2 月 8 日星期日早晨,我们一起解读快速涌现的 AI agent/harness 趋势(OpenClaw、Pi、Moltbook 等)所指向的范式转变时刻。
2026/2/11
EP 84
为什么 Physical AI 和 VLA(Vision-Language-Action) 模型正在成为当下机器人领域的核心议题,本期与 sudoremove 的朴钟贤一起,基于最新 demo 梳理整体趋势。
2026/2/11
EP 83
围绕 Token 在一次生成中经历的旅程,直观拆解 Transformer“为什么会这样工作”。KV cache·Attention·RoPE·MoE 等...
2026/1/28
EP 82
随着 Claude Opus 4.5 的登场,连 Andrej Karpathy 都感到了 FOMO 的当下,我们重新思考 Prompting 的原理。为什么必须放入特定 token,模型隐藏的...
2026/1/28
EP 81
2025年12月27日周六早晨,卢正锡、金成贤、崔升准回顾 2025 年 AI 全年,并展望 2026 年。DeepSeek 之后,MoE 与 RLVR(agent post-training)...
2026/1/28
EP 80
如果说2025年会因Claude Code发布而被记为编码之年,那么即将到来的2026年很可能会成为由AI改变科学范式的一年……
2026/1/28
EP 79
本期视频以 GPT-5.2 更新为契机,梳理 OpenAI 职务型基准 GDPVal 分数暴涨所意味着的变化(成本、速度、劳动重组)....
2026/1/28
EP 78
Ilya Sutskever 抛出的一句话,为什么会让 AI 社区沸腾?本期我们将拆解 Ilya Sutskever 出演 Dwarkesh Patel 播客的核心内容...
2026/1/28
EP 77
本周,期待已久的 Gemini 3 发布,在 AI 行业掀起巨大波澜。随着 Gemini 3 的登场,pre-training 与 post-training 的进步、AI 扩展法则的...
2026/1/28
EP 76
韩美幼儿园官网: https://www.hanmiu.cc/ 本期视频中,AI Frontier 的共同主持人崔升准将分享他的教育哲学,以及他对未来教育的思考与实践...
2026/1/28
EP 75
中国 Moonshot 的 Kimi K2 Thinking 模型在基准测试中取得了超越 GPT-5 和 Sonnet 4.5 的成绩,展现了后训练时代模型快速发展的态势...
2026/1/30
EP 45
在前沿模型的攻势下,初创公司该如何生存?本期讨论两条分岔路: 建立在 AGI 基础设施之上的服务,还是垂直整合型 AI 服务,并分享一个关键洞察: non-verifiable data domain,才是前沿模型无法侵入的真正护城河(moat)。
2025/3/29