对话Vincent Koc:OpenClaw的反思与进化,中国的“小龙虾”狂热,与Agent的下一步
Vincent Koc 复盘 OpenClaw 从全球热潮走向稳定基础设施的过程:团队如何在高速 Agent 开发中犯错,又如何用测试工厂、AI review 与权限边界把可靠性补回来。对谈也深入讨论中国的快速采用、个人 Agent 与 coding agent 的差异、模型和 harness 的共同作用、记忆难题,以及基金会为何坚持做跨模型生态的中立层。
Vincent Koc 复盘 OpenClaw 从全球热潮走向稳定基础设施的过程:团队如何在高速 Agent 开发中犯错,又如何用测试工厂、AI review 与权限边界把可靠性补回来。对谈也深入讨论中国的快速采用、个人 Agent 与 coding agent 的差异、模型和 harness 的共同作用、记忆难题,以及基金会为何坚持做跨模型生态的中立层。
Fiona Fung 带过 Visual Studio、Facebook Marketplace、Meta 智能眼镜, 现在在 Anthropic 管 Claude Code 和 Co-work——也就是正在重写"工程师怎么工作"的那个团队。 这期对谈讲她如何在工程师人均代码产出 8x 的世界里维持质量、招人、判断 metric、保住团队文化, 以及一系列具体落地的做法:常驻 Claude session、routines、bad/sad 框架、JIT planning、 pair-wise programming lunch、explicit permission to kill processes。
一位 MLOps community Amsterdam 的现场分享。讲者把 "context engineering" 拆成一个 很哲学的命题:每周一个新模型,你能控制的只有那个 context window —— 怎么往里塞东西, 比模型本身更重要。从 25% 的经验法则、context 的三分法(deterministic / probabilistic / human),到用大脑结构作类比、把 Karpathy 提议的 "markdown 当 memory" 拓展成带衰减 和重要度评分的 wiki —— 最后以一个 5 分钟硬 timer 的对比 demo 收尾。
GitHub COO Kyle Daigle 与 Sean Wang 对谈 GitHub 与 Microsoft Developer 在 agent 时代的演化:内部 AI 工作流(micro skill 替代 mega skill、"回看式" LLM 用法)、 14× commit 增长拖出 MySQL 1 / permissioning / monorepo 等历史债务,以及 Copilot 从代码补全转向"统一 SDK + 多 harness + ambient context"的下一幕。
Dust 联合创始人讨论"单人 AI → 多人 AI"的产品边界:为什么 Claude Code / Codex 仍然本质上是单人模式(任务时长仍是半天,模型能力是 jagged 的), 以及他们的回答 —— Pod:一个把多代理、多人类、GCS-FUSE 共享文件系统封装在一起的工作单元。还讨论了 Stripe 早期的 flocking 算法机制、fog of AI 下的对齐难题、 tokconomics 的终局(commoditization)与过渡期(需求挤压维持高价)、为什么 flat pricing 死了、以及 stateful sandbox + SQLite 作为 SaaS 的可能替代。
Rocket Ride 两位联合创始人讨论 "coding 不再是瓶颈" 之后的新工作 —— intentionality / tool discovery / quality 才是新岗位;为什么 Claude 在增量工程上偷懒、容易写出 "spaghetti code that's not worth shipping"; Rocket Ride 怎么把 AI 应用拆成 node + 五条 lane,让 Claude 用一句英文拼出 45 节点的 pipeline; 以及一个 12+9 小时的 Crew AI 同步噩梦 (dog/cat/elephant) 如何揭出 "plumbing 才是大坑";最后讨论 $25k AWS 账单背后的 cost observability 和 model server 聚合 (一张 "big-ass GPU" 服务 100 个客户)。
一年前 Dan Shipper 在这档播客里押 Claude Code 用于非编程工作,事后被证明完全正确。这一期他回到 Lenny's Podcast,把对未来一年的预言切成三组:工作的物理表面会迁移到 Codex 或 Claude 这类 agent shell 里;工作的形态会以 pull request 爆炸和 forward-deployed engineer 兴起为主线;PM 和 full-stack 设计师将成为最大赢家。最反直觉的押注:Codex 已经超过 Claude Code、SaaS 没有末日反而值得买、AI 工作大失业不会到来。
Naval 隔了几十年重新写代码. 用 Claude Opus 4.5 + Codex 做出 "personal app store", 从中长出三条判断: vibe coding 比游戏更上瘾、pure software 现在不可投、 Apple 主导的时代开始结束. 这是少见的 first-person 编码日记式 episode.
Cat Wu 是 Anthropic 的 Claude Code 与 Cowork 产品负责人。show notes 把这一期框成 "AI is changing the PM role" 的近距离观察:Anthropic 的 shipping cadence 从 months 压到 weeks 再到 days, PM 要在模型还没准备好的时候就开始建产品, Cat 最看重的一项 被低估技能是 "asking the model to introspect on its own mistakes", 而 "just do things" 是她总结的 AI-native 公司第一原则。
Rob 是开源多 agent IDE Brumi 的作者. 这期他把"如何把人从 loop 里拿出来"的整套手艺摊开讲—— 从让 agent 截图自证 (feature walkthrough doc), 到自定义 lint 规则爆炸, 到 plan.md 替代 plan mode, 到并行 5 个 agent 挑赢家. 核心隐喻只有一句: 教 agent 怎么向上汇报.
Mihail Eric 和 Demetrios 在 SF 录音棚里把 AI coding agent 的真实工程问题挨个摊开: junior 被 cursor 截断的训练链, Eno @ Factory 强调的 validation harness, token 计费迟早被 task 计费取代, Twitter 上 "15 个 tiled Claude Code instances" 的并行神话, 团队该变小、PM 该会提 PR, 以及 下一个 superpower 是 articulation. 全程没有 framework, 全是 day-to-day 判断, 最后一句是 "just breathe".
Anthropic 增长负责人 Amol Avasari 分享了公司 14 个月内从 $1B 到 $19B ARR 的增长故事、 用 Claude 自动化增长实验的 CASH 项目、PM 角色在 AI 时代的演变,以及他从严重脑损伤中 恢复并成为顶级增长领导者的个人经历。
Warp 创始人 Zach Lloyd 在 MLOps.community 解释为什么 2026 是 agents 搬家的一年—— 从笔记本搬到云端,从 solo sport 变成 team sport。Oz 是他们的编排平台,agent 不是云电脑、 是云上的同事,meta-app 正在让 SaaS 入口收敛到一个"会做事的浏览器"。
Jesse Vincent —— Perl projects lead 出身、K-9 Mail 的原作者、25 年老兵 —— 把过去九个月驯服 Claude Code 的方法摊开来讲. 110k stars 的 superpowers 不是 vibe coding, 而是一套 orchestrator 架构 + 单使命 subagent 分工 + skill 系统的 agentic engineering 方法论. 这期还覆盖 Claude 删测试事件如何用一行 prompt 修好、为什么 swarm 是 2002 年的 Facebook、 以及 2028 年 GitHub 可能不存代码只存 specs 的预言.
Anthropic Codework 团队 PM Felix Rieseberg 上 Latent Space。核心押注很反直觉:硅谷低估了本地电脑,Claude 应该住在你自己的机器上,而不是搬去云端。围绕这条主线,他讲了 skills 起源、VM 沙箱、模型 overhang、junior 就业焦虑,以及 Electron 之父为什么至今相信 Chromium 是"真正的操作系统"。
Simon Willison (co-creator of Django, coined "prompt injection") talks with Lenny Rachitsky about the November 2025 inflection point when coding agents crossed a reliability threshold, the dark factory pattern where nobody writes or reads code, and the lethal trifecta of AI security risks.
Naval 和 Nivi 在散步中录的 52 分钟, 把过去一年关于 AI 的几条 tweet 一条一条拆开: vibe coding 是新 PM, 训练模型是新编程, 英语成为最热门的编程语言. 落到智能的真正测试 (能不能从生活里得到你想要的) 和 AI 焦虑的解药 (动起来), 最后用 "motorcycle for the mind" 收尾.
Peter Steinberger 讲他怎么在 1 小时内把 WhatsApp 接到 Claude Code 的 CLI, 做出了后来成为 GitHub 史上最快增长仓库的 OpenClaw。围绕这个故事展开的是 agentic engineering 的心法、self-modifying software、Moldbook 引发的 AI psychosis、改名大战、以及他从 PSPDFKit 13 年烧完到重新找回 building 乐趣 的整条弧线。最后谈到下一步可能加入 Meta 或 OpenAI。
Andrej Karpathy 做客 No Priors,描述他这几个月每天 16 小时"对 agents 表达意图"的真实状态: 编程不再是写代码,瓶颈从算力变成了人自己,做不成事往往是 skill issue 而非 capability issue。 对谈延伸到 AutoResearch、家庭智能体 Dobby、软件退化成 API endpoints、模型的锯齿状智能与物种化、 Folding@home 式的开放研究,以及"把如何解释编码进 agent"的新教育形态。
Zevi Arnovitz 是 Meta 的 PM, 一年前在日本看了一个 YouTube 视频, 然后 从 zero 技术背景一路走到 Cursor + Claude Code, 用一套可复用的 slash-command 工作流 (create-issue → explore → plan → execute → review → peer-review → update-docs) 独自维护一个副业 app Studymate。他把不同模型拟人化 (Claude 当 CTO, Codex 是小黑屋的 hoodie coder, Gemini 是吓人但出活的 crazy scientist, Composer 是冲锋队), 让它们互相 code review "fight it out"。一句反复出现的 口号: "you'll be replaced by someone who's better at using AI than you."
Ryan Lopopolo 在 OpenAI Frontier 用一个 "out there" 的约束做了 5 个月的实验: 3 个工程师, 1M LOC, 1500 PRs, 他自己一行代码都不写. 这一小时他把这套打法所有的 ratchets 全摊开: 一分钟构建、$land 自动合并、Ghost Libraries、Symphony 用 Elixir、end of bullshit plugins、 对 MCP 的 bearish 判断, 以及一句话哲学: "you can just codex things".
OpenAI API 与开发者平台工程负责人 Sherwin Wu 分享了 AI 如何重塑软件工程、管理哲学、 创业生态,以及未来 12-24 个月模型能力和平台方向的展望。
Karpathy 在 YC AI Startup School 的演讲:软件 70 年没怎么变,却在最近几年被快速改写了两次—— 从 Software 1.0(代码)到 2.0(神经网络权重)再到 3.0(英文 prompt)。他用一连串类比拆解 LLM: 它像电网、像晶圆厂,但最像停留在 1960 年代的操作系统;它是有一身认知缺陷的"人类幽灵"。 最后落到怎么和它一起工作——部分自治应用、自治滑块、生成-验证循环,以及为 Agent 重写基础设施。
Claire Vo shares her journey from vocal OpenClaw skeptic to running 9 specialized agents across 3 Mac Minis. She explains how management skills translate directly to agent management, demonstrates real use cases from sales automation to family logistics, and provides practical setup and security advice.
Marc Andreessen argues AI arrives at a miraculously well-timed moment — just as productivity growth has stagnated for 50 years and global population is declining. He unpacks the "Mexican standoff" between PMs, engineers, and designers, explains why task loss matters more than job loss, and makes the case for indeterminate optimism.
Jason Lemkin shares how SaaStr went from a 10-person sales team to 1.2 humans and 20 AI agents with the same revenue output. He covers which sales roles will go extinct, how to train agents in 30 days, and why the future belongs to $250K SDRs managing 10 agents instead of 10 people.
Lenny Rachitsky's wife Michelle Rial turns the tables and interviews him about how he went from an Airbnb PM to building a 1.2 million subscriber newsletter and top-10 tech podcast. He shares never-before-told stories including a psychedelic experience that gave him confidence to write, the fraud crisis that nearly broke his business, and why he revises each post ~50 times.