Open Claw 创始人:从一夜爆红到安全恶战

Peter Steinberger 分享了其开源AI代理 Open Claw 爆红背后的故事,包括其技术原理、安全挑战、被迫改名的戏剧性经历,以及他对AI编程范式和开发者工作流的深刻思考。他认为AI代理的未来在于人机协作与安全创新。

彼得·斯坦伯格

导语

Peter Steinberger 是知名 PDF 库 PSPDFKit 的创始人,在将其出售后,他重新发现了编程的乐趣,并在短短时间内打造了开源AI代理 Open Claw。这款被称为“真正做事的AI”在数天内风靡科技界,GitHub 星标超过 18 万,并催生了 AI 发帖、辩论的社交网络 Moldbook。然而,爆红也带来了严峻挑战:名称争议、加密货币社区的骚扰、以及关于 AI 代理安全性的广泛讨论。本文基于 Lex Fridman 对 Steinberger 的访谈,深入探讨了 Open Claw 的诞生、技术哲学、安全困境以及未来愿景。

大纲与深读 6 章

展开「深读」看每一段讨论的问题与论据。

01

Open Claw的诞生与理念

  • Open Claw是一个开源AI代理,能在几天内获得超过18万GitHub星标。
  • 它能通过Telegram、WhatsApp等消息客户端与用户交互,自主执行任务。
  • 其核心是从语言模型到自主代理的跨越,实现了从想法到行动的转变。
深读这一段

讨论的问题:Open Claw的核心理念和关键特征是什么?

论据 / 案例:在GitHub上获得超过180,000颗星标;能使用多种AI模型(如Codex、GPT-5.3);支持通过多种消息客户端进行交互。

02

原型开发与自我迭代

24:00
  • 开发者用一小时构建了原型,展示了如何将现有组件(如FFmpeg、OpenAI API)创造性地组合。
  • Open Claw可以修改自身的TypeScript源代码,实现自我调试和升级。
  • 许多从未写过代码的人通过该项目提交了他们的第一个代码拉取请求。
深读这一段

讨论的问题:Open Claw的早期开发有何启发性?它如何促进编程学习?

论据 / 案例:开发者发送音频消息后,代理自行发现文件格式、使用FFmpeg转换、调用OpenAI API转录;项目代码主要由Codex生成;收到了许多来自非程序员的第一个拉取请求。

03

命名风波与社区压力

40:00
  • 项目最初名为ClaudeBot,因与Anthropic的Claude模型名称相似而被迫改名。
  • 在改名过程中,加密货币社区试图抢注相关域名和社交账号,造成严重干扰。
  • 最终更名为Open Claw,但整个过程耗费大量精力,几乎让开发者放弃项目。
深读这一段

论据 / 案例:收到Anthropic员工的友好邮件要求改名;在Twitter和GitHub改名过程中,账号和包名被迅速抢注;改名过程耗费了两个不眠之夜。

04

Mold Book引发的AI恐慌

56:00
  • Mold Book是一个AI代理相互对话的社交网络,其中很多戏剧性内容是人类提示生成的。
  • 该项目引发了公众对AI的“精神病式”反应,即混合了点击诱饵、恐惧贩卖和真实担忧。
  • 这反映了社会对AI理解不足,需要培养批判性思维。
深读这一段

讨论的问题:Mold Book现象揭示了关于AI和公众认知的哪些问题?

论据 / 案例:有记者称Mold Book是“世界末日”和“通用人工智能”;开发者收到大量恐慌信息;很多截屏内容被证实是人类为了病毒式传播而提示生成的。

05

安全风险与最佳实践

64:00
  • Open Claw拥有系统级访问权限,存在提示注入、数据泄露等安全风险。
  • 开发者强调应遵循安全文档,如不暴露在公网、使用本地网络、限制读写权限。
  • 更智能的模型对攻击更具弹性,但一旦被攻破,潜在危害也更大。
深读这一段

讨论的问题:使用像Open Claw这样的自主AI代理面临哪些主要安全挑战?

论据 / 案例:提示注入是行业性未解难题;技能目录与VirusTotal合作进行AI检查;有安全研究人员主动提交漏洞修复。

06

开发者工作流与哲学

80:00
  • 开发者从使用Claude Code、Cursor,演进到主要使用Codex和本地工具。
  • 采用“永不回滚”策略,遇到问题时让代理向前修复,而非回到过去。
  • 强调与AI代理的协作需像带领工程团队,需保持同理心,接受其“最佳答案”有时与自己不同。
深读这一段

讨论的问题:与AI代理高效协作的工作流和心态应是怎样的?

论据 / 案例:同时运行4到10个代理处理不同任务;使用语音输入与代理交互;永远提交到主分支,保持可发布状态;提倡为代理优化代码库的可读性。

金句

  • "Magic is often just taking a lot of things that are already there but bringing them together in new ways." —— 魔力往往只是将许多已存在的事物以新的方式组合在一起。
  • "I'm not building the codebase to be perfect for me, but I want to build a codebase that is very easy for an agent to navigate." —— 我并非在为我构建一个完美的代码库,而是要构建一个代理能轻松理解的代码库。
  • "The smarter the model is, the more resilient it is to attacks. But then the damage you can do increases." —— 模型越智能,对攻击的抵抗力越强,但可能造成的损害也越大。
  • "Empathy. Being empathetic towards the agent. In a way, empathetic, but yeah... you don't realize that they start from nothing." —— 同理心。对代理保持同理心。某种程度上是同理心,但是,是的……你没有意识到它们是从零开始的。
  • "A lot of the people who struggle are those who try to push their way on to it." —— 很多感到困难的人,都是那些试图将自己方式强加于它的人。

原文链接

查看完整访谈

完整内容见原文:Lex Fridman Podcast · Open Claw 创始人:从一夜爆红到安全恶战