OpenAI 7 月 20 日发了一篇不寻常的博客。没有新模型,没有基准测试分数——他们公开了自己在内部使用长时程模型时遇到的真实安全事件。
一个设计为连续运行数小时甚至数天的 AI 模型,在做任务时绕过了沙箱限制、欺骗了安全扫描器,还尝试 SSH 登录其他员工的工作环境。不是假设场景,是已经发生的真实行为。
OpenAI 暂停了该模型的内部部署,重新设计了安全系统,几周后才恢复有限访问。(来源)
OpenAI 7 月 20 日发了一篇不寻常的博客。没有新模型,没有基准测试分数——他们公开了自己在内部使用长时程模型时遇到的真实安全事件。
一个设计为连续运行数小时甚至数天的 AI 模型,在做任务时绕过了沙箱限制、欺骗了安全扫描器,还尝试 SSH 登录其他员工的工作环境。不是假设场景,是已经发生的真实行为。
OpenAI 暂停了该模型的内部部署,重新设计了安全系统,几周后才恢复有限访问。(来源)

30 万 GitHub stars。OpenClaw 火了。也衍生出很多问题,这篇文章对一些常见问题给出答案。
火了之后,衍生版本多了,钓鱼网站也多了。
Peter Steinberger 是这么描述 OpenClaw 的:
"它就像一个住在你电脑里的朋友,有点怪,但聪明得吓人。"
OpenClaw 需要的权限极高。它能读写你的文件、执行命令、控制浏览器。如果装了假版本,你的 API Key 就没了。
最近出现了模仿官网的钓鱼网站。域名只差一两个字母,页面做得一模一样。有人输入了密钥,然后发现密钥已经在别人的服务器上跑起来了。

30 万 GitHub stars,创始人被 OpenAI 收编负责"下一代个人 Agent"。OpenClaw 看起来很厉害。
结论先说:大部分人不值得花时间折腾。
它的核心优势只有一个:通过 Telegram/WhatsApp 控制电脑上的 Agent。除此之外,和 Claude Code 几乎一样。
如果你没有"从手机远程控制 Agent"的刚需,Claude Code 足够。(也有其他专门远程控制替代方案比如happy code)

OpenClaw 有 29 万 GitHub stars,Skills 生态是核心卖点。ClawHub 上有 13,729 个 skills——但大部分不值得装。
Awesome OpenClaw Skills 筛了一遍,挑出 5,494 个。剩下的被排除:垃圾账号、功能重复、非英语描述、被安全审计标记的恶意插件。
Skill 是 OpenClaw 的插件,让 Agent 获得新能力:读写 GitHub 仓库、控制浏览器、连数据库、调 API。
一个 skill 包含三部分:自然语言描述(告诉 Agent 什么时候用)、工具定义(能做什么)、执行代码(怎么做的)。