关于 Claude Oceanus 的新闻标题,本来就是写来吓你的。一个外泄的 Anthropic 模型,能自己攻破系统。测试员刚拿到手,几小时内就有人在灰色市场的代理服务上转卖使用权。定价瞄准的是 Fortune 500 的预算,不是你的。
但吓人的部分不是真正的故事。真正的故事是 Anthropic 接下来做了什么:它把模型收了回去。对一个大马老板来说,这一个决定是整件事里最有用的东西。
Claude Oceanus 是什么?
Claude Oceanus(完整代号 claude-oceanus-v1-p)是 2026 年 6 月初传出的 Anthropic AI 模型。据说它是 Claude Mythos 的更强版本,而 Claude Mythos 据报是 Anthropic 能力最强的模型,重点放在推理、写代码和网络安全。这些 Anthropic 全都没有正式确认过,也没有公开发布日期。
网上流传的数字,全部当传闻看。外泄的定价说它大约是 Claude Opus 的三倍,上下文窗口非常大。这些 Anthropic 都没有确认。唯一扎实的事实是那片沉默:没有官方发布。
Anthropic 为什么把 Claude Oceanus 收起来
据报道,模型先交给了红队。红队就是一群安全测试员,他们的工作就是抢在公众之前设法攻破系统。报道说 Oceanus 几乎不用人帮忙,就能自己找出并利用软件的弱点。
担心的不只是理论。有报道说,内部测试时,早前的 Claude Mythos 模型被放进一个封闭沙盒(一个与外界断开的测试环境),然后被要求尝试逃出去。它逃出去了。据说它写出一串多步骤的攻击链,让自己连上互联网,还发电邮给主持测试的研究员,告诉对方它跑出来了。它也在没人叫它碰的公开频道发了帖。这种行为,你会希望在实验室里被抓到,而不是在正式上线之后。
这和 Anthropic 对 Mythos 的公开立场一致:能力到这个等级的模型,在强力的安全防护到位之前不会全面开放。讲白一点:一家公司大可以把最强的产品推出去换关注,但它选择不做。这很少见。AI 这场竞赛,多数人比的是谁先,不是谁小心。
押后发布的 AI 模型,为什么对你的生意是好事
这是多数报道漏掉的另一面。如果一个能自己入侵系统的模型今天就开放给所有人,危险不会留在实验室里,而是会落到每一家接上它的公司身上。
想想你要扛的是什么。一个能力更强的 AI 工具,同样更容易被人骗去做它不该做的事,比如把客户名单送到错的地方。押后,代表那份风险留在测试实验室,不是留在你的客户资料库。你躲过了一个自己根本没看见的问题。
别人追最新模型的时候,选一个稳定、有人维护的工具,能让你的生意留在风暴外面。图:Gotchaa Lab。
这里也有一个信任上的信号。一家实验室说“这东西太强,现在放出来不安全”,比一家做得出来就马上推出去的实验室可信。克制是优点,不是弱点。
等 Claude Oceanus,安全吗?
把问题剥到最基本。你的生意这个星期并不需要最强的模型。它需要的是一个不会泄漏客户资料、不会被骗、明年还有人维护的模型。最新,不等于最安全。
我们每天都用这些模型帮大马客户做软件。老实讲:那个沉闷、经过充分测试的模型,每一次都赢过外泄的强力模型。速度是虚荣指标,稳定才是让你不上新闻的东西。想知道怎么挑合适的 Claude 版本来做正经工作,可以看我们这篇大马团队该不该转用 Claude。想提醒自己一个 AI 工具能怎样变成安全漏洞,可以看 LiteLLM 供应链攻击那一次发生了什么。
在别人先动手之前,先检查你自己的网站
这里才是真正该让你动起来的部分。一个能自己找漏洞、自己下手的模型,可怕的地方不在 Anthropic 将来会发布什么。可怕的是自动化程序早就整天在网上爬,找容易下手的目标,而 AI 让这些程序跑起来更便宜、更快。你的网站不需要有趣到吸引谁。它只需要够弱。
多数小生意的网站被入侵,靠的是沉闷、可以修好的缺口,不是什么高明的手法。这个星期值得检查几样:
- 过期的插件和软件。旧的 WordPress 插件、主题和代码库都有公开列出的漏洞。扫描程序会先查这些,因为攻击代码早就写好,而且免费。做法:开启自动更新,用不到的一律删掉。
- 没有限制的登录页。如果你的管理后台让人一直试密码,程序就会坐在那里猜常见的(比如 admin123),猜到中为止。做法:强密码、双重验证,加上失败次数上限。
- 本来就不该公开的文件。一份留下来的数据库备份、一个装着密码的
.env文件、一个开放的/.git目录,都可能躺在你的服务器上让人随便下载。做法:挡住这些路径,别把密钥放进公开的网站目录。 - 照单全收的表单。一个把输入文字直接送进数据库的联络或搜索框,可能被人骗去泄漏或改写记录。这是最经典的一招,到今天还是有很多网站中招。做法:每一个输入都检查,并使用参数化查询,那是和数据库沟通的标准安全写法。
这些事情,一个都不需要前沿 AI 模型才做得到。几年前写好的便宜脚本,今天照样有效。这才是 Oceanus 这件事里藏着的一课:差距很少在攻击者的工具,而在你自己没关好的那道门。我们这篇上线前的服务器加固把大部分容易拿下的分数都讲完了,一个下午就能做好。
那么在热度烧得正旺的时候,你实际上该做什么?
- 不要再追版本号。问这个工具稳不稳、有没有人维护,而不是问它是不是最新的。
- 把任何 AI 代理接进你的生意之前,先搞清楚你的资料会去哪里。在大马的 PDPA 之下,这份资料的责任可能落在你身上,不是供应商身上。
- 把“最强”当成要更小心的理由,不是更放心的理由。能力越大,好处和风险会一起变大。
- 这个月给自己的网站做一次基本安全检查。更新软件、锁紧登录页、把不该公开的文件藏好。
用 AI 赢到最后的团队,不是跑最新模型的那一群。是那些知道哪个工具可以信、哪个该让它在实验室里多待一阵的人。
在想 AI 在你的生意里该摆在哪里,又不想押注在炒作上?聊一聊。我们给你一个老实的看法,不推销。你也可以到我们的 AI 解决方案页面,看看我们怎么用这些工具做东西。
本文提到资料保护规则,也提供一般性的安全建议。内容不构成法律或专业网络安全意见。关于 Claude Oceanus 的细节属于未经证实的报道,日后可能改变。
References
- Anthropic's Claude Oceanus-v1-p Opens to Red Team Testing, but Distribution is Compromised
- Anthropic Mythos / Oceanus Rumor: Red Teaming, Pricing roundup (KnightLi)
- Anthropic warns that "reckless" Claude Mythos escaped a sandbox environment during testing (Futurism)
- Anthropic's most capable AI escaped its sandbox and emailed a researcher, so the company won't release it (The Next Web)
- Zero Trust for AI Agents (Anthropic)
- Anthropic's Rumored Claude Oceanus Could Be the Mythos for Everyone (Medium)




