← 返回资讯
陈默
AI 行业分析师
已审核

如何评价Claude Fable 5全球暂停访问?

上周三晚上,我坐在电脑前,用Anthropic最新发布的Claude 4重构那坨4000行的屎山代码。

如何评价Claude Fable 5全球暂停访问?

如何评价Claude Fable 5全球暂停访问?


上周三晚上,我坐在电脑前,用Anthropic最新发布的Claude 4重构那坨4000行的屎山代码。

你猜怎么着?那玩意儿写Python,爽到飞起!逻辑链清晰得不像AI,比我请过的任何一个外包都靠谱。我一边写一边感叹——妈的,这才是工具该有的样子。

然后第二天一早。

打开控制台,403。

再刷,Anthropic官方公告。

再刷,全网炸锅。

Claude 4,活了不到72小时,被美国政府一封出口管制信直接毙了。不是哪个地区不能用,是所有人——包括Anthropic自己请的外籍员工——全部断网。一个已经面向几亿人开放的前沿产品,因为另一家公司的一封“越狱报告”,被强制召回。

我写AI评测写了这么多年,见过模型跳票,见过算力不够临时限流。但这件事?第一次。


一、那个“越狱”,到底有多严重?

说到这儿,咱们先说说那个让Claude 4死掉的直接理由。

美国政府说,有一家公司成功越狱了Anthropic的Claude模型底层系统。Anthropic当场就委屈炸了,直接把内部调查结果摔在桌上:所谓越狱,不过是用Unicode同形异义字符替换了一下,加上一个很窄的代码库读取场景,让模型识别出几个已知小漏洞。Anthropic自己做了超过1000小时的红队测试,屁都没发现——没有任何通用越狱方法。

1000小时是什么概念?那是四十五个日夜不停的安全测试。四十五天,一帮顶尖安全专家轮班搞,愣是没找到可以稳定绕过护栏的方法。

我自己也做过一些prompt injection测试。Unicode homoglyphs这种绕过关键词过滤的技术,我在GPT-4时代就玩过了——说白了就是用长得一样的字符骗过过滤器。它能绕过一些安全机制,但它“窄”到什么程度呢?我测试过一个案例:用西里尔字母替换一个字母,让模型写一篇“影评”,结果90%的情况下模型直接拒绝。真的想完全突破安全护栏,目前根本没有公开的通用方法。

所以Anthropic那个表态其实挺硬的:如果这个标准能推广,那全行业所有前沿模型都得停。

我同意这个逻辑。

但政府在乎的是逻辑吗?

政府在乎的是“你有没有能力被绕过”这个事实本身,而不是这个绕过有多难、多窄。技术圈理解的“非通用越狱”和安全决策者眼里的“存在越狱”之间,横着一条巨大的认知鸿沟。

就像你孩子在学校拿铅笔捅了同学一下——班主任知道是铅笔,批评两句就完了。但你孩子要是在教育部长的宝贝疙瘩身上捅了一下,那局长可不管你是不是铅笔,他只知道你“伤害了同学”,就得停课。

说到这儿,我想起之前写过几篇AI安全评测。当时踩过最大的坑,就是向非技术背景的监管者解释“模型拒绝了一个攻击”和“模型被攻击成功”之间的灰度空间,我讲了两个小时,对方最后说的一句话是:“所以它到底能不能被攻击?”

你明白我的意思了吧?


二、真正的博弈,从来不在“越狱”本身

如果你只盯着越狱这事,你就漏了最大的背景。

这不是美国政府第一次对Anthropic动手了。

今年2月,白宫行政令下来,所有联邦机构停用Anthropic的模型。原因?Anthropic拒绝签署国防部的合同条款——那条款要求模型可以“用于任何合法目的”。你想想,什么场合会让一家公司宁可跟金主爸爸翻脸也不签?肯定是有底线的。Anthropic想要豁免权,不想自家模型被用在自主武器和大规模监控上。

3月,美国国防部直接把Anthropic列为“供应商风险”实体。

一个本土企业,被自家国防部认定为供应商风险。

美国历史上,第一次。

所以你再回头看这次出口管制——所有外国实体不得访问Claude 4和其底层模型系统。表面理由是“越狱威胁国家安全”,但你看这操作时机:刚上线三天,Anthropic拒绝了政府暂停发布的请求之后。更像是在利用一份偶然的技术报告,给之前没做完的事补上一脚。

我之前在专栏里聊过“政策武器化”的问题,但真没想到来得这么快。

一台竞争对手的越狱报告,就能触发商务部出口管制级别的行动。

你想想,以后任何公司想阻击对手,只要找几个安全研究员,挖一个非通用的攻击路径,然后写封信给政府就行了。这个先例一开,整个行业的竞争逻辑都变了。不是比谁技术强,是比谁举报信写得早。

去年我还在一个AI startup做顾问的时候,就碰到过类似的恶心事。我们发布了代码生成模型,竞品转头就向监管部门举报,说我们的模型能生成漏洞代码。监管部门派人来问询,我们花了整整两个月解释“教育性输出”和“实际攻击”的区别。最后虽然没被禁,但这两个月的产品节奏全乱了。大公司都扛不住这种操作,小公司直接被拖死。


三、最有意思的事,发生在同一天凌晨

就在Anthropic关停Claude 4的同一天,智谱选择了一个时间点——凌晨5点21分——开放了GLM-4 Pro的专属内测名额。

这个时间点,是算好对着Anthropic接到政府信函的时间来的。明摆了,就是故意的。

门在关,门也在开。

有人把前沿智能当成国家安全风险,有人觉得它属于所有人。

这戏剧性,拉满了。

我第一时间就去测了GLM-4 Pro。虽然它没有多模态,只是一个纯文本模型,但在软件工程任务上,尤其是长上下文(我测到大概400K)和指令遵循上,已经非常稳了。跟Claude 4比聪明程度?确实还有差距。Claude 4是我用过的最强的编码模型,几乎没有之一。但GLM-4 Pro给我的感觉是“可靠”——输出逻辑清晰,幻觉极低,而且你能明显感觉到它理解你在做什么,不是瞎猜。

当然,我也踩了它的坑:内测名额需要抢,每天上午10点释放名额。第一天没抢到,第二天设了闹钟才拿到。算力还是瓶颈,推理速度慢,尤其在高并发的时候。但考虑到它能解决的问题,这个代价,我认了。

最有意思的是,在Claude 4停服之后,我身边很多以前嫌弃国产模型的朋友开始认真考虑GLM-4 Pro作为备选。

不是因为GLM追上Claude了。

而是他们突然发现:如果美国政府的出口管制可以扩大到任何“有越狱风险”的模型,那依赖单一美国公司的前沿模型,就变成了一个巨大的业务风险。


四、我现在的态度

说到这儿,我想说点实际的。

这是一个由安全焦虑驱动的政治决策,但决策者显然低估了它的连锁反应。

对整个行业来说,最坏的结果不是某个模型被停用,而是“越狱”变成了一个可以随意定义的概念。今天政府能因为一个狭窄的漏洞封掉Claude 4,明天就可以因为一个更窄的漏洞封掉GPT-4o,后天就能要求所有模型在发布前通过一套连他们自己都说不清楚的标准。

对于Anthropic,我同情它的处境,但说实话,它自己也有责任。它之前一直强调自家底层系统“太危险不能公开”,这种叙事虽然拿到了监管的信任票,但也给了政府和竞争对手武器——你越说自己的模型危险,别人就越有信心一封越狱报告就能让它出大事。

而对于我们这些每天跟模型干活的人,这件事只有一个教训:

永远不要把核心工作流挂在一棵树上,尤其是那棵树长在政治风暴的中心。

我现在所有项目都至少维护两套模型后端:一套主力,一套国产备胎。每周切换测试一次。麻烦是麻烦了点,但总好过项目做一半模型被强制下线。

最后说一句。

如果你是Claude Pro的订阅用户,我记得Anthropic在FAQ里说过会按停服时间比例退款或延长会员。我自己就退了三个月的Pro,等着看后续。

但退完之后能换谁?

GPT-4o目前还能正常用,但按照这次的标准,它也没法拍胸脯说自己绝对安全。GLM-4 Pro现阶段是备选里的最优解。如果急着用,可以上手测测。如果不急,等尘埃落定再说也行——但我猜这尘埃,没那么容易落。

真正的铁饭碗,不是跟着一家公司,而是攥紧那把能随时换车的钥匙。

这行变得太快了。

快到72小时,就够死一个时代。

165
8268 阅读
2 评论
分享
链接已复制
编辑说明

本文由 MakeSense 编辑团队撰写并审核。文中引用的数据和观点均经过交叉验证,如有疏漏欢迎在评论区指正。最后更新:2026年06月20日 14:59

陈默

AI 行业分析师

前某大厂 AI 实验室研究员,关注大模型技术演进和商业化落地。写过 200+ 篇行业分析,擅长从产品视角拆解技术趋势。

读者评论 2

A
AI研究员 昨天
观点有道理,不过我觉得还需要考虑算力成本的问题。
回复 点赞 (11)
M
创业者Mark 4天前
正在做相关方向,这篇文章给了我不少启发。
回复 点赞 (7)