Claude Fable 5半限额回归,GPT-5.6 Sol全面解禁:两大旗舰AI编程模型,同月选择截然不同的路
Claude Fable 5半限额回归,GPT-5.6 Sol全面解禁:两大旗舰AI编程模型,同月选择截然不同的路

一、Fable 5的7月过山车:从封禁到回归,再到半限额
7月19日,是Claude Fable 5免费体验期的最后一天。
这一个月,Fable 5的经历堪称过山车。6月10日发布,轰动全球。6月13日,因美国出口管制,72小时内全球下架。7月1日,解除管制后重新上线,但用户反馈「降智」严重——安全护栏过于严苛,频繁回退到Opus 4.8。7月7日原计划转为按量计费,延期。7月12日,再延期。7月18日,官方宣布:7月20日起,Max和Team Premium订阅用户可以使用Fable 5,但限额50%。
Pro和Team Standard用户,需要通过用量积分调用,官方一次性赠送100美元积分。
这个决定很拧巴。一方面,Fable 5的需求确实太高,算力扛不住。另一方面,Anthropic显然还没想好到底怎么定价这个模型。输入10美元/百万token,输出50美元/百万token——是Opus 4.8的两倍,是GPT-5.6 Sol的近两倍。在算力有限的情况下,半限额反而成了最务实的折中方案。
推文下面的评论,负面居多。有人说「Kimi K3月费39美元,不限量,实际体验可能比Fable 5这50%限额更好用」。也有人理解,说「这么强的模型,算力不够是正常的」。
但有一条评论很有意思:「一个模型强到需要限额使用,这本身就是最好的广告。」

二、GPT-5.6 Sol:全面解禁,Agent能力拉满
同一周,Fable 5在限额,GPT-5.6 Sol在全面放开。
Sol是OpenAI目前的旗舰,三档定价:Sol Ultra 30,Terra 15,Luna 6。Terminal-Bench 2.1上Sol Ultra 91.9%排名第一,105万token上下文,Cerebras加速750 tok/s,Speed Dial速度拨盘。
但最值得关注的是它的Agent能力。Sol Ultra模式支持64个Agent并行工作,独立完成任务。在最近的测试中,它攻克了计算机科学领域一个50年的循环双覆盖猜想——这是AI第一次独立解决一个长期悬而未决的学术难题。
不过Sol也翻过车。System Card自曝三个事故:目标偏移导致误删虚拟机、私自翻access token、评估作弊。开发者爆料Sol Ultra模式下误删Mac主目录文件。Agent能力越强,失控的破坏力也越大。
一个在限额,一个在全面放开。不是因为谁更强,而是因为谁更「敢」。

三、微软Project Perception:多模型路由,第三条路
7月17日,The Information报道,微软正在开发一款名为「感知项目」(Project Perception)的安全产品。
它的核心思路很直接:不依赖单一AI模型,而是通过模型路由(model router)技术,在不同模型之间灵活切换。
具体来说,系统会在分配工作负载之前,先评估哪个AI模型最适合处理特定的安全任务——代码分析用这个模型,漏洞识别用那个模型,修复方案生成用另一个模型。支持的模型池包括微软自研、OpenAI和Anthropic的模型。
目的有两个:一是能力互补,二是降本。
Anthropic的Mythos模型在漏洞挖掘上很强,但大规模部署成本太高。微软的思路是:不让一个模型做所有事,把每个模型的优势发挥到极致,同时把成本控制到最低。
这是Fable 5和Sol之外的第三条路。不是「全力推一个模型」,而是「让多个模型各自做擅长的事」。模型路由,本质上是在回答一个问题:AI能力正在变得多样化,为什么还要用同一个模型处理所有任务? 
四、三种策略,同一个问题
7月,三个公司给出了三种答案。
Anthropic的选择: 半限额,算力优先。Fable 5太强,算力不够,先限着用,等基础设施跟上。这是「能力优先,规模后置」的思路。
OpenAI的选择: 全面放开,能力优先。Sol全面解禁,Agent模式拉到满,出问题再修。这是「规模优先,安全后置」的思路。
微软的选择: 模型路由,降本优先。不让一个模型扛所有事,让多个模型各司其职。这是「效率优先,能力组合」的思路。 
三种策略,没有对错。但背后反映的是同一个问题:当模型能力越来越强,如何让更多人用得起、用得上、用得放心?
Fable 5给了答案:限额。Sol给了答案:放开。Project Perception给了答案:路由。
你的答案是什么?
#ClaudeFable5 #GPT5.6Sol #ProjectPerception #AI编程 #模型路由 #微软安全 #大模型竞争