Claude Opus 5.5对决Fable 5.1:更低价码与编程基准领先,高端定位仍存疑问
Anthropic于九月二十二日发布Claude Opus 5.5,称其在多数工作上接近Claude Fable 5.1,而标价每token成本不到后者一半:Opus 5.5输入与输出分别为每百万token四美元与二十美元,Fable 5.1则为十美元与五十美元。官方称Opus 5.5在Terminal-Bench 4.0、FrontierCode与CursorBench上领先,但也表示两模型差距比这些分数看起来更窄;其文档仍将Fable 5.1指向“高要求推理与长程智能体工作”,并标注其更慢。作者通过Anthropic接口以相同提示、自适应思考与最高effort对各模型各跑五次,记录token、标价成本与墙钟时间,并用隐藏测试集评分,重点检验编程任务:修复含四个植入缺陷与一个不稳定测试的订单定价仓库、按两页规格编写虚构包管理器的依赖解析器、以及在不运行代码的情况下定位并修复异步任务队列中的三处竞态条件。作者拟回答Opus 5.5是否真与Fable 5.1一样准确,以及后者是否仍应作为这些任务上的高端型号销售。
