【中信证券前瞻】Claude Opus 5.5与GPT-6 Sol发布速评
【Claude Opus 5.5】
9月22日,Anthropic发布Claude 5.5系列首款模型Opus 5.5。评分方面,Opus 5.5以58分登顶Artificial Analysis智能指数,高于Fable 5.1和GPT-6 Astra(均为53分)。能力方面,多数任务已达到Fable 5.1水平,长程任务表现突出,早期测试中不到一天完成68万行代码迁移。定价方面,API价格降至输入/输出4/20美元/百万token(-20%),缓存读取价格下调60%,叠加token效率提升,典型任务成本较Opus 5下降约40%,API价格较Fable 5.1低约60%。同时,Pro、Max等订阅计划的5小时用量额度也有所上调。
【GPT-6 Sol】
9月22日,OpenAI发布GPT-6 Sol和Luna,二者分别是本月初旗舰模型GPT-6 Astra的中端和轻量版本。评分方面,Sol在Artificial Analysis智能指数中得48分,与GPT-5.6 Sol(47分)基本持平,智能提升有限;DeepSWE v1.1得分68.8%,接近Fable 5,单任务成本低约80%。能力方面,事实性错误较前代减半,编码、电脑操作和沟通风格向Astra看齐。定价方面,API价格降至2/10美元/百万token,较GPT-5.6 Sol促销价再降50%,且为常规定价;缓存命中率提升,缓存读取享受90%折扣。
观点1)迭代节奏上,两家头部厂商同日发布新模型,Anthropic约两个月迭代一代Opus,OpenAI三周内补齐GPT-6系列,发布节奏越来越卷,印证了模型进展在加速而非放缓的判断;2)场景拓展上,通用场景下用户对能力提升的敏感度在下降,更应关注能力再上台阶后新场景突破,测试案例中显示金融研究/知识工作/长程多Agent编码工作能力显著提升,建议关注落地情况;3)定价变化上,Anthropic已下调定价并上调订阅额度,Opus 5.5性能和价格均好于Fable 5.1,可能带动用量由高价模型转向低价模型,闭源模型token价格继续通缩。目前仍属温和降价,可由Infra优化和芯片效率提升对冲,但若后续降价更激烈,可能对毛利率产生负面影响。