核心摘要
- GPT-6 Sol、Luna,Opus 5.5发布
- 两个数字的比较基准并不相同
- 能否按任务类型分开使用不同模型
- 先统计大批量任务所占比重
OpenAI于2026年9月22日(当地时间)发布了API价格较GPT-5.6促销价降低50%的GPT-6 Sol与Luna,Anthropic同日发布了运营成本较Opus 5降低约40%的Claude Opus 5.5。
两家公司分别推出了什么
- GPT-6 Sol:在OpenAI GPT-6系列中,是次于最高端模型“Astra”的下一级模型,专注于编码等复杂任务。
- GPT-6 Luna:专为快速处理信息提取、文档摘要等大批量任务而设计。
- Claude Opus 5.5:Anthropic Claude 5.5系列的最新模型,Anthropic表示通过提升token效率,运营成本较此前的Opus 5降低了约40%。
Anthropic产品管理、研究与实验室部门负责人黛安·彭(Diane Penn)表示:“我们持续创新的领域之一,就是如何让思考和回答变得更高效”,并说明可根据用户设置的思考水平来减少所使用的token数量。
为何会掀起价格战
据《Financial News》报道,尽管业界存在为保障AI安全应放慢尖端模型开发速度的呼声,但企业客户对AI支出增加感到负担,正要求以更低成本完成相同任务的模型。阿里巴巴、月之暗面(Moonshot AI)、DeepSeek等中国企业相继推出相对低价的开源权重模型,也被认为是促使两家公司降价并提升token效率的背景因素之一。
对韩国企业AX的启示
这两个数字的基准并不相同。OpenAI所称的50%是相对于GPT-5.6促销价的API价格降幅,而Anthropic所称的约40%则是通过提升token效率而降低的运营成本。将海外发布的数据套用到国内预算规划时,最好先厘清这究竟是单价下调,还是完成同一任务所需token数量减少。
OpenAI将模型分为面向复杂任务(Sol)和面向大批量任务(Luna)的做法,可以理解为一种按任务单位选择模型的信号。如果企业内部目前用同一模型来处理编码辅助和文档摘要工作,不妨比较一下按任务分别分配模型后成本会有何变化。Anthropic提到的思考水平设置也是同样的思路,如果已经在使用其API,仅确认当前设置值也可作为成本判断的起点。
本周需要确认的事情只有一件:请统计一下企业内部AI调用中,信息提取、文档摘要等大批量任务所占的比重。
