导语
Cursor发布了其第二代软件开发AI模型Composer 2。该模型旨在以极低的成本,与Anthropic和OpenAI等领先的代码模型相匹敌。
该模型目前已在Cursor及其全新“Glass”界面的早期Alpha版本中推出。定价为每百万输入Token 0.50美元,每百万输出Token 2.50美元。Cursor表示,速度更快的版本在智能方面表现相同,但成本分别为每百万Token 1.50美元和7.50美元,并作为默认版本提供。
仅从API定价来看,Cursor Composer 2远低于Claude Opus 4.6和GPT-5.4。即使是速度更快的版本,其Token成本也远低于这两个竞争对手。
核心信息
联合创始人Aman Sanger告诉彭博社,该模型完全使用代码数据进行训练。这种专注使其能够构建一个更小、更具成本效益的模型。Sanger表示:“它帮不了你报税,也写不了诗。”
Cursor表示,与前代产品相比,其质量提升得益于更强大的持续预训练第一阶段,这为随后的强化学习奠定了更好的基础。训练在所谓的“长周期编码任务”上进行,这些编程挑战需要数百个独立操作才能完成。
Cursor公布的数据显示,与早期Composer版本相比,Composer 2取得了显著飞跃。在CursorBench(该公司针对编码任务的内部基准测试)上,Composer 2从Composer 1.5的44.2分提升至61.3分。该模型还在Terminal Bench 2.0(针对终端中基于代理任务的基准测试)和SWE-bench Multilingual(测试多种编程语言的软件工程任务)上取得了进展。
更多细节
Terminal Bench 2.0的得分并非完全可比,因为结果也取决于代理、运行环境和设置。对于Claude Opus 4.6,Claude Code的评分为58.0;Anthropic发布了一个额外的优化值为65.4。对于GPT-5.4 Thinking,只有一个已发布的Terminal Bench值可用。
Cursor直接与Anthropic和OpenAI竞争,两者都在推出日益强大的软件开发AI模型。据彭博社报道,Cursor目前拥有超过一百万的日活跃用户和约5万家企业客户。该公司还在就一轮估值约500亿美元的新融资进行谈判。
与此同时,Cursor面临着一个结构性困境。该平台仍然支持OpenAI和Anthropic的模型,这意味着它正在与自己所依赖的技术提供商竞争。只要Cursor购买第三方模型,其定价、性能和利润都将取决于那些直接向相同客户销售产品的公司。
影响与观察
特别是Anthropic,正凭借Claude Code在编码市场积极布局。据Cursor估计,单个Claude Code订阅每月200美元,实际计算成本可能高达约5000美元。这凸显了结构性问题:当你基于他人的模型进行开发时,你正在为计算资源支付全价,而模型提供商可以在其自有产品中大幅补贴这些成本。



