OpenAI拟终止Cursor模型直连合作

Latent Space19 天前

OpenAI拟终止与Cursor的模型直连合作

Cursor被SpaceX收购后,OpenAI宣布计划结束双方合作。按照OpenAI提出的方案,Cursor对OpenAI模型的直接访问将于11月12日终止。

OpenAI给出的主要理由是,其过去与埃隆·马斯克旗下公司在合同履行方面存在争议。此次决定也意味着,长期存在于相关公司和管理层之间的竞争关系,开始直接影响AI开发工具的模型供应链。

Cursor:OpenAI模型约占5%流量

Cursor方面的回应相对克制。其表示,OpenAI模型目前大约占Cursor用户流量的5%,同时正在与OpenAI团队沟通,希望解决这一问题。

因此,目前更准确的表述是OpenAI已经提出终止直接访问的计划,而不是Cursor已经无法使用OpenAI模型。最终执行方式以及双方是否会达成新的安排,仍有待后续确认。

这件事值得关注的地方,在于AI编程工具与基础模型厂商之间的关系正在发生变化。过去,Cursor可以同时接入不同厂商的模型,让用户根据任务选择模型;随着模型厂商自身的编程产品不断增强,这种合作关系也可能逐渐转向直接竞争。

编程模型竞争进一步加剧

相关动态发生时,OpenAI与马斯克旗下AI业务都在强化编程能力。报道认为,GPT-5.6已经成为Claude 5系列在编程场景中的有力竞争者,而Grok 4.6也在加强代码能力。这使模型厂商与AI编程工具之间的竞争边界更加复杂。

从Cursor披露的约5%流量占比来看,即使OpenAI最终停止直接模型访问,对Cursor整体模型调用量的影响可能相对有限;但对于习惯在Cursor中使用OpenAI模型的开发者而言,工作流仍可能受到影响。

开源模型继续向大规模MoE和长上下文发展

同期AI模型领域还有多项值得关注的更新:

  • GLM-5.3开放权重,定位包括智能体编程和网络防御。相关部署信息显示,其规模为744B总参数、40B激活参数,支持100万上下文和最高128K输出
  • Hy4-preview采用770B总参数、49B激活参数的MoE架构,同样支持100万上下文。相关测试信息显示,其代码能力相比上一代有明显提升。
  • Qwen3.8-Flash采用125B总参数、6B激活参数设计,支持100万上下文和多模态。部分实际使用反馈指出,FP8环境下的多轮任务稳定性可能受到KV Cache配置影响,切换至BF16 KV后有所改善。

这些更新延续了当前模型发展的几个明显方向:更大的MoE总参数规模、更低的实际激活参数、更长的上下文,以及针对代码和Agent任务的强化。

推理优化不再存在统一答案

在模型推理方面,针对MTP、EAGLE-3、DFlash、DSpark等推测解码方案的测试显示,不同方法在不同模型、工作负载和推测深度下表现并不一致。

这意味着推测解码更适合作为持续调优的工程参数,而不是打开一个开关就能获得固定收益的通用能力。模型类型、硬件平台、任务特征和推测深度都可能影响最终吞吐与延迟表现。

Agent正在从本地工具走向云端运行环境

另一个明显趋势是,AI Agent开始从单纯的本地CLI工具向云端常驻环境发展。共享上下文、长期记忆、服务集成、日志访问以及跨设备恢复任务,正在成为新的产品能力。

相关产品已经开始增加远程控制、会话恢复和更丰富的应用上下文能力。与此同时,一种更加模块化的架构正在出现:将Agent拆分为运行时、路由器、插件和模型等不同层,而不是把全部能力封装在一个单体Agent应用中。

如果这一方向持续发展,未来开发者选择AI编程工具时,比较的可能不再只是“哪个模型代码能力更强”,还包括模型切换能力、Agent运行环境、上下文管理、插件生态以及不同模型厂商之间的兼容性。

评论

请登录后发表观点

暂无数据