AI 模型竞争(AI Model Competition)

跟踪前沿模型之间的能力与价格竞争。更全面的模型版图见 AI-Models-Landscape-2025-2026

[2026-07-20] 剪刀差:能力天花板上探 vs 能力地板商品化

来源:Fable 5 × CursorBench / Kimi K3(2026-07-17/18)。

同一时间窗内,前沿模型竞争沿两个相反方向同时位移:

方向代表信号
能力天花板上探Claude Fable 5CursorBench 最大努力模式 72.9% 新高;从”局部推理”跃迁到”全局推理”(登月测试数小时 vs Opus 12+ 小时无果);“保姆式操作”不再必要
能力地板商品化Kimi K32.8T 参数 / 1M 上下文,智能指数 57(接近 GPT-5.5 / Opus 4.8),约一半成本(单任务 $0.94),前端代码竞技场第一;催化全球算力股重定价(“DeepSeek 2.0”)

核心判断:两端同时位移挤压中间地带,打破了”美国前沿闭源模型享有稳定技术溢价”的预期,市场开始重新评估大模型公司、芯片厂商、数据中心产业链之间的利润分配。注意:商品化压低的是模型服务价格,未必降低芯片长期需求(更便宜模型可能刺激企业扩量)。

评估方法论张力:CursorBench(Cursor 单方内部基准,还原混乱真实提示)与 Artificial Analysis 智能指数(第三方)方法论不同,跨基准分数不可直接通约——比较模型能力时需警惕口径差异。详见 AI Agent Evaluation

相关 Wiki