7月28日,大模型赛道在24小时内迎来多线并进的密集动态。AMD宣布开源其首个自研的16B参数混合专家模型Instella-MoE,采用完全开放的Apache 2.0许可协议。同日,DeepSeek宣布V4模型永久降价至原价的四分之一,Kimi K3以极具竞争力的API价格正式入局,Qwen3.8-Max接棒发布,国产开源模型包揽OpenRouter全球调用量前五。多重事件同时发生,揭示了一个明确的行业趋势:大模型正在全面进入"降价加开放"的新阶段。
AMD的Instella-MoE是本周最受关注的开源动态之一。该模型在AMD自家的MI300X与MI325X加速卡上训练,采用了混合专家架构,在保持模型性能的同时大幅降低了推理成本。AMD选择Apache 2.0许可协议,意味着企业可以自由地用于商业部署和二次开发,无需担心许可费用。这对于正在寻求模型自主可控的企业级用户而言,是一个重要的信号。
DeepSeek V4的永久降价决定成为本周的另一个引爆点。根据官方公告,DeepSeek V4的API调用价格将永久降至原价的四分之一。这是DeepSeek继此前推出峰谷定价策略之后的又一次价格调整,其目标非常明确:以极致性价比在高强度竞争中抢占市场份额。在OpenRouter等第三方平台的数据中,DeepSeek系列的调用量一直位居前列,降价策略有望进一步拉大与竞争对手的差距。
与此同时,Kimi K3以"地板价"API入局也是一大看点。月之暗面在7月28日正式开放Kimi K3的商业化API调用,其定价远低于行业平均水平。加上此前一天公布的开源权重发布计划,Kimi K3正在同时走"开源加低价"两条路线。Hugging Face数据显示,Kimi K3在上线后30分钟内以超过4000个点赞登顶趋势榜,创下了Hugging Face有史以来最快的流行速度记录。
Nebius、Baseten、Fireworks等海外AI基础设施厂商随即宣布Day 0适配Kimi K3。Nebius的官方声明称,Kimi K3是首个达到前沿性能水平的开放权重模型,是开放模型发展历程中的一大进步。华为昇腾CANN也宣布对模型实现Day 0原生支持。
在Kimi K3和DeepSeek V4的持续施压下,阿里云通义千问团队也在加速推进其模型阵容的更新。Qwen3.8-Max作为新一代旗舰模型,将接替此前的主力版本,在中文理解、数学推理和代码生成等关键能力上实现进一步突破。同时,通义千问团队还在推进Qwen系列多模态模型的迭代。
大模型"降价加开放"的双主线,正在快速改变行业格局。OpenRouter平台的调用量数据显示,国产开源模型包揽了全球前五名。这意味着全球开发者选择使用AI模型时,越来越多地将目光投向中国开源模型。对于海外模型厂商而言,这带来了前所未有的竞争压力——既要在性能上保持领先,又要在价格上具有竞争力。
对于企业用户,这意味着前所未有的选择空间和议价能力。在过去一年中,调用同一级别模型的API成本已经下降了超过80%。如果这一趋势持续,大模型能力的获取成本将趋近于零——大模型本身将像电力一样成为通用的基础设施服务。在这种格局下,真正的竞争将从模型能力转向应用层创新和行业解决方案的落地能力。谁能在场景中创造可量化的商业价值,谁就能在下一阶段的竞争中占据主动。
大模型赛道的降价加开放浪潮,正在推动模型层利润空间的大幅压缩,但同时也为应用层创新打开了前所未有的窗口期。当调用顶尖模型的API成本趋近于零,真正的竞争将从"谁有更好的模型"转向"谁有更好的应用场景和用户体验"。这一趋势对于中国的AI产业而言,既是挑战也是机遇。挑战在于模型层的投入回报率在下降,机遇在于凭借庞大的应用市场和丰富的场景数据,中国AI企业有机会在应用层建立起全球领先的竞争优势。2026年下半年,模型开源和API降价将成为常态,而真正拉开差距的将是产品和生态。从开发者生态来看,降价加开放的浪潮正在培育一个更加活跃和多样化的AI应用开发生态。当模型调用成本降至足够低时,更多开发者愿意尝试将AI集成到他们的产品中,从而催生出更多创新的AI应用。这一正反馈循环将推动整个AI产业的持续繁荣和创新。
从全球视角来看,中国开源大模型正在以前所未有的速度获得国际开发者的认可。OpenRouter数据显示国产开源模型包揽全球调用量前五,这一事实本身就说明了中国AI技术在国际市场上的竞争力正在快速提升。降价加开放的双主线策略,正在帮助中国AI企业在全球市场中建立更大的话语权。
在全球AI产业格局加速重构的大背景下,中国大模型厂商以降价加开放策略快速拓展市场的趋势不可逆转。2026年下半年,模型层竞争的焦点将从单纯的参数规模和基准分数,转向推理效率、生态兼容性和场景适配能力。在企业级市场中,能够同时提供极致性价比和可控数据安全的模型供应商,将获得更多长期客户。