美企用上中国开源AI模型,成本直接砍一半
来源:龙灵发布时间:2026-06-29362浏览
询问 AI据报道,美国部分科技企业正逐步将中国开源人工智能模型引入其生产基础设施中,以此来降低运营成本并拓展应用范围。加密货币交易所Coinbase首席执行官Brian Armstrong透露,该公司已将智谱最新推出的GLM 5.2以及北京月之暗面(Moonshot AI)的Kimi 2.7设置为内部研发人员的默认大语言模型。
Brian Armstrong指出,由于美国顶尖模型的服务费用不断上涨,Coinbase通过引入上述中国开源模型处理常规任务,并在复杂规划场景中保留前沿模型,成功将人工智能相关支出降低了近50%,同时Token消耗量依然保持指数级上升。在代码审查方面,该公司还采取了多模型并行机制,通过不同模型交叉验证输出来保障代码质量。
据透露,此次成本的大幅下降主要得益于三项基础设施的优化。一是“智能路由”机制,系统会对提示词进行预处理,并根据缓存命中率和模型价格自动分配任务;二是“积极缓存”策略,通过赋予所有请求缓存感知能力,使LibreChat的缓存命中率由5%大幅提升至60%;三是“精简上下文”方法,建议在切换任务时新建会话并缩小文件范围,从而减少无效的Token消耗。
Brian Armstrong强调,这些举措的核心目的并非限制资源使用,而是为了推动人工智能技术的规模化应用。通过这种模式,企业能够在不限制成本上限的前提下,让工程师自由调用各类模型和Token,并将资源消耗与实际业务产出紧密结合,从而实现人工智能应用的可持续扩展。
新闻来源:龙灵,文中所述为作者独立观点,不代表icspec立场。更多精彩资讯请下载icspec App。如对本稿件有异议,请联系微信客服specltkj。