2026年9月18日,阿里巴巴发布Qwen3.8-Omni-Flash,原生全模态模型支持文本、图像、音频、视频输入,API音频输入定价较谷歌Gemini 3.8 Live下降逾98%,视频任务token消耗减少45.7%,29项基准测试平均提升25%。
事实还原
谷歌于2026年9月15日发布Gemini 3.8 Live,并在语音对语音榜单取得领先。阿里巴巴在三天后推出Qwen3.8-Omni-Flash,直接针对音频定价展开竞争。模型支持100万token上下文,视频任务token消耗较此前减少45.7%。
机制拆解
价格战成为本次竞争的核心手段。阿里通过大幅降低音频输入定价,试图在成本层面形成优势。谷歌此前凭借Gemini 3.8 Live占据语音交互领先位置,阿里选择在短时间内以价格反制,体现出对多模态语音AI市场的快速响应。
视频任务token消耗减少45.7%这一事实,显示模型在效率优化上有所进展。29项基准测试平均提升25%,为性能提升提供了量化依据。
产业影响
此次发布可能加剧中美多模态AI领域的价格竞争。音频定价的显著下降,有助于降低开发者接入门槛,但也对其他厂商的盈利模式形成压力。支持100万token上下文的特性,可能推动长上下文应用场景的发展。
战略判断
【分析】价格战可能短期内改变市场份额分布,但长期可持续性取决于模型实际性能与生态建设。Qwen3.8-Omni-Flash的推出,反映出中国企业在多模态领域正通过成本策略加速追赶。未来评测需关注其在真实场景中的表现,以判断是否能持续保持竞争力。
© 2026 Winzheng.com 赢政天下 | 转载请注明来源并附原文链接