首页 > 开源 > Cloudflare 让决策模型打起了价格战:Clef 降价、提速、上多模态

Cloudflare 让决策模型打起了价格战:Clef 降价、提速、上多模态

OSChina资讯 2026-10-10 16:25 5 阅读 查看原文

Cloudflare 今天把三件事打包放出来了:一个新的多模态决策模型 Clef-omni,一个变便宜了的 Clef-flash,还有一个变快了的 Clef。官方博客标题写得很直白——『faster, cheaper, multimodal』。

Clef-omni 是 Clef 系列里第一个能吃音频、视频、图像和文本的决策模型。它基于开源的 Qwen3-Omni-30B-A3B-Instruct(MoE 底座),砍掉了 TTS 组件,用 LoRA 在冻结的 Qwen3 backbone 上做后训练,专门输出校准概率而不是生成文本。延迟数字:文本约 130ms,图像约 150ms,一条 21 秒的视频约 1.5 秒。定价每百万输入 token 0.15 美元。

Clef-flash 的降价更直接:输入 token 每百万从 0.09 降到 0.038 美元——比之前几天刚刷屏的 Jev 还便宜,在决策模型这条新赛道上一下就成了价格最低的那一档。代价是托管版的上下文窗口从 64k 砍到 24k,但如果自己部署,Hugging Face 上的权重不受影响,仍然是 256k。官方给的理由是只有 0.24% 的请求会超过 24k,砍掉这部分内存就能把成本降下来。

Clef 本体在 Workers AI 上提速:约 800 tokens 的请求延迟从 262ms 降到 152ms(1.7x),约 3,400 tokens 从 616ms 降到 305ms(2.0x),约 16,000 tokens 从 2721ms 降到 1635ms(1.7x)。这些模型全部开源权重,跑在 Cloudflare 自己的 Workers AI 上。

把三件事放一起看,决策模型这条赛道的竞争逻辑已经很清楚了:TypeSafe 拿到 75 亿美元估值、微软发专攻评分的 Decision-1、Cloudflare 这边直接拼价格和部署自由。Clef 从一开始就是 Cloudflare 给自己 agent 生态准备的『判断单元』,现在它把这个单元做得更快、更便宜,还补上了多模态输入——此前有观点指出『决策模型正在变成独立于 LLM 的赛道』,这条赛道现在的价格战已经打起来了。

来源: