2026年10月8日,在“Birthday Week”活动期间,Cloudflare宣布推出Clef系列模型。这两款开放权重模型专为决策而非文本生成打造。Cloudflare通过Workers AI提供一款270亿参数的多模态模型和一款较小的90亿参数版本Clef‑Flash,用户也可从Hugging Face下载模型权重。
模型如何运作
Clef接收状态描述和一组带类型的问题模式作为输入,并为每个允许的选项返回一个概率。它可在一次前向计算中处理文本、JSON、图像或视频,无需额外解析自由格式输出。27B模型的上下文窗口为64 k tokens,是Typesafe的Jev等同类模型的两倍。
性能与获取方式
Cloudflare表示,在其自有基准测试中,9B版Clef‑Flash的延迟中位数为38.8 ms,较大的27B模型则为209.3 ms。由于这些模型运行在Cloudflare的边缘GPU上,该公司预计它们在关键路径决策中的网络延迟较低。开发者可以使用一项新服务,以自己的数据微调模型;该服务初期会提供工程师支持,之后将开放自助使用。
为什么重要
对于开发AI智能体的开发者,Clef提供了一种开箱即用的方式,可快速做出结构化决策,无需自行编写解析器。9B模型的低延迟适用于工单分流、机器人流量过滤等实时任务;开放权重也让团队能够用自己的数据调整模型。