# Cloudflare发布面向AI智能体的开放权重决策模型

> Cloudflare推出的Clef模型可对文本、JSON、图像或视频进行分类，并输出结构化决策；9B版本的延迟低于40 ms。

Oossa · 2026-10-08 · https://oossa.com/zh/cloudflare-releases-open-weight-decision-models-for-ai-agents

2026年10月8日，在“Birthday Week”活动期间，Cloudflare宣布推出Clef系列模型。这两款开放权重模型专为决策而非文本生成打造。Cloudflare通过Workers AI提供一款270亿参数的多模态模型和一款较小的90亿参数版本Clef‑Flash，用户也可从Hugging Face下载模型权重。

## 模型如何运作

Clef接收状态描述和一组带类型的问题模式作为输入，并为每个允许的选项返回一个概率。它可在一次前向计算中处理文本、JSON、图像或视频，无需额外解析自由格式输出。27B模型的上下文窗口为64 k tokens，是Typesafe的Jev等同类模型的两倍。

## 性能与获取方式

Cloudflare表示，在其自有基准测试中，9B版Clef‑Flash的延迟中位数为38.8 ms，较大的27B模型则为209.3 ms。由于这些模型运行在Cloudflare的边缘GPU上，该公司预计它们在关键路径决策中的网络延迟较低。开发者可以使用一项新服务，以自己的数据微调模型；该服务初期会提供工程师支持，之后将开放自助使用。

## 事实

- Cloudflare于2026年10月8日在“Birthday Week”活动期间发布了这一消息。
- Clef有270亿参数和90亿参数（Clef‑Flash）两个版本。
- 在Cloudflare的基准测试中，Clef‑Flash的延迟中位数为38.8 ms，27B模型的延迟为209.3 ms。
- 这些模型支持文本、JSON、图像和视频，并会为预设选项输出概率。
- 用户可通过Workers AI使用Clef模型，也可从Hugging Face下载模型权重。

## 为什么重要

对于开发AI智能体的开发者，Clef提供了一种开箱即用的方式，可快速做出结构化决策，无需自行编写解析器。9B模型的低延迟适用于工单分流、机器人流量过滤等实时任务；开放权重也让团队能够用自己的数据调整模型。

## 来源与参考

1. [Cloudflare Open Sources Decision Models for AI Agents](https://www.infoq.com/news/2026/10/clef-decision-models/?utm_campaign=infoq_content&utm_source=infoq&utm_medium=feed&utm_term=AI%2C+ML+%26+Data+Engineering) – InfoQ, 2026-10-08

最后更新: 2026-10-08
