8 октября 2026 года, во время «Birthday Week», Cloudflare представила Clef — две модели с открытыми весами, предназначенные для принятия решений, а не генерации текста. Компания открыла доступ к мультимодальной модели с 27 млрд параметров и более компактной версии с 9 млрд параметров под названием Clef‑Flash: обе доступны через Workers AI, а их веса можно скачать на Hugging Face.
Как работают модели
На вход Clef получает описание ситуации и схему типизированных вопросов, а на выходе возвращает вероятность для каждого допустимого варианта ответа. Модель обрабатывает текст, JSON, изображения и видео за один проход, поэтому дополнительно разбирать текстовый ответ в свободной форме не нужно. Контекстное окно модели 27B вмещает 64 k токенов — вдвое больше, чем у сопоставимых моделей, например Jev от Typesafe.
Производительность и доступ
По данным Cloudflare, медианная задержка Clef‑Flash 9B в собственных тестах компании составляет 38.8 мс, а у более крупной модели 27B — 209.3 мс. Поскольку модели работают на периферийных графических процессорах Cloudflare, компания рассчитывает на низкую сетевую задержку при принятии решений в критически важных процессах. Разработчики смогут дообучать модели на собственных данных с помощью нового сервиса: сначала с поддержкой инженеров, а позднее — самостоятельно.
Почему это важно
Разработчики ИИ-агентов могут использовать Clef для быстрого принятия структурированных решений, не создавая собственные парсеры. Низкая задержка модели 9B подходит для задач реального времени — например, распределения обращений в поддержку или фильтрации бот-трафика. Благодаря открытым весам команды смогут адаптировать модель под собственные данные.