Oossa

Cloudflare, AI 에이전트용 오픈 웨이트 의사결정 모델 공개

Cloudflare의 새 Clef 모델은 텍스트, JSON, 이미지, 동영상을 분류해 구조화된 결정을 내린다. 9B 버전의 지연 시간은 40ms 미만이다.

작성: Oossa 게시일: 1 분 읽기

Growtika · Unsplash

Cloudflare는 2026년 10월 8일 ‘Birthday Week’ 행사에서 텍스트 생성보다 의사결정에 초점을 맞춘 오픈 웨이트 모델 제품군 Clef를 발표했다. 270억 개 파라미터를 갖춘 멀티모달 모델과 Clef‑Flash라는 이름의 90억 개 파라미터 모델을 공개했으며, 두 모델은 Workers AI에서 이용할 수 있고 Hugging Face에서 가중치를 내려받을 수도 있다.

모델 작동 방식

Clef는 상태 설명과 유형이 지정된 질문으로 구성된 스키마를 입력받아, 허용된 각 선택지의 확률을 반환한다. 한 번의 순전파로 텍스트, JSON, 이미지, 동영상을 처리하므로 자유 형식 출력물을 별도로 파싱할 필요가 없다. 27B 모델의 컨텍스트 창은 64k 토큰으로, Typesafe의 Jev 같은 비슷한 모델보다 두 배 길다.

성능 및 이용 방법

Cloudflare에 따르면 자체 벤치마크에서 9B Clef‑Flash 모델의 중앙값 지연 시간은 38.8ms이며, 더 큰 27B 모델은 209.3ms를 기록했다. 모델이 Cloudflare의 엣지 GPU에서 실행되므로, 회사는 지연 시간이 중요한 의사결정 작업에서 네트워크 지연도 낮을 것으로 기대한다. 개발자는 엔지니어 지원으로 시작해 나중에는 셀프서비스 방식으로 전환될 새 서비스를 이용해 자체 데이터로 모델을 미세 조정할 수 있다.

왜 중요한가

AI 에이전트를 만드는 개발자는 Clef를 활용해 별도의 파서를 직접 작성하지 않고도 빠르고 구조화된 의사결정 기능을 구현할 수 있다. 9B 모델의 짧은 지연 시간은 고객 지원 티켓 분류나 봇 트래픽 필터링 같은 실시간 작업에 적합하며, 오픈 웨이트 공개로 각 팀은 자체 데이터에 맞춰 모델을 조정할 수 있다.

이 기사가 도움이 되었나요?
공유

다음 읽을거리

Oossa · 뉴스레터

이번 주 AI, 쉽게 정리

매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.