클라우드플레어, 음성·영상 판정 AI 공개…저가형은 가격 내리고 입력 한도 줄여
클라우드플레어가 음성·영상을 함께 처리하는 판정형 AI 클레프 옴니를 공개했다. 클레프 플래시는 가격을 낮추는 대신 서비스 입력 한도를 축소했다.

클라우드플레어가 9일 음성·영상을 문자·이미지와 함께 받아 정해진 선택지를 평가하는 AI 모델 ‘클레프 옴니’를 공개했다. 함께 가격을 낮춘 ‘클레프 플래시’는 회사가 운영하는 서비스의 입력 한도가 줄었다.
클레프 옴니는 질문과 선택지를 미리 지정하면 각 답의 확률을 반환하는 판정형 모델이다. 대화문이나 영상 설명을 자유롭게 생성하는 제품은 아니다. 클라우드플레어의 개발 문서에는 이미지 최대 4개, 음성 파일 최대 4개, 영상 최대 2개를 한 요청에 넣을 수 있다고 적혀 있다. 원격 URL 대신 데이터를 요청에 포함해야 하며 파일 크기와 재생시간에도 제한이 있다.
공개 가중치와 서비스는 구분
회사는 이 모델을 자사 워커스 AI에서 제공하며, 허깅페이스에도 가중치를 공개했다. 허깅페이스의 모델 카드에는 중국 알리바바 계열 큐원의 Qwen3-Omni-30B-A3B-Instruct를 토대로 추가 학습했다고 명시돼 있다. 공개 가중치가 있다는 사실과 자체 서버에서 같은 성능·속도를 낼 수 있다는 주장은 다르다. 모델 카드가 제시한 자체 실행 환경은 고용량 GPU가 필요한 구성이다.
클라우드플레어는 클레프 옴니의 서비스 가격을 입력 토큰 100만 개당 0.15달러로 안내한다. 영상·음성도 입력 토큰으로 환산돼 과금되므로 문자만 보낼 때와 사용료가 달라질 수 있다.
싼 모델의 입력 길이는 축소
기존 클레프 플래시의 서비스 가격은 입력 토큰 100만 개당 0.09달러에서 0.038달러로 낮아졌다. 대신 한 번에 처리할 수 있는 문맥 길이는 6만4000토큰에서 2만4000토큰으로 축소됐다. 회사는 직접 운영하는 공개 가중치에는 변경이 없다고 설명했다.
클라우드플레어가 제시한 처리 속도와 성능 수치는 자체 측정 결과다. 9일자 회사 블로그와 개발자 변경 기록에 실린 클레프 옴니의 응답시간 수치도 서로 달라, 이를 검증된 실사용 속도로 제시하기 어렵다. 회사 자료만으로는 실제 음성·영상 업무에서의 정확도나 비용 절감 효과가 독립적으로 확인되지 않았다.
대표 이미지: AI 생성 이미지 / 데이마크
자료: https://blog.cloudflare.com/clef-faster-cheaper-multimodal/ ; https://developers.cloudflare.com/changelog/post/2026-10-09-clef-omni-workers-ai/ ; https://developers.cloudflare.com/workers-ai/models/clef-omni/ ; https://huggingface.co/Cloudflare/clef-omni


