判断モデルガイド

Cloudflare Clef。コンテキストを入力し、判断を出力。

Clef は、定義した質問に対して共通の状態を評価し、許可された回答の確率を返します。アプリケーション内の振り分け、分類、チェックに活用できます。

Cloudflare のモデルを紹介するガイドです。以下の例は、ご自身の Cloudflare アカウントを使い、Workers AI で実行します。

1 つの状態から 3 つの判断

受信したサポートメッセージ

「サインインの試行回数が多すぎたため、アカウントがロックされました。会議の前にアクセスを回復する必要があります。」

choice

担当チームを選ぶ

score

順序付きの尺度で緊急度を評価する

noul

アクセスがブロックされているかを推定する

質問の例です。このページでは実際の推論は行いません。

Clef のパラメータ数
27B
Workers AI のコンテキストトークン数
65,536
入力 100 万トークンあたり
$0.24
公開ウェイトのライセンス
Apache-2.0

Workers AI の仕様と料金は 2026年10月3日に確認しました。最新情報は公式ドキュメントをご覧ください。

01 / 仕組み

質問する前に、回答の選択肢を定義する

Clef は Qwen のバックボーンと共通のスキーマヘッドを組み合わせています。中間的なテキスト回答を生成せず、1 回の順伝播で各質問の有効な選択肢をスコアリングします。

choice

カテゴリを選ぶ

名前と説明を付けた選択肢を指定します。選択された項目、信頼度、各選択肢の確率を取得できます。

score

尺度に沿って評価する

順序付きの評価基準を指定します。回答には、0 から始まる各段階の値を確率で重み付けしたスコアが含まれます。

noul

はい/いいえで答える質問をする

true の確率を取得します。アプリケーションのしきい値を設定し、人による結果の確認が必要な条件を決めます。

02 / Clef と Clef-flash

許容レイテンシに応じて選べる 2 つのサイズ

Cloudflare は Clef を精度重視、Clef-flash を時間制約の厳しい判断向けに位置付けています。ご自身のワークフローを代表する例で、両方を評価してください。

モデルバックボーン公表レイテンシ中央値
ClefQwen3.8-27B209.3 ms
Clef-flashQwen3.5-9B38.8 ms

レイテンシの数値は、Cloudflare が公開した社内の Decision Index 評価に基づきます。本番環境でのレイテンシを保証するものではありません。

発表と評価の詳細を読む

03 / Workers AI クイックスタート

状態を送信。質問を定義。回答を取得。

Worker に AI という名前の AI バインディングを追加し、@cf/cloudflare/clef を呼び出します。この例では、同じサポートメッセージの 3 つの側面を評価します。

リクエストの構造

model、state、questions を渡します。Workers AI は 1–64 個の質問を受け付け、同じ質問 ID に対応する回答を返します。

Workers AI での画像入力

ホスト型 API は、埋め込みの PNG、JPEG、WebP 画像を最大 4 枚まで受け付けます。リモート画像の URL は利用できません。ペイロードの制限はリファレンスをご確認ください。

Jev / SystemOne との互換性

Clef は型付きのリクエストと回答の形式に従います。プロバイダーを切り替える際は、認証とエンドポイントを更新し、プロバイダーのレスポンス全体の構造を確認してください。

Workers AI リファレンスを開く
Worker / TypeScript
export default {
  async fetch(request, env) {
    const result = await env.AI.run("@cf/cloudflare/clef", {
      model: "clef",
      state: "My account is locked after too many sign-in attempts.",
      questions: {
        team: {
          type: "choice",
          instructions: "Which team should help?",
          criteria: {
            accounts: "Sign-in and account access",
            billing: "Payments and invoices",
            technical: "Service errors and outages"
          }
        },
        urgency: {
          type: "score",
          instructions: "How urgently does this need attention?",
          criteria: ["Low", "Medium", "High"]
        },
        blocked: {
          type: "noul",
          instructions: "Is account access blocked?"
        }
      }
    });

    return Response.json(result);
  }
} satisfies ExportedHandler<{ AI: Ai }>;

04 / 用途に合った実行環境

ホスト型推論とセルフホスティング

公開ウェイト

Hugging Face の公開モデルには、バックボーンと共通のスキーマヘッドが含まれます。ローカルの画像や動画の入力を含め、セルフホスティングには load_release_model と systemone の例を参考にしてください。

モデルカードを読む

よくある質問

Clef を組み込む前に

Clef はチャットの返信を生成しますか?

Clef は、指定したスキーマの範囲内で判断結果を返します。その回答を次のアクションの選択に利用してください。アプリケーションで文章による返信が必要な場合は、テキスト生成モデルを使います。

ホスト型とローカル環境の入力制限は同じですか?

いいえ。Workers AI ではコンテキストウィンドウが 65,536 トークンと記載され、埋め込み画像の入力が説明されています。ローカルモデルのモデルカードには動画入力の説明もあり、encode_record のデフォルトは 16,384 トークンです。利用する実行環境のドキュメントに従ってください。

Clef は商用利用できますか?

ウェイトは Apache-2.0 で公開されています。セルフホスティングでは同梱のライセンスと通知事項を、ホスト型の利用では Cloudflare のサービス利用規約を確認してください。

返された確率はどのように使えばよいですか?

ご自身のワークフローに沿ったラベル付きの例を使って、しきい値を決めてください。誤ったアクションと見逃したケースを測定し、不確実な判断は代替処理または担当者による確認に回します。