choice选择类别
提供带描述的命名选项,读取选中的选项、置信度及每个选项的概率。
决策模型指南
Clef 根据你定义的问题评估共享状态,返回各个允许答案的概率,可用于应用中的路由、分类和条件检查。
本页介绍 Cloudflare 的模型。下方示例需要使用你的 Cloudflare 账户在 Workers AI 上运行。
收到的客服消息
“多次登录失败后,我的账户被锁定了。我需要在开会前恢复访问。”
choice选择负责处理的团队
score按有序等级评估紧急程度
noul估计账户访问是否受阻
仅展示问题设计,此处不执行实时推理。
Workers AI 规格和价格核对于 2026 年 10 月 3 日,更新信息请查阅官方文档。
01 / 工作原理
Clef 将 Qwen 骨干模型与联合 schema 预测头结合,通过一次前向计算为各问题的有效选项评分,无需生成中间文本。
choice提供带描述的命名选项,读取选中的选项、置信度及每个选项的概率。
score提供有序的判断标准,模型返回基于从 0 开始的等级计算的概率加权分数。
noul读取结果为真的概率,由应用设定判断阈值,并决定何时交由人工复核。
02 / Clef 与 Clef-flash
Cloudflare 将 Clef 定位于重视准确性的任务,Clef-flash 则侧重时效性。请用实际业务中的代表性样本评估两者。
| 模型 | 骨干模型 | 公布的中位延迟 |
|---|---|---|
| Clef | Qwen3.8-27B | 209.3 毫秒 |
| Clef-flash | Qwen3.5-9B | 38.8 毫秒 |
延迟数据来自 Cloudflare 公布的内部 Decision Index 评测,不代表生产环境的延迟保证。
阅读发布文章与评测说明03 / Workers AI 快速上手
为 Worker 添加名为 AI 的 AI binding,然后调用 @cf/cloudflare/clef。示例从三个角度评估同一条客服消息。
传入 model、state 和 questions。Workers AI 支持 1–64 个问题,答案沿用请求中的问题 ID。
托管 API 最多接受四张内嵌 PNG、JPEG 或 WebP 图片,不接受远程图片 URL。具体请求体限制请查阅参考文档。
Clef 遵循类型化请求和答案格式。切换服务商时,需要更新鉴权方式和端点,并检查服务商对响应的封装结构。
export default {
async fetch(request, env) {
const result = await env.AI.run("@cf/cloudflare/clef", {
model: "clef",
state: "My account is locked after too many sign-in attempts.",
questions: {
team: {
type: "choice",
instructions: "Which team should help?",
criteria: {
accounts: "Sign-in and account access",
billing: "Payments and invoices",
technical: "Service errors and outages"
}
},
urgency: {
type: "score",
instructions: "How urgently does this need attention?",
criteria: ["Low", "Medium", "High"]
},
blocked: {
type: "noul",
instructions: "Is account access blocked?"
}
}
});
return Response.json(result);
}
} satisfies ExportedHandler<{ AI: Ai }>;常见问题
Clef 返回受你定义的 schema 约束的决策。可以用这些答案选择下一步动作;应用需要书面回复时,应使用文本生成模型。
不同。Workers AI 列出 65,536 token 的上下文窗口,并提供内嵌图片输入说明。本地模型卡还介绍了视频输入,encode_record 默认限制为 16,384 token。请以实际部署方式对应的文档为准。
权重以 Apache-2.0 许可证发布。自行部署时请阅读随附许可证和声明;使用托管服务时请查阅 Cloudflare 的服务条款。
使用业务中的已标注样本来选择阈值,衡量错误执行与遗漏情况,并将不确定的决策交给备用流程或人工复核。