Decisions API · 聚合多种决策模型 · 一个 PLAYGROUND 与 API

Decisions API,让应用的下一步有据可依。

在 Decisions API 一站体验多种决策模型。在 Playground 比较 Jev、Laya、Kev、Solar 和 Span,再通过 API 将文本分类、评分和路由接入应用。新账户赠送 100 credits。

结果样例 · 查看不消耗积分

“今天早上被重复扣款了,请今天帮我退回多扣的款项。”

一段输入 → 多个结构化判断

分类选择

账单问题

分配至账单处理队列

是非判断

96%

请求紧急处理的概率

量表评分

2.8 / 3

紧急程度,范围 0–3

此处仅演示输出格式,数值并非实时模型结果,也不代表准确率。

01 / WORKBENCH

Decisions API 在线工作台

在 Decisions API 预览任务、选择模型并编辑输入,登录后即可使用积分运行。每个新账户一次性获得 100 credits。

决策工作台

你想判断什么?

选择场景即可加载输入与规则,加载示例不消耗积分。

Kev 4B · 模型与价格 ↗Span · 行为评估 ↗

各问题独立评估的文本或 JSON 上下文。

问题 1/8

Which team should handle this ticket? Use other when no option fits.分类选择

选项

积分预算上限: 1 credits

运行前预留此额度,成功后按实际用量结算并退回差额;失败请求退回积分。

新账户一次性赠送 100 credits。短请求通常消耗 1 credit,较长输入可能消耗更多。

新用户赠送 100 credits · 网页与 API 共用余额

草稿保存在当前浏览器 · 登录后会恢复当前草稿。

结果样例 · 查看不消耗积分

“今天早上被重复扣款了,请今天帮我退回多扣的款项。”

一段输入 → 多个结构化判断

分类选择

账单问题

分配至账单处理队列

是非判断

96%

请求紧急处理的概率

量表评分

2.8 / 3

紧急程度,范围 0–3

此处仅演示输出格式,数值并非实时模型结果,也不代表准确率。

登录后会恢复当前草稿。

认识决策模型生态

让“做判断”成为软件可以调用的接口。

许多 SaaS 和 Agent 工作流需要选择类别、工具或下一步动作。Decisions API 把上下文与边界明确的问题转换成代码可以使用的结果。在 Decisions API 中,可以先用已支持的模型体验这种流程,再接入自己的应用。

  1. 01

    提供上下文

    消息、规则、记录或应用当前的状态。

  2. 02

    定义问题

    明确要做的判断、候选答案或评分标准。

  3. 03

    查看结构化结果

    检查答案,以及模型提供的概率信号。

  4. 04

    决定下一步

    按自己的规则分流、评分或提交审核。

生态动态 · 2026 年 9 月 30 日

OpenAI Decisions API 加入决策模型话题

9 月 29 日 DevDay 的报道介绍了处于 limited preview 的 OpenAI Decisions API:使用 GPT-6 Luna 特化版本,依据文本或图片上下文完成有限决策。报道中的约 150 ms 来自演示,不是生产 SLA。

阅读发布报道 · 非官方文档

它与 Jev 有什么不同?先看三个仍待确认的重点:正式 schema、价格、概率校准。Jev 已公开 Noul、Choice 和 Score 的文档;对比页会区分官方依据与预览报道。

查看 OpenAI Decisions API 与 Jev 对比

Decisions API 将多种决策模型聚合在同一个 Playground 与 API 中。本站是独立平台,目前尚未接入 OpenAI Decisions API。你可以在工作台选择已支持的模型,或阅读下方对比了解两者差异。

02 / 上线前比较规则

在 Decisions API 中验证你的决策

一个模型是否适合业务,需要看它在不同真实输入上的表现。在 Decisions API 中使用代表性样本和预期答案,对比两组配置。调整问题或模型、逐项检查结果,再保留适合任务的版本。

打开完整工作台
  1. 01

    明确决策及其边界

    从应用需要执行的动作出发。在 Decisions API 中为问题命名、选择类型,并用其他人也能理解的语言描述标准。加入正常范围以外的样本。如果一张工单同时提到账单和登录,应明确由哪个问题决定分流。

  2. 02

    不只看最终选项

    把答案、可用概率和请求详情一起查看。当 Decisions API 的结果出乎意料时,先检查输入是否包含判断标准所需的证据。高概率不等于实测准确率;在用它控制自动化前,需要用你所在领域的标注样本进行验证。

  3. 03

    用同一批样本比较两个配置

    先保存配置 A,修改问题后再保存配置 B。Decisions API 的评测空间可以让两个配置对同一批输入进行判断,一次最多比较 25 个样本。补充已知答案,检查具体失败案例并导出报告。修好一类工单的问题,也可能让另一类变差。

  4. 04

    保存基线,持续复查

    保存有用的配置,回看私有网页运行历史,并在修改后重跑疑难样本。将 Decisions API 接入线上流程前,明确缺少答案、结果不确定或请求报错时的处理方式。政策、输入格式或模型选择变化后,应重新评测。

评测用于区分模型表现和应用策略。Decisions API 输出决策信号,实际后续动作由产品决定。为不适合自动继续的情况设置复核路径,并根据真正影响用户的结果评价工作流。

03 / 从实际任务开始

用 Decisions API 构建实际工作流

从产品已经需要做出的判断开始。Decisions API 的可编辑示例把问题定义与实际业务相连。替换样例输入、调整标准、比较输出,再决定哪些步骤适合自动化。

分流客户请求

当客户反馈重复扣款时,可以用 Decisions API 区分账单、技术故障或账号访问问题,再把分类交给客服系统。提供足够的上下文,以区分退款诉求与支付失败。

同时测试清晰和模糊的工单。为现有团队无法处理的请求保留 other 类别,并明确不确定结果何时需要人工判断。

打开并修改示例

选择 agent 的下一步

有些请求只需查记录,有些需要语言模型,还有些应交给人工。Decisions API 可以根据你定义的路径对任务分类,在执行下一项操作前给应用一个结构化信号。

说明各路径的能力和边界。实际调用工具、检查权限、处理失败以及确认路径是否合适,仍由你的应用负责。

打开并修改示例

检查结论是否有依据

把待验证的结论与原文放在一起,询问原文是否支持它。使用 Decisions API 可以将引用检查变成一个具体判断,同时复核输入和结果,避免只笼统地评价整份文档。

分别测试缺少证据、部分支持与直接矛盾的情况。判断范围由提供的原文决定;这个检查不会自动搜索网络,也不证明来源本身正确。

打开并修改示例

04 / 理解输出

Decisions API 如何把上下文变成判断

Decisions API 为开发者聚合决策模型及其 API。描述场景、定义问题,即可查看结构化答案:客服工单变成分流标签,规则核验变成是否判断,质量审核变成具有明确标准的分数。

在 Decisions API 中选择 Jev、Laya、Kev、Solar 或 Span。不同模型有各自的特点、输入限制和积分费率。这个独立平台提供统一的 Playground 与 API,方便你先验证决策流程,再选择适合应用的模型。

CHOICE / 分类

用 Decisions API 做分类

当应用需要从指定选项中选择一个标签时,可以使用 choice。Decisions API 中的每个选项都有名称和说明,你可以明确区分账单、技术支持与账号问题。除了最终选项,也要查看概率分布,尤其要留意两个类别存在交集的情况。

让各选项的标准有明确区别,并为无法归类的输入设置兜底选项。分类结果可供队列分配、搜索筛选或 agent 后续步骤使用。

SCORE / 评分

用 Decisions API 做评分

如果单个标签不足以表达差异,可以定义一组有序等级,对相关性、紧急程度或完整性进行评分。说明每个等级的含义后,Decisions API 会返回该尺度上的分数,让不同输入可以按同一标准比较。

保持等级顺序一致,并测试接近等级边界的样本。只有使用分数的人和系统对尺度含义达成一致,评分才有实际价值。

NOUL / 是非判断

用 Decisions API 核验依据

noul 适合聚焦的是非问题,例如原文是否支持某个结论,或某项请求是否需要复核。Decisions API 返回的 yes 概率可供应用选择判断阈值。它代表模型对所给证据的判断,并不保证命题一定为真。

一次问清楚一个问题,并说明缺少证据时应如何判断。有重要后果的动作,应由业务规则和复核流程共同控制。

先明确要做出的决策,再准备输入。向 Decisions API 提供相关消息、政策和已知事实,省去无关对话。可以使用文本、JSON 对象或数组整理上下文。工作台允许在运行前检查请求,确认模型实际将收到哪些信息。

为开发者而生

一次接入 Decisions API,调用多种模型

沿用相同的 state 和 questions 结构,把 Decisions API Playground 中的请求迁移到后端。选择支持的模型、创建 API key,即可使用生成的 cURL、JavaScript 或 Python 示例。探索不同决策模型时,统一端点让接入方式保持熟悉。

从服务端使用 Bearer token 请求 Decisions API。成功响应包含结构化答案与用量信息。读取答案前检查响应状态,保留请求标识以便排查,并明确处理错误。至于是分配工单、请求审核还是触发下一步,由你的应用决定。

Decisions API 的 Playground、API 和评测共用一个余额,按相同的模型费率计费。每次调用前预留预算,成功后按实际输入用量结算,失败调用退还积分。接入前可先核对请求与模型费率。

POST /v1/systemone

typesafe/jev-1.13 · upstage/solar-decide · jaredpalmer/kev-4b · laya-english · laya-multilingual · laya-auto

// Server-side JavaScript (Node 20+ or Bun). Set JEV_API_KEY.
const response = await fetch("https://decisions-api.org/v1/systemone", {
  method: "POST",
  headers: {
    "Authorization": `Bearer ${process.env.JEV_API_KEY}`,
    "Content-Type": "application/json",
  },
  body: JSON.stringify({
  "model": "typesafe/jev-1.13",
  "state": "I was charged twice for order A-4471. Please refund the duplicate payment.",
  "questions": {
    "route": {
      "type": "choice",
      "instructions": "Which team should handle this ticket? Use other when no option fits.",
      "criteria": {
        "billing": "Payments, charges and refunds",
        "technical": "Bugs and product errors",
        "account": "Login and account access",
        "other": "None of these teams"
      }
    }
  }
}),
});
const body = await response.json();
if (!response.ok || body.code !== 0) throw new Error(body.message);
console.log(body.data.result.answers);
console.log(body.data.creditsUsed);

05 / 了解服务方式

从 Decisions API 开始构建

新用户赠送 100 credits

注册后一次性获赠 100 credits。在 Decisions API 加载场景,查看预算后运行问题。短请求通常消耗 1 credit,较长输入可能更多;保存配置和私人历史便于持续调整。

所有实时调用共用余额

需要更多用量时再购买积分。每个积分包都可用于 Decisions API 网页、API 和评测,统一 $1 = 10,000 credits,永久有效。成功请求按输入用量计费,每次最低 1 credit。

可查看的用量记录

Decisions API 账号页区分网页与 API 活动,并提供积分历史供你核对。request ID 可以连接一次 API 调用及其用量记录。私有网页历史保存输入和答案,方便回看;API 用量记录仅保留请求元数据,不保存完整的请求和答案正文。

价格

一个积分余额,用于网页、API 和评测。新账户赠送 100 credits。

所有套餐均为 $1 = 10,000 credits,积分不过期,一次购买,无订阅。成功调用最低 1 credit,按实际输入用量结算。本站每百万输入 tokens 费率:Jev / Kev $0.06,Solar Decide $0.072,Span-01 $0.03,Laya $0.06。输出 tokens 不收费。

入门版

$10

适合开始验证场景与接入应用。

  • 100,000 credits,永久有效
  • choice、score、noul 三类问题
  • 概率与置信度结果
  • 在线测试台
  • API key 管理
  • 调用用量与扣费记录
推荐

专业版

$100

适合持续使用与重复评测。

  • 1,000,000 credits,永久有效
  • choice、score、noul 三类问题
  • 概率与置信度结果
  • 在线测试台
  • API key 管理
  • 调用用量与扣费记录

大容量

$1,000

适合更大用量,积分单价保持一致。

  • 10,000,000 credits,永久有效
  • choice、score、noul 三类问题
  • 概率与置信度结果
  • 在线测试台
  • API key 管理
  • 调用用量与扣费记录

估算积分用量

输入上下文和问题合计的平均 tokens。每次请求分别向上取整。

每次请求积分

1

预计总积分

10,000

按所选积分包折算金额

$1.00

max(1, ceil(input_tokens × 600 / 1,000,000))

所有实时调用均消耗积分,包含网页和评测。每次成功请求最低 1 credit,输出 tokens 不收费。Span-01 为 300 credits / 百万输入 tokens;Span-01 Lite 每次成功请求 1 credit;Jev、Kev 和 Laya 为 600 credits / 百万,Solar Decide 为 720 credits / 百万。$1 = 10,000 credits。失败请求退回积分,估算不含税费。

Jev models 基准评测

了解每一次决策背后的模型

选择 Decisions API 模型时,可以把独立评测作为参考。链接中的 JevBench 对比标明了来源、版本和快照日期。公开分数帮助你了解模型表现,但不代表它在你的工单、规则或文档上的准确率承诺。

决定接入前,结合公开结果和自己在 Decisions API 中的标注样本一起判断。使用接近实际业务的输入,比较答案质量、不确定性、响应时间与实际积分消耗。

决策能力与概率校准速度单次判断成本
查看完整评测

Jev 1.13.0

第 1 名 · JevBench v1.3.0

74.4

Score

SemIf

第 2 名 · 开源重建版本

73.1

Score

djev

第 3 名 · 在线预览

73.0

Score

JevBench v1.3.0 · 52 个系统 · 534 个任务 · 数据日期:2026 年 9 月 21 日

关于 Decisions API 的常见问题

了解 Decisions API 如何聚合多种决策模型、积分如何使用,以及怎样从 Playground 过渡到 API 接入。