跳转到内容
原创教程官方文档整理

Jev 问题怎么拆:把一个含糊的分流判断拆成三步

一份可评审的三问题规格、边界输入和带版本的分流建议。

适用场景用一条虚构产品反馈,把类别、证据是否充分、影响程度分开判断,再由代码组合结果;附问题规格和边界样例。

来源 · JevLog 编辑部Intermediate15 分钟

用一条虚构产品反馈,把类别、证据是否充分、影响程度分开判断,再由代码组合结果;附问题规格和边界样例。

来源 · JevLog 编辑部 · 本站原创

原文封面 · TypeSafe AI

原文封面 · TypeSafe AI

2026-10-02 新增:依据当前官方文档整理,附本站编写练习。未做真实服务调用;来源首次发布日期未确认。

“重要吗,要交给谁?”混合了多个标准。先固定输入,分别问类别、信息够不够和影响,才能知道判断为什么失败。同次 Jev 请求的问题独立读取同一状态,不能让第二问引用第一问的答案。

  • 下载 question-design.json,先人工标注四种虚构输入;不含客户隐私。

  • 调用示例需要 Python、typesafe-sdk 与服务端 TYPESAFE_API_KEY;执行会消耗 API 额度。只设计规格时无需密钥。

  • 官方文档

  • 官方文档

JevLog 原创流程图,非产品截图或实测结果。

JevLog 原创流程图,非产品截图或实测结果。

保留具体行为、环境、复现条件。例如“Firefox 下载无反应,Chrome 正常;清缓存后仍发生”。不要先写“严重故障”,否则把结论混进证据。删除账号和姓名,但不要删掉判断所需的环境。

类别用 Choice,资料是否充分用 Noul,阻碍程度用 Score。把标准写进 instructions 和 criteria,保留 other 出口。问题 ID 是程序查找答案的键,不应代替写给模型的判断说明。

from typesafe_sdk import TypeSafeClient, Choice, Noul, Score
questions = {
"queue": Choice(instructions="Which team should review this report?",
criteria={"engineering": "Software behavior", "content": "Wording or documentation", "other": "Neither or unclear"}),
"context": Noul(instructions="Does the report describe a concrete failing action and its environment?"),
"impact": Score(instructions="How much does this block the stated task?",
criteria=["Task works normally", "A stated workaround works", "No stated workaround works"]),
}
with TypeSafeClient() as client:
result = client.system_one("Download fails in Firefox but works in Chrome.", questions)
print(result.choices["queue"].choice)
print(result.nouls["context"].noul)
print(result.scores["impact"].score)

先检查字段与 queue.confidence、context.noul;资料不足、分布含糊或类别为 other 时进入 review。其余只生成建议,不自动创建工单。0.8 只是候选阈值,需要用自己标注数据验证,不是准确率保证。

样例含环境明确、缺环境、文案问题和无关消息。调用前写预期,调用后记录 case_id、问题版本、预期、实际和差异原因。每次只改一个标准,再用同一组输入比较;不要为了通过而修改人工标签。

5. 给下一步留下版本与复核出口

Section titled “5. 给下一步留下版本与复核出口”

保存 routing-v1 与原始证据,复核者能看见问题规格和建议。若下一步问题需要前一步答案,拆成两次调用并记录中间状态;应用仍要检查动作许可和用户权限。

练习样例:下载 question-design.json,可在本地练习;非本站实测结果。

一份可评审的三问题规格、边界输入和带版本的分流建议。

  • Noul 返回 noul 概率,不含独立 confidence;缺字段应记错误而非低置信度。
  • 四种输入都有人工预期,other 和资料不足有明确出口。
  • 日志含问题版本,动作权限仍由代码验证。

来源边界:依据所列公开来源整理;本站未复现演示。分类结果需人工复核,不会自动执行。

同一次调用能让第二问用第一问的答案吗?

Section titled “同一次调用能让第二问用第一问的答案吗?”

不能。问题独立读取同一状态;依赖关系由代码组合,或分成两次调用。