跳转到内容

人工复核队列生成器:把缺分和低分结果留下

如果输出有建议标签和一个已归一化到 0–1 的分数,可以先用这个页面演练“哪些先交给人”。建议标签缺失,或分数缺失、越界、低于你输入的练习阈值时,记录进入待复核队列;其余记录仍应抽查。本工具不校准分数,也不把分数称作准确率。

本地操作台 / 无需账号

文件只在此浏览器中读取,不上传到 JevLog,也不调用模型。刷新页面会清除当前结果。

上限 5 MB;支持带引号的逗号和换行。

选择文件,或先载入演示样例。

CSV 为表格查看添加公式前缀防护,可能改变报告单元格的原值;如需程序继续处理报告,请下载保留报告字段原值的 JSON。

下载的队列保留输入文件的全部原始列,只在末尾增加一列复核原因;页面表格则展示 ID、建议标签、分数、原因,以及文件里存在的 text、feedback 或 message 原文列。复核人应另记最终标签、原因、时间和身份;不要用最终标签覆盖最初建议。输出不会回复客户、批准退款或执行任何外部动作。

演示样例的阈值 0.8 仅用于说明:5 条虚构记录中 3 条进入待复核(低分、缺分、缺标签各一条),2 条进入建议抽查。正式阈值必须用你自己经过人工确认的数据选择,并在规则或数据分布变化后重新评估。

继续读:人工复核流程教程 · 两次分类结果对比 · CSV 输入预检。

输入样例 CSV 用 id、label、confidence。阈值 0.8 时,ID 2(0.60)、ID 3(缺分)、ID 5(缺标签)进入复核;ID 1 和 4 留待抽查。对照 预期完整 JSON 和 预期队列 CSV,核对 5 = 3 + 2。

阈值改成 0.6 后,分数恰好等于阈值的 ID 2 留待抽查,队列变为 2 条;缺分与缺标签仍需要复核。这是固定规则的教学结果,不是模型效果证据。

工具不读取 status/error 字段。真实接入时要单独保留技术失败,不要让失败记录沿用旧标签、旧分数后混进抽查队列。

当前生成器没有在线审核或多人任务分配。下载队列保留原始列并增加 jevlog_review_reason;人工最终标签、理由、复核人、时间需要另存,参见 交接步骤。

不会。先下载完整报告与队列;之后重新选择文件和阈值重跑。无需登录,文件不上传,也不会执行外部操作。