决策工作台

自然语言提问 → 结构化 choice / score / noul
后端 TypeSafe Jev 耗时 —

问题

Ctrl/⌘ + Enter 提交
0 字 Enter 提交 · Shift+Enter 换行

候选列表

0 项
从知识库构建候选
关闭后仅在你的候选中决策

高级设置

展开 ▾

近期决策

0/50

批量评估

上传 JSONL 测试集 → 批量决策 → 准确率与校准分析,用于调拒答阈值

样本数
0
已导入测试集
Top-1 准确率
—
正确 / 已判定
拒答率
—
score/noul 触发阈值
拒答样本正确率
—
被拒不冤枉

运行

待运行
0 / 0

校准分析

score 分桶 vs 实际准确率

逐条结果

#问题标注 决策score noul耗时结果
尚未运行评估

知识库管理

导入文档 → 切分 → 向量 + 关键词混合检索 → 构建候选。全程确定性,可追溯

导入文档

拖拽文件到此,或点击选择
.md / .txt / .json / .csv 直接读入;.pdf / .html 由服务端解析文本层

检索调试器

输入问题,看命中片段与检索分

文档列表

文档条目入库时间 索引状态启用

模型管理

统一走 /v1/systemone 语义。切换后端只改配置,业务代码零改动

阈值与检索参数

保存后立即生效

适配器接口契约

应用内统一接口 DecisionModelAdapter.decide(payload) → {choice_index, score, noul, scores[], model, latency_ms}。
真实 TypeSafe 远端使用官方 System One 协议:{state, model, questions}(choice + noul 双问题); simulate=true 时走本地确定性引擎并标记 simulated:true。 API Key 仅存在于服务端环境变量,不会下发到浏览器。

反馈与监控

日决策量、拒答率、用户纠正率趋势,驱动阈值校准

日决策量
—
最近 24h
拒答率
—
低置信度拒答占比
平均 score
—
被采纳决策的置信度
用户纠正率
—
标记错误 / 总反馈

趋势

近 14 天
拒答率纠正率决策量

反馈记录

时间问题决策 判定修正答案
暂无反馈记录