决策工作台
自然语言提问 → 结构化 choice / score / noul 后端 TypeSafe Jev 耗时 —问题
Ctrl/⌘ + Enter 提交
0 字
Enter 提交 · Shift+Enter 换行
候选列表
0 项从知识库构建候选
关闭后仅在你的候选中决策
高级设置
展开 ▾近期决策
0/50批量评估
上传 JSONL 测试集 → 批量决策 → 准确率与校准分析,用于调拒答阈值
样本数
0
已导入测试集
Top-1 准确率
—
正确 / 已判定
拒答率
—
score/noul 触发阈值
拒答样本正确率
—
被拒不冤枉
运行
待运行
0 / 0
校准分析
score 分桶 vs 实际准确率逐条结果
| # | 问题 | 标注 | 决策 | score | noul | 耗时 | 结果 |
|---|---|---|---|---|---|---|---|
| 尚未运行评估 | |||||||
知识库管理
导入文档 → 切分 → 向量 + 关键词混合检索 → 构建候选。全程确定性,可追溯
导入文档
拖拽文件到此,或点击选择
.md / .txt / .json / .csv 直接读入;.pdf / .html 由服务端解析文本层
.md / .txt / .json / .csv 直接读入;.pdf / .html 由服务端解析文本层
检索调试器
输入问题,看命中片段与检索分文档列表
| 文档 | 条目 | 入库时间 | 索引状态 | 启用 |
|---|
模型管理
统一走 /v1/systemone 语义。切换后端只改配置,业务代码零改动
阈值与检索参数
保存后立即生效适配器接口契约
应用内统一接口
真实 TypeSafe 远端使用官方 System One 协议:
DecisionModelAdapter.decide(payload) → {choice_index, score, noul, scores[], model, latency_ms}。真实 TypeSafe 远端使用官方 System One 协议:
{state, model, questions}(choice + noul 双问题);
simulate=true 时走本地确定性引擎并标记 simulated:true。
API Key 仅存在于服务端环境变量,不会下发到浏览器。
反馈与监控
日决策量、拒答率、用户纠正率趋势,驱动阈值校准
日决策量
—
最近 24h
拒答率
—
低置信度拒答占比
平均 score
—
被采纳决策的置信度
用户纠正率
—
标记错误 / 总反馈
趋势
近 14 天拒答率纠正率决策量
反馈记录
| 时间 | 问题 | 决策 | 判定 | 修正答案 |
|---|---|---|---|---|
| 暂无反馈记录 | ||||