1. Human-in-the-loop 的触发条件设计,风险阈值 vs 置信度
Human-in-the-loop(HITL)的触发条件应如何设计?风险阈值与置信度这两种触发依据如何取舍与结合?
- 风险阈值触发的逻辑
- 置信度触发的逻辑
- 两者结合与优先级
HITL 触发条件有两种方向:①风险阈值——按任务的风险等级(金额、影响范围、合规要求)触发,属于"规则驱动",反应的是"这事必须人确认",与模型表现无关;②置信度——按模型对输出的置信度触发,属于"模型驱动",反映的是"模型自己没把握"。两者应结合:风险阈值是底线(无论置信多高,高风险动作都要人确认),置信度是补充(低置信但未达风险阈值的也要人介入)。优先级上,风险阈值优先——只要风险等级超限就触发;置信度作为兜底,在风险内但置信度低的场景补上。触发条件可配置成二维矩阵(风险等级 × 置信度),为不同组合设定不同的处理(自动放行/抽样/人工确认)。触发条件需结合业务与评测调优,避免过度打扰(太多无关触发)或漏触发(漏掉高风险)。
HITL 触发是"规则(风险)与信号(置信度)"的结合。风险阈值保证"该人定的必人定",置信度补充"模型没把握的也人定",二维矩阵让触发更精细、更可调。