不要猜测模型来评判AI答案
在模型身份影响决策之前,审查任务匹配度、主张、证据、不确定性及可用性。
- 当
- 你有两个或多个针对同一任务的AI输出,或者一个需要可辩护接受决策的后果性输出。
- 可重复使用的输出
- AI输出审查记录
RichBay 实际使用
使用方法→三种维护方法
每种方法都会链接到一个真实的案例或沙盒,并包含可重复使用的Markdown工件。
在模型身份影响决策之前,审查任务匹配度、主张、证据、不确定性及可用性。
将稀疏结果转化为决策,而不将标签、原因或预测作为观察到的事实呈现。
从源值重新构建算术,保留中间精度,并且只有在路径和结果一致时才接受答案。