幻觉防御
状态与知识→事实核验→上下文忠实
我是Mask,来自字节跳动 AI数据与安全 团队,主导并设计10+ Agent 评测集,包括从问题定义、题目构造、Judge 设计到质量验证的完整链路。
十个专项最终形成一组可复用的评测基础设施,可继续服务模型准入、版本回归与能力诊断。
把幻觉、检索与工具执行问题拆成可复现、可归因的风险类型。
从真实轨迹与失败案例提炼测试点,并生成可稳定回归的专项样本。
组合 Claim 抽取、轨迹核验、事实检索、硬规则与多数票聚合。
通过人工抽检、人机一致率与异常样本复盘控制自动判分可信度。
以维度诊断支撑模型选型、版本比较和专项能力回归。