CodeRoadMap
路线图课程知识库文章题库资源社区我的学习
CodeRoadMap

程序员的学习成长路线图。登录解锁全部课程,并同步路线图与课时进度。

学习

  • 路线图
  • 课程
  • 文章
  • 题库
  • 知识库

更多

  • 资源
  • 社区
  • 我的学习
  • 内容说明

© 2026 CodeRoadMap

津ICP备2026012044号-1·coderoadmap@126.com
开发路线图/AI 智能体开发路线图/人在回路评估
阶段一

人在回路评估

节点说明与学习资源

Human-in-the-loop evaluation 通过让真人评判 AI agent 的输出与行为来检查其表现。测试者不只看 automated score,还邀请 user、domain expert 或 crowd worker 观察任务、标注答案、标记错误,并评价 clarity、fairness 或 safety。他们的反馈揭示数字 alone 难以发现的问题,如 hidden bias、confusing language 或对人感觉不对的行动。团队研究这些笔记、调整 model 并再跑一轮,重复直至 agent 达到质量与信任目标。混合 human judgment 与 data 可得到更准确、有用且日常更安全的系统。

← 上一节点流程的集成测试下一节点 →LangSmith