Dan Hendrycks

美国 AI 研究者,CAIS(AI 安全中心)负责人,知名 LLM 评测基准的关键推动者。他是 MMLU 论文的第一作者,也是 2025-01 由 Scale AI 与 CAIS 发布的 Humanity’s Last Exam(HLE)的核心组织者——同一人出的第一张考卷(MMLU)已被评测生态遗弃,更难的 HLE 也在被快速追上,成为古德哈特定律在 LLM 评测领域的生动注脚。

关联