跳到正文
Microsoft Research· Chad Atalla, Jennifer Neville·· 5 天前AI 评分22

微软研究员 Jennifer Neville 谈 AI 评测与「意外失败」:从传统 benchmark 之外看模型真实表现

What AI gets wrong and what failure teaches us

AI 导读

微软 partner research manager Jennifer Neville 在 Microsoft Research Podcast 中讨论了评测如何推动 AI 系统性能边界,以及模型在超出传统 benchmark 测试时出现的「意外失败」。她结合自身从数学、物理、认知科学到计算机科学的经历,分享了使用当前 AI 系统的实用建议,并强调当结果偏离预期时应仔细审视数据。

来源:Microsoft Research · microsoft.com