跳到正文
热点事件持续更新

提出 AHL 范式并发布 AAArena 基准

1 篇报道1 个报道来源12 小时前更新

先了解这件事

AI 综述

论文作者 Kaisen Yang 提出 Adversarial Heuristic Learning 范式,并发布对抗游戏智能体基准 AAArena。该基准包含 12 款真实对抗游戏和 1,920 份存档人类程序,采用模拟真实游戏竞赛的评测协议,用于考察智能体在长期竞赛中的学习能力。 论文报告称,在已评估的模型与工具配置中,Opus5.5 搭配 Claude Code 拿下 6 枚金牌,其余 6 条人类天梯没有任何配置能够攻克。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. arXiv 游戏 AI 检索精选
    AI 智能体能否靠学习登顶?AAArena 评估长期游戏竞赛中的启发式学习

    论文提出 AAArena 基准,用 12 款真实对抗游戏和 1920 份存档人类程序,评测智能体在长期竞赛中的学习能力。在评估的模型与工具配置中,Opus5.5 搭配 Claude Code 拿到 6 枚金牌,没有配置能攻下其余 6 条人类天梯。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。