AI情报Aug 23, 2026AI情报文章Prime Intellect发布了一项基准,使用nanoGPT优化器框架评估了18个前沿模型在153次自主运行中的表现。该研究发布了工具调用和推理草稿的开放轨迹,为开发者提供了关于当前模型在自主任务中能力的细粒度数据。Data Cube AI 编辑部2026年8月22日来源: VentureBeat01来源简报Prime Intellect发布了一项基准,使用nanoGPT优化器框架评估了18个前沿模型在153次自主运行中的表现。该研究发布了工具调用和推理草稿的开放轨迹,为开发者提供了关于当前模型在自主任务中能力的细粒度数据。02相关话题研究与开发基准测试开源自主智能体查看本期