AB
AiBoss站
快讯

Artificial Analysis 开源 AA-AgentPerf-Local,用真实 Agent 轨迹测试本地推理

Artificial Analysis 开源 AA-AgentPerf-Local,用录制的 Agent 工作负载比较笔记本与工作站本地模型推理表现,并同步发布首批硬件结果。

Artificial Analysis 9 月 29 日发布 AA-AgentPerf-Local。默认测试回放 8 个录制的 Agent 任务、共 168 次模型轮次,用逐步增长的上下文模拟实际 Agent 调用。

首批榜单覆盖 DGX Spark、RTX 5090、Ryzen AI Halo 和 MacBook Pro M5 Pro。工具与基准配置公开,但成绩仍受模型、服务框架、硬件和测试策略影响;不同策略的回放结果不能直接横比。

参考:Artificial Analysis原始资料