中国信通院发布AI Infra运维领域首个评测基准
首个智算运维智能体评测基准发布,用真实运维数据考核智能体解决实际故障的能力,填补国产芯片运维评估空白。
中国信通院联合无问芯穹发布AISHPerf 3.0,包含两大评测基准:智算运维智能体基准(考核运维智能体在真实集群中自主排查修复故障的能力)和算子生成智能体基准(评估生成算子能否实际替代现有算子),首次将国产芯片运维纳入评测体系。
正文摘录
6月29日,在中国信通院人工智能软硬件协同创新与适配验证中心、中国人工智能产业发展联盟、工信部人工智能标准化技术委员会联合主办的 2026“众智”大模型开放智算生态协同高级别研讨会中,中国信通院副院长魏亮,正式发布 AISHPerf 人工智能软硬件基准体系 3.0 版本,包含两项 AI Infra 领域核心评测基准—— AISHPerf-智算运维智能体评测基准 以及 AISHPerf-算子生成智能体评测基准,两大基准由国内顶尖 AI 原生基础设施服务商无问芯穹及清华大学团队作为重点技术支持方参与建设。 前者是首个面向 AI Infra 的运维智能体评测基准,依托百亿级真实运维数据构建,核心考核智算运维智能体在真实生产场景中解决实际问题的落地能力。后者则跳出 “模型能否生成可运行 GPU 算子” 的基础维度,将评测重心锚定在 “模型生成的算子能否在真实量化推理部署中替代现有算子” 的工程可部署性上,更贴合产业实际落地需求。 二者从底层算力优化到上层集群运维,共同为智算产业的标准化升级与高质量发展提供了统一的能力参照框架。 AISHPerf(Performance Benchmarks of Artificial Intelligence Software and Hardware)是中国信通院与人工智能大模型及软硬件评测工业和信息化部重点实验室,依托人工智能软硬件协同创新与适配验证中心(位于国家信创园)联合构建的人工智能软硬件基准体系,旨在设置多维度指标,考察端到端方案对模型及应用场景的真实承载能力,系统评估软硬件各层级间的协同优化水平、兼容适配能力及整体交付效能。