中国信通院牵头的10项人工智能国际标准化成果取得新进展

2026/08/04 责任编辑:Hanson 访问:1021

2026年7月,国际电信联盟电信标准化部门第21研究组(ITU-T SG21)全会在瑞士日内瓦召开。中国信息通信研究院(简称“中国信通院”)围绕大模型评估、智能体评估、智能化软件工程、世界模型、人工智能原生应用平台等重点领域共取得10项标准化成果,持续完善人工智能国际标准体系布局。

2项大模型领域国际标准发布出版。本次全会审议通过了2026年5月第三工作组(WP3)中间会议报告,确认了相关课题组的工作进展。中国信通院牵头的2项大模型领域国际标准依据ITU-T AAP程序获得批准,目前已由国际电联正式发布出版。

● ITU-T F.748.69(ex F.FMD)General technical framework and requirements of foundation model for mobile device/ 面向移动终端的大模型通用技术框架和要求

大模型正在向手机、平板、机器人等终端设备加速渗透,但端侧算力不足、网络不稳定、功耗敏感等约束使得云端大模型方案难以直接复用,亟需针对终端场景制定专用技术规范。该标准规定了终端大模型的总体框架、模型能力要求、模型适配要求和模型服务要求,为端侧大模型的研发、评估和部署提供指引。

● ITU-T F.748.74(ex F.RFE-MM)Requirements and framework for evaluation of multimodal foundation models/ 多模态基础模型评估要求与框架

多模态基础模型融合文本、图像、音视频等多种模态能力快速迭代,但各厂商评测口径不统一,跨模态任务缺乏可比的评估基准,制约了模型的可信选型和持续改进。该标准建立了多模态基础模型评估框架,规定了测试场景、数据集、工具与流程,并围绕感知、理解、生成、检索、推理等核心能力给出可量化评估方法。

智能体互操作标准、世界模型技术报告获全会批准。本次全会对中国信通院牵头的1项智能体领域国际标准和1项世界模型领域技术报告进行了审议,分别批准结项和通过,两项成果将进入发布程序。

● ITU-T F.748.93(ex F.AAI)Framework and Requirements for AI Agent Interoperability/ 智能体互操作性技术要求

当前智能体面临集成成本高、跨系统互联存在壁垒等挑战,业界亟需标准规范智能体的互操作机制和应用层交互。该标准涵盖互操作基础要素、互操作与交互、互操作应用三个部分,其中:互操作基础要素明确了智能体互联协同过程中各类基础数据和信息单元,互操作与交互明确了智能体的互操作流程与交互机制,互操作应用明确了智能体互联协同过程中的应用管理与应用保障。

● ITU-T FSTR.WM Technical framework and essential capabilities of World Models/ 世界模型技术框架及关键能力技术报告

世界模型作为物理世界理解和预测的核心模块,在自动驾驶、机器人等领域展现出显著潜力,但其技术路线和能力边界尚缺乏系统梳理。该技术报告给出世界模型的定义、阐述技术架构与最新进展、归纳关键能力,并分析典型应用场景,为后续研究和标准化工作提供了重要参考。

智能体、智能化软件工程等方向6项新项目成功立项。本次全会还批准了中国信通院牵头的3项新国际标准和3项新技术报告立项,覆盖智能体评估、智能体分类分级、智能体基础设施、智能化开发与运维工具、人工智能原生应用平台等方向。

● ITU-T F.ACAIA-B Assessment criteria for artificial intelligence agents: Benchmark/ 智能体评估标准:基准测试

智能体在各行业加速部署,但不同智能体之间缺乏一致的测试流程和可比的性能基准,难以客观评判智能体的实际能力。该标准拟规定智能体基准测试框架,包括测试环境、数据集和工具等基准要求,以及通用能力与任务性能的评估范围,为以可复现、可比较的方式评估智能体提供标准化方法。

● ITU-T F.EM-IDT Evaluation Methods and Metrics of Intelligent Development Tools for Multimedia Applications/ 智能开发工具评价方法与指标

智能开发、智能测试等软件研发工具快速涌现,但不同工具采用的智能化能力指标计算方法差异明显,导致评估结果缺乏横向可比性。该标准以软件工程全生命周期为主线,覆盖需求分析与设计、开发、测试、运维四大阶段,系统构建各阶段智能化能力的度量指标体系与评估方法,对数据来源、指标计算规则等核心内容作出统一界定,为软件工程全生命周期智能化能力的规范评价与持续提升提供技术支撑。

● ITU-T F.IOMT Technical Requirements of Intelligent Operation and Maintenance Tools for Multimedia Applications/ 智能化运维工具的技术要求

智能运维工具正向根因研判、协同处置和故障恢复等闭环自治演进,然而不同工具的能力边界和评价要求尚不统一。本标准面向智能运维全流程,围绕自主运维、故障响应、运维协同、知识管理四个核心能力域,规定异常检测、告警分析、根因识别、故障恢复、知识问答等11类场景的技术要求,为智能运维工具的研发设计、采购选型和验收应用提供统一依据。

● ITU-T FSTR.CMCLAIA Classification methods and capability level requirements for AI agents/ 智能体分类方法与能力等级要求技术报告

智能体产品形态日趋多样,但功能分类和能力分级尚无统一标准,企业和用户难以快速判断产品定位和能力水平。该技术报告拟建立智能体分类方法与能力等级要求框架,分类方法覆盖技术维度与应用维度,能力等级涵盖技术能力、应用成效与运行保障,为产品选型和能力评估提供参照。

● ITU-T TR.AAI Technical report for guidance on the technical framework of AI Agent Infrastructure/ 智能体基础设施技术框架技术报告

智能体应用已从单轮问答扩展到任务规划、工具调用、多智能体协同等复杂场景,但底层基础设施在记忆管理、工具编排、权限控制、运行监测等方面缺乏统一架构参考。该技术报告研究智能体基础设施的框架、关键能力和功能要求,覆盖运行环境、记忆系统、能力接入和运维管理等,为智能体应用的研发、部署与运行提供统一参考。

● ITU-T FSTR.AINAP Analysis of artificial intelligence native application platforms/ 人工智能原生应用平台技术报告

当前,人工智能原生应用平台进入快速发展期,但此类平台存在工具链不成熟、多模态支持不足等挑战,国内外尚未形成相关的技术报告,存在明显研究空白。为引导产业有序发展、规范行业自律、为用户提供科学选型参考,该技术报告聚焦面向多媒体应用的人工智能原生应用平台,从平台背景、概念、应用开发、应用分发和平台成熟度展开系统性研究,旨在提升相关概念的国际影响力。

中国信通院长期深耕人工智能标准化研究,围绕人工智能技术研究、标准研制、报告编制和测试评估等开展多维度工作,已构建覆盖大模型、智能体、智能化软件工程等方向的国际国内标准体系。未来,中国信通院将持续跟踪人工智能技术与产业发展,深入推进重点领域的国际标准化工作,与产业各方共同推动人工智能行业健康有序发展。

本文来源:中国信通院

扩展阅读

  • 扫码关注微信公众号