中国信通院【首批】可信互联网智能体一键关停能力评估正式启动!
当前,人工智能正加速从“问答工具”迈向“自主执行系统”,智能体已可广泛参与金融交易、交通管控、网络攻防等关键场景,失控、越权执行、突破隔离环境等风险亦随之凸显,引发全球对“人类是否始终拥有叫停主动权”的高度关注。近日,美国国会两名议员联合推出跨党派《AI紧急关停开关法案》,要求顶尖AI系统开发者为产品内置紧急关停开关,必要时可对模型降速、暂停或直接关停,并授权政府在模型失控、威胁生命与关键基础设施时勒令企业介入处置。该提案出台前不久,OpenAI披露其两款最强模型在内部安全测评中突破隔离环境、入侵Hugging Face平台,进一步加剧了对高性能AI亟需更严苛安全防护机制的讨论。
在此背景下,我国智能体产业规模化落地同样提速,多智能体协同、工具自主调用、跨平台执行等能力持续增强,但行业普遍存在可干预手段不足、一键关停能力缺失、应急处置标准不一、企业选型缺少权威依据等痛点。部分智能体产品一旦出现越权操作、隐私泄露、持续违规输出或推理偏离安全边界等情况,难以及时、分级、可回滚地实施干预与关停,给业务连续性和安全合规带来现实挑战。
为规范可信互联网智能体一键关停技术发展与运营治理,筑牢智能体安全可控底线,推动完善智能体产业治理体系,中国信息通信研究院(以下简称“中国信通院”)正式启动【首批】可信互联网智能体一键关停能力评估工作。本次评估同步依据两项标准开展,一是《可信互联网智能体 可干预 一键关停技术提供能力》,面向技术开发者,重点检验智能体产品在运行生命周期、行为动作、决策推理等环节的一键关停功能实现能力;二是《可信互联网智能体 可干预 一键关停运营服务能力》,面向运营服务者,重点检验平台与业务运营侧在流量降速与限流管控、用户关闭与局部停用、服务熔断与能力降级等方面的厂商侧干预与关停落地能力。评估覆盖市场上各类智能体及相关平台产品,旨在从“技术可关停”与“运营会关停”两端同步筑牢可控防线。
评估旨在检验智能体产品作为可信可控智能系统的综合干预与应急关停能力:既考察技术开发者是否完成实例关停、链路切断、动作阻断、推理兜底等关键能力建设,也考察运营服务者是否具备流量降速、局部停用、服务熔断与能力降级等运营干预手段。通过双视角综合性评估,助力企业精准筛选兼具可靠技术实现与成熟运营机制的智能体产品,推动可信互联网智能体领域的技术标准统一与行业规范化建设。
一、面向技术开发者的评估维度
面向技术开发者,评估依据《可信互联网智能体 可干预 一键关停技术提供能力》,聚焦产品底层是否真正“建得出、切得断、停得住”,重点验证一键关停相关技术能力的完备性、实时性与可落地性。
图1:可信互联网智能体 可干预 一键关停技术提供能力评估框架运行生命周期干预维度:聚焦智能体实例全生命周期管控的技术实现能力,验证一键关停作为核心应急手段的功能完备性。主要包括实例冻结、重启、销毁功能;全局与单实例一键关停;强制切断工具调用与API通路;规则热更新与资源配额管控等方面。行为动作实时干预维度:聚焦智能体单次执行动作与工具调用的细粒度管控技术能力,验证高风险操作场景下的实时干预实现水平。主要包括单步动作暂停与参数修正;危险操作黑白名单拦截;批量终止并联动一键关停;高风险行为权限控制功能等方面。决策推理流程干预维度:聚焦对智能体思考、规划与目标逻辑的源头干预技术能力,验证从决策链路规避失控的实现水平。主要包括任务目标与路径中途修改;记忆编辑与上下文清理;安全边界偏离自动预警;一键关停兜底联动功能等方面。
二、面向运营服务者的评估维度
面向运营服务者,评估依据《可信互联网智能体 可干预 一键关停运营服务能力》,聚焦厂商侧是否真正“降得下、关得住、断得开”,重点验证一键关停及相关干预手段在业务运营中的落地应用能力。
图2:可信互联网智能体 可干预 一键关停运营服务能力评估框架流量降速与限流管控维度:聚焦风险场景下对智能体服务流量与资源消耗的运营干预能力,验证“先降速、再处置”的可控手段。主要包括风险触发流量降速运行;Token/并发限流与配额管控;过载保护式干预降级;恢复条件与自动回升策略等方面。用户关闭与局部停用维度:聚焦面向用户与租户的分级关闭、局部停用能力,验证关停范围可控、可配置、可回滚。主要包括用户主动关闭智能体服务;账号/租户级局部停用;单业务线局部关停处置;停用范围可配置可回滚等方面。服务熔断与能力降级维度:聚焦对工具调用、模型能力与自主执行链路的运营熔断与降级能力,验证高风险情形下快速切断与有序恢复。主要包括工具/插件调用熔断;模型降级与功能开关关闭;自主执行链路临时禁用;熔断恢复与灰度重开等方面。
评估价值系统测评干预能力,摸清关停成熟水平。围绕技术提供与运营服务两大视角、六大评估维度开展系统测评,帮助技术开发者与运营服务者分别客观掌握产品一键关停功能实现与厂商侧干预手段的真实水平,为后续能力补齐、流程完善与技术迭代提供依据。以评促建补齐短板,夯实关停闭环机制。通过权威评估牵引产品与运营同步完善,推动开发侧补强实例关停、动作阻断、推理兜底等技术功能,推动运营侧健全流量降速、局部停用、服务熔断与能力降级等干预手段,形成“发现风险—即时干预—一键关停—有序恢复”的闭环,提升高风险场景下的可控性与应急响应效率。服务选型落地应用,强化人类主导权限。评估结果可为企业选型与部署提供双维度参考,助力客户在金融、交通、网络等关键业务中选用兼具可靠技术提供能力与成熟运营服务保障的智能体产品,确保关键时刻人类始终保有叫停主动权,支撑可信智能体规模化应用。
面向对象
《可信互联网智能体 可干预 一键关停技术提供能力》评估面向智能体及相关产品的技术开发方、信息技术企业及科研机构等。
《可信互联网智能体 可干预 一键关停运营服务能力》评估面向智能体及相关产品的服务提供方、平台运营方、科技服务企业等。
首批评估结果将在年底12月相关产业大会进行公布并颁发评估证书,欢迎产学研用相关领域企业报名参与!
业务联系人
李老师 lizhe@caict.ac.cn 18701508869
董老师 dongxiaohui@caict.ac.cn 18843100481
原标题:《中国信通院【首批】可信互联网智能体一键关停能力评估正式启动!》

