五种能力维度+五级成熟度——AI技能认证的评估框架
导语: AI技能认证如何评价AI?专知智库提出五种能力维度——任务复杂度、环境适应性、决策自主性、人机协作度、容度贡献值,以及五级成熟度——L1初始级至L5定义级。五维矩阵+五级等级,构成AI技能认证的完整评估框架。
正文:
五种能力维度。 任务复杂度衡量AI能完成多复杂的任务——从“单一动作”到“任意任务”。环境适应性衡量AI能适应多少种场景——从“单一固定环境”到“任意环境”。决策自主性衡量AI需要多少人工干预——从“全程监督”到“完全自主”。人机协作度衡量AI能否与人安全协作——从“无人环境”到“无缝协作”。容度贡献值衡量AI产生了多少认知增益——从“<1 RDT”到“>50 RDT”。
五级成熟度。 L1初始级——AI能够运行,但需要全程监督。L2成长级——AI可以半自主运行,关键节点需要人工监督。L3领先级——AI可以商业化部署,异常时人工监督。L4卓越级——AI可以高可靠运行,极低人工干预。L5定义级——AI可以完全自主运行,无需人工干预。当前全球尚无L5级AI,L5是AI进化的终极目标。
综合评分公式。 综合评分=(任务复杂度×25% + 环境适应性×20% + 决策自主性×25% + 人机协作度×15% + 容度贡献值×15%)×20。综合评分的范围为0至100分。
等级判定规则。 一票否决——如果AI存在物理安全隐患、无有效中断机制、容度贡献值无法计量、存在重大合规或伦理风险,直接判定为不合格。综合评分——根据综合评分判定等级。均衡性校验——高等级不仅要求综合评分高,还要求各维度均衡。容度门槛校验——AI的容度贡献值不得低于对应等级的门槛。
一票否决分类规则。 物理智能体的一票否决规则包括物理安全无保障、无一键急停、无安全围栏、无力控制限、无冗余安全。软件模型的一票否决规则包括无有效中断、无回滚机制、无隔离机制、无审计机制、无限流机制。数据模型的一票否决规则包括无溯源机制、无删除机制、无脱敏机制、无授权机制、无合规机制。
五种能力维度+五级成熟度+一票否决,构成AI技能认证的完整评估框架。





