← 返回教程库

评估团队 AI 成熟度:自测表 + 分级诊断行动建议

最后更新 2026-06-25
你将学到
  • 理解 AI 成熟度分级(L0—L4)的本质含义和典型特征,能准确给团队定位
  • 用五维度自测表为团队打分,得出综合定级结果
  • 根据定级结果,知道该先补哪个模块,而不是跟风做"高级"的事
  • 识别两类典型错误:跳级硬推和用成熟度当政绩虚报

想推 AI 转型,先搞清楚团队现在到底在哪一级,别 L0 硬推 L3 的事。

这句话说起来容易,但很多管理者在决定"推 AI 落地"的时候,脑子里没有一张清晰的图:我的团队现在处于什么状态?基础在哪儿?缺口在哪儿?

于是就出现了一些经典场景:某公司 HR 团队,半数员工连 AI 工具账号都没注册,管理者已经在安排"全员 AI 流程再造"培训;某产品部门,AI 用了三个月,每个人各自摸索,提示词从没统一过,管理者却要上线"AI 辅助需求评审自动化系统"。跳级推进的结果,要么是落地无效,要么是团队产生强烈抵触,要么是建了一堆没人用的东西。

在推进之前,先定位。 这一节的核心就是给你一套工具,让你能回答这个问题:我的团队现在在哪一级?


为什么先评估再推进

很多管理者把 AI 落地看成一个执行问题——定好目标、排好计划、推动执行。但 AI 转型首先是一个基础设施问题。没有基础设施,再好的计划都是空的。

成熟度评估解决的是三件事:

一、诊断真实现状,而不是凭印象。 你对团队 AI 使用情况的判断,往往来自几个活跃分子的反馈,而不是全队的真实状态。评估能让你看到安静的大多数在哪里。

二、确定优先级,不乱撒资源。 L0 团队最缺的是"让人愿意用起来",L2 团队最缺的是"把个人经验变成组织资产"——两者需要完全不同的动作。没有定位,资源就会被浪费在不对的地方。

三、建立共同语言。 用同一套框架讨论"我们在哪里、要去哪里",比用"大家都要拥抱 AI"这种口号更能凝聚共识。


五级成熟度框架:L0—L4

成熟度不是说"AI 用得多先进",而是说团队把 AI 能力系统化、可持续化的程度。用得多但没有沉淀,仍然是低成熟度。

L0:观望期

核心特征:团队整体对 AI 持观望态度,工具接触极少,没有主动使用 AI 的习惯。

  • 多数人没有注册主流 AI 工具的账号,或注册后基本没用
  • 对 AI 的认知来自媒体报道,而不是亲身体验
  • 管理者可能有意愿,但不知道从哪里切入
  • 没有任何关于 AI 使用的内部规范或讨论

处于 L0 的原因:不是不聪明,也不是懒,而是缺乏"第一次成功体验"——没有人给过一次具体的、当场能用的示范。

L1:个人零散使用期

核心特征:部分人开始用 AI,但完全依赖个人探索,没有团队层面的任何组织化动作。

  • 少数积极分子在用 AI,大多数人偶尔用或完全不用
  • 提示词完全靠个人摸索,没有共享和沉淀
  • 同一个任务,不同人的 AI 使用方式和质量差异极大
  • 没有人知道"哪些活适合用 AI"——判断完全凭个人直觉
  • 有安全意识薄弱的情况:有人把内部数据直接粘进公开工具

典型话语:"我们有几个人在用,效果还不错。"——但说不出具体在哪些场景,也没有办法让其他人复制同样的效果。

L2:团队规范初建期

核心特征:团队开始系统化管理 AI 使用,有了基本的规范和可复用资产。

  • 有统一的 AI 工具使用规范(至少有数据安全底线的明文规定)
  • 有团队共享的提示词模板,覆盖高频场景
  • 有人负责收集、整理、更新提示词库(即使是兼职)
  • AI 使用已经被纳入部分工作流程(比如会议纪要、文案初稿)
  • 管理者能说出具体场景下 AI 帮团队省了什么时间

这一阶段的关键是可复用性——好的经验不再停留在个人那里,开始变成组织资产。

L3:流程级重构期

核心特征:不只是用 AI 提效,而是重新设计了部分核心工作流程,AI 是流程的内置环节。

  • 有 1—3 个关键工作流被系统重做,AI 是这些流程的必要节点(不是"可选用"的辅助)
  • 有量化的效果数据:哪个流程用了 AI,省了多少时间、提升了多少质量
  • 团队成员对"AI 能做什么、不能做什么"有清晰共识,不再靠管理者一个个解释
  • 开始涉及跨岗位、跨部门的 AI 协作

这一阶段不再是"用 AI 帮我做事",而是"工作流本身长成了含有 AI 的样子"。(关于流程重构的方法论,见 重造在前,自动化在后:AI 流程改造的正确顺序。)

L4:规模化治理期

核心特征:AI 使用已经成为组织能力,有系统性的治理机制,并且在不断迭代。

  • 有正式的 AI 治理框架(工具采购标准、数据分级规则、审计机制)
  • AI 相关能力建设纳入人员发展体系(不是一次性培训,而是持续评估)
  • 有跨部门的 AI 落地协调机制
  • 有内部最佳实践的传播和复制机制
  • 管理层有 AI 能力的定期复盘指标

L4 不是终点,是一种持续运行的状态。 技术在变,业务在变,治理机制也必须随之迭代。


五维度自测表

下面这张表可以直接用。五个维度,每个维度用 L0—L4 描述,对照选出最符合当前实际的等级,最后综合判断整体处于哪一级。

注意:要按实际情况填,不是按"期望状态"填。如果你不确定某个维度,就选更低的那个。


维度一:工具使用普及度

等级 描述
L0 全队几乎没人在用 AI 工具;有账号但基本没打开过
L1 20%—40% 的人偶尔用,其余人几乎不用;使用频率参差不齐
L2 60% 以上的人每周都在用 AI,覆盖主要岗位
L3 主要岗位的核心任务,AI 是日常工作工具,不用反而是例外
L4 全队 AI 工具使用被系统追踪,有使用率/效果数据看板

你的团队当前等级:___


维度二:提示词规范与共享

等级 描述
L0 没有任何提示词积累,每次用 AI 全靠临时想
L1 个别人有自己的提示词,但完全没有共享,其他人复制不了
L2 有团队共享的提示词库(哪怕只是一个共享文档),覆盖 5 个以上高频场景
L3 提示词库按岗位/场景分层管理,有人负责维护,有版本记录
L4 提示词库纳入知识管理体系,有定期审计和更新机制,与工具链集成

你的团队当前等级:___

关于如何建团队提示词库,见 团队提示词库:从散乱到统一可复用的落地指南


维度三:知识沉淀与传播

等级 描述
L0 AI 使用经验停留在个人头脑里,没有任何沉淀
L1 偶尔在群里分享一个截图或提示词,但没有系统化存储,找不回来
L2 有文档化的最佳实践,新人能通过文档了解团队 AI 使用方式
L3 有机制让个人经验变成组织资产,AI 用法迭代能被追踪
L4 有内部知识复盘会,跨部门最佳实践可以被识别和复制

你的团队当前等级:___


维度四:工作流程改造程度

等级 描述
L0 没有任何流程因为 AI 发生改变
L1 AI 作为个人辅助工具,在原流程之外用,流程本身没变
L2 1—2 个流程节点加入了 AI(比如会议纪要、文案初稿),但整体流程架构不变
L3 有 1—3 个关键流程被系统重设计,AI 是流程的内置必要环节
L4 流程设计中默认考虑 AI 的角色,有跨部门流程协同的 AI 接入

你的团队当前等级:___


维度五:治理与合规意识

等级 描述
L0 没有任何关于 AI 使用的规定;有人把内部数据直接粘进公开工具
L1 管理者口头强调过"不要放敏感信息",但没有明文规定,执行全靠自觉
L2 有书面的 AI 使用规范,包含数据安全底线;新人入职有告知
L3 有工具白名单/黑名单,数据分级规则,定期合规检查
L4 有 AI 治理委员会或负责人,审计机制,与信息安全体系联动

你的团队当前等级:___


综合定级

五个维度打完分之后,按以下逻辑确定综合等级:

  1. 找出最低分的维度:综合等级不高于最低维度得分。(短板决定上限,不是平均分。)
  2. 看是否有连片 L2 以上:如果多数维度达到 L2,但有一个维度卡在 L0,这个 L0 就是首要修复目标。
  3. 综合判断:多数维度在某个等级,就是你的当前定位。
综合定级 判断标准
L0 多数维度 L0,没有任何组织化动作
L1 多数维度 L1,个别人在用但没有任何共享或规范
L2 多数维度 L2,有基础规范和共享资产
L3 多数维度 L3,有流程级重构和量化数据
L4 多数维度 L4,有系统性治理机制

注意:大多数团队在不同维度上不均衡,这很正常——找出最薄弱的维度才是重点。


按评估结果:该先补哪块

定好级之后,重点不是"我要升到下一级",而是先修短板,再谈升级

如果你在 L0

首要任务:制造第一次成功体验,而不是推制度。

  • 选 2—3 个最高频、最低风险的任务(比如周报整理、会议纪要、文案初稿),给全队做一次现场演示
  • 管理者自己先用,用完当众讲"我用 AI 做了什么、省了多少时间"
  • 不要在 L0 阶段推任何规范或培训——没有使用基础,规范是空的

L0 最需要的是示范,不是制度。

如果你在 L1

首要任务:把个人经验变成团队资产。

  • 找出团队里 AI 用得最好的 2—3 个人,请他们把自己用过的提示词整理出来
  • 建一个极简提示词库(飞书文档或 Notion 都行),先收 10 条高频场景
  • 给治理补底线:一份两百字的"AI 使用安全守则",全队确认一次

L1 最容易犯的错误是跳过"提示词共享",直接冲流程改造——基础没有,流程改造做不起来。

如果你在 L2

首要任务:选一个流程做深度重构试点。

  • 不要继续横向扩展工具使用,而是选一个核心流程(比如产品需求评审、客户沟通处理、数据报告生成),系统地重新设计这个流程
  • 重构完成后,量化效果,用数据说话
  • 同时补齐知识沉淀机制——谁来维护、怎么更新、新人怎么上手

L2 到 L3 的核心跨越:从"个人用 AI 高效"变成"流程本身包含 AI"。

如果你在 L3

首要任务:建立跨部门协调和治理机制。

  • 单部门的 L3 做好了,现在要看跨部门场景:哪些工作流需要多个部门的 AI 协作?
  • 数据安全和合规机制是否跟上了流程复杂度的增长?
  • 有没有内部最佳实践的传播机制,让一个部门做好的事情,其他部门能学到

L3 到 L4 的常见障碍:信息孤岛——各部门自己在做,但没有跨部门的共享机制和统一治理视角。


反面教训

这两类错误反复出现,值得专门讲。

跳级硬推

一个典型剧情:管理者看了几篇 AI 转型报告,对标某头部公司的 L3/L4 做法,决定直接引入"AI 辅助需求管理系统"。团队里多数人连提示词怎么写都不清楚,直接就进入了"系统流程改造"阶段。

结果:系统建完没人用,推了两个月以后悄悄搁置,投入的资源打了水漂,团队对 AI 的信心反而更低。

跳级的根本问题:高成熟度的做法依赖低成熟度的基础。没有 L1 的个人使用基础,L2 的提示词库是空架子;没有 L2 的规范和共享资产,L3 的流程重构推不动。每一层都是下一层的地基。

判断自己是否在跳级的方法:如果你在计划某件事的时候,需要假设"团队成员已经具备 X 能力",但你没有确认这个假设是否成立——你很可能在跳级。

用成熟度当政绩虚报

另一个更隐蔽的问题:某些团队或管理者,把"评估成熟度"变成了自我汇报的机会,向上汇报时选评分有利的维度,或者把"有提示词文档"等同于"提示词库已经在用"。

这类虚报有两个危害:

一是资源错配。上级以为这个团队已经在 L2—L3,就不给基础支持了,但实际上基础根本没打好。

二是内部信任损耗。团队成员清楚地知道现实和汇报之间的差距,这会加速他们对"AI 转型"这件事的不信任。

正确的做法:评估结果对内真实,对上汇报的是"我们在哪里、下一步要做什么、需要什么支持"——而不是"我们已经很厉害了"。低定位不是问题,低定位但不知道怎么往前走才是问题。


常见问题

自测表是让我自己填,还是让团队成员填?

两者都可以,但建议同时做,然后对比结果。管理者的感知往往高于团队成员的实际状态,差距本身就是信息。如果你认为团队在 L2,但团队成员普遍认为自己在 L1,说明规范和沉淀的落地没你想的那么好。

评估完发现我们在 L0/L1,要不要跟上级汇报?

这取决于上级是否在推 AI 落地。如果是,定位清晰是好事——比"我们在积极推进"这种含糊表态更有说服力。你可以汇报"我们当前在 L1,下一步计划是 X,需要 Y 支持",这比虚报高级更有建设性。

多久评估一次?

初期每季度一次,到了 L2 以上可以半年一次。关键节点(比如引入新工具、做了一次流程改造、发生过数据事件)之后,随时可以重新评估。

五个维度不均衡,比如工具使用 L2 但治理只有 L0,怎么处理?

这非常常见,也是评估最有价值的地方。不均衡说明有明确的短板需要先补。治理在 L0 意味着有安全风险——越早补治理底线越好,不要等到出了问题再做。规范不复杂,一份两百字的"AI 使用安全守则"就能把治理从 L0 拉到 L1。

我们已经到 L2—L3 了,还需要看这张表吗?

需要,因为成熟度会退步。人员更替、业务调整、工具变化都会导致某些维度滑回低级。定期重新评估是发现退步的机制,不只是给新手用的。


小结 · 你现在该做什么

  • 理解了 AI 成熟度的五级框架(L0 观望 / L1 个人零散 / L2 团队规范初建 / L3 流程级重构 / L4 规模化治理),能给自己的团队定位
  • 完成了五维度自测(工具使用 / 提示词规范 / 知识沉淀 / 流程改造 / 治理合规),找到了短板维度
  • 拿到了按定级的行动建议:L0 先做示范,L1 先建提示词库,L2 先做流程试点,L3 补跨部门治理
  • 知道了两类反面教训:跳级硬推依赖不存在的基础,用成熟度当政绩虚报损耗内部信任

定好位,看清楚短板,然后再谈推进。想了解管理者自己应该具备什么 AI 认知基础,见 管理者 AI 认知地图:能力边界在哪里;提示词库从零开始怎么建,见 团队提示词库:从散乱到统一可复用的落地指南;准备做流程改造的,先看 重造在前,自动化在后:AI 流程改造的正确顺序

👉 看看 AI 时代的组织与管理 专栏,或了解 AI 时代管理者认知课。需要定制落地与陪跑,欢迎聊 企业服务

内容有错、看不懂、或想看下一期?告诉我们 →

本文为学习与落地整理,AI 工具与平台更新较快,关键步骤请结合官方最新资料验证。见免责声明