评估团队 AI 成熟度:自测表 + 分级诊断行动建议
- 理解 AI 成熟度分级(L0—L4)的本质含义和典型特征,能准确给团队定位
- 用五维度自测表为团队打分,得出综合定级结果
- 根据定级结果,知道该先补哪个模块,而不是跟风做"高级"的事
- 识别两类典型错误:跳级硬推和用成熟度当政绩虚报
想推 AI 转型,先搞清楚团队现在到底在哪一级,别 L0 硬推 L3 的事。
这句话说起来容易,但很多管理者在决定"推 AI 落地"的时候,脑子里没有一张清晰的图:我的团队现在处于什么状态?基础在哪儿?缺口在哪儿?
于是就出现了一些经典场景:某公司 HR 团队,半数员工连 AI 工具账号都没注册,管理者已经在安排"全员 AI 流程再造"培训;某产品部门,AI 用了三个月,每个人各自摸索,提示词从没统一过,管理者却要上线"AI 辅助需求评审自动化系统"。跳级推进的结果,要么是落地无效,要么是团队产生强烈抵触,要么是建了一堆没人用的东西。
在推进之前,先定位。 这一节的核心就是给你一套工具,让你能回答这个问题:我的团队现在在哪一级?
为什么先评估再推进
很多管理者把 AI 落地看成一个执行问题——定好目标、排好计划、推动执行。但 AI 转型首先是一个基础设施问题。没有基础设施,再好的计划都是空的。
成熟度评估解决的是三件事:
一、诊断真实现状,而不是凭印象。 你对团队 AI 使用情况的判断,往往来自几个活跃分子的反馈,而不是全队的真实状态。评估能让你看到安静的大多数在哪里。
二、确定优先级,不乱撒资源。 L0 团队最缺的是"让人愿意用起来",L2 团队最缺的是"把个人经验变成组织资产"——两者需要完全不同的动作。没有定位,资源就会被浪费在不对的地方。
三、建立共同语言。 用同一套框架讨论"我们在哪里、要去哪里",比用"大家都要拥抱 AI"这种口号更能凝聚共识。
五级成熟度框架:L0—L4
成熟度不是说"AI 用得多先进",而是说团队把 AI 能力系统化、可持续化的程度。用得多但没有沉淀,仍然是低成熟度。
L0:观望期
核心特征:团队整体对 AI 持观望态度,工具接触极少,没有主动使用 AI 的习惯。
- 多数人没有注册主流 AI 工具的账号,或注册后基本没用
- 对 AI 的认知来自媒体报道,而不是亲身体验
- 管理者可能有意愿,但不知道从哪里切入
- 没有任何关于 AI 使用的内部规范或讨论
处于 L0 的原因:不是不聪明,也不是懒,而是缺乏"第一次成功体验"——没有人给过一次具体的、当场能用的示范。
L1:个人零散使用期
核心特征:部分人开始用 AI,但完全依赖个人探索,没有团队层面的任何组织化动作。
- 少数积极分子在用 AI,大多数人偶尔用或完全不用
- 提示词完全靠个人摸索,没有共享和沉淀
- 同一个任务,不同人的 AI 使用方式和质量差异极大
- 没有人知道"哪些活适合用 AI"——判断完全凭个人直觉
- 有安全意识薄弱的情况:有人把内部数据直接粘进公开工具
典型话语:"我们有几个人在用,效果还不错。"——但说不出具体在哪些场景,也没有办法让其他人复制同样的效果。
L2:团队规范初建期
核心特征:团队开始系统化管理 AI 使用,有了基本的规范和可复用资产。
- 有统一的 AI 工具使用规范(至少有数据安全底线的明文规定)
- 有团队共享的提示词模板,覆盖高频场景
- 有人负责收集、整理、更新提示词库(即使是兼职)
- AI 使用已经被纳入部分工作流程(比如会议纪要、文案初稿)
- 管理者能说出具体场景下 AI 帮团队省了什么时间
这一阶段的关键是可复用性——好的经验不再停留在个人那里,开始变成组织资产。
L3:流程级重构期
核心特征:不只是用 AI 提效,而是重新设计了部分核心工作流程,AI 是流程的内置环节。
- 有 1—3 个关键工作流被系统重做,AI 是这些流程的必要节点(不是"可选用"的辅助)
- 有量化的效果数据:哪个流程用了 AI,省了多少时间、提升了多少质量
- 团队成员对"AI 能做什么、不能做什么"有清晰共识,不再靠管理者一个个解释
- 开始涉及跨岗位、跨部门的 AI 协作
这一阶段不再是"用 AI 帮我做事",而是"工作流本身长成了含有 AI 的样子"。(关于流程重构的方法论,见 重造在前,自动化在后:AI 流程改造的正确顺序。)
L4:规模化治理期
核心特征:AI 使用已经成为组织能力,有系统性的治理机制,并且在不断迭代。
- 有正式的 AI 治理框架(工具采购标准、数据分级规则、审计机制)
- AI 相关能力建设纳入人员发展体系(不是一次性培训,而是持续评估)
- 有跨部门的 AI 落地协调机制
- 有内部最佳实践的传播和复制机制
- 管理层有 AI 能力的定期复盘指标
L4 不是终点,是一种持续运行的状态。 技术在变,业务在变,治理机制也必须随之迭代。
五维度自测表
下面这张表可以直接用。五个维度,每个维度用 L0—L4 描述,对照选出最符合当前实际的等级,最后综合判断整体处于哪一级。
注意:要按实际情况填,不是按"期望状态"填。如果你不确定某个维度,就选更低的那个。
维度一:工具使用普及度
| 等级 | 描述 |
|---|---|
| L0 | 全队几乎没人在用 AI 工具;有账号但基本没打开过 |
| L1 | 20%—40% 的人偶尔用,其余人几乎不用;使用频率参差不齐 |
| L2 | 60% 以上的人每周都在用 AI,覆盖主要岗位 |
| L3 | 主要岗位的核心任务,AI 是日常工作工具,不用反而是例外 |
| L4 | 全队 AI 工具使用被系统追踪,有使用率/效果数据看板 |
你的团队当前等级:___
维度二:提示词规范与共享
| 等级 | 描述 |
|---|---|
| L0 | 没有任何提示词积累,每次用 AI 全靠临时想 |
| L1 | 个别人有自己的提示词,但完全没有共享,其他人复制不了 |
| L2 | 有团队共享的提示词库(哪怕只是一个共享文档),覆盖 5 个以上高频场景 |
| L3 | 提示词库按岗位/场景分层管理,有人负责维护,有版本记录 |
| L4 | 提示词库纳入知识管理体系,有定期审计和更新机制,与工具链集成 |
你的团队当前等级:___
关于如何建团队提示词库,见 团队提示词库:从散乱到统一可复用的落地指南。
维度三:知识沉淀与传播
| 等级 | 描述 |
|---|---|
| L0 | AI 使用经验停留在个人头脑里,没有任何沉淀 |
| L1 | 偶尔在群里分享一个截图或提示词,但没有系统化存储,找不回来 |
| L2 | 有文档化的最佳实践,新人能通过文档了解团队 AI 使用方式 |
| L3 | 有机制让个人经验变成组织资产,AI 用法迭代能被追踪 |
| L4 | 有内部知识复盘会,跨部门最佳实践可以被识别和复制 |
你的团队当前等级:___
维度四:工作流程改造程度
| 等级 | 描述 |
|---|---|
| L0 | 没有任何流程因为 AI 发生改变 |
| L1 | AI 作为个人辅助工具,在原流程之外用,流程本身没变 |
| L2 | 1—2 个流程节点加入了 AI(比如会议纪要、文案初稿),但整体流程架构不变 |
| L3 | 有 1—3 个关键流程被系统重设计,AI 是流程的内置必要环节 |
| L4 | 流程设计中默认考虑 AI 的角色,有跨部门流程协同的 AI 接入 |
你的团队当前等级:___
维度五:治理与合规意识
| 等级 | 描述 |
|---|---|
| L0 | 没有任何关于 AI 使用的规定;有人把内部数据直接粘进公开工具 |
| L1 | 管理者口头强调过"不要放敏感信息",但没有明文规定,执行全靠自觉 |
| L2 | 有书面的 AI 使用规范,包含数据安全底线;新人入职有告知 |
| L3 | 有工具白名单/黑名单,数据分级规则,定期合规检查 |
| L4 | 有 AI 治理委员会或负责人,审计机制,与信息安全体系联动 |
你的团队当前等级:___
综合定级
五个维度打完分之后,按以下逻辑确定综合等级:
- 找出最低分的维度:综合等级不高于最低维度得分。(短板决定上限,不是平均分。)
- 看是否有连片 L2 以上:如果多数维度达到 L2,但有一个维度卡在 L0,这个 L0 就是首要修复目标。
- 综合判断:多数维度在某个等级,就是你的当前定位。
| 综合定级 | 判断标准 |
|---|---|
| L0 | 多数维度 L0,没有任何组织化动作 |
| L1 | 多数维度 L1,个别人在用但没有任何共享或规范 |
| L2 | 多数维度 L2,有基础规范和共享资产 |
| L3 | 多数维度 L3,有流程级重构和量化数据 |
| L4 | 多数维度 L4,有系统性治理机制 |
注意:大多数团队在不同维度上不均衡,这很正常——找出最薄弱的维度才是重点。
按评估结果:该先补哪块
定好级之后,重点不是"我要升到下一级",而是先修短板,再谈升级。
如果你在 L0
首要任务:制造第一次成功体验,而不是推制度。
- 选 2—3 个最高频、最低风险的任务(比如周报整理、会议纪要、文案初稿),给全队做一次现场演示
- 管理者自己先用,用完当众讲"我用 AI 做了什么、省了多少时间"
- 不要在 L0 阶段推任何规范或培训——没有使用基础,规范是空的
L0 最需要的是示范,不是制度。
如果你在 L1
首要任务:把个人经验变成团队资产。
- 找出团队里 AI 用得最好的 2—3 个人,请他们把自己用过的提示词整理出来
- 建一个极简提示词库(飞书文档或 Notion 都行),先收 10 条高频场景
- 给治理补底线:一份两百字的"AI 使用安全守则",全队确认一次
L1 最容易犯的错误是跳过"提示词共享",直接冲流程改造——基础没有,流程改造做不起来。
如果你在 L2
首要任务:选一个流程做深度重构试点。
- 不要继续横向扩展工具使用,而是选一个核心流程(比如产品需求评审、客户沟通处理、数据报告生成),系统地重新设计这个流程
- 重构完成后,量化效果,用数据说话
- 同时补齐知识沉淀机制——谁来维护、怎么更新、新人怎么上手
L2 到 L3 的核心跨越:从"个人用 AI 高效"变成"流程本身包含 AI"。
如果你在 L3
首要任务:建立跨部门协调和治理机制。
- 单部门的 L3 做好了,现在要看跨部门场景:哪些工作流需要多个部门的 AI 协作?
- 数据安全和合规机制是否跟上了流程复杂度的增长?
- 有没有内部最佳实践的传播机制,让一个部门做好的事情,其他部门能学到
L3 到 L4 的常见障碍:信息孤岛——各部门自己在做,但没有跨部门的共享机制和统一治理视角。
反面教训
这两类错误反复出现,值得专门讲。
跳级硬推
一个典型剧情:管理者看了几篇 AI 转型报告,对标某头部公司的 L3/L4 做法,决定直接引入"AI 辅助需求管理系统"。团队里多数人连提示词怎么写都不清楚,直接就进入了"系统流程改造"阶段。
结果:系统建完没人用,推了两个月以后悄悄搁置,投入的资源打了水漂,团队对 AI 的信心反而更低。
跳级的根本问题:高成熟度的做法依赖低成熟度的基础。没有 L1 的个人使用基础,L2 的提示词库是空架子;没有 L2 的规范和共享资产,L3 的流程重构推不动。每一层都是下一层的地基。
判断自己是否在跳级的方法:如果你在计划某件事的时候,需要假设"团队成员已经具备 X 能力",但你没有确认这个假设是否成立——你很可能在跳级。
用成熟度当政绩虚报
另一个更隐蔽的问题:某些团队或管理者,把"评估成熟度"变成了自我汇报的机会,向上汇报时选评分有利的维度,或者把"有提示词文档"等同于"提示词库已经在用"。
这类虚报有两个危害:
一是资源错配。上级以为这个团队已经在 L2—L3,就不给基础支持了,但实际上基础根本没打好。
二是内部信任损耗。团队成员清楚地知道现实和汇报之间的差距,这会加速他们对"AI 转型"这件事的不信任。
正确的做法:评估结果对内真实,对上汇报的是"我们在哪里、下一步要做什么、需要什么支持"——而不是"我们已经很厉害了"。低定位不是问题,低定位但不知道怎么往前走才是问题。
常见问题
自测表是让我自己填,还是让团队成员填?
两者都可以,但建议同时做,然后对比结果。管理者的感知往往高于团队成员的实际状态,差距本身就是信息。如果你认为团队在 L2,但团队成员普遍认为自己在 L1,说明规范和沉淀的落地没你想的那么好。
评估完发现我们在 L0/L1,要不要跟上级汇报?
这取决于上级是否在推 AI 落地。如果是,定位清晰是好事——比"我们在积极推进"这种含糊表态更有说服力。你可以汇报"我们当前在 L1,下一步计划是 X,需要 Y 支持",这比虚报高级更有建设性。
多久评估一次?
初期每季度一次,到了 L2 以上可以半年一次。关键节点(比如引入新工具、做了一次流程改造、发生过数据事件)之后,随时可以重新评估。
五个维度不均衡,比如工具使用 L2 但治理只有 L0,怎么处理?
这非常常见,也是评估最有价值的地方。不均衡说明有明确的短板需要先补。治理在 L0 意味着有安全风险——越早补治理底线越好,不要等到出了问题再做。规范不复杂,一份两百字的"AI 使用安全守则"就能把治理从 L0 拉到 L1。
我们已经到 L2—L3 了,还需要看这张表吗?
需要,因为成熟度会退步。人员更替、业务调整、工具变化都会导致某些维度滑回低级。定期重新评估是发现退步的机制,不只是给新手用的。
小结 · 你现在该做什么
- 理解了 AI 成熟度的五级框架(L0 观望 / L1 个人零散 / L2 团队规范初建 / L3 流程级重构 / L4 规模化治理),能给自己的团队定位
- 完成了五维度自测(工具使用 / 提示词规范 / 知识沉淀 / 流程改造 / 治理合规),找到了短板维度
- 拿到了按定级的行动建议:L0 先做示范,L1 先建提示词库,L2 先做流程试点,L3 补跨部门治理
- 知道了两类反面教训:跳级硬推依赖不存在的基础,用成熟度当政绩虚报损耗内部信任
定好位,看清楚短板,然后再谈推进。想了解管理者自己应该具备什么 AI 认知基础,见 管理者 AI 认知地图:能力边界在哪里;提示词库从零开始怎么建,见 团队提示词库:从散乱到统一可复用的落地指南;准备做流程改造的,先看 重造在前,自动化在后:AI 流程改造的正确顺序。
👉 看看 AI 时代的组织与管理 专栏,或了解 AI 时代管理者认知课。需要定制落地与陪跑,欢迎聊 企业服务。