Automotive SPICE 4.1 过程能力评估与 3.1 迁移要点解析(Automotive Specialty翻译) ypxx.net

ASPICE 深度解析系列(第1期):Automotive SPICE 4.1 过程能力评估——从版本迁移到 CL3 证据链的完整闭环

图1 Automotive SPICE 4.1 主题封面:V 模型骨架与 CL0-CL5 能力刻度,对应过程能力评估主线

一句话总结:本文带你完整走一遍 Automotive SPICE 4.1 的落地全流程——版本差异比对、评估范围圈定、过程域建设、证据链组织、现场评估推演、定级与持续改进,解决"客户要求按 4.x 评估、现有 3.1 体系怎么办"的换版难题。

零 痛点开场:一个项目经理的换版难题

问:客户 SQE 在邮件里写"下季度过程审核,结果按 Automotive SPICE 4.x 出"——你打开按 3.1 建了三年的体系文件,发现 SYS.6 不见了,多出 HWE、MLE 两个陌生过程组,SUP.10 也改了名。手头的证据还能用吗?从哪里补起?

如果你负责过车载软件研发体系,大概率在某个深夜收到过类似的邮件。ASPICE 这套东西,平时感觉是"写文档的负担",一到供应商准入、项目投标、审核现场,它就是决定拿不拿得到订单的那道闸门。

如果说 ISO 26262 管的是"产品安不安全",ASPICE 管的就是"造产品的过程稳不稳"。它像一个研发体系的体检标准加教练手册:体检报告(评估定级)交给客户看,训练计划(改进建议)留给自己练。过程能力等级上不去,产品的安全论证再漂亮,客户也会问一句:你们每次都能稳定做出来吗?

把视角拉到当下:4.0 版于 2023 年 11 月发行,4.1 版由 VDA QMC 第 13 工作组于 2026 年 8 月发布,配套指南第 3 版把"AI 辅助开发"与"维护"正式写进评估视野。行业正处在 3.1 向 4.x 换版的深水区,这一期我们把换版与迎评一次讲透。

一 概念与差距分析——4.x 到底改了什么,我们差多远

问:3.1 体系跑了三年,4.x 改在哪里?直接拿老证据迎评行不行?

先厘清身世。ASPICE(Automotive SPICE,汽车软件过程改进及能力评定)由德国汽车工业协会质量管理中心(VDA QMC)第 13 工作组维护,包含过程参考模型(PRM,Process Reference Model)与过程评估模型(PAM,Process Assessment Model)两份文件;评估量规脱胎于 ISO/IEC 15504 过程评估框架,与 ISO/IEC 33020 的度量框架对齐,评估师则由 intacs 注册体系管理。

4.0 的结构变化记三笔账:删了 10 个少用或重叠的过程(ACQ.3、ACQ.11-ACQ.15、SPL.1,以及与 SUP.1 重叠的 SUP.2、SUP.4,与 SUP.8 重叠的 SUP.7);新增 3 个过程组共 10 个过程(VAL.1 确认,HWE.1-HWE.4 硬件工程,MLE.1-MLE.4 机器学习工程加 SUP.11 机器学习数据管理);另有若干改名——原 SYS.6 的系统鉴定测试职责并入 VAL.1,SYS.5 变为系统验证,SWE.5/SWE.6 改用验证类命名,SUP.10 明确为变更请求管理。

4.1 则是勘误级小版本:PAM 从 153 页到 159 页,过程数量、能力等级、评估方法全部不变。实质调整集中在少数过程:SYS.1 需求获取新增"识别相关干系人"的成果与信息项;SPL.2 产品发布要求发布内容与预期客户达成一致;SYS.4 与 SWE.5 把"验证措施的必要顺序"恢复为必备要素;MLE.2 删去资源消耗类实践、MLE.4 恢复通过/失败判据;HWE.2 收窄硬件设计评估范围。真正的大头在配套指南第 3 版:新增 AI 辅助开发与维护两个章节,并补充遗留软件与复用组件的评分规则。

下面这张版本演进表,是启动换版时先给管理层看的一页。

💡 实战提醒:换版评估先做"范围圈定"——基础过程域(MAN.3、SUP.1、SUP.8、SUP.9、SUP.10)必选,工程过程域至少选一组,灵活过程域按需。范围清单要跟客户书面确认,比事后加过程便宜得多。

差距分析的第二步,是把现有证据按新过程 ID 重映射,并判断每个过程当前的能力等级差距。能力等级 CL0 到 CL5 的含义如下表。

定级推演示例:某 Tier1 座舱软件团队试点评估 SYS.2 系统需求分析,五条基本实践全部有证据,PA1.1 过程绩效评为 F(完全达成);但项目计划齐、监控记录少,PA2.1 绩效管理评为 L(大部分达成);工作产品命名规则不统一,PA2.2 工作产品管理评为 P(部分达成)。按"该等级及以下全部过程属性至少 L"的判定规则,CL2 因 PA2.2 只有 P 而未达成,过程定级 CL1。团队用两个月补齐命名规范与基线管理,复评 PA2.2 升为 L,过程定级升至 CL2。等级不是评出来的,是平时管出来的。

图2 版本演进时间轴:3.1 到 4.1 的结构变化与指南第 3 版两个新章节,对应换版差距分析

二 体系与架构——32 个过程怎么装进一张图

问:32 个过程、11 个组,它们之间是什么关系?哪些必选、哪些可选?

4.1 沿用 4.0 的三层范围结构:基础过程域必选,是 CL2 证据的主产地;工程过程域至少选一组,软件开发选 SYS+SWE,电子开发选 SYS+HWE,纯软件选 SWE;灵活过程域按需勾选。机器学习工程不是独立王国——按 PAM 附录的"插件"概念,MLE 过程挂在软件工程主干上,训练数据链路由 SUP.11 单独管理,附录还给出了 ML 架构示例与工作产品追溯关系。

比清单更重要的是心智模型:一张 V 模型图加五个支撑过程,就是 ASPICE 的全部骨架。左翼自上而下分解——需求获取、系统需求、系统架构、软件需求、软件架构、详细设计;右翼自下而上验证——单元验证、组件与集成验证、软件验证、系统集成验证、系统验证、确认;MAN 与 SUP 过程贯穿全程。左右翼之间的每条横向虚线,都是一条双向追溯链。

💡 关键认知:把 32 个过程当 32 座孤岛去建体系,必然建出"两张皮"。正确姿势是先画 V 模型,再把支撑过程当传送带,随后用映射表把功能安全、网络安全的要求挂到同一条证据链上。

图3 Automotive SPICE 4.1 过程全景:基础域、工程域、灵活域三层范围结构与 32 个过程分布

图4 V 模型与过程映射:左翼分解、右翼验证,MLE 以插件方式挂接,支撑过程贯穿全程

三 过程实施——BP、WP 与 CL2/CL3 的分水岭

问:评估老师翻的到底是什么?为什么有的团队"文档齐全"还是只拿 CL1?

先分清三件套。BP(Base Practice,基本实践)回答"做没做",对应过程成果;GP(Generic Practice,通用实践)与信息项回答"管得好不好",对应过程属性。CL1 只看 PA1.1 过程绩效;CL2 要求 PA2.1 绩效管理与 PA2.2 工作产品管理双双达成;CL3 在此之上要求 PA3.1 过程定义与 PA3.2 过程部署。文档齐全只说明 CL1 的产出在,CL2 看的是管理痕迹。

五个支撑过程是 CL2 证据的主产地,也是审核现场被翻得频次高低依次排队的地方。它们的共同特点是:平时不产生"技术价值",缺了它们所有技术证据都不可信。

工程域证据的命根子是双向追溯。系统需求要能追到软件需求,软件需求要能追到验证用例,反过来每条用例都要能回到需求。下面是一张可落地的追溯矩阵样例。

💡 实战提醒:CL2 与 CL3 的分水岭是"项目管得好"与"组织会复制"。PA3.1 要企业标准过程,PA3.2 要项目裁剪部署记录——一套文件两个用途,别为了评估把标准过程抄成第二套与项目平行的体系。

图5 能力等级阶梯与评分推演:CL0-CL5 定义、N/P/L/F 量规与 SYS.2 定级示例

四 证据与工具链——AI 辅助进入评估视野

问:证据包怎么组织?AI 写的代码、生成的文档,评估时算不算数?

证据组织用矩阵法:按"过程×信息项×存放位置×责任人"列一张表,评估前自查。哪些过程抽得到证据、抽到的证据能不能互证,一目了然。下面这张矩阵是评估前自查的底稿。

指南第 3 版把 AI 辅助开发正式写进评估:不强制也不限制具体工具,AI 支持过程活动、生成工作产品被视为正当实践,但产出必须在接受前经过评审,且 AI 引入的风险要按明确准则管理。指南明确要求评估师在访谈与定级中核查 AI 的使用痕迹,重点落在配置管理、质量保证与工作产品管理三处。

维护章节同样值得细读:SOP(Start of Production,量产启动)前看可维护性有没有规划,SOP 后看修复、增强、补丁的开发是否受控,评判口径是"当前团队有没有把产品和文档准备好移交",而不是替未来的维护组织打分。新的评分规则还专门处理了遗留软件与复用组件——未反映在需求或架构里的旧代码,不能再用"历史原因"搪塞过去。

💡 关键认知:AI 生成的工作产品是草稿,人评审加受控入库之后才是证据。评审记录里写清"AI 参与生成、人工确认",比藏着掖着更能过评——指南已经把 AI 使用当成了需要管理的事实,而不是要隐藏的瑕疵。

图6 AI 辅助开发的评估要点:生成、评审闸门、受控入库三段式,以及 SUP.8、SUP.1、PA2.2 三处专项检查

五 测试评估——现场评估怎么跑,分数怎么算

问:听说评估就是"抽文档加访谈"?能力等级的分数到底怎么算出来的?

一场正式评估分六个阶段走:评估准备确认范围与过程清单,证据抽样按过程抽取信息项与记录,角色访谈从项目经理覆盖到一线工程师,初步发现与被评方当面核对,之后按 BP 与 GP 证据映射到过程属性完成定级,随后形成评估报告。评估师分两级:Provisional(临时评估师)可在受限范围参与,Competent(主管评估师)可主导全程。

评分量规是四档标尺:N 未达成(0 到不超过 15%)、P 部分达成(15% 到 50%)、L 大部分达成(50% 到 85%)、F 完全达成(85% 到 100%),评估师还可用 P-、P+、L-、L+ 细分档收敛分歧。过程定级的规则只有一句话:某等级达成,当且仅当该等级及以下全部过程属性至少评为 L。下面用 SYS.2 做一次完整推演。

推演结论:SYS.2 定级 CL3,但三个 L 都是边界分——监控记录断层、命名规则不统一、部署培训缺口,就是评估报告里的改进建议来源。再强调一次访谈的分量:评估师会问一线工程师"这个流程你实际怎么做",突击补的证据时间戳集中、版本跳跃,交叉提问立刻露馅。口径统一培训过的团队,往往在第二个访谈对象身上就前后矛盾。

💡 实战提醒:把"证据时间戳自然分布"当成日常习惯而不是评估动作。计划随项目更新、评审随阶段发生、问题随发现关闭,评估现场才不需要演技。

图7 现场评估六步流程:从范围确认到评估报告,量规打分与访谈交叉验证贯穿全程

六 审核定级与持续改进——CL2/CL3 之后怎么办

问:评估通过就一劳永逸了吗?OEM 的供应商准入到底看什么?

评估结果反映的是评估时点上的过程能力。组织架构大调整、产品线切换、模型大版本更新之后,结论都需要重新建立——这次 3.1 向 4.x 换版就是典型场景。行业普遍把 CL2 当作供应商准入门槛、CL3 当作标杆要求;据 VDA QMC 公开发布页,2024 年 8 月还推出了 Potential Analysis(潜力分析)评估模型,供 OEM 在供应商早期筛选时快速摸底。

能力提升按台阶走,每级都有明确的投入重心与周期特征。下表是据公开行业实践整理的节奏参考,具体项目应按团队能力裁剪。

到这里六步闭环成型:差距分析定范围、体系架构建骨架、过程实施留痕迹、证据工具链管资产、测试评估出定级、改进闭环回差距。评估报告里的每个弱点项,都应当回到步骤一的差距清单里排队,而不是评估一结束就归档吃灰。

💡 关键认知:CL3 不是终点。CL4 要求用度量数据做量化分析与控制(PA4.1、PA4.2),对多数团队,先把 CL2 的管理动作练成肌肉记忆,比追逐高等级更划算。

图8 能力提升路线图:CL1 跑通、CL2 管住、CL3 固化、CL4 量化的进阶路径与投入重心

七 行业案例(据公开资料整理)

以下均为企业官方渠道或公开媒体报道的客观陈述,评估范围与结论以各家公布为准。

• 经纬恒润:据其公开发布,2026 年 7 月,基础软件平台 HIRAIN OS 开发项目通过 Automotive SPICE PAM 4.0 能力等级 3 评估——公开案例中少见的明确按 4.0 模型定级的实践,对正在换版的团队有直接参照价值。

• 德赛西威:据公司官网新闻,2022 年 7 月其智能座舱域控制器项目通过 ASPICE CL3 过程能力评估,同年 9 月智能驾驶产品亦公开了 CL3 结果,覆盖座舱与智驾两条产品线。

• 慧荣科技:据公开报道,2025 年 2 月其车用 SSD 主控芯片通过 ASPICE CL3 评估,评估对象从车载应用软件延伸到存储主控芯片。

案例背后的趋势比结论更有用:评估对象正从座舱、智驾应用软件,扩展到基础软件与芯片,这与 4.0 新增硬件工程、机器学习工程两个过程组的方向一致——硬件与 AI 负载,都进入了过程评估的射程。

八 容易踩的坑

❌ 拿 3.1 证据直接迎 4.x 评估 → ✅ 先做过程映射表:SYS.6 职责并入 VAL.1,SWE.5/SWE.6 采用新命名,SUP.10 改名不影响证据主体,但体系文件的引用必须更新。

❌ 为了凑 CL3 把标准过程抄成第二套文件 → ✅ 标准过程加项目裁剪记录,一套文件两个用途;平行体系注定在访谈时露馅。

❌ AI 生成的文档未经评审直接入库 → ✅ 按指南第 3 版执行"评审后接受",配置管理记录生成与评审轨迹,AI 使用在访谈中如实说明。

❌ 评估前突击补证据、给访谈统一口径 → ✅ 评估师会交叉验证访谈与时间戳,平时留痕才是硬通货;口径培训过头的团队,往往败在第二个访谈对象。

九 本期重点回顾

十 下期预告

下一期我们进入 ASPICE 的网络安全延伸:Automotive SPICE for Cybersecurity 2.0(VDA QMC 2025 年 3 月发布)。当客户要求"过程评估顺带覆盖网络安全",三个问题先行:

1. 网络安全扩展的 SEC 过程组怎么和 SYS、SWE 挂接,TARA 分析报告算哪类信息项?

2. 一场联评里,功能安全证据、网络安全证据、过程能力评级怎么织成一张证据网?

3. 指南第 3 版的 AI 与维护新章,会不会倒逼网络安全扩展再出新版?

十一 系列简介

本系列聚焦汽车软件过程能力与安全认证落地,定位工程师"看完就能用"的实战连载;本期为《ASPICE 深度解析系列》第 1 期:Automotive SPICE 4.1 过程能力评估。后续将覆盖网络安全扩展联评、评估师视角的评分细节、与 ISO 26262 的联合审计等主题。

— — — — — — — — — — — — — — — —

苏州纳兰企管提供以上专业技术支持,

欢迎联系邮件[email protected]获取解决方案。