我是小兵,一个动手派AI架构师。“AI工程化实战”系列第 16 篇。
选齐了国产组件,甲方三句话把我问住
第 15 篇那张选型地图,我把“国产化 / 私有化”标成了一整根约束轴,向量库、Embedding、推理引擎每一格都摆好了国产候选,写的时候觉得挺全。
结果有个政企项目,我照着地图把组件全选齐——都是国产的、还都能私有化——自以为交了个漂亮方案。甲方信息中心的老师看完,问了我三句话:
“这几样在信创名录里吗?”
“上了之后大半夜挂了,谁起来修?”
“跑在国产卡上出问题,原厂管不管?”
我一句都答不上来。那一刻我才知道:我那套“选型”,在政企只完成了第一关,后面还有四关,我一关都没核过。
实验室是技术题,政企是准入题
前十五篇该造的零件我都造了,可搬到政企落地,会撞上三个误区,一个比一个贵。
误区一,把政企选型当成“更严格的选型”。其实不是加严,是换了第一性约束——从“在一个开放集合里找最优”,变成“在一个被合规和名录框死的子集里找可行”。实验室里,选型是道技术题:哪个准、哪个快、哪个便宜;政企里,选型是道准入题:这东西能不能进网、进不进名录、谁来扛、原厂认不认账。先有可行解,才谈最优解;边界外的第一名,对你等于不存在。
误区二,以为信创有统一名单。这是我踩得最狠、也最反直觉的一条。数据库、操作系统、芯片(含 AI 芯片)确实有相对成熟的国测目录兜底;可 LLM 这一挂——推理引擎、向量库、Embedding、Agent 框架——没有一张统一的权威名单,只能逐家看原厂公开口径、逐项送测。
误区三,只算建设成本,不算运维成本。POC 阶段原厂工程师把集群架得漂漂亮亮、演示流畅、顺利验收;人一撤,这套栈就归你了——半夜挂了谁修、版本升级谁做,这笔账没人替你算。
五道关,顺序不能反
结论先撂这儿:政企国产化 = 五道关,顺序不能反——① 合规关(数据出不出域、等保密评、关键操作留审计)→ ② 信创关(进不进名录)→ ③ 运维关(谁半夜起来修)→ ④ 适配关(国产芯片/OS 上跑不跑得动)→ ⑤ 支持关(出事原厂兜不兜底)。
先说清一件事,免得你去搜一个搜不到的东西:这“五关”是我为“可核对”做的工程化归纳,不是哪个部门的官方分类。但它不悬空——每一关都挂得到公开流程上:合规挂等保密评、信创挂国测、运维挂采购的 SLA、适配挂信创适配中心、支持挂维保条款。
顺序为什么不能反?这是第 15 篇“硬约束先过滤、软权重后排序”的政企版。合规和信创是最硬的两条,一票否决:你推理再快,进不了信创名录就是台不能插电的服务器;你模型再强,越过合规边界就是泄密。顺序反了会算出什么?一个过不了合规的方案,因为跑得快所以“推荐”——实验室里荒谬,政企里是事故。
五关里最锋利的一刀在信创关:LLM 软件组件没有统一名录。国测目录只覆盖 CPU、人工智能训练推理芯片、操作系统、数据库、打印机主控芯片这五类——数据库、操作系统、芯片有目录兜底,可推理引擎、向量库、Embedding、Agent 框架这些软件组件不在其中。注意别说成“推理引擎不在目录里”就完事:昇腾 950 是“人工智能训练推理芯片”这个硬件、在目录里;“推理引擎”这个软件不在。懂行的人一句“昇腾 950 进目录了”就能反驳你,措辞得先站住。
更麻烦的是“信创兼容”这四个字没有统一定义:A 家指进了目录、B 家是拿了互认证证书、C 家只是有人在国产卡上跑通过——三个不是一个意思。
三个取舍点,每个都有代价
取舍一,先过边界,再谈性能。政企选型的第一性是准入约束,不是技术指标。代价我认:在合规边界内会牺牲一截性能、候选少自由度低,而且边界会动——今天核过的结论,明天可能就得重核。但边界外的方案,性能再高也是零分,它根本进不来。
取舍二,信创没有统一名单,只能逐家核。代价:逐家核、逐项送测,工作量极大,做完也不保证权威;口径不统一,没法横向对齐;有些条目就是核不到,只能自己担判断风险。我认,因为编死一句“已信创认证”,比留一句“待核实”危险得多。
取舍三,运维谁扛,比装不装得上更要命。代价:自建要人,可政企的编制预算卡得最死;原厂兜底要钱,边界还写得细;有些组件算下来就是养不起,只能退回一个更土但有人养的方案。我认,因为一套没人运维的私有化集群,比一套“不够先进”的托管服务更危险。
落点:一个纯标准库的核对器
“能核、能对账、能老实说核不到”是这一篇区别于“避坑清单文”的硬落点。落点是离线可跑、纯标准库、无 API key 的五关核对器:把五关核对项编成数据,输入“我的处境”,确定性地吐出“被哪几关卡住 + 带依据的结论 + 待人工确认清单”。
判定是四态不是两态——政企的现实是“很多项你核不到确定答案”:PASS(过了)、FAIL(卡住)、PENDING(核不到、标待核实)、NEEDS_HUMAN(口径冲突、需人工判断)。信创关里凡命中 LLM 软件组件的,一律 PENDING、绝不硬给 PASS;核不到的条目老实进“待人工确认清单”,不混在结论里蒙混过去。
跑一遍就很直观:同一套国产组件,数据分级从“内部”改成“涉密”,合规关就从 PASS 翻 FAIL——处境一换,结论就换;运维关不是报“装好了”,是算“缺 1 人”。完整可跑的核对器和 9 个断言见 CSDN 原文 / govcheck/mini_govcheck.py。
选型:三种做法,你该抄哪一种
|
|
|
|
|
|---|---|---|---|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
结论:做法①抄来的答案不一定是你的;做法②问一次只能用一次;做法③可复用、可对账,还能标出“我不确定的那部分”。小团队不用一上来就把五关填满,先把你自己项目真实要过的关填上,核对器就比任何“避坑清单”都有用。
三个真金白银的坑
坑一:我把“数据不出域”理解成了“服务器在我们机房”,漏了审计留痕,验收卡住。合规关其实有三层——数据在不在边界内、系统过不过等保密评、关键操作留不留可审计的痕,我只看了第一层。甲方合规口一问“你这个 LLM 每天放行哪些、拒绝哪些、谁批的、依据是什么”,我拉日志一看:只有机器日志,没有“谁、凭什么”的决策链。
教训:政企的“合规”不是“数据别跑出去”这一件事,它还要求每一次决策都能被追溯。
坑二:我照着一份“信创兼容清单”选了组件,交付才发现那清单根本不适用。我找的清单,是一家别的公司内部的清单,跟我们项目适用的目录/口径根本不是一套;更糟的是,LLM 软件组件这类东西很多根本不在任何一张统一名录里,原厂说的“信创兼容”和我理解的还不是一个意思。
教训:没有统一名单的东西,别替它编一个名单——你编的那个,迟早会在交付现场被拆穿。
坑三:POC 时原厂工程师架得漂漂亮亮,验收后人一撤,夜里集群挂了没人会修。某个夜里向量库集群挂了,值班的小伙子重启三次没起来,第二天一问原厂:“这套是你们自建的,维保合同里没包含这一项。”根因是我把“装得上”当成了终点,从没算过“装上之后谁养它”。
教训:私有化交付的终点不是“装好了”,是“有人能一直养着它”。
一句收口
回到开篇那三句问话——“在信创名录里吗”对应信创关,“半夜挂了谁修”对应运维关,“原厂管不管”对应支持关,加上合规关和适配关,就是政企国产化的五道关。
政企国产化避的坑,八成不是技术坑——在实验室,选型是道技术题(哪个准、哪个快、哪个便宜);到了政企,选型是道准入题(能不能进网、进不进名录、谁来扛、跑不跑得动、原厂认不认账);技术指标在这五关面前,一个都排不进前三。
还有句大实话:涉密项目我只给公开口径、不假装跑过;这篇里实打实跑过的,是一个省级和一个地市级的政企私有化交付,其余照实标“没实跑过”。
但注意:这五关是政企通用的一组约束。有的行业比这还狠一层——它不只要求你“能进来”,还要求你每一个决策事后都能被审计、被复现、被追到具体责任人。这套约束,五关没覆盖全。下一篇《金融级 AI 落地》讲的就是它。
这篇是脱水版。完整版里有五关核对表、判据复用表、一张“组件 × 关 × 依据 × 核实日期”的现状表,还有一个纯标准库、离线可跑、带 9 个断言的五关核对器——输入“我的处境”直接吐结论的那种。想看能核、能对账、能老实说“核不到”的完整版,点“阅读原文”直达 CSDN。
评论区聊聊:你被政企国产化这五关里的哪一关卡住过?
我是小兵,一个动手派AI架构师。这里只写自己跑过、摔过、复盘过的AI工程化案例。如果你想持续收到这类实战内容,点击关注,下篇见。

