本文的实证引用经过分级:正文引用的 30 组承重论断(数字的引用链原文、失败率一手测量、Agile/DevOps 档案、变革理论证据、AI 采纳数据)各经 3 名独立验证者对抗核查(逐字核对一手原文、检索反证、口径审查),30 组全部挺过反驳、其中 20 组按验证者意见完成 40 余处口径修正;未进入验证流程的引用标【未验证,来源】。方法学限定(自报口径/厂商利益/预测 vs 实测)在正文中如实交代,文末附来源索引。
打开任何一份 AI 转型方案的开场白,大概率会撞见同一个句式:"研究表明,70% 的转型会失败——但我们知道怎么让你成为那 30%。"这个数字给整个变革咨询行业当了三十年招牌,现在正原封不动地搬进 AI 时代:2024-2026 年,《Why 70% of AI Transformations Fail》《The 70% Rule for AI Change Management》这类厂商文章批量出现,句式与三十年前逐字同构——先吓你,再卖你解药。【未验证,来源:novoslo.com、aiassemblylines.com 等】
本站《当代码变得便宜》论证了 AI-native 转型的困难主要在组织而不在技术。顺着这条线索,自然的下一问是:上一轮席卷软件业的大转型——敏捷与 DevOps——留下了完整的档案,这批档案对这一轮有多少预测力?而检查档案的第一步,是检查档案封面上那个最响亮的数字。
这篇文章做三件事:给"70%"验尸(它从哪来、怎么变异、为什么杀不死);问测量要一个诚实的基率(真实的转型失败率到底是多少——剧透:这个问题本身有问题);评估上一轮尸检报告对 AI-native 的预测力(哪些失败机制在原样重演,哪些结构性条件已经变了)。
"70%"有精确的出生记录,而且出生证明上写着"非科学"。
1993 年,出生。Hammer 与 Champy 的《Reengineering the Corporation》(再造企业)写道:"Our unscientific estimate is that as many as 50 to 70 percent of the organizations that undertake a reengineering effort do not achieve the dramatic results they intended."(我们的非科学估计是,多达 50%-70% 进行流程再造的组织,没有达到它们预期的戏剧性成果。)【已验证;不同版本"50 to 70 percent"与"50 percent to 70 percent"拼写略异】注意三个限定:估计是"非科学的";范围只是流程再造这一种变革;"失败"的定义是没达到预期的戏剧性成果——不是搞砸,是没够到自己喊出的高目标。
1995 年,作者收回。Hammer 在《The Reengineering Revolution》里亲自纠偏:"……this simple descriptive observation has been widely misrepresented and transmogrified and distorted into a normative statement. There is no inherent success or failure rate for reengineering."(这个简单的描述性观察,被广泛地误传、扭曲成了一个规范性论断。流程再造并不存在什么固有的成功率或失败率。)【已验证】这段收回几乎从不被引用——数字活了下来,免责声明死了。
1995 年,被冤枉的"源头"。日后被无数引用指认为 70% 出处的,是 Kotter 同年在《哈佛商业评论》的名文《Leading Change: Why Transformation Efforts Fail》。可原文里没有任何整体失败率数字,更没有 70%。Kotter 看了 100 多家公司,给出的是印象式判断:"A few of these corporate change efforts have been very successful. A few have been utter failures. Most fall somewhere in between, with a distinct tilt toward the lower end of the scale."(少数非常成功,少数彻底失败,大多数介于两者之间——明显偏向下端。)全文唯一一个与失败沾边的百分比是分阶段的:他观察的公司里"远超过 50%"倒在第一步(建立紧迫感)。【已验证】
2000 年,关键变异。Beer 与 Nohria 在《哈佛商业评论》写下:"The brutal fact is that about 70% of all change initiatives fail."(残酷的事实是,约 70% 的变革计划都会失败。)没有脚注,没有研究,没有出处。【已验证】一句"非科学估计"在这里完成了两次脱落:范围脱落(流程再造 → 一切变革)、免责声明脱落(unscientific estimate → brutal fact)。
2008 年,Kotter 终于亲口说出 70%。在《A Sense of Urgency》里:"From years of study, I estimate that today more than 70% of needed change either fails to be launched, even though some people clearly see the need, fails to be completed, even though some people exhaust themselves trying, or finishes over budget, late, and with initial aspirations unmet."(基于多年研究,我估计如今超过 70% 的必要变革,或者根本没能启动,或者没能完成,或者超预算、延期、未达最初期望。)【已验证】依然是个人估计、依然无研究引用——且口径宽到把"该变而没变"也计入失败。
2008-2009 年,第三次变异:出处被发明出来。McKinsey 的 Keller 与 Aiken 在《The Inconvenient Truth About Change Management》里写道:"In 1995, John Kotter published research that revealed only 30 percent of change programs are successful."(1995 年,John Kotter 发表的研究揭示,只有 30% 的变革项目是成功的。)【已验证】如前所述,Kotter 1995 年的文章里不存在这个数字,也不存在任何整体百分比——"published research that revealed"是无中生有的学术包装。同期的实证遮羞布是 McKinsey 自己 2008 年 7 月的全球调查:3,199 名高管自评本组织的转型,其中经历过转型的约 2,663 人打分,"只有约三分之一说自己的组织成功实现了目标"。同一份数据里,明确评为"完全不成功"的只有约 5%-6%——"三分之二没说成功"被卖成了"70% 失败"。【已验证】
2011 年,学术验尸。Hughes 在《Journal of Change Management》发表《Do 70 per cent of all organizational change initiatives really fail?》,逐条追溯五个已发表的 70% 论断——Hammer & Champy 1993、Beer & Nohria 2000、Kotter 2008、Bain 的 Senturia 等 2008、McKinsey 的 Keller & Aiken 2009——结论原文:"whilst the existence of a popular narrative of 70 percent organizational change failure is acknowledged, there is no valid and reliable empirical evidence to support such a narrative."(70% 变革失败的流行叙事确实存在,但没有任何有效可靠的实证证据支持它。)【已验证】
2011 年之后,僵尸期。被验尸不影响流通:McKinsey 2015 年《Changing Change Management》继续不带出处地写"70 percent of change programs fail to achieve their goals"【已验证】;2021 年《Losing from day one》干脆在脚注里引 Kotter(《Leading Change》1996 与《A Sense of Urgency》2008)为 70% 背书【已验证】——咨询公司引用大师,而大师这个数字的"研究出处"正是这家咨询公司当年发明的。引用链闭环了。BCG 则在 2020 年为数字化转型重启了这个数字(70% fall short,下文细拆)。然后是 2024-2026 年的 AI 版宿主。
这条传播链在医学文献计量里有现成的分类学:Greenberg 对引用网络的研究把这类机制命名为引用偏倚、放大与发明(citation bias / amplification / invention),原文的警句是"citation can be used to generate information cascades resulting in unfounded authority of claims"(引用可以制造信息级联,让论断获得无根据的权威)。【未验证,来源:BMJ 2009;339:b2680】"70%"三十年的旅程,是这三种机制的教科书标本:范围脱落是偏倚,反复转述是放大,"Kotter 1995 published research"是发明。
考古只能证明"70% 没有出处",不能证明失败率不高。要回答"到底多少",得去看认真测过的人测出了什么——以及测量本身遇到了什么。
软件业自己的"70%"叫 CHAOS 报告。Standish Group 1994 年的首份报告:成功 16.2%、"受挑战"52.7%、受损/取消 31.1%(365 名受访者,覆盖 8,380 个应用项目)。【已验证】注意定义:"成功"= 按时、按预算、交付全部预定功能——三条全中才算赢。这份报告喂养了此后三十年"软件项目大多失败"的叙事,但它经受的三次独立拆解值得逐一记录:
Flyvbjerg 团队的项目数据库是这个领域样本最大的测量:
这两组数字并排看,教训不是"大多数项目失败",而是分布是肥尾的:典型项目超支可控,毁灭性的是尾部——那六分之一会吃掉不成比例的损失。注意 0.5% 这个数字的结构:它和 Standish 的 16.2% 是同一种"多杆全中才算赢"的定义装置,杆加得越多,"成功"越稀有。用三杆全中的口径宣布"99.5% 失败"与用取消率宣布"只有 19% 失败",用的是同一批项目。
跳出软件项目,组织变革整体的测量记录更薄:
这就是学术界的诚实答案:真实失败率是"未定"——不是因为没人测过,而是因为"失败"没有统一定义,而定义选择本身决定数字。
理解了定义的杠杆,再看今天流通的转型统计,机器的构造一目了然:
自报口径还有一层系统性问题:打分的高管既是转型的责任人又是评委,且咨询公司的调查问卷天然以"是否达到最初目标"为标尺——而最初目标是销售阶段定的。卖转型服务的机构,同时垄断了"转型是否成功"的计分权。这不需要阴谋论,只需要注意每份此类报告的最后一章都是服务介绍。
敏捷是软件业上一场全行业转型,它留下的档案有独特的价值:长达十七年的同题问卷,和一个从未兑现的测量承诺。
State of Agile 调查(VersionOne → CollabNet → Digital.ai)是敏捷运动的自我镜像——厂商主办、受访者自选样本,这两条先记在案。它测出的东西恰恰因此有趣:
学术侧的系统综述与之互证:Dikert、Paasivaara 与 Lassenius(2016)梳理 52 篇大规模敏捷转型文献(42 个案例),发现将近 90% 是经验报告而非严谨研究;单项最高频挑战是"其他职能不愿改变"(约 31% 的案例);作者的结论是(原话):"large-scale agile cannot be just taken into use off-the-shelf"(大规模敏捷不能拿来即用,必须仔细定制)。【已验证】
给敏捷验尸,不等于说敏捷无效。Jørgensen(IEEE Software 2019)对 196 个挪威软件项目的分析:使用敏捷方法的项目在所有规模档上结果都好于非敏捷(小型项目 p<0.01、中型 p≈0.03,大型不显著;成功为自评口径、设计为相关性)。【已验证】这与前述档案并不矛盾,反而拼出这场运动最重要的一课:实践与转型是两回事——迭代交付、持续集成这些实践与更好的结果相关;而"敏捷转型"这个组织仪式批发的是实践的名字,不是实践本身。
如果说敏捷实践有证据、敏捷转型证据稀薄,那么"规模化敏捷框架"是证据真空:
DevOps 一代比敏捷一代在证据上前进了一大步,也正因此,它的档案暴露了这类测量的上限在哪。
进步是真的。DORA/State of DevOps 测的是结果指标(部署频率、变更前置时间、变更失败率、恢复时间),不是满意度;四键指标可以从系统数据直接测(Google 开源了 Four Keys 工具),别人可以用自己的数据复算。这比"你觉得你们敏捷吗"是范式升级。
但它的纵向叙事撑不住自己的方法。2022 年报告里,"精英"绩效集群整个消失了——官方原文:"Unlike in years past, there was no evidence of an 'Elite' cluster."低绩效组从 2021 年的 7% 跳到 19%,DORA 给出的解释是一个未检验的疫情假说。把历年精英占比连成线(2018 年 7% → 2019 年 20% → 2021 年 26% → 2022 年消失 → 2023-24 年约 18-19%),这条"行业在进步"的曲线其实不可比:DORA 自己的 FAQ 承认,集群每年从当年的不同受访者中重新涌现,不是校准过的行业指数。加上自报问卷、可能的自选偏差(自认精英的人更愿意答卷,The Register 2021 年就点过名)、原始数据不公开、能力→绩效路径模型无独立复现——这一波测量最认真,也只能认真到这里。【已验证】
预测被当成了测量。广为流传的"75% 的 DevOps 计划将因组织学习与变革问题达不到预期"(Gartner,2019,预测期到 2022;另有 90% 版本到 2023)是分析师预测,从未被回头验证过。【未验证,来源:Gartner 2019 及其社交媒体贴】它照样进了无数张胶片当"研究表明"。
具名的大案:GE Digital。转型叙事经济里最响的案例给出了最硬的收尾数字:GE 2015 年宣布目标"2020 年软件与解决方案收入超过 150 亿美元"(当时约 50 亿);据报道 2016 年一年就向 GE Digital 投入超 40 亿美元(第三方估计,GE 未正式披露该口径);2018 年 12 月,GE 宣布把数字业务改组为独立运营但仍全资持有的公司,当时年软件收入约 12 亿美元——目标的 8%——并把 2016 年花 9.15 亿美元买的 ServiceMax 多数股权卖给了 Silver Lake(这次拆分后来也没走完,GE Digital 最终并入 GE Vernova)。【已验证;注意 GE 2018 年那笔 220 亿美元商誉减记属于 GE Power,与 Digital 无关,常被混引】同期,GE 系的转型故事还在行业峰会上作为成功案例巡讲【未验证,来源:DOES 议程存档】。
幸存者经济。DevOps 的案例库结构性偏成功:企业峰会讲台由自荐的成功故事组成,运动的奠基文本(《凤凰项目》)本身是小说;没有失败者分会场。【未验证,来源:DOES 2016 新闻稿、IT Revolution 案例库】这不是谁作弊,是这类档案的生成机制——记住它,第 7 节读 AI 案例集时原样适用。
这一波档案里已经有 AI 的第一行记录。DORA 2024:AI 采用度每升 25%,交付吞吐量估计降 1.5%、交付稳定性估计降 7.2%;2025 年报告吞吐量转正、稳定性依旧为负,官方定调改为放大器:"AI doesn't fix a team; it amplifies what's already there."(AI 不会修好一个团队,它放大团队本来的样子。)【已验证,口径沿用《当代码变得便宜》】上一波转型建起来的测量基础设施,已经开始给下一波转型出成绩单——这是两波档案之间最有价值的连续性。
"70% 会失败"是恐吓,"照我们的框架做就能成功"是解药。恐吓部分已经验完尸,现在验解药。
这一节的合订结论:变革工业的恐吓数字没有实证出处,解药框架没有整体检验,而购买行为由合法性驱动——三十年卖了个寂寞?不。卖出去的东西真实发生了作用,只是作用机制是 Staw-Epstein 式的:采纳者获得合法性、声望与薪酬,咨询方获得收入。唯一没被证明的,是它对"70%"那个分母的作用。
每个转型故事都有一个官方反派:中层经理——"上面想变,下面想变,中间冻住了"。这个"冻土层"(frozen middle)值得单独过堂,因为它正被原句搬进 AI 叙事。
出身先存疑。这个说法通常被归给 1980 年代通用汽车 CEO Roger Smith,但可查证的只有咨询博客互相转引(连 Dartmouth Tuck 的案例页也这么写)——没有任何 1980 年代的一手出处(演讲、访谈、当时报道)可以定位。【已验证(缺失性)】一个用来解释转型失败的概念,自己的出处就是转述链——与"70%"是同一种生物。
学术档案给中层翻案,但翻得有条件。Wooldridge 与 Floyd(1990,20 家组织的定量研究):中层参与战略制定与组织绩效正相关。Huy(2002,三年田野,ASQ):激进变革中,中层经理的"情绪平衡"工作(一边推动项目、一边接住下属的情绪)是适应得以发生的机制。Balogun 与 Johnson(2004,AMJ):变革走样的主因是高层撤出后中层在沟通真空里各自意会(sensemaking),不是蓄意抵抗。反面钉子也是学术的:Guth 与 MacMillan(1986)证实,当中层认定变革损害自身利益时,能把战略拖慢、降级乃至"totally sabotage"(彻底破坏)。【已验证】合起来:中层是条件反应器,不是冻土——条件是激励对齐、信任与参与,而这三个旋钮都在高层手里。
从业者最大的数据集把矛头指向楼上。Prosci 自 1998 年起的两年一度调查(厂商自报、从业者样本,这两条记在案):"积极且可见的高管赞助"连续每期都是变革成功的第一贡献因子,提及率约为第二名的三倍;"与中层经理的互动"在七项里排第七;赞助极其有效时,项目达标概率约为极其无效时的 3.5 倍(该倍数为本期口径,其他版次为 2.5-2.9 倍)。同一份材料也如实写着中层是其调查里抵抗最强的群体——与"条件反应器"读法一致:抵抗是测得到的,但它是因变量。【已验证】另一条同向证据来自反面:MIT Sloan 的 Johnson 总结变革研究的取样偏差——多数研究只覆盖头几个月、只访谈领导层,"变革失败怪懒经理"的证据本身是这么生产出来的。【未验证,来源:strategy+business 2020】
连"参与"这块金字招牌都是有条件的。变革管理的创世实验——Coch 与 French(1948,Harwood 睡衣厂)——被教科书讲成"参与消除抵抗":无参与组产量从约 60 件/时跌到约 50(约 17-20%),32 天无起色;全参与组回升并超出变革前约 14%。但原始实验的对照组只有 18 人、实验组 13/8/7 人,头 40 天对照组 17% 的人离职;Bartlem 与 Locke(1981)指出解释、培训、工作可得性、计件价公平性全是混杂变量;挪威复制实验(French、Israel 与 Ås,1960)没测到产量效应。【已验证】参与→承诺是个条件启发式,不是定律——这对下文的 AI 强制令 vs 自下而上之争是直接的校准。
冻土叙事在 AI 时代的新工作,以及数据怎么说。2025-2026 年的"AI 冻土层"文章批量出现,但它们引用的报告常常说着相反的话:McKinsey《Superagency》(2025)的结论是员工已准备好、领导层才是最大瓶颈;Kyndryl 2025 年调查的"45% 的 CEO 认为员工抵触 AI"是 CEO 对全体员工的感知,被博客改装成了"中层阻挡 AI"。【未验证,来源:各原报告与转引文】而直接测使用率的数据给出的梯度方向干脆是反的——领导 > 中层 > 一线(Gallup 2025 年四季度:每周多次使用 AI 者,领导约 44%、经理约 30%、一线约 23%)。【已验证】中层不是 AI 的冻土;如果有冻土,它在别处(见下节)。
变革疲劳是真实的,数字是乱的。员工侧的档案:2022 年平均每人经历 10 项计划内企业变革,2016 年只有 2 项(HBR 2023,Gartner 作者)。【已验证】"支持变革的意愿从 2016 年 74% 跌到 2022 年 __%"这道填空题,Gartner 自家出版物给过两个答案:43%(2022 年 10 月发布材料)与 38%(2023 年一季度刊物)——本文最初把 43% 判为流传错误,验证者纠正:分歧存在于 Gartner 内部,另有一对巧合同数的"留任意愿 43%/74%"统计与之并存。【已验证】一个关于"变革让人疲劳"的统计,自己都疲劳出了两个版本——这句不是俏皮话,是本文方法论的免费教具。
现在合卷作答标题问题。把前六节的失败机制列成清单,对着 2024-2026 年的 AI 采纳记录逐项打勾,得到的是一张大部分打勾、三处断裂的表。
上一轮尸检报告对 AI-native 的预测力,可以压成三句:
按证据强度排序:
值得盯的信号:Meta 的 AI 绩效指标能否活过 2026 年(Duolingo 剧本预测它会退);McKinsey 的"21% 重设计工作流"在 2026-27 年调查里的走向(升=实质化开始,平=仪式期延长);DORA 2026 的 AI 稳定性符号;规模化敏捷框架会不会在 AI 时代出现第一项独立受控研究(基率:九年零项);以及下一个僵尸数字——"95% 的 AI 试点失败"——的引用链会不会重演本文第 1 节(我们打算届时也给它验一次尸)。三十年前,一个自称非科学的估计当上了一个行业的导航仪;这一轮的组织有当年没有的东西——自己的交付数据。用它。
数字考古:Hammer & Champy, Reengineering the Corporation (1993) · Hammer & Stanton, The Reengineering Revolution (1995) · Kotter, "Leading Change: Why Transformation Efforts Fail" (HBR, 1995) · Beer & Nohria, "Cracking the Code of Change" (HBR, 2000) · Kotter, A Sense of Urgency (2008) · Keller & Aiken, "The Inconvenient Truth About Change Management" (McKinsey, 2009) · McKinsey Global Survey, "Creating Organizational Transformations" (2008-07) · Hughes, "Do 70 per cent of all organizational change initiatives really fail?" (J. Change Management 11(4), 2011, DOI 10.1080/14697017.2011.630506) · Ewenstein, Smith & Sologar, "Changing Change Management" (McKinsey, 2015) · McKinsey, "Losing from day one" (2021-12) · Greenberg, "How citation distortions create unfounded authority" (BMJ 2009;339:b2680) · Tourish, Management Studies in Crisis (CUP, 2019)
基率测量:Standish CHAOS Reports (1994/2015/2020) · Eveleens & Verhoef, "The Rise and Fall of the Chaos Report Figures" (IEEE Software 27(1), 2010) · Jørgensen & Moløkken, "How large are software cost overruns?" (IST 48(4), 2006) · Flyvbjerg & Budzier, "Why Your IT Project May Be Riskier Than You Think" (HBR, 2011; arXiv:1304.0265) · Flyvbjerg & Gardner, How Big Things Get Done (2023) · Smith, "Success rates for different types of organizational change" (Performance Improvement 41(1), 2002) · Cândido & Santos, "Strategy implementation: What is the failure rate?" (JMO 21(2), 2015) · BCG, "Flipping the Odds of Digital Transformation Success" (2020-10) · Bain, 88% 新闻稿 (2024-04) 与 Mankins & Litre, "Transformations That Work" (HBR, 2024) · Sauer, Gemino & Reich (CACM 50(11), 2007) · Loureiro et al. (Heliyon, 2024) · Ika & Pinto, "The re-meaning of project success" (IJPM 40(7), 2022)
Agile 档案:Digital.ai/VersionOne, State of Agile Reports 第 14-18 期 · Dikert, Paasivaara & Lassenius (JSS 119, 2016) · Jørgensen, "Relationships Between Project Size, Agile Practices, and Successful Software Development" (IEEE Software 36(2), 2019) · Scaled Agile, framework.scaledagile.com/about 及 scaledagile.com 营销页 · Putta, Paasivaara & Lassenius (XP/PROFES 2018) · Verwijs & Russo, "Do Agile Scaling Approaches Make A Difference?" (EMSE, 2024; arXiv:2310.06599) · USAF CSO Chaillan, Memorandum for Record on Agile Frameworks (2019-12-28) · Jeremiah Lee, "Spotify's Failed #SquadGoals" (2020) · Kniberg (blog.crisp.se, 2015) · Banking Dive, Capital One 报道 (2023-01) · Fowler, "FlaccidScrum" (2009) · Dave Thomas, "Agile is Dead (Long Live Agility)" (2014)
DevOps 档案:DORA/Google Cloud, State of DevOps / DORA Reports (2018-2025) 及 dora.dev/faq · Forsgren, Humble & Kim, Accelerate (2018) · Sallin et al. (XP 2021) · The Register (2021-09) · Gartner, "The Secret to DevOps Success" (2019) · GE 新闻稿 (2015-09-29、2018-12-13) · The Conversation, GE Digital 分析 (2018) · Keunwoo Lee, Accelerate 书评及 Humble 回应
变革理论与中层:Appelbaum, Habashy, Malo & Shafiq (JMD 31(8), 2012) · Cummings, Bridgman & Brown (Human Relations 69(1), 2016) · Burnes (JABS 56(1), 2020) · Stouten, Rousseau & De Cremer (AMA 12(2), 2018) · Pollack & Pollack (SPAR 28, 2015) · DiMaggio & Powell (ASR 48(2), 1983) · Staw & Epstein (ASQ 45(3), 2000) · Westphal, Gulati & Shortell (ASQ 42(2), 1997) · Abrahamson (AMR 21(1), 1996) · Abrahamson & Fairchild (ASQ 44(4), 1999) · Wooldridge & Floyd (SMJ 11(3), 1990) · Huy (ASQ 47(1), 2002) · Balogun & Johnson (AMJ 47(4), 2004) · Guth & MacMillan (SMJ 7(4), 1986) · Oreg, Vakola & Armenakis (JABS 47(4), 2011) · Coch & French (Human Relations 1(4), 1948) · Bartlem & Locke (1981) · French, Israel & Ås (1960) · Prosci, "Top Contributors to Success" · Gartner 变革疲劳系列 (2022-2023) · O Morain & Aykens (HBR, 2023-05) · Reichers, Wanous & Austin (AME 11(1), 1997)
AI 采纳记录:Lütke 备忘录 (X, 2025-04-07) · Fortune, von Ahn 播客言论报道 (2026-04-13) · Business Insider/Entrepreneur, Liuson 内部信报道 (2025-06) · HR Grapevine, Meta 绩效新规 (2025-11) · TechCrunch, Coinbase (2025-08) · McKinsey, "The State of AI" (2025-03) · IBM/牛津经济研究院 CEO 调查 (2025-05) · Accenture 8-K (SEC, FY2024/FY2025) · BCG 年报新闻稿 (2025) · WSJ/Alex Singla, QuantumBlack (2025) · Revelio Labs, AI 认证分析 (2026) · Microsoft/LinkedIn Work Trend Index (2024) · KPMG × 墨尔本大学, "Trust, attitudes and use of AI" (2025) · Gallup, Q4 2025 工作场所 AI 使用 (gallup.com/workplace/701195) · METR, "Measuring AI Ability to Complete Long Tasks" (arXiv:2503.14499) · DORA 2024/2025(口径沿用本站《当代码变得便宜》已验证记录)
调研材料与全部验证判定存于研究底座(7 条调研线、30 组承重论断 × 3 票对抗验证:30/30 挺过、20 组含口径修正、0 推翻)。