🧒 初中生也能看懂的版本
① 研究背景(为什么要做?)
政策并不总是越做越大,很多改革试点做着做着就悄无声息地停下了。
你有没有注意过这样的事:新闻里说某地要「探索」一项新做法,热闹了一阵,后来就再也没人提起。它既没有被正式宣布取消,也没有推广到全国,就这么消失了。
研究政策的学者过去更关心政策怎么「长大」——怎么从试点变成全国推广。对于政策怎么「缩小」或「停下」,讨论一直不多。早年有一个概念叫「政策终止」,但它只盯着那种在政策周期末尾正式宣布结束的情况,覆盖面太窄;后来的「政策拆解」概念也没有真正流行起来。
中国是观察这个问题的好地方。中国治理很依赖「先试点、再推广」:各级政府不断宣布要探索各种新办法,再从中挑出合适的留下。既然要挑,就必然有大量试点被放弃。可是政府很少正式宣布某个试点结束了,所以这些「半路停下的试点」很难被看见,以往的研究也大多只盯着最后成功的那些。
此外,现有的政策过程理论大多是照着美国这样的西方民主国家建立的。作者认为,把中国的情况纳入进来可以让理论视野更宽,而且中国这种试验式治理在日本、韩国等国家也能找到相似之处,结论并不只适用于中国。
② 研究问题(要回答什么?)
这篇论文想弄清楚中国的政策试点在什么情况下会走进死胡同,以及这些死胡同暴露了治理体系的哪些长处和短板。
为此作者先造了一个新概念:「死胡同」。它指政策过程中的一个节点——走到这里,这项政策以现在的样子再也推进不下去了。注意,死胡同本身不是一种政策变化,而更像一块「此路不通」的路牌,它决定了接下来政策只能怎么变。
作者特别强调,这个词不带好坏评价。一个有问题的政策走进死胡同可能是好事;一个表现不错的试点走进死胡同则可能是浪费。死胡同也不等于「犯错」:试点中出了错,只要还能修修补补继续往前走,就不算死胡同。
具体来说,论文要回答两个问题。
- 第一,中国的政策试点在什么样的模式和条件下会走进死胡同?
- 第二,这些死胡同能告诉我们中国政策变化是怎样运作、又受到哪些约束的?
作者还提出,走进死胡同之后,政策一般有三种去向:终止(不做了)、回退(目标不变,但退回到更早、更小的版本)、转向(目标不变,但换一套全新的办法)。
③ 研究方法(怎么做的?)
这项研究最大的难点是:被放弃的试点几乎不留痕迹。政府很少发文说「这个试点停了」。传统的「过程追踪」要靠丰富的档案一步步还原,只能研究那些活得够久的政策——这就像只采访长寿老人,却想弄明白人为什么会早早离场,天然带着「幸存者偏差」。
作者的办法叫「计算过程追踪」。思路并不复杂:中国政府很大程度上是「靠文件治理」的,每年发出数以万计的文件,一个试点只要还在推进、调整或推广,就会在后续文件里被反复提到。如果某个试点整整一年里、所有层级的政府文件都没再提它,就认为它走进了死胡同。这就像判断一位同学是否还在班级群里:一整年任何聊天记录里都没人提到他,大概率他已经离开了。
具体分三步。
- 找试点:数据来自「读懂中国」(Reading China Better)项目,收录了来自一百四十多个党政机关网站的六十八万多份官方文件。作者挑出二〇一三到二〇一八年间,在法规、规划和意见这三类权威文件里首次宣布要「探索」某事的试点,共 27,103 项,再用句法分析自动抽出每句话里到底在探索什么。之所以选这几年,是因为那段时间文件公开比较规范,而且之后还能追踪至少六年。
- 追踪试点:在整个数据库里搜索后续文件对这些试点的提及。因为同一件事可能换个说法,作者用了既比较字面、又比较意思的「模糊匹配」。核对显示,找对的比例(精确率)为 0.926,没漏掉的比例(召回率)为 0.945。这些试点一共被提及了 1,231,122 次。
- 分类与分析:用自动脚本判断每条提及处在哪个阶段(还在探索、试点实施、实施、调整、明确废止),再比较「停下的」和「活下来的」试点在用词上有什么不同。另外还做了两项统计分析:一是看中央文件和地方文件谁带动谁,二是看省委书记换人前后,试点被提及的次数怎么变化。
最后,作者挑了金融和教育两个领域的试点做深入个案分析,把数字背后的来龙去脉讲清楚。
④ 结果(发现了什么?)
研究发现,中国绝大多数早期政策试点都会走进死胡同,六年后仍被官方文件持续提及的只剩一成出头。
27,103 项试点中,只有 7,224 项在宣布一年后还被文件提到,不到三分之一。到第六年只剩 3,172 项,占 11.7%。其中只有 15 项有明确的正式废止记录,其余都是悄悄停下的。
一直停留在「探索」阶段的 21,281 项试点,到第六年有 97.9% 走进死胡同;而进入实施阶段的 3,882 项里,也有 52.2% 最终不再被提及,试点实施类为 57.4%。
省级发起的试点,只要被中央文件提到过至少一次,走进死胡同的比例只有 40%;从未被中央提及的,这个比例超过 95%。统计分析还显示,中央提及会明显带动之后地方的跟进,反过来的带动作用则小得多、也更短暂。
省委书记换人之前,试点被提及的次数逐年上升,在换届前后达到顶峰,之后逐渐回落,总体比换届前下降约 33%。
有意思的是,这并不代表试点制度没用。把所有试点加起来看,它们被提及的总次数从第一年约五万次涨到第六年约十五万次。这说明中国的改革像一场「锦标赛」:大量试点争夺注意力,大多数被淘汰,少数胜出者越做越大。
哪些领域容易走进死胡同?用词分析显示,医疗、科技、数字、基础设施和产业政策相关的试点更容易活下来,比如「数据」「医养」「家庭医生」「汽车」这些词;而保险、融资、金融、社会信用体系、行政审批改革、中小学教育,以及「合作」「鼓励」「参与」这类软性治理的试点更容易停下。
两个个案:金融方面,789 项提到「金融」的试点里有 463 项(58.9%)从未得到后续跟进。二〇一四年的移动金融试点设想以银行卡为核心,结果被飞速普及的二维码支付甩在身后,大约一年后就没了下文,重庆还正式废止了相关计划。教育方面,常州提出要探索中小学生法治教育的考核评价,但后来教育部列举的各项举措里并没有这套考评体系,到二〇二四年仍有学者指出相关考核机制缺失。
⑤ 讨论(这些发现说明什么?)
这些发现说明,中国的试验式治理像一台擅长做「单选题」、不太擅长做「综合题」的机器。
哪些试点容易活下来?一是和官员考核激励对得上的,比如被提升到国家重要地位的汽车产业;二是政府手里有现成「杠杆」、能自己拉动的,比如补贴、优惠政策、设立特区,又比如医疗领域大多数医院本来就是公立的。目标清楚、工具在手,试点就容易一路走下去。
哪些试点容易卡住?需要妥协、情况复杂、目标模糊,或者要靠别人配合的。比如社会信用体系,规模巨大、目标又比较含糊;比如「合作」「鼓励」「参与」这类软性治理,政府没法完全说了算;再比如重大行政改革,上面压力很大、实际动作却不多;还有教育改革,既要花钱,又会重新分配不同人群的机会,容易引发争议。
还有一个重要发现:停下的往往是「工具」,不是「目标」。移动支付这个目标实现了,如今在中国无处不在,停下的只是那套以银行卡为中心的具体方案;法治教育也一直被强调,停下的只是那套考评体系。这就像要去同一个地方,一条路走不通就换一条——作者把这叫做「转向」。
作者也坦诚地提醒了几点局限:电脑匹配难免漏掉或认错一些说法,有些试点写得太笼统根本追踪不到,还有少数试点其实是顺利完成了才不再被提起,所以真实比例未必真有九成那么高;而且这套分析只能说明「有关联」,还不能证明「谁导致了谁」,也看不出试点停下之后到底是被终止、回退还是转向了。
⑥ 结论(最终结论 + 启示)
政策走进死胡同并不稀奇,它其实是中国这种边试边改的治理方式的常态。
这篇论文用 27,103 项试点、六十八万多份官方文件说明:大多数「探索」停在了半路,而且几乎都是悄悄停下,并没有谁正式宣布。第一年最危险,熬过了第一年,掉队的速度就会慢很多。
作者总结了决定试点命运的三个因素。
- 和官员的政治激励对不对得上;
- 有没有钱、做起来贵不贵;
- 议题本身和牵涉的各方复不复杂。
此外,由中央发起或被中央点名、领导班子保持稳定,也会让试点更容易活下来。
对研究者来说,这是一个很实际的提醒:如果你研究的恰好是一个正在试点的新政策,它可能明天就走进死胡同,你的结论也会跟着过时。所以在下判断之前,不妨先看看这个试点是否带有那些容易「卡住」的特征。
作者还希望「死胡同」这个概念能被用到更多国家的研究中,并进一步弄清政府如何从死胡同里吸取教训、试点如何在地区和层级之间传播,以及到底是什么机制把政策推进了死胡同。
🎓 专业 IRMaD 结构解读
I. Introduction(引言)
议题源流:政策变迁不仅有扩张方向,也包括回退、终止、拆解与降级,但主流政策过程研究对非扩张型变迁关注甚少。deLeon(1978)开创的政策终止文献聚焦政策周期末端的正式终止,概念过于刚性、忽视变迁梯度,且常被规范性地理解(终止是更好政策产生的前提);Bauer 等(2012)、Knill 等(2009)提出的「政策拆解」亦未成为主流,部分因其与终止区分不清,且多与福利削减等有限议题绑定。作者据此认为重估非扩张型政策变迁框架已属必要(Adam and Bauer 2018)。
文献空白:
- 多数政策变迁理论隐含线性、单一的事件序列假设(Capano 2009),终止研究长期苦于经验案例匮乏;
- 政策过程理论主要以自由民主体制尤其是美国为模型,部分框架的解释力弱正与此相关;
- 中国试验性治理研究多聚焦最终成功的试点,对停滞试点只是顺带提及,隐含把中国政策变迁视为趋向预定状态的目的论倾向。
案例选择:试验性治理要求在探索、试行与评估后收敛到统一方向(Heilmann 2018),必然舍弃部分试验,死胡同因而内生于这种政策风格,而非终止文献所称的「罕见现象」。中国的试验主义模式与日本、韩国等国具有可比性,结论可外推至威权语境之外。同时,中央对地方试验日益施加自上而下的压力(Heffer and Schubert 2023),政策学习偏差(Wang and Yang 2025)与试验适应不良(Yasuda 2024)也可使试验停滞——死胡同由此成为观察试验性治理中「创新与约束」张力的透镜。
本研究贡献:
- 概念:提出「死胡同」(dead ends),界定为约束后续变迁方向的政策过程节点,并以之组织终止、回退、转向三种原型。
- 方法:提出计算过程追踪(computational process tracing),将过程追踪逻辑用于大规模文本数据,以缓解停滞试验信息稀缺造成的幸存者偏差。
- 经验:追踪 2013–2018 年宣布的 27,103 项「探索」型试验,辅以金融、教育两个质性个案,识别行政层级、中央认可、领导更替与议题属性等关联因素。
I. Theoretical Framework & Hypotheses(理论框架与假设)
核心概念 · 死胡同:政策过程中的一个节点,在此处政策以其现有形式的进一步制定、发展或执行不再推进。它不是政策或政策变迁本身,而是对变迁方向的约束,决定后续变迁如何展开;其后的变迁通常(至少初期)为非扩张型,部分情形导致完全停止。
- 阶段普适:可发生于议程设置(未获进一步探索的认可)、政策制定(未获支持或出现根本障碍)、执行(未兑现承诺、出现替代方案或新情势)与评估(未达预期)任一阶段。
- 持续性:原则上为永久或至少长期的中断,须区别于短期路障,尽管事先无法断言其是否永久。
- 非规范性:以轨迹的中断或结构性耗竭而非「成败」主观判断识别;可观测形态包括政策突然不再被决策者提及、工具被默示中止、初期看好的试验被搁置。
- 与试错区分:错误若不阻断进一步发展则不构成死胡同;成功试验也可能进入死胡同(深圳城市更新试验选择市场主导路径后,表现尚可的备选方案亦被舍弃)。
- 成因谱系:设计内在缺陷(1999 年被国务院终止的早期农村养老保险)、情势突变、出现更有效替代、资金约束(低碳发展举措)、科层错位与部门地盘之争(网络失信黑名单)、领导更替、公众争议(2020 年杭州「健康分」设想)。
| 后续轨迹 | 定义 | 中国案例 |
|---|---|---|
| 终止 | 权威性地停止执行;作者扩展为三维度:① 范围(全部或部分)② 意图与公开性(明示废止或默示放弃)③ 持久性(可长期搁置后复活) | 以房养老:2013 年启动、2018 年推广至全国,2024 年国办文件已将其视为可能的诈骗途径 |
| 回退 | 保持总体目标,将工具退回更早或更有限的既有配置;比「拆解」(降低政策密度或强度)更具体 | 北京及周边地区城市供暖「煤改气」在运动式扩张后因严重气荒与基础设施不足而回退 |
| 转向 | 保持总体目标,以全新工具绕开死胡同,常表现为替代 | 厦门低碳试点随新任党委书记转入新战略;自主招生 2003 年试点、2020 年废止并由同目标新举措取代 |
三种原型边界并非绝对:转向包含一定程度的终止,回退是部分终止的一种。Figure 2 将框架表述为:试验 → 遭遇挑战(经验成因 + 理论透镜)→ 死胡同 → 三种结果,且即便终止也应(至少在纸面上)促成制度学习。
| 理论透镜 | 对死胡同成因的推演 |
|---|---|
| 倡导联盟框架 ACF | 一党体制下试验由某一群体推动却未获更广泛支持:遭党内对立联盟反对,或主导联盟失势(如领导更替) |
| 多源流框架 MSF | 政策未与真实问题及足够政治意愿和资源耦合;既有政策则在不利于它的政策之窗开启时进入死胡同 |
| 间断均衡理论 PET | 稳定期试验无法克服制度惯性;突发变迁(中国常见的运动式治理)亦可使进行中的试验停摆 |
研究问题:RQ1 中国政策试验在何种模式与条件下进入死胡同?RQ2 死胡同如何揭示中国政策变迁的运作与约束?本文定位为探索性、描述性研究,未设正式假设。
M. Materials & Methods(材料与方法)
- 研究设计:计算过程追踪 + 质性个案的混合方法。作者明确采用探索性、主要为描述性的过程追踪(区别于 Beach and Pedersen 2016 的机制中心取向),关注死胡同中的过程与因素而非确立因果链;无因果识别设计(非 DiD / RDD / IV / 实验),VAR-Granger 与事件研究仅提供关联与方向性证据。
- 数据来源:Reading China Better 数据库,汇集来自 140 余个党政机关网站的 68 万余份官方文件(法律法规、规划、意见、通知、指南等),覆盖国家级、部级、省级及部分地级机构(附录 Table A1)。
- 抽样:① 首次宣布于 2013–2018 年——该期文件发布相对透明、一致、标准化(Brussee 2025),可缓解缺失,并留出至 2024 年至少 6 年追踪期;② 文种限于立法性文件、规划文件、意见三类高权威、常用于宣布与调整试验且更具长期战略取向的文种;③ 试验类型限于「探索」——通常对应议程设置与政策制定阶段的最初形态,便于覆盖完整政策周期(作者承认其不必然代表试点、示范等其他类型)。最终 N = 27,103 项独立试验。
- 测量 1 · 试验识别:依存句法分析抽取每句「探索」的直接宾语与名词短语;文件多以内容或目标而非专名描述举措,措辞贴近政策当前形态。
- 测量 2 · 跨文件追踪:在全库(非仅样本)中以词汇相似度 + 语义相似度的模糊匹配链接同一试验的不同表述(如「生态恢复性司法机制」与「生态环境损害赔偿修复性治理机制」)。精确率 0.926,召回率 0.945。共匹配 1,231,122 次引用(Figure 3)。
- 测量 3 · 死胡同操作化:
DeadEndi = 1 若 Σ所有政府层级 Refsi,t = 0 持续一个完整年度。代理逻辑:在「以文本为中心」的治理体系中,文件例行记录执行、调整与推广,持续失去文本覆盖即表明不再发展或执行。附录 Figure A1 验证显示无后续跟进较不可能源于试验成功完成;中断一年后再度出现的比例很小,不足以扭曲总体结果。 - 测量 4 · 阶段编码:对仍被覆盖的试验,自动脚本(附录 Tables A2–A4 给出技术路径与验证)将每条表述编码为 探索 / 执行(区分试点执行与其他)/ 调整(制度化或完善)/ 废止(明确终止);多状态并存取主导类别。与政策周期大致对应,但因中文政策措辞模糊难以一一对应。
- 分析 1 · 时间模式:T0(首次提及年)至 T6 的逐年保留率与分类流失率(Figure 4、Table 1)。
- 分析 2 · 科层因素:按首发机构行政层级分组(「中央」含国务院、中共中央、最高人民法院等国级机关,不含部委);省级试验按是否获中央文件提及分组;以 T0–T6 面板、对数化引用计数估计向量自回归并做 Granger 因果检验,通用形式
ln Ci,t = Σk αk·ln Ci,t−k + Σk βk·ln Li,t−k + εi,t(C 为中央覆盖、L 为非中央覆盖,另一方程对称;正文未报告滞后阶数与系数)。 - 分析 3 · 领导更替事件研究:将省级试验匹配至 2013–2024 年省委书记更替数据;为保证前后观测充足,限于在观测窗中段(T3–T4)经历更替、且更替前尚未进入死胡同的试验;引用量以更替前一年为基准指数化(
t−1 = 1);作者称去掉上述限制模式依然稳健。 - 分析 4 · 议题差异:Monroe 等(2008)区分词分析,比较 T6 时判为死胡同与仍被覆盖试验的用词;负分为死胡同特有词汇、正分为存续试验特有词汇,政策领域标签为人工标注。
- 质性个案:自 Table 3 选取金融与教育两例,结合政策文件、官方答复与二手文献追踪其轨迹。
- 透明度:数据库可申请用于研究,部分数据与代码公开于 Zenodo;作者声明以 GPT 5.1 辅助语言反馈与编码,结果经附录验证。
R. Results(结果)
R1 · 死胡同普遍存在(Figure 4、Table 1):27,103 项试验中,T1 仍被覆盖的仅 7,224 项(不足三分之一),T6 降至 3,172 项(11.7%);T0–T6 间有 5,822 项明确推进至后续阶段,体现早期「分诊」(triage)。
| T6 前分类 | 对应政策周期阶段 | 试验数 | T6 时判为死胡同 |
|---|---|---|---|
| 探索 | 议程设置与政策制定 | 21,281 | 97.9% |
| 试点执行 | 政策制定与执行 | 676 | 57.4% |
| 执行 | 执行 | 3,882 | 52.2% |
| 调整 | 执行与评估 | 1,249 | 60.0% |
| 废止 | 终止 | 15 | 100.0% |
- 默示终止为主:仅 15 例有明确终止证据,绝大多数试验是默默进入死胡同而非正式终止。
- 锦标赛逻辑:总体引用量由首年约 50,000 次增至 T6 约 150,000 次,尽管此时绝大多数试验已进入死胡同——试验在高度竞争环境中争夺注意力(Xu 2011),少数存续者持续扩大范围与规模。
- R2 · 行政层级(Figure 5):中央级机关首发的试验进入死胡同的频率低于地方试验,作者归因于更大的政治分量与「表演性对齐」压力(正文未给出分组百分比)。
- R3 · 中央认可(Figure 6):省级试验若至少一次获中央文件提及,死胡同比例仅 40%;未获中央提及则超过 95%。
- R4 · VAR-Granger:中央与非中央覆盖相互具有预测力但不对称——中央覆盖对后续非中央覆盖呈现持续的大幅正向效应,反向效应较小且持续性弱;作者强调不构成严格意义的因果。
- R5 · 领导更替(Figure 7):驼峰形模式——引用量在首次省委书记更替前逐年上升、换届前后见顶、此后逐步回落,总体降幅约为更替前水平的 33%;下降渐进而非即时,可能因并非所有试验由书记推动,且更替多发生于年末党代会期间。
R6 · 议题差异(Tables 2–3 节选,区分度分数):存续领域为医疗、科技、数字、基础设施与产业政策;易入死胡同领域为金融保险、社会信用体系、行政改革、软治理与中小学教育。
| 存续试验特有词 | 分数 | 死胡同特有词 | 分数 |
|---|---|---|---|
| 数据(数字政策) | 55.294 | 保险(保险) | −100.019 |
| 医养(医疗) | 45.532 | 融资(金融) | −76.546 |
| 大学(高教科研) | 41.190 | 合作(软治理) | −66.091 |
| 家庭医生(医疗) | 35.151 | 鼓励(软治理) | −65.050 |
| 数字(数字政策) | 31.821 | 参与(软治理) | −57.692 |
| 关键技术(科技产业) | 30.692 | 学生(教育) | −45.787 |
| 汽车(科技产业) | 27.586 | 金融(金融) | −43.879 |
| 交通(基础设施) | 22.643 | 行政审批(行政改革) | −42.190 |
| 互联网(数字政策) | 19.731 | 信用(社会信用体系) | −39.490 |
- R7 · 金融个案:语料中 789 项试验明确提及「金融」,其中 463 项(58.9%)从未获后续跟进。2014 年发改委办公厅与人民银行办公厅发起移动电子商务金融科技服务创新试点,授权若干地区开展四项任务(城市级移动金融安全平台;联合商业银行、电信运营商、银行卡清算机构与电商推广移动终端交易;支持企业探索移动信贷与在线支付;完善政策标准与业务融合)。该试点共获 15 次引用、约一年后跟进停止;重庆于 2017 年正式废止相关计划,成都 2015 年规划的芯片卡金融服务平台此后再无公开提及。其隐含的以银联、电信商与银行合作为核心的卡基生态因硬件瓶颈、费用过高、演进过慢,且要求地方自筹资金,与经济趋势错位,被二维码支付的迅猛发展边缘化——目标延续、工具转向。
- R8 · 教育个案:语料中 827 项试验提及「教育」。常州《妇女发展规划(2016–2020)》提出探索青少年学生法治教育考核评价(承接 2013 年教育部加强青少年法治教育文件),针对学校认识不足、课程与课时缺位、缺乏专业师资、管理者不重视四项问题;教育部 2021 年答复全国人大代表建议时列举高考相关内容、教师培训、宣传项目等举措,唯独不含学校考核评价体系;2024 年研究仍指出制度保障与考核机制缺失。作者推断资源与激励错位导致原计划被默示终止,同样作用于工具层而非目标层。
a / D. Discussion & Conclusion(讨论与结论)
- 结构性解释 · 激励与工具:存续试验多集中于与干部激励体系契合、被提升至国家重要性的领域(如汽车产业),且国家拥有可独立行使的工具(补贴、优惠政策、特区设立;医疗领域多数医院仍为公立)。中国治理体系因而对目标清晰、有明确「杠杆」的线性或单一议题十分有效。
- 结构性解释 · 复杂性与依赖他者:涉及妥协、复杂性、模糊性或依赖其他主体的议题更易进入死胡同——社会信用体系以极端复杂、规模庞大与目标模糊著称;包容与软治理议题政府无法完全掌控;重大行政改革依赖脆弱的精英网络,政治压力大而实际活动少;高教以外的教育改革受资源约束,且因再分配社会群体间机会而引发争议。
- 三项议题因素:① 与政治激励的契合度;② 财政资源可得性与举措的感知成本;③ 议题与利益相关方的总体复杂度。科层因素:发起层级越高越少进入死胡同(但中央试验亦常见,金融个案即是);早期势头关键——首年后约 70% 进入死胡同,此后流失率迅速下降;领导更替与死胡同相关。
- 多层次性:两个个案均显示死胡同常发生于政策工具层而非总体目标层,揭示试验性治理中死胡同的多层结构,也修正了把中国政策变迁视为目的论进程的倾向。
- 理论贡献:① 为非扩张型政策变迁提供非规范、开放式的组织概念,统合终止、回退、转向;② 将试验性治理中适应能力与结构约束的张力具体化;③ 以中国经验拓展主要基于西方民主体制的政策过程理论;④ 提出可扩展至因果分析的计算过程追踪方法。
- 局限(作者自述):① 定量方法无法判断死胡同之后走向哪条轨迹;② 结论主要反映「探索」阶段,越往后的阶段死胡同越少;③ 模糊匹配存在漏检与误检,部分试验表述过于模糊无法追踪,少量试验因已完成而不再被提及——真实比例未必高达 90%,但死胡同的普遍性仍获强支持;④ 模型尚非因果,影响方向须审慎解读。
- 局限(评注):以官方文本覆盖作代理,依赖文件公开的完整性;样本期正是因发布较规范而选定,向公开度下降的时期外推需谨慎;Figure 5 行政层级差异与事件研究正文未给出分组数值与置信区间。
- 研究议程:① 将理论或方法应用于与中国治理风格相近的国家及其他情境;② 深入研究死胡同前后的政府学习过程;③ 利用本文数据与方法研究试验在地区与层级间的转移;④ 将计算过程追踪推进至因果分析与机制识别。
- 对研究效度的提示:在死胡同频发的政策领域,研究发现与新理论可能因政策骤停而「一夜改变」,威胁效度;评估所研究举措与死胡同关联因素的契合度,可作为可靠解读中国式试验的第一步。
- 资助:荷兰研究理事会(NWO),项目号 406.22.CTW.013。
🧠 IRMaD 思维导图
mindmap
root((中国试点的死胡同))
I 引言
非扩张型变迁缺研究
政策终止概念过窄
试点研究偏重成功者
理论多基于西方民主
中国试点案例丰富
R 问题
试点何种条件下中断
死胡同揭示何种约束
死胡同是非规范概念
后续终止 回退 转向
M 方法
计算过程追踪
68万余份官方文件
27103项探索型试点
匹配精确率0.926
召回率0.945
一年零提及即判中断
VAR与事件研究
金融教育个案
R 结果
一年后仅剩7224项
六年后仅剩11.7%
明确废止仅15项
获中央提及中断40%
无中央提及超95%
换届后提及降约33%
金融试点58.9%无跟进
a 讨论
擅长线性单一议题
契合干部激励者存活
复杂议题易中断
中断多在工具层面
目标常经转向延续
锦标赛式改革逻辑
D 结论
死胡同是常态
真实比例或不及九成
尚非因果模型
四条后续研究议程
研究结论可能速朽
图:本研究的 IRMaD 思维导图。蓝色 I 引言;橙色 R 研究问题;绿色 M 方法; 橙色 R 结果;紫色 a 讨论;红色 D 结论。