government-accountability-and-transparency
政策评价如何塑造未来的立法决定
Table of Contents
政策评价在立法决定中的作用
政策评估不仅仅是一项学术工作,而是一种推动有效、负责治理的基础机制。 当立法机关制定法律时,它们正在对特定干预如何改变行为、分配资源或解决社会问题进行赌注。 不进行系统评估,这些赌注就仍然失明。 执行后评价政策的做法为立法者提供了具体的证据,使他们能够完善、扩大或放弃未能取得成果的方法。 这种反馈循环对于一个正常运作的民主至关重要,因为公共资源必须明智地使用,并通过透明的结果维持公众的信任。
本条探讨了政策评价如何影响未来的立法决定,从理论基础到现实世界的案例研究和新趋势,认为评价应从一开始就纳入立法进程,而不是在政策得到确立后紧紧地进行。
理论基础:循证决策
现代政策评价的侧重点来自于向循证决策(EBPM)的更广泛运动。 EBPM认为决策应该以严格的数据和分析而不是意识形态、传闻或政治权宜之计为参考。 核心思想是直截了当的:在颁布新法律或扩大现有方案之前,决策者应该审视证据对类似干预的描述。 在政策出台之后,他们应该评估其实际影响,以达到预期目标。
两种典型的决策模式说明了评价为何重要:
- 理性-全面模型: 假设决策者可以确定明确的目标,考虑所有备选方案,选择最佳方案,然后客观地评价结果。 事实上,由于时间、信息和认知能力有限,这个模型很少实现。 评估通过反馈实际业绩数据来帮助大致理性。
- ” 递增主义(Lindblom的“干涉”): 将决策描述为从现状中的一系列小调整。 评估是一个指导性机制,它显示哪些递增变化是有效的,哪些是无效的,从而可以进行连续的改进。
两种模式最终都依赖评价的反馈来改进未来的决策。 没有这些反馈,政策进程就仍然停留在猜测中。 为了更深入地探索环境、生物和植物计划框架,RAND公司提供了政策分析方法的广泛研究。
政策评价对立法机构至关重要的原因
立法机构的运作受到种种限制:会议时间有限、优先事项相互竞争、政治压力很大。
- 问责制:[ 纳税人和组成人应当知道某项法律是否实现了其既定目标,评价报告创造了可用于监督听证和预算谈判的业绩记录。
- 资源优化: 政府很少有无限的预算。 评价确定了每支出美元能带来高回报的方案以及那些应该被解资或重组的方案。
- 机构学习: 随着时间的推移,定期评价在立法机关和各机构中积累机构知识。 立法者在起草新法案时可以借鉴以往的成果,避免重复错误。
- 公共信托:[] 当公民看到法律根据证据得到审查和修订时,对政府的信心就会增加. 围绕评价方法和调查结果的透明度会减少怀疑.
政策评价的类型和方法
理解不同的评价方法有助于立法者为每种情况选择正确的工具。 评价并非单一的;可以按几个方面分类。 评估可以将评估分为不同层面。
格式与总结性评价
新的数字税务申报平台可能要经过成型评价,以确定可用性问题。 简要评价[ 是在政策设计或早期实施期间进行的。它测试了试点研究、收集利益攸关方的反馈并完善程序,然后才全面推出。 例如,一个新的数字税务申报平台可能会接受成型评价,以确定可用性问题。 简评 则在执行完成后进行。它问:政策是否导致了预期的变化?这些变化有多大? 负担得起的护理法的覆盖范围扩大需要经过无数总结评价,为以后的改革提供了依据。
过程、影响和成本效益评价
- 程序评价[]:检查某项政策是否按设计实施。如果职业培训方案显示效果不佳,则程序评价将检查培训是否实际交付、向谁提供以及是否忠实。这有助于区分政策失败和执行失败。
- 影响评估[:使用实验或准实验方法(随机控制试验、差异、回归不连续)来隔离政策的因果关系,例如,对最低工资增加的影响评价利用国家一级的变化来衡量对就业和收入的影响,城市研究所保存了这类研究的综合汇编。
- 成本效益和成本效益评价:将政策的货币成本与其结果相比较,通常以非货币性(例如,挽救生命的年份,减少犯罪)来比较。 这些分析对于有预算意识的立法机构来说至关重要。
定量、定性和混合方法
良好的评价往往结合了各种方法。 定量数据(调查、行政记录、经济指标)提供了统计力量和普遍性。定性数据(访谈、焦点小组、案例研究)揭示了机制、背景和意外后果。 混合方法评价越来越普遍,因为既提供了广度,又提供了深度。
进行有益评价的核心挑战
尽管政策评价的价值很大,但政策评价仍然面临长期存在的障碍,认识到这些挑战有助于立法者设计现实和可操作的评价任务。
数据提供和质量
缺乏可靠的基线数据和结果措施,就不可能进行评价。许多法律没有具体说明必须收集什么数据或如何提供这些数据。隐私问题、信息系统分散以及陈旧的基础设施使问题更加复杂。 立法机构可以通过将数据收集要求纳入原始法案语言来解决该问题,规定各机构必须在合理时限内公布已解析的数据集。
政治抵抗和时机错乱
当选官员可能抵制可能令他们难堪或增强反对者权能的评价。 受到选民欢迎的方案即使有证据表明其无效,也可能受到保护,不受审查。 此外,立法周期往往与评价周期不协调。 通过原始法案的议员卸任或继续工作后,五年评价可能到达。 为了反对这种情况,立法起草可以包括需要提交评价后才重新授权的日落条款。
复杂因果关系和归属
政策很少孤立地运作。 经济条件、其他法律和外部冲击都影响着结果。 孤立政策的净效果需要复杂的统计控制或随机设计,而这种设计并不总是可行的。 决策者应该现实地看待评估可以要求什么,避免期待复杂的社会方案给出简单肯定/否定的答案。
资源限制
严格评价既昂贵又耗时。 预算有限的小型机构或州立法机构可能缺乏执行高质量研究的专门知识或资金。 与大学、无党派研究组织(如政府问责办公室或州立法审计办公室)的合作安排以及慈善基金会可以帮助进一步拉长评价资金。
案例研究:评价如何塑造随后的立法
现实世界的例子表明,政策评价对立法轨迹产生了实际影响。
收入所得税抵免
美国联邦就业服务中心自1975年成立以来就受到广泛评价,研究一直表明,它增加了单身母亲的劳动力参与,减少了贫困,边际成本相对较小,这些积极的调查结果导致联邦和州两级的多重扩展,而对于贫困家庭临时援助(TANF)方案的评价则产生了更多的好坏参半的结果,促使一些州试行了放弃和工作支持政策, 预算和政策优先事项中心 跟踪就业服务中心的成果和立法变化。
三害法律和判决改革
加利福尼亚州在1994年颁布的“三击”法对累犯规定了长期判决。 到2000年代,评估表明,法律对非暴力罪犯的监禁比例过高,花费数十亿美元,而且与其他州相比没有显著减少犯罪。 这些调查结果为改革创造了势头,导致2012年提案36缩小了法律的适用。 其他州也进行了类似的评估驱动的改革,将资源转移到了药物法院和重返方案等循证替代方案上。
失业保险创新
在COVID-19大流行期间,许多国家简化了失业保险制度,并增加了临时福利,学术界和美国劳工部进行的评估显示,哪些过程的改变,例如接受电子签名和追溯付款,降低了拖延和错误率,有几个国家通过立法行动使这些改变永久化,经合组织研究了这些调整,供其他国家适用。
教育标准化测试和问责制
2001年的《无子留学生法》规定每年进行一次测试,并对成绩不佳的学校实施制裁。 在未来十年里,汇总评估发现,虽然一些分组在数学方面有所改进,但法律鼓励教学到测试阶段,缩小课程范围,并在困难学生中产生高辍学率。 这些评估为2015年的《每个学生成功法》提供了依据,该法将灵活性回归各州,强调学校成绩的多种衡量标准,而不是仅测试分数。
将评价纳入立法进程
为了最大限度地发挥影响,评价不能成为事后考虑。 立法者可以通过若干机制将评价纳入他们的工作。
立法前评价所需经费
在出台法案之前,需要有一个初步评估计划,其中要明确:(1) 政策打算实现的可衡量的结果,(2) 衡量这些结果的数据来源和方法,(3) 编写报告的时间表。 一些立法机构,如美国政府问责局,已经应要求提供了无党派评估。 扩大这些办公室的能力确保了评估的可信和及时性。
日落条款和定期审查
许多州都设有日落咨询委员会,除非立法机构根据业绩重新授权,否则会自动解散机构或方案。 比如,德克萨斯州利用日落咨询委员会每12年对州机构进行评估。 这创造了内在的评价触发机制,迫使立法对结果而不是惰性的关注。
利益攸关方参与和参与性评价
评估如果包括受政策影响者的观点,则更可信。 参与性评估让受益者、前线工作者和社区组织参与确定成功与否和解释结果。 这种方法可能会显现出一些意外后果 — — 如阻碍合格受援者的行政负担 — — 可能错过自上而下的评价。
立法工作人员关于证据使用的培训
委员会成员和立法助理往往为立法者编写评价报告,对他们进行基础研究设计、数据扫盲和评价评价方面的批评性评估方面的培训,提高了立法审议的质量,包括国家立法机构全国会议在内的一些组织提供循证决策讲习班和工具包。
政策评价的新趋势
政策评价领域在技术进步和不断变化的期望的推动下正在迅速发展。
大数据、机器学习和实时监测
税收申报、福利要求、健康记录和地方政府系统的行政数据现在可以在个人层面联系起来,从而能够进行更细微和及时的评价。 机器学习算法可以确定模式并预测结果,尽管它们也引起了对偏倚和透明度的担忧。 实时评价仪表板 — — 目前在一些国家用于大流行病应对 — — 让决策者能够调整中期执行过程,而不是等待最终报告。
参与性和公平评价
越来越多的人认识到传统评价方法可能忽视差距或强化现有的不平等。 新框架通过按种族、收入、性别和地理分列结果,让社区在设计评价问题时发表意见,从而将公平中心化。 城市研究所以公平为中心的评价方法[就是这一趋势的例证。
国际基准制定和跨国学习
立法者在起草法律时越来越关注其他国家的经验。 经合组织和世界银行等组织公布了教育、卫生、税收和环境监管等领域的政策比较评估。 这些跨国数据库有助于立法者评估某项政策是否有可能在其自身背景下发挥作用,然后才能对国内进行全面评估。
行为观察和实验方法
政治政策改革的“新政策”和“行为科学”团队(比如英国的行为洞察小组)对小的政策变化进行快速随机评估,比如重新设计信件以减少税收违法率或简化表格以增加方案入学率。 如果结果良好,这些低成本的实验可以被扩大为全面立法,从而形成从评价到立法行动的直接管道。
结论:建立评价文化
政策评价并不是一个外围活动,可以外包给学术界,被政客忽略。 它是中央反馈机制,可以让立法机构学习、适应和有效治理。 当评价从一开始就被设计成立法过程时,它会产生可操作的洞察力,为随后的决定提供参考 — — 无论是扩大成功的试点,确定有缺陷的执行,还是结束一个已经失去其效用的方案。
数据、政治和资源的挑战是真实的,但可以克服。 通过投资独立的评估办公室,授权数据收集,培训工作人员,以及采用实时监测和参与性评估等新方法,立法机关可以从制定信仰法转向制定证据法。 有效治理的未来取决于此。