government-spending-taxes-economics
捐助国如何衡量外援方案的成功
Table of Contents
外援包括官援、人道救援、技术合作,仍然是國際發展努力的基石。 捐獻國每年投入數十億美元,期望這些基金能促进經濟增長、减少贫穷、改善保健和教育,并最终幫助受援国实现自给自足。 但把良好意向化為可衡量的成果遠非直接的。 外援方案的成功不仅取决于资金量,而且取决于如何有效地管理、监督和調整資源。 了解捐獻國如何衡量成功,對纳税人、决策者和发展實施者都至关重要。 強力的評估框架使捐獻國能更有效地分配资金,吸取以往的經驗,并讓所有行为者都對成果负责。 這篇文章研究了主要指示數、评估方法、挑戰和新趋势,這些都決定了捐獻國如何评估外援方案的有效性。
外援成功的主要指标
援助國依靠一套广泛的量和量指标來決定援助是否正在实现其预期目的。 這些指标跨越經濟、社會、制度和环境等层面。 任何一個衡量尺度都無法掌握多年期援助方案的全部效果,但一系列精心選擇的指标合在一起,提供了全面的进展圖景。
经济增长与减贫
經濟指标仍然是援助评估的核心。 捐助机构追蹤人均GDP(GDP),就业率和收入水平的变化。GDP的上升速度超过了人口增长,表明援助可能有利于可持续的經濟發展。 相类似,生活在國際貧困線以下的人口比例的降低(目前被定义为每天不到2.15美元)是直接衡量减贫的尺度。 然而,經濟學家提醒說,总体增长數值可以掩盖日益扩大的不平等。因此,捐助者也檢查吉尼系数和家庭消费調查,以确保穷人真正受益于增长。 提高本地企業、农业生产率和市场准入的方案常常根据创造就业和在援助期之后生存的小企业数量來评估。
健康和营养成果
改善健康是援助成功的最有目共睹的指標之一。 降低五岁以下幼儿死亡率、产妇死亡率和可预防疾病,如疟疾、结核病和艾滋病毒/艾滋病等的发病率通常受到監控。 由捐助者资助的免疫运动、清洁用水项目和营养補給都以覆盖率和保健设施使用情况来衡量。例如,接受基本疫苗的儿童人数或获得安全饮用水的家庭百分比直接反映了方案的普及程度。 捐助国也研究预期寿命和残疾年限的变化,以评估更广泛的健康影响。营养指标,如五岁以下儿童的发育不良和消費率,越来越多地用于评估長期人力资本收益。
教育和人力资本
教育指示數衡量了入学和學品的改善。 學校的入学率,尤其是女孩的入学率,是共同的輸出量。 然而, 捐獻者現在强调的是學習成果:识字和算學測試、完成率和學校到工作的轉折。 訓練老師、建造教室或提供獎學金的計畫,都以他們提高平均學年數的能力,更重要的是使學生掌握與劳动力市场相關的技能為考量。 UNDP的人类发展指数(HDI)把教育、健康及收入结合起来,提供了許多捐獻者用以衡量整体進步的综合衡量尺度。 此外,教育中的两性均等是可持续发展目標4下的一项具体目标,捐獻者追蹤女孩和男孩在初等、中等和高等教育中學程度上的比例。
治理和机构能力
援助者日益认识到援助的成功取决于地方机构的強度。 这一领域的指标包括:腐敗感知指数的降低、公共财政管理的改善、法治的加强以及预算编制的更大透明度。 支持司法改革、反腐败机构或公民社会监督的方案,都由世界银行世界治理指标或透明化國際等組織提供的治理度量的变化來评估。 援助者也评估受援国政府规划、执行和评价自身发展战略的能力。 援助通过直接预算支持提供,捐助方密切監控信托风险和受助者保持宏观经济穩定的能力。 強大的机构不仅提高援助效能,而且降低援助被滥用的可能性。
男女平等和社会包容
男女平等是很多捐獻國的交叉目標。 方案被估計為對女性經濟權、政治参与和服務的影響。 女性在有酬工作、性别暴力的流行和女性在國會中的数量等指标被用來追蹤進步。 社會包容性超越了性别,包括被边际化的族群、残疾人和流离失所人口。 捐獻者越来越多地使用「不傷害」的视角,并估計援助方案是否无意中加重了现存的不平等。 歐洲共同體的男女平等標誌和聯合國的男女平等指数是用于确保援助設計能促进两性平等的工具之一。
環境可持续性
氣候變遷對發展收益造成越来越大的威脅,因此,援助者現在要估量援助项目是否有助于環境可持续性。 指标包括碳排放的减少、森林恢复或保护的公顷、可再生能源的采用以及气候震荡的承受能力。 许多援助國在為大型基建工程提供资金之前需要環境影响评估。 巴黎協議和可持续發展目標13促使援助者量度援助组合中的「綠色”部分。 整合氣候調整或减少灾害风险的方案尤其受人重视。 一個日益增长的趋势是使用環境標記號來追蹤援助與氣候相關的量,如歐洲信用國報告系統所報道的。
评估框架和方法
選擇正確的指數只是挑戰的一部分。 捐助国也使用严格的評估方法來建立援助活動和觀察結果的因果連結。 選取方法要看方案的性质、資料的提供以及評估的目的。
发援会
歐洲发展協助委員會(DAC)制定了六項被双边和多边捐助者广泛使用的評估标准:相关性、连贯性、有效性、效率、影響力和可持续性。 相关性 研究方案是否满足真正的需要。 一致性 研究方案如何与其他干预措施相适应。 有效性衡量目标实现的程度。 效果 将成果与所花的资源进行比较。 Impact 抓住了更广泛的、较长期的變化——既有意向的,也有意向的。最后, 可持续性评估在筹资目的之后是否仍然存在效益。这些标准为捐助者提供了共同语言,有助于确保评价涵盖所有重要方面。很多机构要求所有项目和方案评价都包含這些要素。
隨機控制下試驗( RCT)
由醫學研究所借的RCT 已經成為了一個金本位, 用以估量特定援助措施( 如現金轉換、除蟲方案、微費計劃) 的影響。 在RCT 中, 受助者被隨機分配到一個治療團體( 接受援助) 和控制團體( 不受援助 ) 。 相對之下, 評估者可以將此方案的效果與其他因素隔離。 RCT 提供了強烈的因果关系證據, 但它們成本高昂, 后勤要求高, 也時而會引來關乎扣費的道德問題。 它們也最適合於狭隘、 定義的介入, 而不是大型、複雜的。 。 ABDul Latif Jameel貧民行動實驗室( J-PAL) [FLT: 1] 支持了RCT 的發展, 提出了有影響性的發現, 重新塑造了捐助政策。
成本效益分析
捐獻者越来越多地采用物有所值的透鏡, 比較干预措施的成本與效果。 成本效益分析( CBA) 以货币化成本與效益來計算净現值或利益成本比率。 成本效益分析( CEA) 衡量每單個結局的成本, 如每名被拯救的或每名被收養的孩子每美元。 這些分析幫助捐獻者在有限资金的競爭用途中排出优先位置。 例如, GiveWell 慈善評估者使用成本-效益估計值來推荐最有效率的援助方案。 然而, 利益货币化(例如, 生命或一年的教育) 可能有爭議性, 并取决于可能不在不同文化和經濟中存在的假設計。
参与性和混合方法
單靠量化方法無法抓住社會變化的复杂性。 捐助国越来越多地采用定性方法, 如焦點群、重要資訊訪問、参与性的农村考核。 這些方法可以讓受益者發出聲音, 并可以發現意想不到的效果、文化障礙或數量錯過的地方創新。 混合方法評估结合了調查和深入的案例研究, 以更深入地了解方案如何可行( 或者說方案不可行 ) 。 参与性方法也使當地社群有能力界定成功之道, 提高當地主人翁感和相关性。 改善評估平台提供了如何把参与性方法融入捐助人評估的指導。 [ 平台。
收集、監控和報告
有效的衡量依靠可靠、及时的資料。 捐款國投資監控系統, 以追蹤整個程序周期的投入、 產品和結果。 定期報告可以确保利益攸关方在需要时能調整行程 。
实时資料系統
傳統援助監控通常依靠年度調查和回溯報告。 如今, 很多捐獻者利用移动科技、衛星影像和云基儀表來实时收集資料。 例如, GPS 追蹤醫療供應鏈、 受助者自動短信調查、 農地無人機影像等, 都讓捐獻者能觀察這些項目是否在問題恶化前就已步入正軌。 這些資料系統會產生近時的回應, 使能適應性管理。 然而, 也要求大量投資於基础设施、 訓練和資料隱私保障。 捐獻者如美國國際發展署(USAID) , 已發展了自己的數位監控平台, 如 [[FLT: 0]] 發展數據庫[, , 以將援助資料标准化並公開發行。
第三方审计和獨立评估
許多捐獻國都與獨立評估者(通常是學術機構或專業的顧問公司)訂約,以評估他們的計畫。 第三方評估降低了偏見的風險,提高了對国内外觀眾的可信度。 美洲发展銀行的評估與監督辦公室[是內部但獨立的評估辦公室的一個例子。 其他的捐獻國,如英國的外務、聯邦及發展辦公室(FCDO),要求所有重大計畫都接受一個單位的「評估 」 。 這些評估常常被公開, 有助于建立發展中起作用的全局證據基础。
透明入口和開啟資料
近些年, 援助透明度的推動促使援助者公布了支出和專案成果的详细數據。 國際援助透明度倡议 標準讓援助者、非政府組織和政府可以公布援助流、活动和成果的可比對數。 荷蘭、瑞典和英國等國家都對援助透明度报告做出了承诺。 研究者和民间社会團體可以使用此公开數據來進行獨立分析,并讓援助者承担责任。 透明度本身并不改善成果,但會造成绩效壓力,也能夠辨明成功與失敗。
衡量成功方面的挑戰
援助國在准确衡量外援影響方面仍面临持久阻礙。
歸咎與反事實
最大的挑戰之一是決定所看到的改善是否真的由于援助方案。 許多因素都影響著發展 — — 贸易、国内政策、天气、全球商品价格 — — 使得援助效果难以孤立。 即使是随机控制實驗,外部有效性也是有限的:在一种情况下有效的方案可能失敗。 捐助者通常使用半實驗性的设计,如差异或倒退不斷,但这些设计仍然依赖于強大的假設。 因此,有些评估可能過大或低估了效果,导致錯誤的政策选择。
政治和经济不稳定
受援國常常會遭遇衝突、天災或經濟震撼,甚至會使设计最好的方案失序。 援助成功指标可能會暂时被壓抑,原因不是方案失敗,而是運作環境改變。 例如,學校建設工程可能會因安全威脅而延遲,或者因與援助無關的疫情而造成高死亡率。 捐獻者需要把背景风险因素纳入其评估,但這在方法上是具有挑戰性的。 许多评估目前包括了“流程追蹤 ” , 以記錄外部事件如何影響方案的实施和成果。
長時地平線與延遲影響
援助最深远的效益,如人力资本、更強健的机构或行為的改變,往往需要多年或几十年才能實現。 如今,获得更好营养的儿童只有在成年后才能表现出更好的收入。然而,捐助人的预算和政治周期需要短期的成果。 这一緊張促使人们注重速成(例如分发蚊帐 ) , 而不是更长期的系统性的改變(例如加强保健制度 ) 。 多年的考核,跟踪群組是少有的,也是昂贵的。 捐助人正在試著“长期研究 ” , 并使用預測後來結果的代用指示數,但这些方法仍然不完善。
資料质量和可用性
許多低收入國家的統計系統薄弱,重要記錄缺失,而且調查覆盖范围有限。 自報資料可能偏見,而且腐敗會導致假報。衛星資料和手機記錄提供了新的機會,但無法捕捉到一切,尤其是治理和權力成果。 捐助者常常在援助方案的同时投資建立受援者统计能力,但進展很慢。 數據質素差會損失評估的可信度, 也可能导致錯誤的結論。 经合组织发展評估委網 已发布了改善脆弱州資料质量的指南,但實施仍不均匀。
今后方向:改善衡量和问责制
國際發展界也正在探索新的方法,
技術和人工智能的整合
大數據、機器學習和自然語言處理的进步讓人們能更成本高效、更及时地做出評估。AI可以處理大量文字、衛星影像和交易資料,以探測模式和預測結果。例如,基于夜光或天台材料的衛星影像的福利預測模型可以实时估計貧困,即使調查不足。社交媒體或新聞報導的自然語言處理可以衡量公众对一個工程的感想。然而,這些技術引起了對隱私、算法偏見和用不透明模型取代人類判斷的道德問題的關注。 捐助者在制定道德指南時,正小心地试行這些技術。
符合 Sustainable Development 目標( SDGs)
社會目標指數(SDG) 框架提供了衡量17個目標和169個目標的進步的通用語言。很多捐助国已經將援助估計指标與SDG相對, 以便更系统地對待和汇总。 社會目標指數如「國際貧困線以下人口比例」(1.1.1)或「死亡率比(3.1.1)」, 現今已例行地被收錄到捐獻者的報告中。 這種調整可以減少重复, 也更容易於估量援助如何有助于全球目標。 然而, 社會目標指數仍在發展, 相關和平、公義及機構的目標的資料差距仍然特別大(SDG16)。 聯合國的 SDG指示數據網站 定期更新指示數值與資料提供。
結 论
衡量外援方案的成功是多面性的工作,需要仔细選擇指标、严格的评估方法以及持续改善數據收集和透明度。 捐助国在超越簡單的產值而更细致地评估成果和影响方面取得了重大的进展。 然而,歸因、不稳定、长期期限和數據質量等挑战依然存在。 日益强调開放數據、参与性评价和與SDG的配合,這提供了一條前进的道路,而谨慎整合新技术也是如此。 最终,目的不只是衡量成功,而是吸取成就和缺陷,使每美元外援都能為所要服務的人提供最大利益。 對捐助国而言,投资于強健的衡量系統本身就是有效援助的一部分 — — 问责制方面的投资以及可以改變意向支出和真正、持久進步的改善。