political-parties-and-their-influence
运动如何衡量推动投票的战略的有效性
Table of Contents
导言
政治运动是在一个与选民进行互动的高度紧张环境中运作的,在战略家掌握的工具中,很少有人能产生与推波助澜投票相同的辩论。 虽然传统舆论研究旨在衡量选民的身影,但推波助澜却被设计来推动投票。 区别很重要,因为竞选如何衡量推波助澜投票的效果决定了这一策略是否被视为战略成功还是声誉责任。 了解评估推波助澜投票效力所涉及的框架、衡量标准和挑战,为现代竞选决策提供了窗口,也为选民说服的道德界限提供了窗口。
推动民意调查占据了研究与宣传之间的灰色地带。 民意调查的目的不是要产生关于选民情绪的公正数据。 相反,它们只是传播有害信息、强化现有偏见或测试特定攻击的反响的工具。 运动投入大量资源来发出这些呼吁,但没有严格的衡量标准,他们无法知道这项努力是动了数字还是只是引起噪音。 文章探讨了运动如何评估投资回报、它们跟踪的具体衡量标准以及它们在试图从更广泛的媒体和广告环境中分离出单一推力调查的效果时所面临的方法障碍。
推波助澜是什么 与合法调查有何不同?
为了衡量推力民意调查的效果,首先必须定义什么是实际推力民意调查。 该术语是指一种假冒合法意见调查的电话营销或现场传呼脚本,但实际上却是为了改变被调查者的意见,通常通过对对手的负面信息来进行。 典型的推力民意调查可能会问到:"如果知道史密斯候选人在2018年因逃税而被引用,你是否或多或少地支持他?" 问题嵌入了一个断言,而被调查者即使回答“不太可能”也处理断言。
相比之下,合法投票则使用中性措辞和平衡的对策选择。 它试图在不污染的情况下衡量现有观点。 美国舆论研究协会(AAPOR)通过指出推票“不是为了收集信息,而是为了在研究的幌子下传播宣传 ” 来区分推动民意调查与合法调查研究。 使用推票的运动经常受到媒体、学术研究人员和有时选举管理机构的批评。 尽管如此,推票仍然持续,因为投票在低信息竞赛中或选举前的最后几天里,在一次时机成熟的电话可以向未决定的选民倾斜。
推力民意测验的法律地位因法域而异。 一些州要求披露谁在付费,而另一些州则试图以欺骗行为为由彻底禁止推力投票。 多个州开展的运动必须谨慎地遵循这些条例,而衡量效力往往包括潜在法律或公共关系后果的风险评估。 推力投票可以把选民情绪提升两个百分点,但可以引起关于肮脏伎俩的正面报道,这可能会给部署这一手段的竞选带来净负差。
推波助澜在现代运动中的战略作用
竞选不是随意地进行投票。 使用这一策略的决定通常遵循一种战略计算,这种计算会权衡潜在的反弹。 投票在竞争的比赛中最常用,少数未决定的选民可以决定投票结果。 投票在初级选举中也被用来测试过于激进的言论,而公开广告则过于激烈。 战略依据基于三个假设:定向电话可以送达不消耗竞选广告的选民,即使被申请人抵制,所传递的信息也会坚持下去,而且很难追溯到最初的竞选。
从这一战略角度衡量有效性不仅需要投票分享模式。 竞选活动还必须评估推波助澜投票是否实现了其沟通目标。 召召是否成功地给对手投下了具体的怀疑? 它是否将对话围绕特定问题进行? 它是否抑制了对手的投票率? 这些都是常规投票不能直接回答的问题,因此竞选活动会利用接触前和接触后调查、控制小组和后续访谈等组合来孤立信息效应。
通过电话将投影作为负面广告
推民调和负面电视广告之间有着很强的相似性。 两者都试图建立一个情绪或认知协会,使对手的吸引力降低。 区别在于推民调是互动的。 被调查者被迫处理信息,然后表达一个回应。 主动处理可以让信息比被动的电视点更令人记忆。 运动通过在后期调查中嵌入的信息召回问题来测量这一现象,询问被调查者是否对某一指控有"最近听到什么"。 被调查者中被调回的频率是效果的代名词。
然而,推力民意调查的互动性也带来了风险。 觉得被操纵的被调查者可能会更积极支持目标候选人。 这种现象被称为反弹效应,是衡量效力的关键变量。 成功的推力民意调查避免了通过将信息设定为中性问题而不是断言引发反弹。 衡量挑战在于发现情绪的微妙转变,而不能直接询问被调查者是否感到被推向。
衡量推动污染有效性的关键衡量标准
运动依靠一套量化的衡量标准来评估推力投票是否达到了预期效果。 这些衡量标准通过多个数据收集点进行跟踪,以建立前后的情景。 最常用的衡量标准包括反应转变、选民参与率、信息召回以及随后的投票结果。 每个衡量标准都掌握了不同层面的实效,运动通常将它们放在一起,而不是依赖单一的指标。
反应移动
反应转变是指在被调查者中记录的倾向性或投票意图的变化。为了衡量这一点,运动对目标宇宙进行前期调查,管理对目标宇宙的子集的推波助澜,然后对同一个人进行后期调查。两个时间点之间的反应差异谨慎地归因于推波助澜,统计学上的重大转变从一到三个百分点一般被认为是在紧张的比赛中的成功。然而,运动必须说明对平均率的倒退以及使前期投票者本身对该问题有敏感认识的可能性。
精心策划的竞选活动构建了控制人口变量、党派倾向和媒体消费的回归模型。 这样的竞选活动还测试了剂量反应效果。 如果接受更长时间的推力投票的受访者显示的转变比接受更短的投票者大,那么竞选活动就对内容本身正在推动变革产生信心。 这种分析需要超过基本投票最低限度的样本规模,这增加了成本,但提高了测量精度。
选民参与和参与计量
完成推举投票的接触选民百分比本身就是一个衡量效果的尺度. 完成率低表明剧本没有与被调查者接触,这减少了接触信息的人的集合. 运动跟踪所拨打的电话数量,联系人数量,完成次数,以及平均通话时间长度. 剧本中间的高投稿率表明被调查者变得怀疑或无聊,这可能表明封面故事不可信或信息过于熟悉.
参与程度也通过要求更多信息或在呼叫中自发提供不及时意见的答卷人数量来衡量。 呼叫中心主管者标榜这些互动进行定性分析。 如果相当一部分答卷人表示愤怒或怀疑,那么竞选活动可能会决定放弃剧本或修改其语气。 相反,如果答卷人似乎接受并询问后续问题,则表明信息渗透力度更大。 这些参与指标往往被实时记录,并汇总到日常审查竞选战略家的仪表板中。
信件回顾
信息召回是效果的滞后指标,它衡量选民是否记得从催促民意调查中发出的中心指控或诉求。高召回意味着信息被编码成长期记忆,从而增加了影响选民最终决定的可能性。运动测试信息召回通过后续调查,询问被访者对候选人的知情情况是否没有限制或引发问题。答复的准确性与原始的催促民意调查脚本相比。
强烈召回的基准因市场密度不同而异。 在选民被相互竞争的信息所轰炸的饱和媒体环境中,召回率超过20%被认为是极好的。 在较安静的种族中,召回率可能达到30%或更高。 运动还通过每隔24小时、48小时和一周进行后续调查来测试召回衰败。 快速衰减表明信息没有坚持下去,而稳定或不断增长的召回表明,信息通过人际讨论或推波投票本身产生的媒体报道而传播。
随后的投票结果
推力民意测验效果的最终检验标准是马力赛车数的移动。 竞选通常在推力投票浪潮前委托进行基准投票,然后在波后委托进行追踪投票。 候选人支持的差异,特别是目标人口或地理部分之间的差异,被用来估计净效应。 这一措施很吵,因为许多其他因素 — — 电视广告、新闻事件、对手反应和选票退出行动 — — 正在同时发生。 为了提高精确度,竞选活动使用差异差异框架,将目标宇宙之间的变化与未接受推力投票的控制宇宙之间的变化进行比较。
一些运动更进一步,使用匹配的派分析或倾向性分数加权来模拟随机化的实验。 当在多个媒体市场进行推波助澜时,运动可以将受处理市场的变化与未经处理市场的变化进行比较,只要市场类似党派组成、收入和教育等关键共变因素。 这种准实验方法是衡量推波助澜结果的金本位标准,但需要有一个具有足够规模和数据基础设施的运动来适当实施。
评估影响运动采用的方法
除了核心衡量标准之外,竞选活动还运用了几种方法来隔离和量化推波助澜的效果。 这些方法从简单的前期比较到复杂的多波面设计。 选用方法取决于竞选活动的预算、时间和对测量错误的容忍度。
投票前后投票
最直接的方法包括对目标人群进行基线调查,包括有利的评级、发行协会和投票意向。 这场运动使那些在一定时期内有民意测验的人饱和。饱和窗口关闭后,后续调查将针对同一人群或从同一框架抽取的新样本。 两波之间关键指标的差异归因于推力投票的曝光,但有警告。 这种方法容易受到历史影响和成熟效应的影响,但依然被广泛使用,因为它是直接的,可以在单一的竞选周期内实施。
进行前期比较的运动通常包括一系列关于无关主题的控制问题,以衡量推波助澜民意是否导致被调查者注意力或情绪的普遍变化。 如果控制问题显示没有变化,而目标问题显示移动,那么对归属的信心就会增加。 事后设计还得益于大样本尺寸,理想的是每波400至800个被调查者,为探测小转变提供足够的统计力量。
控制组设计
控制组设计通过确保部分选民被故意排除于曝光之外,提供了更强大的因果关系. 在随机化的控制设计中,竞选活动确定一个电话号码列表,并随机分配其中一部分接受推波助澜呼叫,而其余的则没有收到一个无关话题的呼叫或安慰剂呼叫. 两个组都接受调查. 处理与控制组的响应差异隔离了推波助澜的效应,同时取消了新闻报道或天气等常见外部因素.
在现场直播中执行真正的随机化控制设计是困难的,因为电话列表很少真正随机,而且选民可能跨处理和控制组共享信息. Spillover效应可以淡化所测量的影响. 运动通过从地理上独立的地区选择控制组或确保从非重叠列表部分抽取处理和控制样本来缓解这种情况. 尽管存在这些挑战,控制组设计被认为是内部竞选评价最可防的方法.
数据分析和行为模型
现代运动可以访问广泛的选民信息数据库,包括过去的投票历史、政党登记、消费者行为和数字足迹数据。 这些数据库可以让运动建立预测性模型,预测选民可能的反应,以推波助澜。 比如,运动可以使用逻辑回归来识别最容易在推波助澜中测试的信息所显示的人口和态度特征。 如果模型预测50岁以上白人、郊区妇女是最能反应的阶层,那么运动可以针对该阶层,并具体衡量其影响。
行为模型化也允许运动检测推波助澜的曝光率与其他竞选触点之间的相互作用。 接受推波助澜的选民,然后看到相关的电视广告,可能比仅接触刺激的选民显示更大的转变。运动使用多触控归属模型来包裹每个频道的贡献。这些模型往往依赖于巴耶西亚统计或机器学习算法,这些统计或机器学习算法可以处理高维度数据。 输出是相对于拉票、直接邮件、数字广告和其他策略而言,推波助澜得分。
美国民意研究协会维持关于道德投票的准则,运动在设计衡量框架时应当参考这些准则,以确保它们不会将真正的投票与宣传混为一谈。
后续调查和定性反馈
量化衡量标准无法涵盖所有内容。 运动用定性访谈、焦点小组和开放式调查问题补充其计量工具。 包括一个简短的免费回答部分的后续调查可以揭示答卷人如何向朋友和家人谈论推价内容。 如果大部分开放式答复提到推价投票的具体指控,运动知道信息正在有机传播。
一些运动也与负责推举投票的呼叫中心工作人员进行汇报。 呼叫中心代表往往有直觉地知道哪些脚本在起作用。他们可以回馈谈话的语气、被调查者的共同反驳和意想不到的反应。 这种质量反馈循环在脚本修订和近实时的定向调整中。这些汇报的洞察力虽然不严格,但有助于在下一波通话之前完善信息。
数据基础设施与跟踪有效性技术
Measuring push poll effectiveness at scale requires robust data infrastructure. Campaigns that deploy hundreds of thousands of calls need systems that log every call outcome, time stamp every interaction, and link responses back to individual voter records. Modern campaign technology stacks include predictive dialers, interactive voice response systems, and customer relationship management platforms that integrate with polling and analytics software.
用于跟踪的常用技术是具有综合调查功能的自动调试器。这些系统记录了呼叫是否被响应,被响应者停留在电话线上多久,回答的问题是什么,以及被响应者是否完成了呼叫。这个元数据直接输入了效果模型。如果数据显示同一脚本在某些区域代码中产生更长的调用时间,那么该运动将调查这些调试是否被记录下来或被忽略,并相应调整模型。
另一种新兴技术是运用于录音通话音频的情绪分析。 一些销售商提供了分析回应者回答的语气、词选和情感价值的自然语言处理工具。 虽然这些工具对大多数竞选来说仍然昂贵,但可以发现愤怒、困惑或热情的转变预示日后的行为。 在推力投票中听起来很不爽的被申请人可能更可能出于敌意投票给目标候选人,从而推翻预期效果。 早期的检测可以让竞选停止产生反弹的剧本。
从皮尤对推票的商业和政治用途的研究强调了透明数据收集对合法性的重要性.
衡量推动污染效力方面的挑战
尽管有多种方法和衡量标准,但竞选活动在试图衡量推波助澜投票的真正影响时面临很大障碍。 这些挑战来自文书本身的性质、其运作环境以及围绕政治研究的道德约束。
潜意识影响和困惑变量
选民可能受推举投票的影响,而不知道这一点。 仅仅暴露效应,一个有详细记录的认知偏见,就表明,即使个人没有意识地记住这种暴露,反复提出刺激也能增加人们对这种刺激的喜爱。 在推举投票的情况下,选民可能觉得目标候选人的负面感比较模糊,但将这种感觉归因于他们所看到的新闻报道或他们的对话。 这种潜意识的影响很难在调查中捕捉到,因为被调查者无法可靠地报告其感受的来源。
令人困惑的变量进一步模糊了测量。媒体对推力民意调查的报道本身可以产生二次曝光。 如果报纸写出推力民意调查的报道,那么读到这个报道的选民可能会在从未接到过电话的情况下转移观点。 竞选活动随后在大众中看到一场可能错误地归结到电话操作的运动。 控制这种效果需要媒体跟踪、新闻报道编码和时间序列分析,因为许多竞选活动缺乏资源。
社会期望和对策
当在后续调查中被问及是否受到电话影响时,许多人会否认,要么是因为他们不想承认易被操纵,要么是因为他们真正相信自己是免疫的。 这种社会可取性偏见夸大了测量数据中推算民意调查的明显无效性。 完全依靠自报影响的运动会系统地低估真实效果。
为了补偿,竞选活动使用间接测量技术,例如,他们要求答卷人将候选人列入属性清单,其中一些在推举民意测验中被提及,有些则没有。如果推举民意测验小组对候选人的评分低于上述属性,但未提及属性,那么竞选活动就推断潜在影响。 这种方法减少了对直接归属问题的依赖,并为推举民意测验的具体内容效果提供了更清洁的证据。
法律和道德限制
衡量推力民意调查的有效性因各州不同的法律限制而变得更加复杂。 在要求披露征召人身份或支付征召费的实体的州,竞选活动可能不得不改变其脚本,从而降低推力民意调查的说服力。 衡量在这些改变条件下的实效可能无法普遍适用于不受限制的环境。 此外,大学和研究机构的道德委员会一般不批准涉及欺骗性沟通的研究,这限制了独立学术研究对推力民意调查效果的提供。
竞选活动还必须考虑到利用推力投票抓住的声誉风险。 如果竞选活动的内部衡量显示推力投票是有效的,那么竞选活动可能会被诱惑升级使用。 这样的升级会增加曝光概率,这可能导致负面的媒体报道、选民的反弹甚至法律行动。 有效的衡量包括风险收益分析,将选民支持的边际收益与丑闻的潜在成本权衡。 一些竞选活动的结论是,衡量效力的最佳尺度是中立的:如果推力投票在没有发现的情况下无法部署,那么其效力就无关紧要。
联邦选举委员会就交流标准提供监管指导,竞选活动应连同其衡量规程一起审查。
评价推波助澜运动的最佳做法
基于上述方法和挑战,宣传运动可以采用一套最佳做法,提高它们推动民意测验有效性衡量的可靠性。 这些做法既严格又符合时间、预算和法律风险的实际限制。
首先,运动应该从一开始就将测量纳入推波助澜操作的设计中。 等待到呼叫完成后,决定如何衡量效果必然会产生薄弱或模糊的结果。 在第一次呼叫之前,应该规划调查前后、控制组和消息召回问题。 这可以进行适当的随机分配,有足够的样本大小,以及明确的假设,说明哪些片段将受影响最大。
第二,运动应该同时使用多种衡量方法。 没有单一的衡量标准能提供完整的情况。 将反应转变分析与信息召回跟踪、参与度量表和定性反馈结合起来,会产生更能应对任何单一方法固有的偏见的趋同证据。 当多个指标指向同一方向时,运动可以更有信心地得出结论。
第三,竞选活动应该透明地记录其衡量方法,供内部使用。 清晰的文献记录可以让竞选团队在未来周期中复制衡量方法,对不同种族进行比较,并从成功和失败中学习。 如果在法院或媒体上质疑推力投票,它也可以提供辩护。 能够显示其效果且没有发现任何选民欺骗证据的竞选活动可能具有更强大的法律地位。
第四,竞选活动应该投资于数据整合。 最有价值的成效衡量标准来自将推投票数据与投票人投票率记录和最终选举结果联系起来。 了解哪些选民获得推投票结果的竞选活动可以检查这些选民是否多少有结果,以及他们是否为目标对手投票。 这一关联需要一份选民档案,可以与许多竞选活动已经拥有的电话号码匹配。
最后,竞选活动应该不断了解不断演变的法规和公众对于推动投票的态度。 随着数据隐私法的收紧和选民对欺骗策略的更多了解,推动投票的效果可能会下降。 衡量这种不断变化的环境中的实效需要不断调整基线和期望。
结论
衡量推力民意测验的效果是选择使用这一有争议的工具的运动的一项复杂但必不可少的任务。 所使用的衡量标准 — — 反应转变、参与率、信息回顾和随后的民意测验结果 — — 提供了数量基础,而诸如前期设计、控制组、数据分析、质量反馈等方法则增加了深度和因果关系。 然而,运动必须应对重大挑战,包括潜意识影响、社会可取性偏差、困惑的变量和法律限制。 衡量最有效的是那些将评价视为推力投票行动的组成部分的运动,而不是事后思考。
最终,推力投票的有效性不仅仅是一个它是否移动数字的问题,也是一个运动是否理解风险、管理道德影响和负责任地使用数据的问题。 最佳运动不仅用衡量方法来确认其策略,而且用学习、适应和决定策略何时已经过时。 只要种族不确定,而且战略家愿意测试合法说服的界限,推力投票就仍然是竞争性选举的固定点。 如何衡量说服力将决定他们如何明智地运用这一策略。
西北政策研究所对政治沟通策略提供了补充分析,为理解推力民意测验策略提供了背景.