论文推荐 Vol. 29|政治局集体学习之后,战狼收声了吗?

Brazys, Dukalskis & Müller, 2023 | The China Quarterly

论文信息

概要

2021 年 5 月 31 日,中共中央政治局就”加强国际传播能力建设”进行集体学习;6 月 1 日新华社播发通稿,其中习近平要求塑造”可信、可爱、可敬”的中国形象。这句话迅速登上国际媒体头条,引发全球猜想:盛行一时的”战狼外交”是不是要被叫停了?

都柏林大学学院的 Samuel Brazys、Alexander Dukalskis 与 Stefan Müller 在 The China Quarterly 上的这篇研究报告,用数据回答了这个问题。他们结合手工编码与潜在语义标度(LSS),构建了一个从”友好”到”战狼”的一维文本测量,将其应用于近 200 个中国官方、媒体与外交 Twitter 账号在 2021 年间发布的 20 多万条英文推文,再以双重差分(DiD)设计比较公告前后驻 OECD 国家与驻非 OECD 国家外交账号的语气变化。结论是微妙的:公告发布数月内,驻 OECD 国家的外交账号推文确实相对柔化了(约 0.1–0.15 个标准差),但数据显示中国对外传播战略没有发生重大转向——战狼没有被驯服,只是对特定听众收敛了一点音量。

这篇论文也是战狼外交量化研究的奠基性工作之一:我在 Vol. 26 介绍的 Lim 等人(2026)用其 LSS 指数做稳健性检验,Vol. 27 介绍的 Yang & Yang(2025)也将其作为战狼外交时间线的重要参照。读它是理解后续这一系列研究的起点。

“可信、可爱、可敬”引发的猜想

中国一向重视国际形象的塑造,其形象工程既有主动维度(展示和平、不具威胁、成就斐然的中国),也有反应维度(回应外国批评)。战狼外交正是在这一背景下诞生的。2019 年,先后驻美、驻巴基斯坦的外交官赵立坚因推特言论受到关注——他的推文热情洋溢地赞美巴基斯坦、为中国政策辩护、点名美国的虚伪。赵立坚和类似风格的官员获得提拔,”整个外交部的外交官都注意到,语气的转变正在得到奖赏”,恰好在同一时期纷纷开设自己的推特账号。

外交官与官方媒体在社交媒体上扩张、中美关系下滑、国际社会对新疆问题的关注、对”话语权”的追求、国内民族主义、最高层对强硬姿态的明确偏好、可见的晋升激励、以及中国不断增长的物质实力——这一切汇合,构成了战狼外交诞生的土壤。

混合信号:驯狼还是放狼?

2021 年 6 月 1 日的新华社通稿看似是承认战狼外交正在适得其反:皮尤的民调显示中国在西方的形象已滑至历史低点,”可爱”的表述像是最高层要出手纠偏。但作者提醒,通稿释放的信号远比头条复杂。

首先,通稿同时强调”舆论斗争”,暗示着对朋友与敌人的区分——对朋友展示可爱,对敌人则要让其”理解”中国。其次,通稿强调提升中国的”话语权”,表明争夺全球叙事主导权的目标没有变。再次,为政治局授课的专家是复旦大学张维为——一位一贯主张中国应对自身制度更加自信、同时放大”西方”缺陷的学者。最后,习近平本人长期以来一直要求外交官采取更强硬的语气。因此,这次集体学习也完全可能被读作不是驯狼,而是重新确认”对朋友可爱、对敌人强硬”的既定路线。

新华社通稿的混合信号意味着,仅靠文本解读无法判断会议的实际效果——这正是实证方法可以发力的地方。作者选择 Twitter 作为观察窗口:由于推特在中国被封锁,中国官方账号的推文主要面向外国受众,是观察对外传播的绝佳材料。

用 LSS 测量“战狼指数”

作者依托一份中国外交账号(大使、使领馆、外交部账号及高级官员)与官方媒体账号的清单,抓取了 2021 年 1 月 1 日至 10 月 7 日间所有至少发过一条推文的账号,仅保留英文原创推文(剔除转推)。

测量分两步。第一步,从语料中随机抽取 1,000 条推文,人工编码为”友好”“战狼”或”中性”,据此确定位于”友好—战狼”一维量表两端的种子词(23–25 个)。第二步,用潜在语义标度(Latent Semantic Scaling, LSS)为全部约 20 万条推文打分:LSS 根据每个词与种子词的语义相似度赋予词语权重,再按词频合成每条推文的得分——得分越高越友好,越低越”战狼”。

表 1:LSS 得分最低(不友好)与最高(友好)的各 100 个词

表 1 列出了量表两端的各 100 个词,一眼就能看出测量的效度。”不友好”一端是 accusations、so-called、fabricated、smear、genocide、disinformation、slander、hypocritical、preposterous,乃至 @adrianzenz(郑国恩,涉疆研究的争议学者)、ASPI(澳大利亚战略政策研究所)、xinjiangcotton、forcedlabour 这样的议题标签——几乎是一份战狼话语的关键词清单。”友好”一端则是 friendship、brotherly、gratitude、donation、all-weather,以及尼泊尔、文莱、古巴、坦桑尼亚等对华友好国家的国名。

推文层面的验证同样直观。得分最低(最战狼)的推文之一来自中国驻悉尼总领馆(2021 年 3 月 7 日):”所谓新疆存在’种族灭绝’的说法荒谬至极,完全是别有用心的捏造、彻头彻尾的谎言。”得分最高的推文之一来自人民日报(2021 年 5 月 6 日):”习近平主席周四同文莱苏丹哈桑纳尔互致贺电,庆祝两国建交 30 周年。”

没有对照组的双重差分

如何利用 6 月 1 日公告的时点做因果识别?作者否定了两个直觉方案:以时间为驱动变量的断点回归(RDiT)在实现上有公认的困难;而简单的公告前—后对比很可能是虚假的——任何同期因素都可能影响推文语气,且根本不存在”未受处理的”对照组(所有账号都看到了公告)。

作者的方案是利用两个”受处理”组之间的异质效应:既然中国的对外传播历来”看对象说话”,那么如果这次集体学习意在软化形象,受战狼外交冲击最大的 OECD 国家(多为富裕民主国家)理应比非 OECD 国家(大致对应全球南方,以及位于中国的官方媒体账号)感受到更明显的语气变化。这一选择有充分的历史依据:中国外交长期经营与发展中国家的友好关系,习近平在 2013 年全国宣传思想工作会议上就强调要在”发展中国家”中更有效地传播中国观点;战狼话语本身也带有反帝色彩——对西方及其盟友更批判,对其他国家更友善。OECD/非 OECD 的划分正是捕捉这一区分的代理变量。

数据分布:驻 OECD 国家账号共 10,066 条推文(公告前 5,904 条、后 4,162 条);非 OECD 账号及官方媒体账号共 190,542 条(前 79,997 条、后 110,545 条)。分析以推文为单位,在从 ±1 天到 ±115 天的对称时间窗口上分别估计经典 DiD 模型,以检验结果对窗口选择的稳健性。主模型按账号标准化语气得分、聚类标准误到账号层面,且不加控制变量以避免后处理偏误。

发现:语气柔化了,但战略没变

图 1:全部外交账号的日均战狼指数(向上为友好;竖线为 95% 置信区间;虚线为 6 月 1 日公告时点)

图 1 是全部外交账号的日均战狼指数时间序列。整体上,公告前后并没有一致的语气突变。但图中有一个刺眼的异常值:2021 年 3 月下旬战狼指数大幅下探,恰好对应 3 月 19 日中美阿拉斯加高层会谈——中国外交官在会上指责美国”煽动一些国家攻击中国”,大量中国账号围绕会谈密集发推。这个外部校验为测量提供了佐证:公认的对抗性事件确实在指标上留下了清晰的印记。

图 2:不同对称时间窗口下的 DiD 估计(OECD 账号相对非 OECD 账号的语气差异;正值表示 OECD 账号更友好;竖线为 90% 与 95% 置信区间)

图 2 是核心结果。横轴是 DiD 估计所用的时间窗口(公告前后各 1 天到各 115 天),纵轴是 OECD 账号相对非 OECD 账号的语气差异。公告显示后立即的窗口(±1 至 ±4 天)内估计值虽大但不显著——样本太小。窗口放宽到约一个半月之后,DiD 估计持续为正,系数在 0.1–0.15 个标准差之间。按账号类型细分(全部账号、仅外交账号、仅使领馆机构账号、仅大使及工作人员账号),结论一致:公告之后,驻 OECD 国家账号的语气相对变温和了。

0.1–0.15 个标准差意味着什么?作者用两条真实推文做了校准。处于均值水平的推文并不激进、但暗含对外国人的批评——驻巴巴多斯大使 2021 年 7 月 27 日写道:”新冠病毒溯源需要国际合作,而不是指责。”一条比它温和 0.12 个标准差的推文——驻苏里南大使 2021 年 2 月 1 日所写——则保留了对中国的正面表述、去掉了隐含批评:”越来越多的国家开始批准使用中国疫苗。”变化微妙但真实。

至于为什么效果要等一个半月才显现,作者给出几种可能:需要积累足够多的推文才能可靠识别语气变化;低频发推账号需要时间形成可测量的语料;也可能集体学习之后数周才下达了更具体的内部指引。

稳健性与平行趋势

作者报告了三组稳健性检验:加入国家与账号固定效应以吸收标准化未能处理的变异;加入推文层面(推文长度、转推数、点赞数)与账号层面(公告日的粉丝数)控制变量;以及改用未标准化的战狼指数。结果均实质一致。

对双重差分最关键的平行趋势假设,作者也做了坦率的检视。公告前后各 30 天的原始数据与 LOESS 趋势显示,部分比较组的事前趋势并不完美平行。一种可能是预期效应:集体学习事先征求专家意见,一些账号可能在公告前就已知晓风向并开始调整——若预期效应与处理效应同向,报告中的估计反而低估了真实效应。另一种可能是反向因果:通稿是对语气已自发转缓的追认——作者认为这不太可能,因为”党定调子、部委和媒体跟进”才是常态。当然,事前趋势也可能意味着估计只是拾取了某种虚假相关,作者承认无法完全排除,但总体认为平行趋势假设基本成立。

局限与启示

作者明确列出三点局限:数据右删失(2021 年 10 月即止,无法捕捉后续变化);仅覆盖 Twitter,未讨论其他跨国社交平台;没有测量传播对受众态度的实际效果。

在作者看来,这些发现至少对三类讨论有价值。第一,它们近乎实时地展示了中国外交系统的响应能力,为研究中国外交中的委托—代理关系与官僚系统协调性提供了一个数据点。第二,它们实证展示了党领导层塑造民族主义对外呈现方式的努力——外交官会响应调整后的指引,这有助于回答”党能在多大程度上控制、引导或压制外交中的民族主义叙事”。第三,它们再次印证了中国对外传播”因受众而异”的特征。

这篇文章的结论也与后续研究相互印证:Vol. 26 介绍的 Lim 等人(2026)用 27 年外交部记者会数据做变点分析,发现真正的结构性语气调整出现在 2022 年 9 月——比政治局集体学习晚了一年多。两篇合看,2021 年年中的那次会议更像是一个渐进调整的开端,而非转折本身。

原文信息

文献来源: Brazys, S., Dukalskis, A., & Müller, S. (2023). Leader of the pack? Changes in “wolf warrior diplomacy” after a Politburo collective study session. The China Quarterly, 254, 484–493.

原文链接: https://doi.org/10.1017/S0305741022001722