#1292 2021 · Twitter (Birdwatch, later Community Notes) · Social media / content moderation
Twitter 不再指定谁来核查推文,而是要求平时意见相左的评分者先达成一致
问题
公司雇的事实核查员审不过海量的推文,而且不管哪个审核员做出的判断,总有人会把它当成偏见的证据
背景
平台自营的事实核查面对两个叠加的问题:推文数量太大,任何雇来的团队都不可能全面审核;而且公司指定的审核员一旦给某条推文打标签或删除它,这个决定本身就会成为争议焦点,被这边或那边的人当成机构偏见的证据。单纯把打标签这件事开放给大众投票,解决不了第二个问题——因为对一个有争议的说法搞多数投票,往往只是把票数更多的那个政治阵营的意见复制一遍,只会加深「结果有偏见」的观感,而不是化解它。
2021 年上线的 Twitter Birdwatch 团队,把一套不同的筛选规则做进了系统本身。任何用户都能给一条推文提议一条更正说明,但这条说明只有在被那些历史投票记录显示平时并不一致的贡献者共同评为有用时,才会公开显示——这是一个「架桥」算法,把跨阵营的共识而不是票数,当作是否可见的门槛。
换别人会怎么做
摆在面前的选项是:要么把审核继续留在公司雇的信任与安全团队手里,不管结果如何都会被读成机构偏见;要么把更正开放给纯粹的大众投票,那样只会由活跃评分者更多的那个政治阵营来定调。
他们看到了什么
团队看清可信度问题不在于谁来打分,而在于哪种一致才算数。一条多数人点赞的说明证明不了什么;一条连平时立场相反的评分者都认为有用的说明,才让人难以否定。
那一手
Birdwatch 后来改名 Community Notes,让任何符合条件的用户都能给一条误导性推文写一条更正说明,再用架桥算法只推送那些被历史上意见相左的评分者共同评为有用的说明,而不是靠简单多数票——让跨阵营的一致本身成为公众能看到什么的过滤器。
为什么管用
通过看历史投票模式明显不同的评分者是否都把一条说明标为有用来打分,这套算法过滤掉了那些只在一个意识形态阵营内部受欢迎的更正——就算那个阵营的人数足以赢下简单多数票也不例外。这把筛选压力从「受欢迎程度」转移到了「跨阵营的可信度」,这也是为什么能过关的说明会在整个政治光谱上、而不只是在一侧,实实在在地改变浏览者的相信程度和转发行为——这套机制真的在做认知层面的工作,而不只是把审核工作量分摊出去。
值了多少
2022 年起对全体美国用户可见的说明,让浏览者相信误导性推文的可能性降低 20-40%,转发的可能性降低 15-35%。
什么时候会失灵
这套机制需要有足够多真正立场不同的评分者同时活跃在同一条内容下,架桥信号才可能存在;对于流量很低的帖子,或者参与者本身就没有真实意识形态多样性的社区,根本没有跨阵营的分歧可以架桥,系统要么产出不了任何说明,要么退化成普通的多数决。
后来呢
Community Notes 成了内容审核领域「架桥式排序算法」被研究得最多的大规模部署案例,被学术研究引用来说明如何降低众包事实核查中的极化程度,也被其他平台在打造自己的社区审核工具时当作讨论范本。
资料来源
- [1]Twitter is making its crowdsourced fact-checks visible to all U.S. users with Birdwatch expansionTechCrunch, 2022techcrunch.com
- [2]Helpful Birdwatch notes are now visible to everyone on Twitter in the USX (Twitter) official blog, 2022blog.x.com