两条补充规则:推广营销类不进入质量放大通道,无论内容质量高低,防止推荐位沦为广告位;站务公告类内容(以官方账号与站务版块的标识识别)不进入评分体系,不参评不排名。分类拿不准时归入语义最接近的分类,低置信度样本升级人工。
多维度打分。 每条内容按四个维度各评 1 至 5 分,每个维度附置信度,整体结论附判定理由。帖子四维为信息量(是否提供新信息、干货密度)、原创性(原创与搬运、复读、跟风的区分)、建设性(对读者或社区是否有益)、表达完整度(结构、清晰度、用心程度)。回复四维在四维框架上按回复语义调整:信息量(是否带来新信息)、建设性(是否对问题或讨论有实际帮助,引战性回复此项得低分)、相关性(是否回应主题而非跑题或借楼引流)、表达完整度。
综合质量分为四个维度的加权和,不同分类使用不同的权重表(例如日常闲聊类降低信息量权重,因为闲聊内容天然信息量低,信息量不应主导其类内排序)。
权重校准方法。 权重初值均等,后续以独立抽样的放大标注集为金标准校准:人工对一批覆盖各分类的帖子只做"是否值得放大"的整体判断(该标注集独立于人工复核队列的疑难样本,避免用有偏样本扭曲权重),再以排序学习方法或参数搜索拟合各维度权重(参数仅四个,方法从简),使加权质量分的排序与人工排序的一致性(以 Kendall 等级相关系数衡量)最大化。校准周期性进行,每积累一定规模(建议约五百条)的标注样本重新拟合一次;机制被站方采纳后,可引入真实用户行为数据(阅读完成率、有效互动率)作为辅助校准信号。回复四维的权重以同法校准,标注集覆盖回复四分类。
回复的处置。 回复与帖子同体系:越线回复删除该回复,不连坐其所属主题与作者的其他内容;擦边回复按擦边规则降权折叠。
3.3 质量放大通道
放大采用相对机制:对滚动时间窗(建议 7 天)内质量分排名前 N% 的内容给予放大,而不是设定绝对阈值。采用相对机制的原因是:新社区内容池小,绝对阈值无从标定,且容易无米下锅;相对机制在社区发展的任何阶段都能工作,且随着整体质量提升,被放大的标准自动水涨船高,无需人工调整。
相对机制需要一条兜底规则:当全站内容普遍低质时,排名前 N% 的内容仍然是水帖,推上推荐位会损害机制公信力。因此放大的完整条件是相对排名前 N% 且高于一条设定得很低的绝对合格线,宁缺毋滥。排名在分类内进行,保证各类内容都有被放大的机会,避免技术类垄断推荐位。
放大的手段包括推荐位、精华标记、首页加权、摘要推送等。回复的放大机制与帖子一致,同样按分类内相对排名进行,入选内容以"精选回复"形态呈现(采纳后由站方以置顶、高亮等方式实现)。放大资格随滚动时间窗更新自然退出:滑出时间窗的内容退出推荐位;精华标记保留——它是对创作价值的长期认可。放大通道不惩罚任何内容:水帖不被删除,只是被放大后的优质内容自然稀释出首屏。这是质量与自由兼容的关键机制——创作者获得"认真有回报"的正反馈,普通发言者的权利不受任何影响。
3.4 用户信誉体系
本节分五部分:设立动机、信誉信号源、信誉分的计算、信誉的用途与抱团检测。
设立动机。 如果所有账号在投票、发言上平权,有组织的小团体即可通过三种方式操纵治理结果:互相给对方的内容投票、抬升水帖;抱团举报持不同意见者,借机制的自动处置实现"捂嘴";批量注册小号充当投票工具。信誉体系的目的就是打破账号平权,让话语权与历史行为挂钩,从成本上瓦解上述操纵。抱团举报的防御不依赖专门的举报通道设计(举报通道归站方系统):机制侧的防线在于处置只由判定结论驱动、不随举报数量而动,被处置者可申诉,判定与处置全程可审计。
信誉信号源。 用户信誉由以下行为信号累积形成:发帖历史质量(历史内容的质量分均值与分布,外部观察阶段可得);违规记录(越线、擦边判定的历史,由本机制的判定产生,可得);回复质量(回复是否具有建设性、是否引战,可得);收到的社区反馈(其内容获得的加权赞同度、引发的讨论深度,可得);阅读行为(浏览内容的类型分布,属隐私数据,仅在机制被站方采纳并获授权后可选,外部观察阶段不可得)。
外部观察阶段站内尚无赞同度投票功能,"社区反馈"信号以公开可见的互动数据(回复数量、讨论深度、既有点赞)作为代理指标,待赞同度功能落地后切换为正式信号。
信誉分的计算。 信誉分量程为 [0, 100],新注册用户初始值为 5:处于"可正常发言、可投票但权重极低"的状态,不剥夺参与权,只限制操纵能力。
信誉分由三类行为记录加权累积,再按时间衰减合成:质量贡献(帖子或回复进入放大名单、引发深度讨论、获得高加权赞同)为正向,加分随质量评分递增;中性行为(普通发帖、正常回复)为零分或微小正向,保证活跃即有缓慢积累;违规记录(擦边判定小幅扣分,越线判定大幅扣分)为负向,越线的扣分幅度显著大于擦边。
时间衰减采用指数衰减,半衰期建议 90 天。衰减设计同时实现两个目的:近期行为比陈年旧账更能代表用户当前状态,老用户不能永远吃老本;犯过错的用户只要持续正常贡献,扣分的影响会随时间消退,始终留有改过自新的通道。衰减的下限是新用户初始分(5 分):长期不活跃用户的信誉不低于新用户,避免"老账号反而更不可信"。信誉分按周期(建议每日)批处理更新;赞同度聚合时投票者权重取上一周期结束时的信誉快照,避免信誉与赞同度互相递归依赖。
防刷约束:单个用户每日从同一投票者处获得的信誉收益设有上限,使两人互刷无法线性累积信誉;信誉的主要来源必须分散,来源集中度本身也是异常信号。外部观察阶段站内尚无投票功能,该上限自然不生效,待赞同度功能落地后启用。
信誉的用途。 信誉分主要有三个用途。其一,投票权重:赞同度聚合时按投票者信誉加权,新注册账号的票权重低,直接抬高养号操纵的成本。其二,内容初始权重:高信誉用户的新帖获得略高的初始曝光。其三,共治资格:参与举报、标注违规、评审等社区治理活动的门槛(这些活动由站方实现,治理系统仅提供信誉分数据)。三个用途中,投票权重由治理系统直接使用;内容初始权重与共治资格的实现依赖站方系统(机制被采纳后由站方执行)。
抱团检测。 抱团检测不依赖任何单一信号,而是综合四类统计特征识别"疑似操纵簇":投票对象重合度(一组账号的投票目标高度重合,正常用户的投票对象分散且随机)、投票时间集中度(短时间内成群出动,正常互动随发帖时间自然分布)、信誉来源单一性(信誉主要来自圈内互投,正常信誉来自大量不同用户)、注册时间聚集性(批量账号注册时间相近,正常用户注册时间无相关性)。
信誉体系的全貌如图 6 所示。

检测的边界从严把握:系统只输出统计上显著异常(各簇的操纵嫌疑综合得分取全站 99% 分位以上)的疑似簇,不做任何自动处罚,一律转人工复核;确认操纵后的处置也仅限于作废操纵性投票、下调相关账号的信誉分,不直接封号——封号属于站方依站规的职权,机制只提供证据。正常的朋友间互相支持是双向、低频、长期的,与操纵簇的单向、高频、集中特征有统计上的可分性,这正是检测不误伤正常互动的依据。
外部观察阶段站内尚无赞同度投票功能,四类投票信号以公开互动数据为代理:以点赞、回复的互动对象重合度替代投票对象重合度,以互动时间集中度替代投票时间集中度,信誉来源单一性按互动来源计算,注册时间聚集性不变;"作废投票"处置在观察阶段没有对应动作,系统只输出疑似簇证据,处置在机制被采纳后执行。
信誉体系与注册门槛的关系。 "门槛筛选的本质是筛选诚意和耐心"这一社区讨论中的共识性判断是成立的,但诚意并非只能在入口处筛选。信誉体系用持续的行为记录替代一次性的入场审查来完成同样的筛选:愿意为社区付出的用户随时间积累信誉并获得相应权重,不愿付出的用户自然停留在低权重状态。这一设计保留了门槛的筛选功能,但不排斥任何新用户进场,是对"自由与质量矛盾"在用户层面的解法。
3.5 社区反馈信号:赞同度
设计动机与取值。 传统的点赞、点踩是二元信号,信息量过低,无法区分"强烈反对"与"略有保留"。本机制采用连续值表示赞同程度,取值区间为 [-1, 1],-1 表示完全反对,1 表示完全赞同。落地形态为"界面离散、存储连续":用户界面提供五档选择(强烈反对、反对、中立、赞同、强烈赞同),内部映射为 -1、-0.5、0、0.5、1。
聚合方式。 单条内容的赞同度均值为所有投票的信誉加权平均,即 Σ(票值 × 投票者信誉) ÷ Σ(投票者信誉)。高信誉用户的意见占更大权重。投票可修改或撤销,以最后一次为准;对自身内容的投票照常记录但不计权重;全部投票者信誉之和为零时,该内容按未投票处理。展示时同时呈现均值得分与投票人数:小样本下的均值极易被个别高信誉用户带偏,投票人数是均值可信度不可缺的参照。
中立与未投票的区分。 "未投票"与"中立(0 分)"必须区分处理。未投票是无数据,不计入均值、不计入投票人数;中立是有效表达"已阅读、无倾向",计入均值也计入投票人数。区分的理由有二:中立票是真实信息,能反映内容的争议度与极化程度;若中立不计数,操纵者可用大量中立票虚增投票人数、制造"广泛参与"的假象。争议度(投票分布的离散程度)本身可作为辅助信号留存,供评估讨论健康度使用。
赞同度与质量分的边界。 必须明确:赞同不等于质量。小众但优质的观点赞同度可能接近零,人畜无害的灌水赞同度可能为正。若以赞同度决定内容排名,等于让多数人的偏好冒充质量,会系统性惩罚少数派观点、制造回音室,与发言自由的目标直接冲突。因此两个信号严格分离、互不替代:赞同度用于评估用户(讨论信誉)和检测抱团投票行为;质量评分用于评估内容、决定内容排名。赞同度对质量体系的唯一作用是校验:对"质量分高但加权赞同度显著偏低"的内容自动抽样转人工复核,用于发现模型评分的系统性偏差,赞同度本身不进入质量分公式。该抽样来源仅在赞同度功能落地后生效;外部观察阶段无赞同度数据,此项暂停。负赞同度本身不直接扣减信誉——反对意见是合法表达;其作用通过既有通道间接体现:内容因问题暴露而被判定违规时,按违规记录扣分;用户持续输出被高权重反对的内容,作为信誉来源质量下降的信号供后续观察评估。
3.6 逻辑自洽性论证
本机制对"自由与质量能否共存"的回答是肯定的,论证如下。
自由由三个设计共同保障:入口无门槛,任何人可注册可发言;负面清单窄而明确,治理只判越线、不判观点;处置可申诉,误判可纠正。降权的三条边界(列表可达、不连坐、状态可见)保证即便是最轻的负向处置也不构成变相捂嘴。
质量由注意力分配机制而非言论管制实现:放大优质内容即稀释劣质内容的曝光,创作者获得正反馈,形成"认真有回报"的正循环,针对性解决"劣币驱逐良币"的问题。
判定宽严与处置代价匹配:越线从紧、擦边从宽,代价越大的判定要求越高的置信度,拿不准的逐级升级(机器复判、最终归人工),从制度上压缩误伤空间。
各部件相互独立、各司其职:底线过滤防破窗,质量放大解决激励;评内容解决内容问题,评人解决权力分配问题;赞同度与质量分分离,防止多数人的偏好冒充质量;信誉衰减与防刷上限、抱团检测共同保证权力不被固化、不被窃取。