内容质量打分:用 6 个维度给每篇文章体检

运营GO 编辑部

一个月发了 12 篇文章,自然流量几乎没动。你逐篇翻后台,每篇看着都还行,却说不清哪篇该留、哪篇该重写、哪篇该合并。缺的不是勤奋,是一把统一的尺子——内容质量打分。

快速结论:把质量拆成搜索匹配、信息密度、结构可读、可信度、阅读体验、转化引导六个维度,每项 0 到 5 分,满分 30。低于 18 分的先重写,18 到 22 分做增量优化,23 分以上只补内链和封面。一个人给 20 篇文章打分大约 90 分钟,换来的是一份能直接排进日历的处理清单。

,具体可参考UGC质量打分
  1. 搜索匹配:是否精准接住一个真实检索意图,主词和两三个变体自然分布,首段就给出答案。
  2. 信息密度:单位篇幅里有多少可用信息,每小节都有数字、步骤或可复现的细节,读完知道该做什么。
  3. 结构可读:能否 30 秒扫完抓住主线,H2 用动作句,关键结论由列表和表格承载。
  4. 可信度:读者凭什么相信这些说法,要有数据出处、真实案例或自己跑过的实验记录。
  5. 阅读体验:在手机上读起来累不累,首屏直接进正文,配图带注解,段落不超过五行。
  6. 转化引导:读完有没有明确的下一步,结尾给行动清单,正文有顺手可点的相关入口。

凭感觉判断质量为什么总是出错

感觉会被三件事带偏:写稿的人对自己的稿子有沉没成本,看稿的人被排版和封面影响,团队讨论时嗓门大的人赢。修改资源于是永远流向最近被吐槽的那一篇,而不是改一次收益最大的那一篇。

打分的意义不在于数字有多精确,而在于把模糊争论压缩成六个能回答的问题。评审会上一句「这篇不够深」,会变成「信息密度 2 分:全文没有一个具体数字,没有一处可复现的步骤」。写手拿到后面这句话,立刻知道下一版要补什么。

尺子还能保护写手。分数由维度构成,谁都能对着锚点复核,主编不能凭一句「感觉不行」把稿子打回去,返工次数会明显下降。

六个维度分别在测什么

每个维度只回答一个问题,避免互相污染。锚点提前写死:0 分是完全没做,3 分是同行平均水平,5 分是同主题下能进搜索结果前三。

维度它回答的问题0 到 2 分的样子4 到 5 分的样子
搜索匹配是否精准接住了一个真实检索意图标题与正文各说各话,主词只在标题里出现主词和两三个变体自然分布,首段就给出答案
信息密度单位篇幅里有多少可用信息大段定义和形容词,读完不知道该做什么每个小节都有数字、步骤或可复现的细节
结构可读能否 30 秒扫完抓住主线通篇长段落,小标题是名词堆砌H2 用动作句,关键结论由列表和表格承载
可信度读者凭什么相信这些说法无来源、无案例、无作者背景有数据出处、真实案例或自己跑过的实验记录
阅读体验在手机上读起来累不累首屏被弹窗和目录挤满,配图模糊无说明首屏直接进正文,配图带注解,段落不超过五行
转化引导读完有没有明确的下一步结尾一句总结就断了结尾给行动清单,正文有顺手可点的相关入口

六项默认等权。站点处在起量期,可以给搜索匹配和信息密度各乘 1.5 倍;进入变现期,再把转化引导的权重提上来。权重一旦定下,至少一个季度别动,不然前后两批分数无法横向比较。

一次给 20 篇文章打分的操作流程

  • 拉数据:从 Search Console 导出近 90 天的展示量、点击量、平均排名,按 URL 合并进同一张表,打分列排在数据列右边。
  • 校准锚点:先挑三篇公认好的、三篇公认差的文章试打,确认所有人对 3 分的理解一致,再开始批量作业。
  • 单篇限时 4 分钟:先扫小标题看骨架,再读首屏 200 字,然后抽查两处事实,超时就先给分并标注待复核。
  • 分数贴数据:高分低点击的那一批多半卡在标题和摘要上,按 标题与元描述的 CTR 写法 里的做法先改元描述,这是成本最低的一次修改。
  • 双人抽检:从 20 篇里随机抽 5 篇由第二个人复评,某个维度两人分差超过 2 分,就回去重写该维度的锚点说明。

批量打分要一口气做完,中途隔天再打,尺子会不知不觉变松。实际操作里,同一批文章的分数分布通常是中间高两头低,如果你打出来八成文章都在 24 分以上,基本可以确定锚点定得太宽。

分数怎么变成排期动作

总分区间判断处理动作建议排期
23 到 30资产篇补 2 到 3 条上下文内链,换更清晰的封面,加结构化数据当周顺手完成
18 到 22有底子补案例和数据,重写首段与结尾清单,标题做一次替换测试两周内
12 到 17骨架尚可保留 URL,正文重写六成以上,大纲推倒重搭排进下个月
0 到 11拖后腿合并进同主题的支柱页,或者下线并做 301 跳转季度清理时统一处理

别把低分文章一次性堆进同一周。一周处理两到三篇、留出观察期,才能判断分数提升是不是真的带来了点击增长。具体改写步骤直接套 旧文章更新 checklist 就行,不必每次重新设计流程。

让尺子不跑偏的四个校准动作

  • 建锚点样例库:每个维度存两篇站内实例,一篇 2 分一篇 5 分,新人上手先读完这六对样例再动手。
  • 每季度回打 10 篇老文:同一批文章分数集体上浮,通常是尺子松了,而不是内容真的变好了。
  • 与审核标准绑定:结构可读和可信度两项的判定依据直接引用 内容风格指南与审核,避免评分表和审核清单成为两套打架的规矩。
  • 记录改动前后:每次重写在表里留一行改前分、改后分、改动日期,三个月后就能算出哪类改动最划算,配合 内容 ROI 的数据口径 把人力成本也摊进去。

打分表本身也需要迭代。跑满两个季度后回头看,某个维度如果始终和流量变化没有相关性,说明它测的东西对你的站点不重要,果断换掉,别让表格越长越像走过场的表单。

下一步

  • 今天先建表:六个维度加总分列,把最近发布的 20 篇 URL 贴进去。
  • 本周完成第一轮打分,只打分不改稿,先看清分数分布长什么样。
  • 挑 3 篇 18 到 22 分的文章做增量优化,两周后回看点击变化。
  • 把 0 到 11 分的名单发给主编,确认合并还是下线,别让它们一直悬着。

核心要点凭感觉判断质量为什么总是出错六个维度分别在测什么一次给 20 篇文章打分的操作流程分数怎么变成排期动作

图:{‘raw’: ‘内容质量打分:用 6 个维度给每篇文章体检’, ‘rendered’: ‘内容质量打分:用 6 个维度给每篇文章体检’} 核心要点(运营GO 整理)

相关阅读