一个月发了 12 篇文章,自然流量几乎没动。你逐篇翻后台,每篇看着都还行,却说不清哪篇该留、哪篇该重写、哪篇该合并。缺的不是勤奋,是一把统一的尺子——内容质量打分。
快速结论:把质量拆成搜索匹配、信息密度、结构可读、可信度、阅读体验、转化引导六个维度,每项 0 到 5 分,满分 30。低于 18 分的先重写,18 到 22 分做增量优化,23 分以上只补内链和封面。一个人给 20 篇文章打分大约 90 分钟,换来的是一份能直接排进日历的处理清单。
,具体可参考UGC质量打分- 搜索匹配:是否精准接住一个真实检索意图,主词和两三个变体自然分布,首段就给出答案。
- 信息密度:单位篇幅里有多少可用信息,每小节都有数字、步骤或可复现的细节,读完知道该做什么。
- 结构可读:能否 30 秒扫完抓住主线,H2 用动作句,关键结论由列表和表格承载。
- 可信度:读者凭什么相信这些说法,要有数据出处、真实案例或自己跑过的实验记录。
- 阅读体验:在手机上读起来累不累,首屏直接进正文,配图带注解,段落不超过五行。
- 转化引导:读完有没有明确的下一步,结尾给行动清单,正文有顺手可点的相关入口。
凭感觉判断质量为什么总是出错
感觉会被三件事带偏:写稿的人对自己的稿子有沉没成本,看稿的人被排版和封面影响,团队讨论时嗓门大的人赢。修改资源于是永远流向最近被吐槽的那一篇,而不是改一次收益最大的那一篇。
打分的意义不在于数字有多精确,而在于把模糊争论压缩成六个能回答的问题。评审会上一句「这篇不够深」,会变成「信息密度 2 分:全文没有一个具体数字,没有一处可复现的步骤」。写手拿到后面这句话,立刻知道下一版要补什么。
尺子还能保护写手。分数由维度构成,谁都能对着锚点复核,主编不能凭一句「感觉不行」把稿子打回去,返工次数会明显下降。
六个维度分别在测什么
每个维度只回答一个问题,避免互相污染。锚点提前写死:0 分是完全没做,3 分是同行平均水平,5 分是同主题下能进搜索结果前三。
| 维度 | 它回答的问题 | 0 到 2 分的样子 | 4 到 5 分的样子 |
|---|---|---|---|
| 搜索匹配 | 是否精准接住了一个真实检索意图 | 标题与正文各说各话,主词只在标题里出现 | 主词和两三个变体自然分布,首段就给出答案 |
| 信息密度 | 单位篇幅里有多少可用信息 | 大段定义和形容词,读完不知道该做什么 | 每个小节都有数字、步骤或可复现的细节 |
| 结构可读 | 能否 30 秒扫完抓住主线 | 通篇长段落,小标题是名词堆砌 | H2 用动作句,关键结论由列表和表格承载 |
| 可信度 | 读者凭什么相信这些说法 | 无来源、无案例、无作者背景 | 有数据出处、真实案例或自己跑过的实验记录 |
| 阅读体验 | 在手机上读起来累不累 | 首屏被弹窗和目录挤满,配图模糊无说明 | 首屏直接进正文,配图带注解,段落不超过五行 |
| 转化引导 | 读完有没有明确的下一步 | 结尾一句总结就断了 | 结尾给行动清单,正文有顺手可点的相关入口 |
六项默认等权。站点处在起量期,可以给搜索匹配和信息密度各乘 1.5 倍;进入变现期,再把转化引导的权重提上来。权重一旦定下,至少一个季度别动,不然前后两批分数无法横向比较。
一次给 20 篇文章打分的操作流程
- 拉数据:从 Search Console 导出近 90 天的展示量、点击量、平均排名,按 URL 合并进同一张表,打分列排在数据列右边。
- 校准锚点:先挑三篇公认好的、三篇公认差的文章试打,确认所有人对 3 分的理解一致,再开始批量作业。
- 单篇限时 4 分钟:先扫小标题看骨架,再读首屏 200 字,然后抽查两处事实,超时就先给分并标注待复核。
- 分数贴数据:高分低点击的那一批多半卡在标题和摘要上,按 标题与元描述的 CTR 写法 里的做法先改元描述,这是成本最低的一次修改。
- 双人抽检:从 20 篇里随机抽 5 篇由第二个人复评,某个维度两人分差超过 2 分,就回去重写该维度的锚点说明。
批量打分要一口气做完,中途隔天再打,尺子会不知不觉变松。实际操作里,同一批文章的分数分布通常是中间高两头低,如果你打出来八成文章都在 24 分以上,基本可以确定锚点定得太宽。
分数怎么变成排期动作
| 总分区间 | 判断 | 处理动作 | 建议排期 |
|---|---|---|---|
| 23 到 30 | 资产篇 | 补 2 到 3 条上下文内链,换更清晰的封面,加结构化数据 | 当周顺手完成 |
| 18 到 22 | 有底子 | 补案例和数据,重写首段与结尾清单,标题做一次替换测试 | 两周内 |
| 12 到 17 | 骨架尚可 | 保留 URL,正文重写六成以上,大纲推倒重搭 | 排进下个月 |
| 0 到 11 | 拖后腿 | 合并进同主题的支柱页,或者下线并做 301 跳转 | 季度清理时统一处理 |
别把低分文章一次性堆进同一周。一周处理两到三篇、留出观察期,才能判断分数提升是不是真的带来了点击增长。具体改写步骤直接套 旧文章更新 checklist 就行,不必每次重新设计流程。
让尺子不跑偏的四个校准动作
- 建锚点样例库:每个维度存两篇站内实例,一篇 2 分一篇 5 分,新人上手先读完这六对样例再动手。
- 每季度回打 10 篇老文:同一批文章分数集体上浮,通常是尺子松了,而不是内容真的变好了。
- 与审核标准绑定:结构可读和可信度两项的判定依据直接引用 内容风格指南与审核,避免评分表和审核清单成为两套打架的规矩。
- 记录改动前后:每次重写在表里留一行改前分、改后分、改动日期,三个月后就能算出哪类改动最划算,配合 内容 ROI 的数据口径 把人力成本也摊进去。
打分表本身也需要迭代。跑满两个季度后回头看,某个维度如果始终和流量变化没有相关性,说明它测的东西对你的站点不重要,果断换掉,别让表格越长越像走过场的表单。
下一步
- 今天先建表:六个维度加总分列,把最近发布的 20 篇 URL 贴进去。
- 本周完成第一轮打分,只打分不改稿,先看清分数分布长什么样。
- 挑 3 篇 18 到 22 分的文章做增量优化,两周后回看点击变化。
- 把 0 到 11 分的名单发给主编,确认合并还是下线,别让它们一直悬着。
图:{‘raw’: ‘内容质量打分:用 6 个维度给每篇文章体检’, ‘rendered’: ‘内容质量打分:用 6 个维度给每篇文章体检’} 核心要点(运营GO 整理)


