首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >这周踩的3个坑:字数卡门槛、同日撞实体、extract被挡还硬刚

这周踩的3个坑:字数卡门槛、同日撞实体、extract被挡还硬刚

作者头像
袁锐钦
发布2026-07-20 21:57:22
发布2026-07-20 21:57:22
260
举报

自动化最怕的不是不会写,是「写了但不合格还往下推」。


周日专栏固定做一件事:把本周流水线里反复出现的坑摊开。

不是鸡汤复盘。是三张可贴在显示器边的纸条。

下面三个坑,都来自公众号日更系统已经踩实、并且写进规则里的问题——不是编「这周我又作死了一次」的故事,是现在写稿前必须过的闸


坑1:只防超字数,不防字数不够

长文容易超标,大家记得砍。 反过来更阴:

  • • Day 系列目标 3000–5000 汉字
  • • 专栏目标 1500–2000
  • • 短文快讯 800–1200

有一轮真实翻车是:Day 初稿汉字停在门槛下,专栏也贴着下限——到推送前才发现。规则里已经写死:低于下限,先扩写,禁止「差不多就推」。

还有一个计量坑:

错误

正确

用 wc -m 看「总字符」

只数 CJK 汉字

把 Markdown、英文、标点算进「字数」

sum(1 for c in t if '\u4e00'<=c<='\u9fff')

超了 15% 还逐句剃头

整段/整节砍

wc -m 会把三千汉字误判成六千「超标」,你一刀刀削,削到内容发虚。 不够的时候又用总字符自我安慰,觉得「已经很多了」。

教训:落盘后先跑汉字门禁。下限和上限同一优先级。

我现在的固定动作是:三篇 write_file 之后,同一目录扫一遍汉字数,不过线不进改稿,更不进发布脚本。


坑2:同日文章②和③撞同一个「主角」

近 7 天主题去重,防的是「上周写过 GPT-Live,这周又写」。 还不够。

还有一种撞法更隐蔽:

同一天里,②用某个产品/事件当主展开,③又拿它当全文主角。

读者打开多图文,两条标题都是同一个词——不是「系列感」,是信息重复税。 规则库里 7/18 已经记过:AI Overviews 双写,改完又在分档名上二次撞车。

正确拆法只有三种:

  1. 1. ②占结构信号,③占具体产品名(或反过来)
  2. 2. ②占事件 A,③占事件 C,禁止 A=C
  3. 3. 实在只有一条热点——合并进一篇,另一篇换未写过的方向

动笔前强制列两张实体清单:

代码语言:javascript
复制




②核心实体:____ / ____
③核心实体:____ / ____
交集?有 → 换题

教训:去重不是只扫「昨天」,还要扫「今天这两篇彼此」。周六②③最容易犯。


坑3:web_extract 被挡,还循环硬刚

写稿要证据。证据链标准是:官方优先,第三方标等级,搜不到就不写死。

实操里有一类失败特别耗时间:

  • web_extract 返回 private / internal blocked / empty
  • • 同一 URL 再 extract 一次
  • • 再一次
  • • 半小时没了,正文还空着

规则已经改成:

  1. 1. extract 失败 → 立刻降级 web_search 多源摘要
  2. 2. 证据标 ⚠️
  3. 3. 不写死百分比、未交叉验证的版本号
  4. 4. 同一 URL extract 不超过 2 次
  5. 5. 不因此停整条 cron

Google 文档、部分企业站,在自动化环境里就是会挡。 你的工作不是证明爬虫很强,是:在可引用的公开摘要上,写出对读者有用的判断。

和「事实断言要双源」是一套的:

  • • 一个来源 → 写成「据报道 / 有资料显示」
  • • 零个来源 → 删句
  • • 两个以上官方或权威源 → 才敢写确定门槛(比如今天 Day 63 的 LCP/INP/CLS 阈值)

教训:工具失败是路径问题,不是停工理由。降级、标注、继续写。


三个坑其实是同一个病

拆开看是字数、撞题、抓取。 合起来看,病根只有一句:

把「生成了」当成「可发布」。

生成很便宜。 可发布很贵——贵在读者时间,也贵在你自己的品牌信用。

日更系统里,AI 最容易在两处偷懒:

  1. 1. 输出里写「待更新 / 差不多 / 稍后」,实际没改文件
  2. 2. 数字好看就过(总字符、实验室分、标题党)——真实门槛(汉字、实体互斥、双源)没过

所以周日这篇不讲新工具。 讲闸门。闸门丑,但闸门保命。


这三条怎么嵌进每天 6 点

对应到流水线,就是三道闸:

时机

不通过怎么办

汉字门禁

初稿落盘后

扩写或砍段,重计

②③实体互斥

选题确认时

换③或收窄②

extract 降级

资料采集时

搜索摘要 + ⚠️,不循环

再补两道「老闸」,规则库里写过、今天仍有效:

时机

不通过怎么办

配置三处同步

改节奏/策略时

SKILL + cron prompt + 选题库一起改

「我」字句证据

改稿阶段

档案/wiki 无记录 → 删或改成方法论

公众号日更不是灵感系统。 是质检系统。

质检漏了,草稿箱里躺的是半成品。 半成品群发出去,搜索长尾也救不了第一眼的信任。


一页纸清单(可直接照抄)

  1. 1. 选题后:列出②③实体,检查交集
  2. 2. 写完:CJK 字数过线(Day≥3000 / ②≥1500 / ③≥800,且各自不超上限太多)
  3. 3. 引用:确定句双源;单源降级;无源删除
  4. 4. extract 挂了:换搜索,标⚠️,继续
  5. 5. 改配置:SKILL / cron prompt / 选题库三处一起改
  6. 6. 含「我」的实操句:先在档案里能指到项目或流程,再落笔

打印也行。钉在显示器边也行。 反正别只活在 SKILL.md 里——文件不会在你点「群发」时跳出来拦你。


写给同样在做自动日更的人

如果你也在用 Agent 跑内容:

  • • 把字数门禁写成脚本,不要靠眼看
  • • 把互斥写成选题步骤,不要靠「我记得写过」
  • • 把抓取失败写成降级路径,不要靠重试情绪

自动化不会放大才华。 它会放大你的质检漏洞。

说难听点:cron 很勤快,勤快地把同一类错误每天送进草稿箱。 你要做的不是让它更勤快,是让错误更贵——贵到脚本直接拦下来。

这周就这三条。够用了。

下周若还有新坑,还是摊开写。


袁锐钦 · AI产品实操 & 出海工具站日更中。做产品、测工具、跑变现,把试过的路摊开给你看。

本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2026-07-19,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 Ruiqin袁锐钦 微信公众号,前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体同步曝光计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • 坑1:只防超字数,不防字数不够
  • 坑2:同日文章②和③撞同一个「主角」
  • 坑3:web_extract 被挡,还循环硬刚
  • 三个坑其实是同一个病
  • 这三条怎么嵌进每天 6 点
  • 一页纸清单(可直接照抄)
  • 写给同样在做自动日更的人
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档