本文作者:dontbesilent(@dontbesilent)。版权归作者所有,未经授权禁止转载。
我做了一个叫 dbs-content-risk-check 的 Skill,用于检查准备发布的笔记、文章、口播、字幕、封面文字和评论。
如果你只想安装和使用,可以直接看文章末尾的「怎么安装」。
普通的敏感词查找为什么不够用
普通的敏感词工具,做法通常是拿一张词表在文案里搜索。搜到某个词,就把它标红。
这个方法能发现一些明显的词,但它看不懂整句话。
比如词表里有“第一”。“第一天使用”和“全网销量第一”都会被找出来。前一句只是时间顺序,后一句在宣传商品排名,需要查看有没有榜单、时间和数据来源。
“微信”也一样。“微信新增了一个功能”只是在介绍产品;“加我微信领取资料”已经带有站外导流动作。只查词,会把这两句话当成同一种情况。
敏感词工具还会漏掉另一类问题。有些文案没有明显敏感词,整句话却在承诺疗效、引导站外交易、泄露个人信息,或者宣传无法证明的效果。风险来自整句话在做什么,单独查词很难发现。
所以,我做这个 Skill 时,没有继续增加一张更长的词表。我把重点放在了完整内容的判断上。
这个 Skill 怎么检查
我把检查过程拆成 5 个问题,让 AI 按顺序回答。
1.你准备发到哪里
同一句话出现在正文、评论区、个人主页和商品页面,作用可能不同。Skill 会先确认发布平台和内容位置,再开始检查。
2.平台机器可能看到什么
它会找外链、联系方式、二维码、长数字、广告结构、重复文字和图片里的文字。这些内容可能触发机器审核。
这里的结论只写“可能触发机器审核”。出现品牌名、药品名或者平台名,不能直接判定内容违规。
3.整句话到底在做什么
它会继续看谁在说、对谁说、想让读者做什么。
提到“微信”,还要看有没有添加好友、领取资料或者站外交易。提到某种药,还要看是在记录就医经历、做医学科普,还是在推广商品并承诺疗效。
同一个词放进不同的句子,结论可以完全不同。
4.这个判断有没有足够依据
AI 经常看到一个词就继续联想,最后给出一串风险。我在提示词里限制了这种做法。
每个问题都要对应到原文里的具体对象和具体动作。想增加第二个风险,还要找到另一组证据。只有一个普通词、一个正常数字或者一句无法验证的猜测时,不写进报告。
用户只提交文字,Skill 就只检查文字,并说明图片、主页和评论区还没看。缺少的材料不能靠猜。
5.最少需要改哪里
找到问题以后,它要引用具体原句,解释风险来自哪里,再告诉用户删什么、改什么或者补什么。
改一个局部能解决,就不重写整段。强观点、情绪、口语、隐喻和个人风格没有形成具体风险时,继续保留。
这一步很重要。很多审核提示词为了显得安全,会把有力度的表达全部改软。内容可能变得平稳,也失去了原来的表达。这个 Skill 只处理能够说清楚的风险。
最后会得到什么
检查结果会先说两件事:哪些内容可能触发平台机器审核,哪些内容本身需要处理。
每个问题都会标出具体位置,并给出局部修改方法。它不会只丢给用户一串敏感词,也不会直接说“保证通过”。
如果视频讲的是个人经验,并且画面需要补充说明,它还可以给出 3 行能够直接放在视频上的文字,例如:
个人经验分享
不构成效果保证
请结合自身情况这 3 行文字只能补充真实情况。正文里已经存在的虚假承诺、导流和隐私问题,仍然需要修改。
我是怎么做的
制作过程中,我持续拿实际内容测试这个 Skill。
早期版本看到招聘文案,会分析岗位信息写得全不全;看到强观点里的“唯一”,会把整段改成中性表达;看到文案里的链接,还会打开网页检查页面内容。这些动作增加了很多分析,却没有解决用户当前要检查的发布风险。
后来我逐项删掉无关判断,并补上限制:只检查用户提交的材料;链接出现在待发布文案中时,先检查这条链接能不能出现在对应平台;强观点只有形成虚假宣传、承诺、攻击或者交易诱导时,才给修改建议。
这套提示词的设计工作,主要花在这些边界上。它需要找到该处理的问题,也要知道什么时候停止分析、停止联想和停止改写。
误判反馈
如果 Skill 判断错了,可以按这个格式留言:
【误判反馈】
原内容:
Skill 判断:
平台结果:请先给联系方式和隐私信息打码。内容太长时,只贴误判的部分。
我会定期查看评论区,复现其中的问题,并据此修改 Skill。
感谢两位共同贡献者 @Ronnie2025 和 @SsyStarry
怎么安装
把下面这条命令发给能够执行本机命令的 AI Agent:
npx -y skills add dontbesilent2025/dbskill -g --all这条命令会安装完整的 dbskill。豆包、WorkBuddy、Claude Code、Codex 和其他支持 Skills 的 Agent 都可以使用。
安装完成后,把准备发布的内容和下面这句话一起发给 Agent:
请使用 dbs-content-risk-check 检查这段内容的发布风险,并告诉我具体改哪里:
【粘贴内容】加本人微信 dbs2408,发送“222”,发你深圳线下课(9.11~9.13)详细介绍