dbs-content-risk-check
面向创作者的内容发布风险检查。逐句检查自媒体、社交媒体和内容平台的标题、正文、图片文字、字幕、口播、评论、账号资料及视频画面,分别判断平台机器可能识别什么、内容本身存在什么实质问题,并给出具体位置和最小修改动作;需要明确视频语境边界时,额外生成真实准确的三行贴片小字。用户询问「检查敏感词」「发布前排雷」「这篇内容哪里可能违规」「这条小红书能不能发」「视频上放什么声明」时使用。保留强观点、情绪张力、个人风格和传播钩子。
How do I install this agent skill?
npx skills add https://github.com/dontbesilent2025/dbskill --skill dbs-content-risk-checkIs this agent skill safe to install?
- Gen Agent Trust Hubpass
The dbs-content-risk-check skill is a safety-oriented tool designed to analyze user-submitted content for platform policy violations. It differentiates between machine-trigger risks and substantive content issues, offering minimal modification suggestions. No malicious patterns such as data exfiltration, unauthorized remote code execution, or obfuscation were detected. The skill includes specific guardrails to prevent the generation of deceptive content or bypass techniques.
- Socketpass
No alerts
- Snykpass
Risk: LOW · No issues
What does this agent skill do?
dbs-content-risk-check:内容发布风险检查
帮助创作者在发布前找到可能导致拦截、复核、限流或处罚的具体内容,并完成必要的最小修改。默认输出普通创作者可以直接使用的自然语言报告,不替用户作出发布决定,也不默认重写全文。
核心原则
同时回答两个问题:
- 平台机器可能识别什么:广告结构、联系方式、外链、二维码、连续数字、敏感词面、OCR 噪声和重复模式可能触发自动审核;
- 内容本身需要处理什么:根据完整语义判断欺诈、虚假宣传、违规导流、受限推广、医疗功效、侵权、隐私、攻击和危险行为等实质问题。
两层结论分别成立。机器误伤只能写成「可能触发机器审核」,不能补造合理违规原因。实质问题必须说明独立机制,不能只引用机器标签或关键词。
每一条建议都要帮助创作者完成以下动作:
- 在原文或画面中找到具体位置;
- 看懂可能产生什么后果;
- 知道删什么、改什么、补什么或改用什么官方入口;
- 知道哪些强观点、口语和叙事可以保留。
工作任务
用户提交文稿、图片、视频、评论、主页或账号资料后,完成发布前检查,输出自然语言结论和最小修改动作。用户没有要求代改全文时,停在风险定位和局部修改建议。
审核流程
第一步:识别材料和发布情境
根据现有材料识别:
- 目标平台;
- 内容位置:标题、正文、OCR、字幕、口播、评论、主页或直播话术;
- 内容目的:个人记录、观点表达、知识科普、招聘、接单、商品推广、品牌合作或交易;
- 发布主体、利益关系、商品或服务类别;
- 会改变结论的资质、授权、证据、活动期限和报备情况。
材料不完整时先完成能够完成的检查:
- 只有文本:结尾简短提醒图片、主页和评论区尚未检查;
- 只有 OCR:把文字识别与原始画面分开,不能用 OCR 结果证明画面安全;
- 只有图片:检查文字、人物、动作、物品、标识、隐私和二维码;
- 视频:至少检查封面、开头、关键转折、产品特写、结尾引导、字幕和完整音轨;
- 平台后台信号不可见:仅列为检查边界,不能反推账号、设备或网络信誉。
商业属性、产品类别或资质可能改变结论时,先给条件化判断,最多补问 1 个具体问题。
第二步:检查五个表面
| 表面 | 检查内容 |
|---|---|
| 文字 | 标题、正文、字幕、口播、评论、OCR 和账号资料 |
| 完整语义 | 主体、对象、动作、条件、否定、引用、承诺和传播目的 |
| 视觉与声音 | 人物、未成年人、裸露、暴力、标识、包装、二维码、背景和音频 |
| 发布关系 | 发布者身份、利益关系、商品类目、交易路径、授权和证明 |
| 平台条件 | 目标平台当前允许的发布身份、入口、报备和行业准入 |
同一个词、数字、人脸或第三方检测标签只负责召回线索。完整语义和独立证据决定是否进入报告。
第三步:判断平台机器审核风险
按以下证据强度判断:
- 明显触发信号:完整外链、联系方式、二维码、明确广告结构、连续长数字、敏感主题与行动组合、破碎 OCR 或明显重复堆叠;
- 名单型信号:品牌或公司名称、竞品平台名称、圈层标签、药品名称、受限主题词和常见变体可能进入平台名单召回;即使完整语义正常,也可能被机器直接拦截或送审;
- 弱词面线索:普通关键词、正常数字、普通姓名或无法验证的经验推测。
明显触发信号可以进入「可能触发机器审核」。名单型信号只有在能够对应到具体名单类别时才进入,并明确写成「可能命中名单」,不能扩展成内容违规。只有弱词面线索时保持沉默。词面信号明显违背完整语义时,可以提示机器误伤可能,并说明具体误读来源。
名单型信号包括但不限于:
- 品牌、公司和竞品平台名称,例如闲鱼、淘宝、拼多多;
- 圈层标签和缩写,例如耽美、GL、腐;
- 药品名称;
- 翻墙、博彩、封建迷信、轻度性暗示、金融广告等受限主题中的高频名单词。
名单只能提高机器审核提示。正常的品牌讨论、文学作品介绍、圈层身份表达、医学科普和药品说明,没有独立违规机制时,内容实质层保持低风险。
不使用百分比预测违规概率,不承诺机器一定怎样处理。
第四步:判断内容实质风险
除明确硬红线外,每项风险至少需要「明确对象+明确动作、结果或传播目的」。第二个风险类别需要独立证据。
按以下层级输出:
| 层级 | 判断条件 | 处理方式 |
|---|---|---|
| 高风险 | 已出现清晰的欺诈、违规导流、受限推广、虚假承诺、侵权、隐私、攻击或危险机制 | 建议优先删除、修改、补证、报备或更换发布路径 |
| 需确认 | 结论取决于产品类别、利益关系、资质、授权、证据、载体或当前平台规则 | 写清需要核实的事实及不同情形的影响 |
| 低置信度线索 | 有可观察信号,能够说明具体风险类别和升级条件 | 简短说明;缺少任一条件时不输出 |
商业属性、敏感词面、名单命中、OCR 数字、二维码或人脸都不能单独证明实质违规。
第五步:给出最小修改动作
优先执行以下动作:
- 为真实陈述补充主体、条件、范围、时间或来源;
- 删除无法证明的权威、排名、销量、库存、价格和效果结论;
- 将医疗功效改成获准表述、客观参数或真实可观察体验;
- 将站外导流改为目标平台当前允许的发布、商品、招聘或联系入口;
- 补充真实的商业利益披露、资质、授权、活动期限或适用条件;
- 只删除局部词句能够解决时,不改写整段。
风险表达承担主要卖点时,可以提供「稳妥版」和「保留力度版」。用户没有要求代改时,不输出完整重写稿。
最小必要干预
- 强观点、情绪化表达、冲突结构、偏激判断、口语、夸张修辞、隐喻和个人偏好本身不构成风险;
- 「更规范」「更稳妥」「可能让人联想到」不能单独构成修改依据;
- 「从来」「唯一」「第一」先区分主观判断、叙事强调和商业宣传,不能只凭词面判定绝对化宣传;
- 「水下」「野路子」「打工人」等隐喻缺少交易、规避、欺诈或伤害证据时不进入报告;
- 同一句同时包含传播钩子和风险机制时,只处理风险机制;
- 无法说明修改后降低了什么具体风险时,不给修改建议;
- 不评价观点是否偏激、措辞是否温和,也不以降低争议或提高专业感为目标。
严禁编造证据、资质、数据、评价、使用经历和活动期限。不能用「个人体验」「因人而异」保留虚假功效,也不能生成谐音、拆字、藏联系方式、评论暗号或其他绕审写法。
高频风险机制
内容安全与公共风险
优先检查违法犯罪、诈骗、赌博、违禁品、色情、性交易、未成年人性化、血腥暴力、自伤方法、危险挑战、仇恨、网暴动员、隐私泄露、冒充身份、伪造通知和无来源公共事件断言。
新闻讨论、历史研究、医学科普、反诈提醒和受害经历可以出现敏感对象。继续检查标题刺激度、操作细节、事实来源、传播目的和隐私暴露。
网络访问与海外账号
重点检查翻墙、科学上网、代理工具、访问受限网站、海外账号代注册、账号买卖和注册 ChatGPT 等教程。
- 只提到 ChatGPT、海外网站或账号名称,可以形成名单型机器信号,不能据此认定内容违规;
- 提供具体翻墙工具、下载地址、配置步骤、节点、购买渠道或规避网络限制的方法时,进入高风险;
- 提供海外账号代注册、出售、共享、代收验证码或绕过身份与地区要求的服务时,继续检查交易、欺诈、账号安全和平台规避;
- 新闻讨论、产品体验和风险提醒没有提供可执行方法时,按照完整语义降级。
玄学占卜与封建迷信
重点检查八字、算命、塔罗改运、看事、风水转运、作法消灾和出售确定性运势结果。
- 民俗、历史、文学、宗教文化和个人信仰讨论可以出现相关词语;
- 提供收费占卜、改运服务,或者承诺招财、转运、复合、消灾、治病等确定结果时,进入高风险;
- 只有名单词面、没有服务、交易或确定性结果时,只提示机器名单风险。
轻度性暗示、缩写和变体辱骂
单独检查日常口语中的性暗示、缩写、emoji 和定向粗口变体,例如「可 s」「🉑」「想看腿」「白袜」「沙币❤️」等表达。
- 单个「🉑」、字母或普通服饰词不能单独证明性暗示,需要结合对象、邀请动作、身体部位、交易、图片焦点和上下文;
- 「可 s」等缩写能够与支配、性行为或交易语境对应时,按轻度性暗示或成人服务继续检查;
- 「想看腿」「白袜」等表达面向具体人物、伴随索取身体展示或性化画面时升级;
- 变体粗口明确指向个人或群体时,继续检查侮辱、骚扰和网暴;普通引用、反诈提醒或语言讨论可以降级;
- 耽美、GL、腐等圈层词可以触发名单型审核,本身不能直接解释成色情内容。
受限推广与全局高风险主题
商业内容继续点名检查以下类别:
- 金融:贷款、理财、保险、荐股、投资回报、代办和征信修复;核对主体资质、收益承诺、风险披露、获客与交易路径;
- 医疗健康:医疗、医美、药品、医疗器械、诊疗服务和健康功效;核对推广主体、准入、资质、证明和获准范围;
- 教育培训:课程招生、升学、考证、就业和保过承诺;核对办学或服务主体、广告身份、效果承诺、退款条件和平台入口。
验男女、非医学需要的胎儿性别鉴定、代孕招揽与代孕服务,在名单型审核中可能按全局受限主题召回。出现提供、组织、招揽、交易、联系方式或操作方法时判为高风险;新闻报道、政策讨论和批评性内容仍需按照传播目的判断。
商业广告、招聘和接单
招聘、人员招募、课程招生、服务接单、商品销售、房源推广、门店推广和咨询获客可以形成完整广告结构。
- 机器层:商业主体、服务内容、价格或待遇、行动邀请、联系方式和交易路径共同出现时,可以提示广告识别风险;
- 实质层:继续寻找欺诈、受限类目、违规导流、资质或披露缺失、虚假承诺、私下交易和平台规避;
- 普通招聘、接单和商品推广没有独立问题时,明确说明内容本身暂未发现欺诈或虚假机制。
根据真实目的提供两条合法路径:
- 确实要获客、招聘或成交:保留商业目的,使用平台允许的企业身份、招聘入口、服务组件、商品功能或报备方式;
- 确实只想分享经验或作品:删除接单、应聘、报价、购买和私信交易动作,让内容实际回到分享或展示。
外链、联系方式和导流
检查手机号、微信、QQ、邮箱、网址、短链、二维码、主页联系、私信报价、评论暗号和跨平台下单动作。第三方平台名称本身不构成导流,需要结合联系、领取、搜索、购买或交易动作。
链接处理
- 链接属于待发布文案时,把链接本身作为审核对象,默认不打开网页;
- 小红书普通笔记出现完整外部 URL 时,优先指出外链和导流风险;
- 用户明确要求检查网页、落地页或视频内容时,才访问链接并扩大审核范围;
user_id、uuid、share_uid等参数只能说明分享或追踪字段,不能推断联系方式;- 去向不明的短链或二维码写「去向未检查」,不能自动打开或扫描;
- 用户需要分享站外内容时,优先建议整理成站内可阅读内容,或使用平台当前允许的官方能力。
宣传、价格和证明
检查确定性效果、无法证明的排名或唯一性、虚假权威背书、价格比较、库存、销量、活动期限和伪造证据。
- 「我个人最喜欢」通常属于个人偏好;
- 「全网销量第一」用于推广时需要榜单、时间、品类、范围和来源;
- 「限时优惠」需要真实截止时间和适用范围;
- 「全网最低价」「永久有效」「100% 有用」缺少可验证依据时建议删除;
- 顺序、型号、温度和客观历史事实不能因为出现「第一」「最高」自动升级。
医疗、健康、美容和食品
检查治疗、治愈、疾病预防、降血压、降血糖、抗癌、消炎、排毒、调节激素、减重、生发、脱敏、祛疤、永久效果和无副作用等表述。
结合产品类别、推广主体、获准功能、证明和平台准入判断。医学科普、个人就医记录、运动记录和正常疾病讨论可以出现相关词语;出现具体产品推荐、远程诊断、替代治疗或确定效果时升级。
缺少产品类别、资质或利益关系时优先列为「需确认」。已经出现普通商品治疗疾病、无资质诊疗、伪造病例或确定疗效承诺时判为高风险。
图片、视频、声音和账号资料
- 普通成人面孔、人物合影或未成年人出现本身不进入风险报告;
- 出现性化、危险动作、身份信息、医疗场景、商业代言、冒充、AI 换脸或授权疑点时继续判断;
- OCR 失败只进入未检查范围,不自动成为风险;
- 二维码只有在去向或旁边文字支持支付、联系方式、站外交易时升级;
- 检查身份证、聊天记录、订单、快递单、车牌、地址、定位、支付信息和屏幕通知;
- 检查武器、伤口、注射、烟草、赌博工具、违禁品、政府文件、制服、印章和公众人物的具体呈现;
- AI 生成或显著修改的内容需要检查是否让用户误认人物、事件、效果或体验。
商业合作、测评和协同营销
确认付费、赠品、佣金、返利、邀请、差旅和其他利益关系。没有利益证据时,不根据品牌同框或主体共同出现推断商业合作。
故事型内容出现突兀产品露出、统一评论卖点、多个账号高度重复或虚构亲测时,继续核实营销关系。单个弱信号不进入报告;多个独立信号共同指向未披露合作时列为「需确认」,确认虚假经历或协同误导时判为高风险。
垃圾内容和机器误伤
检查无意义重复、机械堆叠、乱码、批量模板和互动刷量。文学重复、口头禅和正常格式符号不自动构成灌水。
短行程、演员姓名、户型尺寸、游戏参数、菜单价格和混杂 OCR 可能被机器误识别。普通语义没有独立问题时,明确写明存在误伤可能;可以建议补全自然语境、清理无关 OCR 或提高图片清晰度,不能要求用户删除正常事实。
视频三行贴片
贴片只用于补充真实边界,不能替代正文修改、证据、资质、利益披露、平台报备或官方交易入口。
只有满足以下任一条件时生成:
- 用户明确询问免责声明、声明小字或视频贴片;
- 缺少边界会让观点被理解成事实指控、让个人经验被理解成普遍效果、让设想被理解成真实承诺;
- 正文完成必要修改后,仍存在清晰且能够解释的脱离语境风险。
“更加保险”不能单独触发贴片。招聘、接单、收款、导流、虚假品牌关系、伪造事实、确定效果、攻击和隐私问题需要先处理正文与发布路径。
三行分别写内容性质、主要边界和补充边界。每行建议 4—9 个汉字,具体、可验证、不重复。默认提供 1 个推荐版,最多增加 2 个确有不同用途的变体。
输出时写:
为了降低脱离语境后的误解或机器误判,可以在视频画面上增加这三行小字:
随后单独列出三行。只提供文字,不生成图片,也不调用生图或封面工具。
示例:
个人经验分享
不构成效果保证
请结合自身情况
真实招聘视频只能使用符合事实的边界,例如:
招聘信息发布
岗位条件为准
不收求职费用
「不收求职费用」只有在业务确实不收费时才能使用。
平台规则与时效
只有结论依赖平台当前政策,或者用户询问准入、报备、处罚、导流、商业入口、直播、AI 标识等时效性问题时,才查询目标平台当前官方规则。
查询时优先使用官方社区规范、创作者中心、广告平台、商业合作平台或电商学习中心,并记录规则标题、更新时间、适用对象和直接链接。搜索摘要、培训文章、社交媒体截图和第三方词库只能作为线索。
普通的欺诈、虚假承诺、联系方式、完整外链、隐私、攻击和危险内容可以先依据稳定风险机制完成检查。没有官方依据时,不提供固定限流比例、恢复天数、申诉成功率、永久处罚、流量权重或精确风控阈值。
默认输出
创作者模式使用以下紧凑报告。没有内容的章节直接省略。
## 先说结论
**平台机器审核**:{最明显的可见触发信号;没有时写未发现明显触发点}
**内容本身**:{是否存在需要优先处理的实质问题}
## 建议优先处理
### 1.「{精确引用原句或描述画面}」
- **具体问题**:{能够说清的实质机制}
- **怎么处理**:{删除、补条件、补证、报备、局部改写或更换发布路径}
## 可能触发机器审核
### 1.「{精确引用原句或描述画面}」
- **机器可能怎样识别**:{广告、联系方式、外链、敏感主题、垃圾内容等}
- **是否可能误伤**:{有依据时说明}
- **怎么处理**:{澄清语境、清理 OCR、删除意外号码、改用官方入口或保留并接受复核}
## 发布前确认
- {只有确实会改变结论的产品类别、资质、利益关系、证明、图片、主页或平台条件}
## 建议放在视频上的小字
{仅在符合触发条件时输出真实准确的三行文字}
两层都没有问题时写:
基于你提供的材料,目前没有发现需要优先处理的发布风险。强观点、口语和个人表达可以保留。
只检查到文本时,最后补充一句:
本次只检查了文字,图片、主页和评论区还没有纳入判断。
输出报告时:
- 不展示内部标签路径、规则编号和技术字段;
- 不用风险数量和等级名称代替人话解释;
- 不写「能发」「不能发」「保证通过」或「100% 合规」。
边界与语言
- 提供发布前风险报告和局部措辞建议;
- 不提供法律意见,不替代平台预审、商品资质审核和专业律师判断;
- 申诉任务先保存通知、发布版本和证明,再核对具体规则,不承诺申诉结果;
- 指出具体词句和完整语境,避免只输出一串敏感词;
- 不使用恐吓式表达;
- 中文遵循《中文文案排版指北》;
- 避免使用套路化的否定转折对比句。
完成当前任务后直接结束。只有用户明确询问下一步,且当前环境已经安装 /dbs 时,简短提示:「下一步不确定时,可以输入 /dbs。」
How can the creator link this skill?
Add the canonical catalog link to the repository README so users can inspect current installs and available audits. The publishing guide covers the complete discovery path.
<a href="https://skillzs.dev/skills/dontbesilent2025/dbskill/dbs-content-risk-check">View dbs-content-risk-check on skillZs</a>