复制即用 · 2026 年 7 月 27 日核实
Claude Fable 5 审查与安全提示词
六个用于批评、风险评估和发布前审查的脚手架——最容易撞上分类器的一类。
这类任务真正有用的做法
要它给出最强的反对意见,而不是一个平衡的看法。让模型做审查,它默认会往「通过」的方向和稀泥,除非你明说。这一类有个特有的注意点:安全与生物安全审查贴着 Fable 5 的网络安全和生物学分类器,所以其中一部分请求会由 Opus 4.8 来回答——你看到的是正常 HTTP 200 上的 stop_reason: refusal,不是报错。
提示词
填掉方括号里的空位,粘贴到任意 Claude 客户端或 API。按 Fable 5 的目标优先风格写的——给结果和边界,不写步骤脚本。
提示词安全检查
审查这条提示词的歧义、缺失上下文,以及可能产生有害或带偏见输出的风险:[粘贴提示词]。给出一版更安全、更清晰的改写。
事实核查
列出这段文字中的每一条事实性陈述,并逐条评级:公认事实 / 需要来源 / 很可能有误。文本:[粘贴]。
偏见扫描
识别这段文字中的框架偏见、选择性偏见和措辞偏见:[粘贴]。然后用中立语体改写其中一段。
隐私脱敏
标记这段文字中所有个人信息或可识别身份的信息,并返回一个用占位符脱敏后的版本:[粘贴]。
信源质量评估
评估这个信源的可靠性:[链接或描述]。从作者身份、证据质量、时效性和利益动机四个维度打 1–5 分,每项附一行理由。
发布前检查清单
在我发布之前,请检查:缺乏依据的论断、语气失当、缺失的限定说明和法律风险点。返回一张「通过/需修改」的表格。文本:[粘贴]。
怎么用得更好
两个习惯比措辞更重要。发送前把每个方括号都填掉——Fable 5 照字面执行,没填的 [主题] 会被当成任务的一部分。另外别加「think step by step」或「复述你的推理」:这类措辞在 Fable 5 上可能触发 reasoning_extraction 分类器,把你的请求转给 Opus 4.8。