CtrlK
BlogDocsLog inGet started
Tessl Logo

red-blue-debate

用红蓝双队辩论模式深度解答通用问题,以非讨好型人格的理性人视角输出最终报告。 触发条件:用户提出任何值得深度分析的问题,尤其是存在争议、有多个维度、需要权威数据支撑的问题。 提到"红蓝辩论"、"辩证分析"、"正反两面"、"两种观点"、"帮我深度分析"、"有没有反驳意见"、"理性分析一下"、"客观看待",或提出任何开放性、争议性问题时必须使用本 skill。 即使用户只是提出一个看似简单的问题如"XX 到底值不值得做"或"XX 是对的吗", 只要涉及价值判断、策略选择、事实真相等复杂情境,也应使用本 skill。 本 skill 不追求讨好用户,拒绝模糊骑墙,双队结论必须互斥,最终裁判整合并输出面向小白的第一人称深度文章。

66

Quality

80%

Does it follow best practices?

Run evals on this skill

Adds up to 20 points to the overall score

View guide

SecuritybySnyk

Passed

No findings from the security scan

SKILL.md
Quality
Evals
Security

Quality

Content

70%Weight 40%Scale 1-5

Reviews the quality of instructions and guidance provided to agents. Good implementation is clear, handles edge cases, and produces reliable results.

该 skill 内容流程清晰、验证检查点完整、输出模板可执行,工作流设计成熟;主要短板是篇幅偏长且未利用progressive disclosure将专家模板等细节外置,对context预算不够友好。

Suggestions

将红队/蓝队专家发言模板、辩论轮模板、质量检查清单等相对独立的细节移入 references/ 下的独立文件,并在SKILL.md中以一级引用指向,以缩短主文件、提升conciseness与progressive_disclosure得分。

对'图示(SVG/Mermaid/ASCII)'、'自我验证'、'可证伪性'等占位段落补充1-2个具体范例(如示例SVG引用、自查条目样例),使actionability从4迈向5。

合并Step 1与Step 2中重复的发言结构描述(蓝队'格式与红队完全相同'),并对核心原则与质量检查清单中重复表述的'互斥/不骑墙'做去重,进一步压缩token。

DimensionReasoningScore

Conciseness

正文约200行,含完整的红/蓝队逐字段模板与10项检查清单表,整体偏长且部分结构可合并;但多为流程定义而非对常识的赘述,未出现解释Claude已知概念的情况,故为3而非2。

3 / 5

Actionability

为每个步骤提供了具体的输出格式模板、文件命名规范(如 markdown/red_[专家角色]_中间结果.md)与辩论规则,指导可落地;但Step 1/2中'图示(SVG/Mermaid/ASCII)'、'自我验证'等仅给出占位提示而非完整范例,存在轻微缺口,故未达5。

4 / 5

Workflow Clarity

Step 0至Step 5顺序清晰、阶段分明,第120行强制'≤5轮辩论'与第137行'第5轮后强制停止'构成显式检查点,第193-206行的输出前质量检查清单为复杂多步流程提供了明确的验证反馈环节。

5 / 5

Progressive Disclosure

正文以分节结构组织、具备清晰导航,但全部内容内联在单一SKILL.md中,未提供任何references/scripts/assets等bundle文件或对外部细节文件的一级引用;对约200行的内容而言,专家发言模板、辩论模板等可外置以减负,故停留在3。

3 / 5

Total

15

/

20

Passed

Description

91%Weight 40%Scale 1-5

Based on the skill's description, can an agent find and select it at the right time? Clear, specific descriptions lead to better discovery.

该 description 在触发词覆盖与 what/when 完备性上表现优秀,以'红蓝双队辩论+互斥结论+裁判整合'构建了较鲜明的生态位。主要不足是个别行为表述偏抽象、触发面偏宽,存在轻微的相近skill重叠风险。

DimensionReasoningScore

Specificity

描述列举了多项具体行为(红蓝双队组建、≤5轮辩论、专家自我验证、第一性原理推导、裁判整合输出第一人称文章),覆盖较全面,仅个别动作表述略偏抽象('非讨好型人格的理性人视角')。

4 / 5

Completeness

同时明确回答了'做什么'(红蓝双队辩论+裁判整合输出深度报告)与'何时使用'(显式'触发条件'+'必须使用本skill'+'即使用户只是…也应使用'),并以具体触发短语落地点。

5 / 5

Trigger Term Quality

列出了大量用户可能自然说出的触发短语——'红蓝辩论'、'辩证分析'、'正反两面'、'两种观点'、'帮我深度分析'、'有没有反驳意见'、'理性分析一下'、'客观看待',以及'XX到底值不值得做'/'XX是对的吗'这类口语化句式,覆盖同义表达与具体范例。

5 / 5

Distinctiveness Conflict Risk

以'红蓝辩论/非讨好/互斥结论/裁判整合'构建独特生态位,与通用问答skill有区分度;但其触发面('任何开放性、争议性问题'、'帮我深度分析')较宽,仍可能与通用深度分析类skill存在轻微重叠,故未达5。

4 / 5

Total

18

/

20

Passed

Validation

93%

Checks the skill against the spec for correct structure and formatting. All validation checks must pass before discovery and implementation can be scored.

Validation15 / 16 Passed

Validation for skill structure

CriteriaDescriptionResult

relative_links

Relative link issues: 1 missing

Warning

Total

15

/

16

Passed

Repository
digoal/blog
Reviewed

Table of Contents

Is this your skill?

If you maintain this skill, you can claim it as your own. Once claimed, you can manage eval scenarios, bundle related skills, attach documentation or rules, and ensure cross-agent compatibility.