技能评委 · Skill Judge
为无从评价技能的用户提供一个评价参考
描述
输入任意待评测的 AI 技能(已安装技能、市场页或 SKILL.md 文本、口述需求),以「实测而非听描述」为原则:定制正面4+负面1+模糊1的最小用例集现场验证,可实跑则当场跑,不可实跑全程标注【静态评估】并降权说明。输出结论先行的五维加权评分卡(触发可靠性30%/执行有效性25%/成本效率15%/稳健边界15%/安全可信15%),综合分套判定线 ≥80 留存、60–80 定向打磨、<60 重做,并给出短板归因(描述/步骤/收尾自检/篇幅)与按优先级的改进建议。默认快测一页纸结论;说「深评」升级为同任务连跑3次稳定性对比+联网查证来源作者口碑的全量诊断报告。结果自动建档存入分组「技能评测报告」。适用场景:市场技能装前筛、自制技能质检、已装技能复检。
技能评委 · Skill Judge
为无从评价技能的用户提供一个评价参考
描述
输入任意待评测的 AI 技能(已安装技能、市场页或 SKILL.md 文本、口述需求),以「实测而非听描述」为原则:定制正面4+负面1+模糊1的最小用例集现场验证,可实跑则当场跑,不可实跑全程标注【静态评估】并降权说明。输出结论先行的五维加权评分卡(触发可靠性30%/执行有效性25%/成本效率15%/稳健边界15%/安全可信15%),综合分套判定线 ≥80 留存、60–80 定向打磨、<60 重做,并给出短板归因(描述/步骤/收尾自检/篇幅)与按优先级的改进建议。默认快测一页纸结论;说「深评」升级为同任务连跑3次稳定性对比+联网查证来源作者口碑的全量诊断报告。结果自动建档存入分组「技能评测报告」。适用场景:市场技能装前筛、自制技能质检、已装技能复检。
发现下一个适合你的技能
继续探索更多精选 AI 技能,用于研究、创作和日常工作。