技能評委 · Skill Judge
為難以評估技能的使用者提供參考
描述
輸入任何待評測的 AI 技能(已安裝技能、市集頁面或 SKILL.md 文字、口述需求),以「實測而非聽描述」為原則:客製正面4+負面1+模糊1的最小用例集現場驗證,可實跑則當場執行;不可實跑則全程標註【靜態評估】並降權說明。輸出結論先行的五維加權評分卡(觸發可靠性30%/執行有效性25%/成本效率15%/穩健邊界15%/安全可信15%),綜合分套用判定線:≥80 留存、60–80 定向打磨、<60 重做,並給出短板歸因(描述/步驟/收尾自檢/篇幅)與按優先級排列的改進建議。預設快速測試一頁式結論;說「深評」升級為相同任務連跑3次的穩定性比較,並聯網查證來源、作者口碑的完整診斷報告。結果會自動建檔,存入分組「技能評測報告」。適用場景:市集技能安裝前篩選、自製技能品管、已安裝技能複檢。
技能評委 · Skill Judge
為難以評估技能的使用者提供參考
描述
輸入任何待評測的 AI 技能(已安裝技能、市集頁面或 SKILL.md 文字、口述需求),以「實測而非聽描述」為原則:客製正面4+負面1+模糊1的最小用例集現場驗證,可實跑則當場執行;不可實跑則全程標註【靜態評估】並降權說明。輸出結論先行的五維加權評分卡(觸發可靠性30%/執行有效性25%/成本效率15%/穩健邊界15%/安全可信15%),綜合分套用判定線:≥80 留存、60–80 定向打磨、<60 重做,並給出短板歸因(描述/步驟/收尾自檢/篇幅)與按優先級排列的改進建議。預設快速測試一頁式結論;說「深評」升級為相同任務連跑3次的穩定性比較,並聯網查證來源、作者口碑的完整診斷報告。結果會自動建檔,存入分組「技能評測報告」。適用場景:市集技能安裝前篩選、自製技能品管、已安裝技能複檢。
發現下一個適合你的技能
繼續探索更多精選 AI 技能,用於研究、創作和日常工作。