Оценщик навыков · Skill Judge

Оценщик навыков · Skill Judge

Помогает оценить AI-навыки без догадок

Автор:
鲜核桃
Установили
7
ОтYouMind
评测 · 技能图标生成器 · 2026-08-27

评级:★★★★☆(4.1 / 5)|综合分 82 / 100 → 达到「留存/上架」判定线

结论:值得留存/继续上架——核心能力(锚点图锁定一致性的三件套流水线)经实测成立,且来源完全可信(作者即本人);但「单张长图交付」依赖环境拼图工具、描述缺负面边界两处短板,建议打磨后长期保留。

五维评分表

维度得分关键证据(事实)归因(推断)
触发可靠性26/303/3 正面触发成功(2 条 showcase+1 条现场实测);实测用自然口语「给我做一套视觉物料:技能名……」即触发描述含明确的输入格式与用途(inputHint),触发面清晰
执行有效性20/25实测完整跑通锚点→封面→信息区三步,封面以锚点图为参考、风格一致;showcase 两套成品均三件套齐全一致性机制(锚点图+头图原图复用)设计成立;但本环境无拼图工具时只能降级交付两张图
成本效率11/15实测 3 次生图+2 次确认门控即完成一套;无无用重试摇骰子随机基调有「用户不满意→重生成」的潜在重复成本;确认门控增加交互次数
稳健与边界11/15实测中确认门控严格执行:未经锚点确认不生成封面、未经文案确认不生成长图防漂移设计是本技能最大优点;但描述无「何时不该用」负面边界,负面/边缘用例未实测
安全可信14/15作者=用户本人(own_skill);reviewStatus=approved;全文可查;仅调用 Create image 技能,无异常外发来源完全可信,无数据风险

综合分 = 26+20+11+11+14 = 82 ≥ 80 → 达到留存/上架判定线。

短板归因

  • 描述(触发边界不全):描述只讲「该用时怎么用」,没写「何时不该用」(如:只想做单张图、已有固定视觉品牌时不该用),会诱使 AI 在用户只想要一张图时也跑整套流程。

  • 步骤(阶段三交付形态依赖环境):最后一步「合成单张 9:16 长图」要求执行环境支持图片拼接;本环境不支持时只能交付「头图原图+信息区」两张图,「开箱即用单张长图」的承诺打折扣。

  • 步骤(showcase 与铁律轻微偏离):水果动画 showcase 实际用「单次生图+头图参照重绘」方式出整张长图,与「头图绝不重绘、必须原图复用」的铁律不完全一致——成功率依赖模型听话,存在潜在漂移。

改进建议(按优先级)

  1. 描述补一句负面边界(最易改):加「当只需单个图标、或已有既定视觉规范时,不要启动三件套流程」。

  2. 阶段三写明降级交付:在步骤里预置「环境无拼图工具时,明确告知用户需自行拼接头图与信息区,并给出拼接尺寸建议」,避免交付时突然降级。

  3. 收敛 showcase 执行路径:统一走「先拼图后交付」或「单图生图」其中一条,避免同一步骤两种做法并存导致行为不稳定。

迭代落地记录(2026-08-27)

Описание

Введите любой AI-навык для оценки: установленный навык, страницу в маркете, текст SKILL.md или устное описание задачи. Принцип — «проверять на практике, а не по описанию»: настраивается минимальный набор из 4 позитивных, 1 негативного и 1 неоднозначного сценария, который проверяется в реальных условиях. Если запуск возможен, навык запускается сразу; если нет — весь процесс помечается как 【静态评估】, а результаты получают меньший вес.\n\nНа выходе — взвешенная пятикомпонентная оценочная карта с выводом в начале: надёжность срабатывания (30%), эффективность выполнения (25%), экономичность (15%), устойчивость и граничные случаи (15%), безопасность и достоверность (15%). Итоговая оценка сопоставляется с порогами: ≥80 — оставить, 60–80 — доработать по конкретным направлениям, <60 — переделать. Также указываются причины слабых мест (описание/шаги/финальная самопроверка/объём) и даются приоритетные рекомендации по улучшению.\n\nПо умолчанию создаётся краткий одностраничный вывод. Скажите «глубокая оценка», чтобы получить полный диагностический отчёт: 3 последовательных запуска одной задачи для сравнения стабильности и проверку в интернете источников и репутации автора. Результат автоматически сохраняется в группе «Отчёты об оценке навыков».\n\nПодходит для предварительного отбора навыков в маркете, проверки собственных навыков и повторной оценки уже установленных.

Похожие скиллы

Посмотреть все

Инспектор качества Skill (PDCA-QMS)

Используйте систему менеджмента качества для проверки Skill, а не список на глаз. Основано на Six Sigma CTQ/FMEA/DPMO × TQM × цикле PDSA Деминга. Через четыре этапа Plan-Do-Check-Act выдаётся: оценочная карта качества с уровнем Sigma, таблица приоритетов дефектов по RPN, корневой анализ на уровне проектирования команд, а также полный текст Skill после исправления методом Poka-Yoke. Исправитель и проверяющий строго разделены, оценки только повышаются. v2.0 новое: ① Количественный контракт — закрытое перечисление единиц структуры (только этапы первого уровня), защита от повышения оценки через градиент K, интерполяция по логарифмической шкале для Sigma, защита от деления на ноль для всех незаполненных состояний — оценка воспроизводима и без искажений; ② Двухосевой шлюз: уровень качества × путь обработки, устраняет противоречие «не соответствует, но рекомендуем к публикации»; ③ Режим диагностики — скажите «только отчёт», «не исправляй» — после P-D-C останавливается на Check, без правок; ④ Контракт вывода — свёртка соответствующих пунктов, ограничение доказательств 50 символами, лимит слов на этап, обязательное указание расчётов. Когда использовать: оценка качества Skill, диагностика нестабильных результатов, системная оптимизация существующего Skill, горизонтальное сравнение нескольких Skills, предпубликационная проверка черновика, если нужен только отчёт без правок. Ключевые слова: проверка качества Skill, аудит качества Skill, оценка Skill, аудит качества, PDCA-оптимизация Skill, диагностика Skill, анализ дефектов Skill, только диагностика без правок, предпубликационная проверка Skill, горизонтальное сравнение Skills.

O
3500

Строгий блокировщик Skill + UX

Вы сталкивались с этими проблемами? ❌ Созданный вами Skill вроде работает, но при использовании пользователем выдает ошибки ❌ Skill работает нормально со стандартными входами, но ломается на граничных случаях ❌ Хотите разделить подтипы (например, количественный/качественный анализ статей), но не знаете, как спроектировать правила блокировки ❌ Skill либо спрашивает каждый шаг (утомляет пользователя), либо полностью автоматический (рискованные действия без подтверждения) Этот Skill помогает: ✅ Сначала режимы сбоя: перед написанием потока выполнения смоделируйте, "как этот Skill может сломаться" ✅ Строгое блокирование: при нехватке информации или рискованных действиях действительно останавливается и запрашивает дополнение, а не мягко пропускает ✅ 7-фазный диалог: определение типа → 7D матрица → моделирование сбоев → проектирование правил блокировки → самопроверка → создание ✅ UX-улучшения: структурированные вкладки снижают когнитивную нагрузку + якоря прогресса + позитивные формулировки блокировки ✅ Соответствие плотности взаимодействия риску: высокорисковые задачи имеют точки подтверждения, пакетные задачи не прерываются на каждом шагу Выходные данные включают: - Определение типа AFP (академический/презентация/безопасная коммуникация/текстовый обзор/рецензия Skill/пользовательский) - Матрица разделения подтипов (опционально, для разнородных входов) - Правила блокировки (три уровня действия: BLOCK/TAG/GRADE + оценочные карты) - Путь понижения Manual_Fallback - Тестовые сценарии (масштабируемые по сложности: стандартный/граничный/блокировка/взаимодействие/подтипы) - Контрольный список (честность прежде всего/соответствие типу/нейтральность имен/защита от жесткого кодирования) Одним словом: Это не "случайный" генератор Skill, а строгий консультант по дизайну, который помогает создать Skill, который выполним, имеет правила блокировки, пути понижения и удобный интерфейс. Подходит вам, если вы: 🛠️ Создатель, желающий превратить повторяющиеся задачи в многоразовый Skill 🎯 Продвинутый пользователь, которому нужно проектировать сложные Skill (с разделением подтипов, оценочными картами) ✅ Пользователь, строго требовательный к качеству Skill, не приемлющий "работает, но нестабильно" 📚 Пользователь YouMind, желающий изучить методологию дизайна Skill

J
0399

Skill Дизайнер

Не умеете создавать Skill? Скажите одну фразу. Skill Дизайнер — это «навык, который учит создавать Skill'ы» — он использует 7-уровневую метарамку (определение намерения → классификация ввода → проектирование рабочего процесса → стратегия инструментов → спецификация вывода → ограничения и границы → компонуемость и тестирование), превращая вашу нечеткую идею в структурно полный и сразу исполняемый YouMind Skill. Поддерживает два пути: проектирование с нуля (опишите свою идею, он автоматически запросит недостающую информацию, пройдёт семь уровней и создаст Skill) и проверка с улучшением (отправьте ему черновик Skill, и он послойно диагностирует проблемы и даст рекомендации по улучшению). При нехватке информации автоматически задает уточняющие вопросы, предлагая варианты вместо открытых вопросов, чтобы снизить затраты на ответы. В итоге напрямую вызывает createSkill для создания готового Skill, без необходимости вручную писать инструкции. Подходит для создателей, которые хотят превратить свой опыт в навыки, но не знают, с чего начать.

R
450

Найди свой следующий любимый скилл

Изучи больше отобранных AI-скиллов для исследований, творчества и повседневной работы.

Изучить все скиллы