Ви хочете створювати зображення з тією самою атмосферою, але щоразу виходить інша картинка.
Коли ви ставите поряд три мініатюри, вони виглядають так, ніби їх зробили троє різних людей. Ви хочете отримати ту саму людину, що й раніше, але її обличчя змінюється. Навіть якщо написати «так само, як минулого разу», це взагалі не працює.
Це стіна, об яку спотикається більшість людей, які починають використовувати AI-генерацію зображень у роботі.
Однак проблема не в тому, що ваші промпти погані. Причина набагато простіша: ви щоразу пишете їх з нуля.
Понад те, OpenAI офіційно відповів на цю проблему. Опубліковано шаблон, який розкладає промпти для зображень на 14 пунктів. Він охоплює 11 типів для різних випадків використання, 8 типів для редагування та готові приклади.
Ось чотири речі, якими я поділюся:
- Повний текст 14 офіційних пунктів шаблону та що писати в кожному з них.
- Список з 11 типів для позначення випадку використання одним словом і 8 типів для редагування.
- Офіційний спосіб постійно отримувати «те саме обличчя» і «той самий стиль».
- Спосіб не вставляти цей шаблон щоразу (включно із записом мого реального запуску).
Друга половина базується на реальних вимірюваннях. Я передав одне референс-зображення, створив шаблон і пройшов процес створення 10-сторінкового документа. Я опишу точно, скільки це зайняло часу, що я переробляв усе 7 разів і як з'ясував, що для створення документів не варто використовувати ImageGen напряму.
Спершу — сам об'єкт. Це офіційний фреймворк.
Офіційний оригінальний текст (Shared Prompt Scaffolding із навички imagegen від OpenAI)
1Випадок використання: <taxonomy slug>2Тип ресурсу: <де буде використано ресурс>3Основний запит: <головний запит користувача>4Вхідні зображення: <Зображення 1: роль; Зображення 2: роль> (необов'язково)5Сцена/фон: <оточення>6Об'єкт: <головний об'єкт>7Стиль/техніка: <фото/ілюстрація/3D тощо>8Композиція/кадрування: <широкий/крупний план/зверху; розташування>9Освітлення/настрій: <освітлення + настрій>10Кольорова палітра: <нотатки про палітру>11Матеріали/текстури: <деталі поверхні>12Текст (дослівно): "<точний текст>"13Обмеження: <обов'язково зберегти/уникати>14Уникати: <негативні обмеження>
Джерело: https://github.com/openai/skills/blob/main/skills/.system/imagegen/SKILL.md
Просто поглянувши на це, ви можете подумати «тут усе англійською» й зупинитися, тому далі я перекладу кожен пункт українською та поясню, як їх заповнювати. Наприкінці я надам українську версію шаблону, яку можна скопіювати й використовувати як є.
Причина, чому щоразу виходить по-різному, — не в тому, що ваші промпти погані
Причина в структурі інструкцій, а не в їхньому змісті.
Ви вводите «створи стильне зображення для шапки блогу» вільним текстом. Наступного дня вводите «проста й крута шапка для блогу». У свідомості людини це те саме замовлення, але для AI це дві різні інструкції.
У першій є лише підказка «стильне». У другій — «проста» і «крута». Частини, які ви не вказали, AI щоразу заповнює сам. Оскільки щоразу вони заповнюються по-різному, зображення щоразу різні.
⚡ Це не AI вагається; це вагаються наші інструкції.
Ось тут і з'являються 14 пунктів. Якщо пункти зафіксовані, ви одразу бачите, де забули заповнити. Якщо відкрити попередній файл і переписати лише ті рядки, які хочете змінити, решта буде такою самою, як минулого разу.
Перестаньте «писати» промпти щоразу й переходьте на «заповнення». У цьому суть цієї дискусії.
Офіційна політика: «не розширювати самовільно»
Є ще одна дизайн-філософія, яку корисно знати.
Офіційне визначення навички свідчить:
1Якщо промпт уже конкретний і детальний, збережіть цю конкретику й лише нормалізуйте/структуруйте його. Якщо промпт загальний, ви можете додати доречні уточнення, коли це суттєво покращить результат.
Джерело: https://github.com/openai/skills/blob/main/skills/.system/imagegen/SKILL.md
Якщо інструкція конкретна, збережіть цю конкретику й просто впорядкуйте структуру. Лише коли інструкція розмита, дозволено додавати елементи в межах покращення результату. Саме так це вирішується.
Іншими словами, чим детальніше ви пишете, тим менше свободи в AI. Менше свободи означає менше варіативності.
І навпаки, для розмитих інструкцій AI офіційно дозволено «бути корисним і додавати». Частини, додані з добрих намірів, щоразу різні. Це і є джерелом варіативності.
📌 Отже, 14 пунктів — це інструменти для передачі інформації AI й водночас інструменти для позбавлення AI свободи. Якщо бачити це так, ви не використаєте їх неправильно.
До речі: у вас, найімовірніше, уже є цей інструмент
Жодного встановлення не потрібно.
imagegen — це «системна навичка», яка була в Codex із самого початку. Користувачі не додають її пізніше; вона готова до роботи з моменту запуску. Жодних додаткових контрактів чи API-ключів не потрібно.
В офіційному описі поведінка за замовчуванням — це режим, що використовує вбудований інструмент image_gen, і виглядає він так:
Вбудований інструмент (за замовчуванням): не потребує OPENAI_API_KEY.
API-ключ потрібен лише для CLI-запасного варіанта (scripts/image_gen.py), який запускається лише за явним запитом. Для звичайного використання це не важливо.
⚠️ Ось де спотикаються 90% людей: символ виклику залежить від місця.
Якщо ви цього не знаєте, ви застрягнете на першому ж рядку. Офіційна документація описує це так:
1У Codex CLI або розширенні IDE виконайте /skills або введіть $, щоб згадати навичку.
1У ChatGPT Work використовуйте формат @skill-creator.
Джерело: https://learn.chatgpt.com/docs/build-skills
У Codex CLI та розширеннях IDE — це $. У ChatGPT Work — це @.
Це та сама функція, але символ виклику різний. Коли процедура, знайдена в інтернеті, не працює, зазвичай це просто означає, що ви перебуваєте на іншому екрані, ніж у статті. Граматика не помилкова.
Офіційна документація також перелічує, де її можна використовувати:
1Окремо розповсюджувані навички доступні в десктопному застосунку ChatGPT, Codex CLI та розширенні IDE. Навички, включені в плагіни, також доступні в Chat і Work у ChatGPT у вебі, на десктопі та мобільному.
Джерело: https://learn.chatgpt.com/docs/build-skills
Десктопний застосунок, Codex CLI та розширення IDE. Ці три — арена для окремих навичок.
🎯 Навіть ті, хто не може користуватися навичкою, можуть використовувати шаблон уже сьогодні.
Це важливий момент, тому скажу чітко. Для людей, які не користуються Codex або десктопним застосунком, imagegen сам по собі не актуальний. Якщо просто відкрити ChatGPT у браузері, від введення $ нічого не станеться.
Однак шаблон із 14 пунктів — це просто текстовий формат. Його можна вставити безпосередньо в поле генерації зображень браузерного ChatGPT, Gemini або Claude. Навичка — це лише «механізм, який записує у цьому форматі за вас», а сам формат може використовувати будь-хто.
Тому цінність цієї статті не змінюється залежно від того, чи вмієте ви користуватися навичкою. Ті, хто вміє, мають сприймати це як автоматизацію, а ті, хто не вміє, — як шаблон для копіювання та вставлення.
Промпт-шаблон: усі 14 пунктів
Далі — основна частина. Розгляньмо, для чого кожне поле, по порядку. Пунктів 14, але заповнювати всі не обов'язково. Це просто відношення, у якому AI доповнює частини, які ви не заповнили. Достатньо заповнити лише ті пункти, де вас турбує варіативність.
- Use case (випадок використання) Це поле, де жанр зображення позначається фіксованим словом. Замість вільних слів ви обираєте з офіційно підготовлених слів (taxonomy slug). Усього є 11 типів, зокрема product-mockup, ui-mockup, logo-brand. Повний список наведено в наступному розділі. Визначивши це спочатку, ви автоматично визначаєте, як заповнювати решту пунктів. Якщо це фотографія продукту — потрібне освітлення. Якщо це діаграма — потрібен текст. Щойно випадок використання визначено, визначено й необхідні поля.
- Asset type (тип ресурсу) Сюди пишуть, де зображення буде розміщено в результаті. «Шапка блогу», «герой-фон для лендінгу», «іконка UI для гри». Якщо випадок використання (№ 1) — це велика категорія, то тут — фактичне місце розміщення. Навіть для однакових фотостилів потрібні поля та пропорції змінюються залежно від того, чи зображення буде в шапці, чи в іконці. Це поле передає саме це.
- Primary request (основний запит) Сюди вставляють те «зроби отак», яке ви зазвичай пишете вільним текстом. В офіційному поясненні це <user's main prompt>. Іншими словами, ці 14 пунктів — не механізм відкидання вільного тексту. Це структура, де ви розміщуєте вільний текст у полі № 3 і вишиковуєте умови навколо нього. Якщо це поле порожнє, нічого не починається. І навпаки, якщо заповнити лише його, стан буде таким самим, як раніше.
- Input images (вхідні зображення) Коли ви передаєте наявні зображення, сюди записують, яку роль відіграє кожне. Офіційний формат — <Image 1: role; Image 2: role>. Ви оголошуєте кількість і роль як набір: «Зображення 1 — фото людини, Зображення 2 — референс одягу». Це необов'язковий пункт, тож під час створення з нуля його можна лишити порожнім. Однак коли ви хочете продовжувати виводити ту саму людину, це поле стає головним. Детальніше — у розділі про редагування.
- Scene/backdrop (сцена/фон) Середовище, у якому розміщена картинка. «На дерев'яному столі», «в індустріальному ангарі», «світло-сірий із легкою текстурою». Це може бути реальне місце або абстрактний фон. Якщо фон не записати, він змінюватиметься щоразу. Причина, чому атмосфера мініатюр не збігається, зазвичай у тому, що це поле порожнє.
- Subject (об'єкт) Що розмістити в центрі кадру. Можна писати не лише сам об'єкт, а й те, як він розміщений: «Одна пляшка в центрі, з легким віддзеркаленням». Сенс у тому, щоб записувати фон (№ 5) і об'єкт (№ 6) окремо; якщо об'єднати їх в одне речення, AI не зможе визначити, чому надавати перевагу.
- Style/medium (стиль/техніка) Це фото, ілюстрація чи 3D? В офіційних прикладах це записано з деталізацією на кшталт «матова ілюстрація», «кінематографічний концепт-арт» або «діаграма у векторному стилі». «Стильне» та «круте» — не ті слова, які сюди пишуть. Сприймайте це як поле для назви техніки.
- Composition/framing (композиція/кадрування) Це широкий план чи крупний, зверху чи знизу, і куди розмістити об'єкт. В офіційному прикладі є формулювання на кшталт «wide composition with usable negative space for page copy» — широка композиція з вільним простором для тексту сторінки. Це горизонтальна композиція з полями ліворуч і праворуч для розміщення тексту. Це поле ефективне для зображень, на які текст додаватимуть пізніше, як-от мініатюри чи шапки. Якщо не зарезервувати поля заздалегідь, об'єкт займе весь екран, і текст не поміститься.
- Lighting/mood (освітлення/настрій) М'яке ранкове світло, студійне освітлення чи промені світла в тумані? В офіційних прикладах використовують вирази на кшталт «soft morning light», «softbox lighting, clean highlights, controlled shadows» і «volumetric light rays cutting through fog». Якщо хочете стабілізувати фотографічність, найшвидший спосіб — щоразу фіксувати тут те саме формулювання.
- Color palette (кольорова палітра) Політика щодо кольорів. «Фірмові кольори», «приглушені нейтральні кольори», «глибокий зелений та екрю». Це можуть бути конкретні назви кольорів або напрямок. Якщо хочете показати впізнаваність бренду, записуйте свої кольори тут і фіксуйте їх. Це саме по собі вирівняє враження, коли зображення стоятимуть поряд.
- Materials/textures (матеріали/текстури) Текстура поверхні. Запишіть інформацію, що стосується відбиття світла, як-от «матовий пластик, чітко надрукована етикетка». Це поле ефективне для фотографій продуктів; для пейзажів чи ілюстрацій його можна без проблем пропустити.
- Text (verbatim) (текст, дослівно) Поле для точного запису тексту, який має бути на зображенні. Сенс у тому, що офіційний формат — Text (verbatim): "<exact text>", а verbatim означає «дослівно, як в оригіналі». Ви передаєте точний рядок, який хочете отримати, у лапках, а не переказ змісту. В офіційному прикладі для діаграми це записано так:
1Text (verbatim): "Bean Hopper", "Grinder", "Brew Group", "Boiler", "Water Tank", "Drip Tray"
Ми часто чуємо, що текст на AI-зображеннях спотворюється, але в багатьох випадках точний текст, який потрібно включити, спочатку не передавався правильно. Просто заповнивши це поле, можна змінити результат.
- Constraints (обмеження) Поле, де перелічують «зберегти це» та «не робити цього». Найпоширеніший набір в офіційних прикладах — «no text; no logos; no watermark» (без тексту; без логотипів; без водяних знаків). Для зображень, на які текст планують додати пізніше, включення цих трьох щоразу зменшує кількість інцидентів. Це зупиняє AI від самостійного додавання англійських слоганів.
- Avoid (уникати) Якщо № 13 — про загальні умови, то це поле звужене до «того, чого ви не хочете бачити у виведенні». Градієнти, 3D, розміщення в мокапі. В офіційному прикладі для логотипа це записано як «no gradients; no mockups; no 3D; no watermark» (без градієнтів; без мокапів; без 3D; без водяних знаків). Оскільки ролі перетинаються з № 13, у реальних офіційних шаблонах часто використовують лише одне з них. Замість суворого розмежування достатньо розуміти, що «є два місця, куди записують те, що треба припинити робити».
Позначте випадок використання одним словом. 11 типів від офіційного джерела
Це список слів для № 1 Use case. В офіційній збірці прикладів для генерації наведено 11 типів.
- photorealistic-natural (реалістичні фото, природні сцени)
- product-mockup (фотографії продуктів, пакування)
- ui-mockup (макети дизайну екранів)
- infographic-diagram (діаграми, інфографіка)
- scientific-educational (діаграми для науки й освіти)
- logo-brand (логотипи, бренд-знаки)
- illustration-story (ілюстрації для історій)
- stylized-concept (стилізований концепт-арт)
- ads-marketing (рекламні та маркетингові матеріали)
- productivity-visual (візуали для документів і бізнесу)
- historical-scene (історичні сцени)
Окрім цих, підготовлено також шаблони за місцем розміщення. Для вебсайтів (герой-зображення, ілюстрації секцій, шапки блогів), для ігор (концепти фонів, персонажі, UI-іконки, текстури), вайрфрейми (ПК, сторінки ціноутворення, онбординг для смартфонів), логотипи (абстрактні знаки, монограми, словесні знаки). Для шапки блогу офіційний приклад наведено як є.
Офіційний оригінальний текст (приклад для вебсайтів: шапка блогу)
1Випадок використання: photorealistic-natural2Тип ресурсу: шапка блогу3Основний запит: сцена столу зверху з ноутбуком, ручкою та чашкою кави4Сцена/фон: тепла дерев'яна стільниця5Стиль/техніка: реалістичне фото6Композиція/кадрування: широкий кадр із чистим місцем для тексту сторінки7Освітлення/настрій: м'яке ранкове світло8Обмеження: без тексту; без логотипів; без водяних знаків
Зверніть увагу: заповнено лише 8 із 14 пунктів. Офіційне джерело саме не заповнює всі. Це приклад того, що заповнювати потрібно лише необхідні поля.
Продовжуємо виводити те саме обличчя і стиль. 8 типів для редагування
Це пряма відповідь на «щоразу виходить по-різному». В офіційній збірці прикладів є 8 типів випадків використання для редагування наявних зображень.
- text-localization (заміна лише тексту, як-от переклад)
- identity-preserve (зміни зі збереженням особистості людини)
- precise-object-edit (заміна лише конкретних об'єктів)
- lighting-weather (зміна лише світла та погоди)
- style-transfer (перенесення стилю референс-зображення)
- compositing (композитинг об'єктів з іншого зображення)
- character consistency workflow (виведення того самого персонажа в іншій сцені)
- sketch-to-render (перетворення скетча на фінальну картинку)
Той, що працює для проблеми зі зміною обличчя, — identity-preserve. Офіційний приклад виглядає так:
Офіційний оригінальний текст (редагування: identity-preserve)
1Випадок використання: identity-preserve2Вхідні зображення: Зображення 1: фото людини; Зображення 2..N: референси одягу3Основний запит: замінити лише одяг на надані речі4Обмеження: зберегти обличчя, статуру, позу, зачіску, вираз та особу; узгодити освітлення й тіні; залишити фон без змін; без аксесуарів і тексту
Ключова частина — рядок Constraints. Зберегти обличчя, статуру, позу, зачіску, вираз та особу. Узгодити освітлення й тіні. Залишити фон без змін. Іншими словами, замість «зроби так, щоб це була та сама людина» ви перелічуєте те, що має залишитися незмінним, за назвами. Такий спосіб написання — офіційна відповідь.
🔥 Якщо ви виводите багато персонажів, використовуйте цей формат
Для таких випадків, як серійні мініатюри або багаторазове виведення тієї самої людини, існує детальніший формат.
Офіційний оригінальний текст (редагування: character consistency workflow)
1Випадок використання: identity-preserve2Вхідні зображення: Зображення 1: попередня якірна ілюстрація персонажа3Основний запит: продовжити історію з тим самим персонажем у новій сцені та дії4Сцена/фон: засніжений ліс після зимової бурі5Об'єкт: той самий юний лісовий герой, який обережно допомагає зляканій білці вибратися з поваленого дерева6Стиль/техніка: та сама акварельна ілюстрація в стилі дитячої книжки, як на Зображенні 17Обмеження: не переробляти персонажа; зберегти риси обличчя, пропорції, одяг, кольорову палітру та характер; без тексту; без водяних знаків
Термін «character anchor» (якірний образ персонажа), використаний тут, — ключовий. Ви вказуєте одне зображення як стандарт-«якір» і відтоді лише описуєте відмінності від нього. Важливий і той момент, що в полі Style/medium записано «та сама акварельна ілюстрація в стилі дитячої книжки, як на Зображенні 1»; стиль не пояснюється словами. Він задається посиланням: «такий самий, як на Зображенні 1». Спроба відтворити стиль словами завжди веде до відхилень. Посилання на референс точніше.
Якщо потрібно вирівняти лише стиль — використовуйте style-transfer
Якщо ви хочете вирівняти загальний тон, а не людину, використовуйте це.
Офіційний оригінальний текст (редагування: style-transfer)
1Випадок використання: style-transfer2Вхідні зображення: Зображення 1: референс стилю3Основний запит: застосувати візуальний стиль Зображення 1 до чоловіка на мотоциклі на простому білому тлі4Обмеження: зберегти палітру, текстуру та манеру мазків; без зайвих елементів
Зберегти палітру, текстуру та манеру мазків. Не додавати зайвих елементів. Якщо у вас є одне зображення, яке вам подобається, розмістіть його як Зображення 1, а потім міняйте зміст. Тон і манера бренду будуть найстабільнішими саме в цьому форматі.
Українська версія шаблону, яку можна використовувати як є
Наведені нижче два шаблони — не промпти, поширювані офіційно. Вони перебудовані у форму, яку можна заповнювати українською, на основі офіційної структури пунктів, наведеної вище. Назви пунктів збережено в офіційному англійському вигляді.
★ Практичне застосування (Створено на основі офіційної структури пунктів. Не є промптом, поширюваним офіційно)
1Use case:2Asset type:3Primary request:4Input images:5Scene/backdrop:6Subject:7Style/medium:8Composition/framing:9Lighting/mood:10Color palette:11Materials/textures:12Text (verbatim):13Constraints: no text; no logos; no watermark14Avoid:
Створіть один такий файл у текстовому редакторі та збережіть. Від наступного разу відкривайте його і переписуйте лише ті рядки, які хочете змінити. Якщо заповнити його для мініатюри, виглядатиме так:
★ Практичне застосування (На основі офіційного прикладу Website assets / blog header, перебудовано українською)
1Use case: photorealistic-natural2Asset type: Зображення для шапки статті блогу (горизонтальне)3Primary request: Вид на стіл зверху по діагоналі. Ноутбук, ручка та кухоль4Scene/backdrop: Теплий стіл із дерев'яною текстурою5Subject: Ноутбук трохи лівіше центру, кухоль на передньому плані праворуч6Style/medium: Реалістичне фото7Composition/framing: Горизонтальне. Залишити поля праворуч для розміщення заголовка8Lighting/mood: М'яке природне ранкове світло9Color palette: Спокійна кольорова гама на основі брунатних відтінків дерева та екрю10Constraints: no text; no logos; no watermark
Від другого разу переписуйте лише два рядки: Primary request і Subject. Усе інше залишайте як минулого разу. Це вирівняє «ту саму атмосферу, що й раніше». Секрет у тому, щоб із самого початку визначити, які рядки фіксуєте, а які змінюєте. Найзручнішим, на мою думку, є розподіл: фіксувати чотири рядки — фон, стиль, світло та кольорову палітру, а рухати лише об'єкт і композицію.
Якщо вставляти шаблон щоразу — морока, можна створити цілий шаблон
Далі — записи мого реального запуску. Чесно кажучи, копіювати та вставляти 14 пунктів щоразу — це боляче. З боку Codex був підготовлений механізм, який це вирішує. Коли ви додаєте Image Gen у поле введення, з'являється контейнер під назвою Template Gallery (Галерея шаблонів). Сюди можна розміщувати власні шаблони. Під час створення я звернувся до Template Creator (Конструктор шаблонів) так:
★ Практичне застосування (Інструкції, які я насправді надіслав. Не є промптом, поширюваним офіційно)
1Будь ласка, використайте Конструктор шаблонів, щоб створити новий шаблон зображення для ImageGen. Спочатку поясніть, як працює шаблон і як ним користуватися. Далі попросіть завантажити PNG-референс і, якщо потрібно, запитайте, коли і як використовувати шаблон.
Відповідь надійшла через 27 секунд. Було добре, що воно спершу поставило два питання, замість того щоб раптово почати роботу. Перше: «Ви хочете, щоб шаблон тяжів до дизайну цілого слайда, чи використовувати його для генерації ілюстрацій і діаграм?» Друге: «Основне використання ближче до дослідницького звіту, матеріалів семінару, продажів чи до каруселі для соцмереж?» Ці два питання — точки розгалуження для дизайну. Навіть із тим самим «хочу вирівняти дизайн» результуючий шаблон змінюється залежно від того, чи створюєте ви повний візуал, чи картинку, на якій текст має бути розміщений на полях. Логічно, щоб це визначили спочатку.
⚠️ Справжня сутність — не «реєстрація шаблону», а «збереження навички»
Я теж до середини розумів це неправильно, тому скажу чітко. Справа не в тому, що всередині ImageGen є механізм реєстрації шаблонів, як у Canva. За словами Codex, насправді це механізм, де правила для референс-зображень, кольорових палітр, виразів і макетів зберігаються як «навичка» (skill) у Codex і викликаються з ImageGen. Навичка — це багаторазовий робочий процес, що поєднує інструкції, референс-матеріали, скрипти тощо. Офіційне пояснення тут.
Джерело: https://developers.openai.com/plugins/concepts/skills.md
Тому акт створення шаблону — це, по суті, вирощування однієї навички, присвяченої вам. Якщо перемкнутися на таке розуміння, наступна частина набуває сенсу.
Як викликати створений шаблон
Після завершення шаблон отримує назву та з'являється в галереї. Від наступного разу його можна викликати двома способами:
- Додати Image Gen у поле введення та обрати з галереї
- Прямо вказати ID, що починається на $artifact-template-
Можна також викликати за назвою. Спрацювало написання «Створити з дизайном (назва шаблону)». 📌 Іншими словами, 14 пунктів — це «формат, який пишуть руками», а шаблон — це «той формат, збережений як навичка». Щодо порядку дій: безпечніше спочатку написати руками, щоб засвоїти формат, а вже потім перетворювати його на шаблон. Якщо створити шаблон раптово, ви не зможете пояснити, що саме зафіксували.
Якщо ви створюєте документи, не варто використовувати ImageGen напряму
Це було найважливіше відкриття цього разу. Коли шаблон був готовий, я спробував доручити йому створити 10-сторінковий документ. У результаті він зміг його створити, але коли я запитав сам Codex «як правильно просити в майбутньому», я отримав відповідь, відмінну від очікуваної. Використання ImageGen напряму підходить для виробництва окремих зображень. Зокрема, коли треба зробити одну ілюстрацію, коли треба зробити лише обкладинку, коли треба виправити колір або композицію наявного зображення або коли треба вивести один дизайн-пропозицію як пробу. І навпаки, воно не підходить для виробництва цілого документа. Причина також зрозуміла. Бо складно колективно керувати дослідженням, проєктуванням структури з 10 сторінок, єдністю між сторінками та конвертацією у PowerPoint і PDF.
🎯 ImageGen — це інструмент, спеціалізований на одному зображенні. Документ доручайте навичці. Якщо ви доручите йому створювати документ, не знаючи цієї межі, це буде обхідний шлях.
Правильний спосіб запиту — «керувати всім через навичку і в межах цього використовувати ImageGen»
Розподіл ролей був таким:
- Дизайн-шаблон (той, що ви створили самі): відтворює кольорову палітру, декор і світогляд
- Навичка для генерації слайдів: відповідає за дослідження, структуру, генерацію зображень, перевірку та конвертацію у PPTX і PDF
- ImageGen: фактично генерує готові зображення для кожної сторінки
Якщо вказати перші дві та надіслати, ImageGen викликається всередині. Ось форма запису, яку насправді підказали:
★ Практичне застосування (Форма специфікації, підказана Codex. Тему приховано та узагальнено)
1Використовуючи $imagegen-slide-deck і $artifact-template-(назва вашого шаблону), створіть, будь ласка, 10-сторінковий документ на тему «XX». З тим самим дизайном, що й цього разу, збережіть PowerPoint і PDF, використавши офіційну назву як ім'я файлу.
Якщо достатньо лише відтворення дизайну, вистачить самого шаблону.
★ Практичне застосування (Те саме, що вище)
```text
Використовуючи $artifact-template-(назва вашого шаблону), створіть, будь ласка, 10-сторінкову презентацію на тему «XX». Дослідіть зміст і збережі





