앞서 말씀드렸듯이, 리트윗이 100개를 넘으면 이 스킬을 공개하겠다고 했습니다.
목표가 달성되었습니다. 모두 정말로 응원해 주셨습니다.
https://x.com/MANISH1027512/status/2094786658914930945
자, 스킬만 공개하는 것이 아니라 그 뒤에 있는 로직도 설명드리겠습니다. 이 글을 읽고 나면 여러분도 AI 사진작가가 되어 자신만의 스타일로 스킬을 확장할 수 있습니다.




첫째, 핵심 프롬프트 프레임워크
한국 인스타그램 인플루언서, 하얀 피부, 과장된 체형.
[표정] + [의상 스타일] + [장면] + [순간] + [촬영 기법]
이게 다인가요?
네, 뼈대는 기본적으로 그렇게 간단합니다.
여러분께 계속 강조해 왔습니다: GPT-Image 2를 다루는 것은 다른 도구와 다릅니다. 너무 과도하게 제어하지 마세요.
사람이 무엇을 입는지, 손을 어떻게 두는지, 고개를 어느 쪽으로 기울이는지, 빛이 어느 각도에서 오는지, 배경에 정확히 무엇이 있는지 엄격하게 정의하면, GPT는 상충되는 요구 사항을 처리하는 데 어려움을 겪습니다. 모든 것을 만족시키려고 하다 보면 렌더링 충돌이 발생할 수 있습니다 (예를 들어, 그렇게 노이즈가 생성됩니다).
따라서 핵심 앵커 포인트를 제어하고 나머지는 적절히 모델에 위임하세요.
하지만 위임한다고 해서 "모든 것이 랜덤"이라고 말하는 것만을 의미하지는 않습니다.
진정으로 중요한 것은:
핵심 앵커 포인트에 대해 충분히 두꺼운 열거 값 세트를 준비하는 것입니다.
예를 들어, 모델에게 "랜덤 표정"이라고 말하면 가장 흔한 몇 가지 표정만 쉽게 반복합니다.
하지만 다음과 같이 제공하면:
멍하니 넋 놓기, 살짝 눈을 가늘게 뜨기, 고개 숙여 딴생각하기, 참지 못하고 웃음 터뜨리기, 갑자기 뒤돌아보기, 잠시 멍해지기, 햇빛에 찔린 듯한 자연스러운 표정, 막 잠에서 깬 나른함...
랜덤의 경계는 여러분이 정의합니다.
이것이 제가 이해하는 스킬과 일반 프롬프트의 주요 차이점이기도 합니다.
스킬이 하는 일은 무엇인가?
사실 그렇게 신비로운 것이 아닙니다.
이러한 핵심 변수들을 지속적으로 변수 풀 / 소재 은행으로 두껍게 만드는 것입니다.
예를 들어:
표정 풀
의상 스타일 풀
장면 풀
순간 풀
샷 유형 풀
초점 거리 풀
카메라 위치 풀
구도 풀
전경 풀
조명 풀
생성할 때 이러한 풀에서 재조합합니다.
일종의 경계가 있는 랜덤성으로 이해할 수 있습니다:
모델이 맹목적으로 추측하게 하지도 않고, 모든 픽셀을 미리 정의하지도 않습니다.
이것은 현재 많은 이미지 생성 스킬의 매우 일반적인 기본 로직입니다.
뼈대 + 변수 풀.
ChatGPT 에서 바로 실행할 수 있는 버전
다음을 복사하면 기본적으로 사용할 수 있습니다:
n=10, 9:16 실사 캔디드 포토그래피 인물 사진. 피사체는 다음과 같이 고정: 카메라 감각이 뛰어난 한국 인스타그램 인플루언서, 하얀 피부, 과장된 체형. 랜덤 표정: 멍하니 넋 놓기, 살짝 눈을 가늘게 뜨기, 햇빛에 찔린 듯한 자연스러운 표정, 반쯤 미소 짓기, 고개 숙여 딴생각하기, 눈 감고 바람 느끼기, 갑자기 뒤돌아보기, 위를 바라보며 먼 곳 응시하기, 참지 못하고 웃음 터뜨리기, 막 잠에서 깬 나른함, 포착되었을 때의 자연스러운 멈춤, 살짝 인상 쓰기, 생각에 잠기기, 잠시 멍한 순간. 랜덤 의상 스타일: BM 스타일, 퓨어 디자이어 스타일, 새엄마 스타일, 성숙한 스타일, 샤넬 스타일, 홈웨어 스타일, 한국식 라이트 성숙 스타일, 프렌치 레이지 스타일, 미니멀리스트 쿨 스타일, 올드 머니 스타일, 휴가 스타일, 어반 커뮤터 스타일, 스위트 앤 쿨 스타일, Y2K 스타일, 한국 걸그룹 사복 스타일, 플레인 워터 하이엔드 룩, 저채도 하이엔드 사복, 편안한 사복 스타일. 랜덤 장면: 한여름 연못, 오래된 나무 배, 호숫가 나무 산책로, 얕은 시골 개울, 대나무 숲 물가, 하얀 벽 안뜰, 남부 옛집 창문, 현대식 유리 온실, 호숫가 돌계단, 산길, 해변 하얀 건물, 도시 옥상, 오래된 버스, 구식 기차 객차, 미니멀리스트 숙소, 편의점 냉동고, 강가에서 과일 씻기, 나무 그늘 아래 벤치, 비 온 후 골목, 오래된 부두, 여름 수영장 옆, 갈대 호숫가, 시골 과수원, 하얀 정자, 연꽃 잎 아래. 랜덤 순간: 막 앉았을 때, 일어나려고 준비할 때, 고개 숙여 치마 정리할 때, 손 들어 모자 고칠 때, 바람에 머리카락 흩날릴 때, 잎사귀 뒤에서 엿볼 때, 몸 굽혀 수면 닿을 때, 맨발로 물속 디딜 때, 나무 산책로 따라 천천히 걸을 때, 배 고물에서 멍하니 있을 때, 돌아서 먼 곳 바라볼 때, 바람에 흐트러진 머리카락 정리하며 손 들 때, 고개 숙여 과일 씻을 때, 창가에서 낮잠 잘 때, 갑자기 뒤돌아볼 때, 눈 감고 일광욕할 때, 그늘에서 햇빛 속으로 걸어 나올 때, 난간에 손 얹을 때, 돌계단에 앉아 다리 흔들 때, 거대한 연잎으로 햇빛 가릴 때, 물가에 쪼그려 앉을 때, 살짝 뒤로 젖힐 때, 손을 땅에 짚고 쉴 때, 렌즈를 지나치다 우연히 포착될 때. 랜덤 샷 유형: 얼굴 극단적 클로즈업, 어깨 클로즈업, 가슴 위 클로즈업, 허리 위 미디엄 클로즈업, 무릎 위 미디엄 샷, 반신 환경 인물 사진, 전신 환경 인물 사진, 큰 환경 속 작은 인물 구도. 랜덤 초점 거리: 24mm 초광각 근거리, 28mm 광각, 35mm 환경 인물 사진, 50mm 자연 시점, 85mm 압축 인물 사진, 105mm 장거리 염탐 망원. 랜덤 카메라 위치: 물에 가까운 매우 낮은 앵글, 거대한 연잎 아래에서 올려다보는 로우 앵글, 지면 로우 앵글, 허리 아래 로우 앵글, 눈높이 캔디드, 약간 하이 앵글, 확실한 하이 앵글, 계단 위에서 아래로 내려찍기, 식물 사이로 옆에서 촬영, 문틀 뒤에서 촬영, 창문 밖에서 실내로 촬영, 객차 앞줄에서 장거리 촬영, 인물 뒤에서 촬영, 어깨 너머 시점, 더치 앵글, 인물 완전히 중앙에서 벗어나기, 사진작가가 환경 사물 뒤에 숨어 염탐 시점. 랜덤 구도: 극단적 네거티브 스페이스, 넓은 하늘 영역, 넓은 수면 영역, 인물을 프레임 하단 1/3에 배치, 인물을 극단적 측면에 배치, 중앙 구도이지만 전경에 의해 가려짐, 비대칭 구도, 대각선 구도, 원근법적 소실선, 거대한 자연물이 인물을 압박, 소규모 환경 인물 사진, 전경이 프레임의 1/3 차지, 전경이 프레임의 절반 차지, 식물 틈새로 엿보기, 문틀 프레이밍, 창틀 프레이밍, 연잎이 자연스러운 원형 프레임 형성, 건축적 기하학적 프레임 절단. 랜덤 전경: 완전히 초점이 흐려진 연꽃, 거대한 연잎, 나뭇잎, 대나무 잎, 하얀 커튼, 유리 반사, 물 반사, 꽃잎, 갈대, 문틀, 창틀, 자동차 유리, 버스 좌석, 투명 플라스틱 커튼, 난간, 하얀 벽 가장자리, 젖은 나뭇가지. 전경은 자연스럽게 프레임에 침입하여 명확한 장애물을 형성해야 함; 모든 요소를 완전히 보여주지 마십시오. 랜덤 조명: 강한 한여름 정오 하드 라이트, 얼룩덜룩한 나무 그늘 빛, 오후 측면 역광, 저녁 낮은 각도 역광, 비 온 후 맑은 산란광, 창가의 고대비 자연광, 수면 반사 필 라이트, 하얀 벽 반사광, 잎사귀를 통해 형성된 미세한 빛과 그림자, 부분적으로 과다 노출된 하이라이트, 빛과 어둠의 경계에 있는 인물, 밝은 배경에 약간 어두운 인물, 인물의 얼굴이 작은 햇빛 패치에만 비춰짐. 랜덤하지만 절제된 색상: 파란 하늘 + 에메랄드 그린 + 흰색, 진한 녹색 + 유백색 + 피부 톤, 물 파랑 + 흰색 + 회색, 청록색 + 회백색 + 약간의 분홍색 꽃, 진한 파란 밤 + 차가운 흰색 빛, 비 온 후 회청색 + 젖은 녹색. 프레임은 최대 3-4개의 주요 색상 블록을 유지, 여러 색상의 혼란을 피함. 랜덤 사진 상태: 자연스러운 캔디드, 포즈를 취하지 않음, 사진작가의 우연한 포착, 인물이 렌즈를 완전히 인지하지 못함, 약간의 모션 블러, 부분적 초점 이탈, 유리 반사 고스트, 실제 렌즈 플레어, 가장자리 하이라이트 오버플로, 약간의 과다 노출, 얕은 피사계 심도, 장거리 압축, 근거리 광각 왜곡, 자연스러운 그레인, 약간의 디지털 노이즈, 휴대용 카메라의 즉각적인 느낌. 전체 요구 사항: 실사 사진, 강한 사진 질감, 현대적인 동양 여름 인물 사진, 깔끔한 프레임, 명확한 대규모 관계, 뚜렷한 공간 레이어, 스튜디오 느낌 없음, 상업 스튜디오 촬영 없음, 표준 인플루언서 포즈 없음, 모든 피사체가 카메라를 보지 않음, 기존의 중앙 인물 사진 없음, 복잡한 소품 없음, 어수선한 배경 없음, 과도한 피부 보정 없음, 플라스틱 피부 없음. 각 이미지는 서로 다른 장면, 의상 스타일, 순간, 샷 유형, 초점 거리, 카메라 위치, 구도, 전경 및 조명을 랜덤으로 결합해야 하며, 비전통적인 카메라 위치와 우연한 캔디드 느낌을 우선시해야 함; 동일 배치 내 이미지 간 반복을 피하십시오.
스킬 버전
오픈 소스 저장소:
https://github.com/vibeshotclub/vsc-skills/tree/main/vibeshot-candid-photography
스킬 버전 자체에는 특별한 마법이 없습니다.
핵심은 위 프레임워크를 기반으로 변수 풀의 두께를 계속 늘려 서로 다른 변수 간의 더 많은 조합을 가능하게 하는 것입니다.
똑똑한 여러분이라면 이미 유추하여 배울 수 있다고 믿습니다.
마지막으로, 제가 작업해 온 커뮤니티 VibeShotClub을 소개합니다:
이곳은 진정으로 장기간 실험하는 AIGC 비주얼 크리에이터들의 모임입니다.
우리는 지속적으로 프롬프트, 스킬, 워크플로우, 모델 기법 및 커뮤니티에서 제작된 우수 사례를 정리하고 공유할 것입니다.
여러분도 AI 이미지, AI 비디오를 진지하게 다루거나 자신만의 창작 워크플로우를 구축하고 있다면 방문해 보시기 바랍니다.





