YouMind
Oturum aç

Bir Yeteneği Açık Kaynaklı Hale Getirmek: Xiaohongshu ve WeChat İçin İllüstrasyon Sorununu Tamamen Çözmek

@op7418
ÇINCE28 May 2026
464K
1.5K
255
98
2.7K

TL;DR

Guizang'ın yeni açık kaynaklı aracı guizang-social-card-skill, yüksek kaliteli sosyal medya içerikleri için dergi tarzı estetik ve akıllı görsel-metin yerleşimi kullanarak genel yapay zeka düzenlerine profesyonel bir alternatif sunuyor.

歸藏(guizang.ai) - inline image

Bir süre önce guizang-ppt-skill'i açık kaynak olarak yayınladım ve daha sonra kendim içerik oluştururken bir şey fark ettim.

Oluşturduğu web sayfalarının ekran görüntülerini alıp metin-görsel platformlarında paylaştığımda, manuel düzenlemelerime göre çok daha iyi geri bildirim ve veri alıyordum.

歸藏(guizang.ai) - inline image

Eminim siz de daha önce bu 3:4 kart görsellerini oluşturan bazı prompt'lar veya Skill'ler bulmuşsunuzdur.

Neredeyse hepsi aynı tada sahip: Tailwind + büyük renk blokları + emoji yığını + vasat font hiyerarşisi.

Bunlara baktıktan sonra, yapay zeka tarafından oluşturulan metin-görsel kartlarının neden ilk bakışta bu kadar kolay anlaşıldığını kabaca anlayabiliyorum - web sayfası yapıyorlar, dergi değil.

Metin-görsel kartları, PPT'lerle karşılaştırıldığında tamamen farklı bir canavardır: dikey ekranlar, bilgi akışında durup durmamaya 1 saniyede karar verme ve kelimelerden çok resimlere güvenme.

Farklı düzenler, farklı ritimler, farklı okuyucular.

Bu yüzden onu PPT Skill'inden ayırdım ve bağımsız bir guizang-social-card-skill (https://github.com/op7418/guizang-social-card-skill) haline getirdim.

Aşağıda, neden iyi olduğundan ve neden bu kadar zaman harcamaya istekli olduğumdan bahsedeceğim.

2. Peki neden iyi?

3:4 dikey görseller, metin-görsel kartlarının ana savaş alanıdır. Bu Skill'in tasarım enerjisinin çoğu, 3:4 oranına harcandı - font hiyerarşisi, düzen oranları ve satır sonu kuralları.

Her şey, mobil bilgi akışında kaydırılma gerçek senaryosuna göre kalibre edildi. 21:9 ve 1:1 WeChat Resmi Hesap kapak görselleri de desteklenmektedir.

歸藏(guizang.ai) - inline image

Metin-görsel yaratıcılarının en çok önemsediği şeyle başlayalım.

2.1 Yazdığınız şeyi ayırt eder ve doğru stille eşleştirir

Metin-görsel platformlarındaki içerik kategorize edilmiştir. Bir film eleştirisi ve bir ürün incelemesi tamamen farklı görsel diller gerektirir;

Bir seyahat günlüğü ve iş yeri ipuçları farklı düzenler kullanmalıdır.

Ancak çoğu AI aracı bunu umursamaz; ne yazarsanız yazın aynı şablonu kullanır.

Sonuç olarak, herkesin kartları bir WeChat Resmi Hesap kapağı montaj hattından çıkmış gibi görünür.

Bu Skill, 11 yaygın metin-görsel kategorisi için yerleşik uyarlama kurallarına sahiptir:

  • Seyahat / Yaşam Tarzı: Dergi stili, sıcak renk paleti, tam ekran görseller, büyük serif başlıklar;
  • İş Yeri / İpuçları / İş Görüşleri: Izgara stili, koyu arka planlar, veri yoğun afiş düzenleri;
  • Film / Kültür: Soğuk tonlu dergi stili, film afişi düzenleri, karakter yakın çekimleri öncelikli;
  • Ürün İncelemeleri / Dijital: Izgara stili, karşılaştırma matrisleri, cihaz çerçeveli ekran görüntüleri;
  • Okuma / Notlar: Dergi stili, serif fontlar, ortalanmış alıntı düzenleri, maksimum beyaz boşluk;
  • Yemek / Mekan Gezileri: Yüksek doygunluklu dergi stili, yukarıdan çekimler öncelikli, metin köşelere taşınmış;
歸藏(guizang.ai) - inline image

Hatta seyahat blog yazarları için özel bir harita bileşeni yaptım. Üzerinde mağaza konumlarını ve seyahat rotalarını işaretleyebilirsiniz, AI sizin için otomatik olarak açıklamalar oluşturacaktır.

歸藏(guizang.ai) - inline image

Aynı metni besleyin: ona bir film eleştirisi olduğunu söyleyin, size bir film afişi tarzı kart versin; ürün incelemesi olduğunu söyleyin, size cihaz çerçeveli bir karşılaştırma tablosu versin.

歸藏(guizang.ai) - inline image

Daha da önemlisi, net "yapılmaması gereken" bölgeleri vardır:

  • Hayran odaklı içerik: gerekli görsel dil tamamen farklıdır;
  • Saf tanıtım reklamları: içeriği vurgulama tasarım felsefesiyle çelişir;
  • 12 ekrandan uzun eğitimler: metin-görsel formatı, uzun eğitimler için en uygun taşıyıcı değildir.

Bu senaryolarda, Skill size baştan "Başka bir araç kullanmak isteyebilirsiniz" diyecektir.

Bunu bilerek bıraktım. Sınırlar, bir ürünü yeteneklerden daha fazla tanımlar; her şeyi yapmaya çalışan bir Skill genellikle hiçbir şeyi iyi yapamaz.

2.2 Görsellere metin yerleştirme

Görsellere metin yerleştirmek, metin-görsel kartlarının en zor kısmı ve "AI hissinin" en kolay ortaya çıktığı yerdir.

İyi yapılmazsa, üç tür başarısızlık meydana gelir:

  1. Metin, yüzleri veya ürünün merkezini kapatır.
  2. Açık arka planlarda beyaz metin veya koyu arka planlarda siyah metin okunamaz hale gelir.
  3. Metin tüm görseli kaplar, güzel bir kompozisyonu mahveder.
歸藏(guizang.ai) - inline image

Skill bunu üç adımda halleder:

  1. Görseldeki nesneleri tanımlar: yüzler, ürünler, metin yoğun alanlar ve düzende bunlardan otomatik olarak kaçınır;
  2. Yerleşim alanının rengini ve parlaklığını hesaplar: metin rengine, maske ekleyip eklememeye ve gölgenin ne kadar derin olacağına karar verir;
  3. Uyarlanabilir font boyutu ve satır sonu: yerleşim alanının boyutuna göre font boyutunu ve satır sonu pozisyonlarını dinamik olarak ayarlar, taşan bir font boyutunu sabit kodlamaz.
歸藏(guizang.ai) - inline image

Bu kurallarla kartın "premium hissi" oluşur. Okuyucular "sonradan eklenmiş metin" ile "orijinal olarak orada olan metin" arasındaki farkı anlayamaz.

2.3 Görseller nereden geliyor: Diğer AI kart araçlarından en büyük fark budur

Metin-görsel kartları oluşturan çoğu AI aracı ya kendi görsellerinizi yüklemenizi ister, bunun yerine emoji kullanır ya da ilk bakışta AI yapımı olduğu belli olan illüstrasyonlar oluşturur.

Sonuç olarak, manuel görsel avlamak yorucudur veya emoji yığmak yapay görünür.

Bu Skill, varsayılan olarak ücretsiz ticari kullanıma izin veren üç görsel kütüphanesine bağlıdır:

  • Pexels: Çince aramayı destekler, genel senaryolar için iyidir;
  • Unsplash: En güçlü fotoğraf dokusuna sahiptir, insan, yaşam ve mekan içerikleri için ilk tercihtir;
  • Wallhaven: Oyunlar, fotoğraflar ve duvar kağıtları burada, ancak telif hakkı karmaşık olabilir.
歸藏(guizang.ai) - inline image

Metin paragraflarının anlamına göre otomatik olarak arama terimleri gönderir, görselleri alır, düzene uyacak şekilde kırpar ve yüzleri veya nesneleri kesmekten kaçınır.

Gerçek fotoğraflara sahip bir kart elde edersiniz, renk bloğu kartı değil.

Ve telif hakkı sorunu olmayan görseller bulma konusunda katı değildir. Hangi görselleri bulduğunu size söyler ve telif hakkı net olmayan görselleri kullanıp kullanmamaya siz karar verirsiniz.

Ayrıca, platformlar şu anda AI filigranları konusunda çok katı. Şu anda kullandığınız AI tarafından oluşturulan görsellerin çoğunda filigran var, bu da platformlar tarafından işaretlenir ve gölge yasaklamaya yol açabilir. Bu büyük bir sorun.

2.4 Ekran görüntüleri de görseldir: Dört Parça Güzelleştirme

İçeriğimizin çoğu fotoğraf kullanamaz; yazılım ekran görüntüleri, sohbet kayıtları veya ürün arayüzleri olması gerekir.

Skill'in yerleşik bir ekran görüntüsü güzelleştiricisi vardır:

macOS/iOS tarzı cihaz çerçeveleri (tarayıcı kenarlıkları veya telefon çerçeveleri) ekler, ekran görüntüsünü tutmak için farklı arka plan dokuları kullanır - grafik kağıdı, nokta matrisi, sıcak beyaz veya koyu - böylece ekran görüntüsü beyaz bir arka planda beyaz bir arka planla yüzmekten kurtulur;

Aynı zamanda, görsel stile göre otomatik olarak gölge katmanlarını ve köşe yarıçapı parametrelerini eşleştirir. Her iki stilin de bir ekran görüntüsü tarifi vardır, manuel ayarlama gerektirmeden tutarlılık sağlar.

歸藏(guizang.ai) - inline image

Basitçe söylemek gerekirse, çektiğiniz rastgele bir ekran görüntüsü, ondan geçtikten sonra resmi bir ürün tanıtım görseli gibi görünecektir.

2.5 AI Görsel Oluşturma: Ölçülü Kullanın

Skill, yalnızca önceki tüm görsel kaynakları uygun malzeme bulamadığında AI görsel oluşturmayı çağırır.

Görseller oluştururken, "bariz AI illüstrasyonlarının" vasat görsellerinden kaçınmak için stil kısıtlama kelimelerini zorlar.

AI'yı tüm metin-görsel kartlarını kardeş gibi gösterecek şekilde kullanmaktansa, daha az kullanmasını tercih ederim. Bu aynı zamanda AI görselleri kullanmanın içerik erişimini etkilemesini de önler.

歸藏(guizang.ai) - inline image

2.6 Görsel Sistem: İki Stil + 28 Düzen İskeleti

Önceki PPT Skill'ime aşina olanlar bunu tanıdık bulacaktır. Bu iki görsel sistem ve düzen iskeleti, PPT Skill'inden uyarlandı ve yeniden kalibre edildi.

Ayrıntıları tekrar etmeyeceğim, ancak işte metin-görsel kartı bağlamında nasıl göründükleri.

İki görsel sistem:

  • Dergi Stili: The New Yorker veya Şanghay Çeviri Yayınevi'nin kapaklarında gördüğünüz türden tipografi. Geniş beyaz boşluk, büyük serif başlıklar, asimetrik düzenler ve nefes alacak alanı olan metin.
  • Izgara Stili: Massimo Vignelli ve Helmut Schmid'in İsviçre grafik tasarımı geleneğinde. Güçlü ızgaralar, sans-serif fontlar, geometrik his, ölçülü ancak hassas renk kullanımı.
歸藏(guizang.ai) - inline image

Son on yılda gördüğüm dergilerden, afişlerden, albüm kapaklarından ve film posterlerinden seçtiğim 28 düzen iskeleti - incelemeye dayanabilecek olanlar.

AI, "serbest düzen tasarımında" hala vasattır. Ona kanıtlanmış bir iskelet vererek, görevi "tasarlamaktan" "doldurmaya" düşürülür ve bitmiş ürünün kararlılığı hemen artar.

10 set tema rengi paleti, sabit font eşleştirmeleri ve sınırlı simge kütüphaneleri - bu ayrıntıları tek tek listelemeyeceğim.

歸藏(guizang.ai) - inline image

Mantık aynıdır: kısıtlamalar engel değildir; onlar taban çizgisidir.

Bir içerik oluşturucuya sonsuz renk seçeneği verin, çirkin bir şey yapma olasılıkları daha yüksektir; onlara 10 set kanıtlanmış palet verin, iyi bir şey yapma olasılıkları %100'e yaklaşır.

3. Neden bunu yapıyorum?

3.1 Tasarım Perspektifi: Dergi hissi çok etkilidir

Neden daha "modern" kart tasarımları yerine dergi ve ızgara stillerini tercih ediyorum?

Bir metin-görsel kartının özü, basılı bir poster, resimli dergi veya albüm kapağı ile aynıdır. Statik bir görüntü kullanarak bir yabancıyı 1 saniyede durmaya ikna etmek. Dergiler ve posterler bunu yüz yıldır derinlemesine inceliyor.

Web tasarım dili, kaydırılabilir, etkileşimli senaryolar için yapılmıştır. Statik bir görüntüye taşımak onu zorlama ve bilgiyi düz gösterir.

歸藏(guizang.ai) - inline image

Bu nedenle, bu Skill'in görsel kararlarının tüm "nedenleri":

  • Neden geniş beyaz boşluk? Beyaz boşluk, derginin size "odak noktası burada" deme şeklidir.
  • Neden serif fontlara öncelik veriliyor? Serif fontlar, büyük boyutlarda basılı malzemenin ağırlığına sahiptir.
  • Neden asimetrik düzenler? Asimetri, gözün nereye ilk bakacağını bilmesini sağlayan görsel bir ritim yaratır.
  • Neden ölçülü renkler? Sosyal medya akışlarında, ölçülü bir palet aslında yüksek doygunluktan daha dikkat çekicidir; etrafındaki tüm "yüksek sesle bağıran" kartlar arasından sıyrılır.

Bu kararlar kulağa "soyut" geliyor, ancak bunların hepsi kodda belirli sabitlerdir. Font boyutu oranları, beyaz boşluk oranları, ızgara sütun sayıları, kontrast eşikleri, satır sonu kuralları. Bu sabitler, bu Skill'in gerçek savunma hendekidir.

3.2 Ürün Perspektifi: Bu bir ürün, sadece bir Prompt değil

Bu kadar çok Skill yaptıktan sonra, "bir Skill'in aslında ne olduğu" konusunda bir yargı oluşturdum:

Bir Skill, özünde küçük bir üründür.

歸藏(guizang.ai) - inline image

Bu projeye uygulandığında:

Onun için bir PRODUCT.md yazdım, hangi sorunu çözdüğünü, kimin için olduğunu ve ne yapmadığını açıkça açıklıyor. Bu, kendimi "aslında ne yaptığım" konusunda net düşünmeye zorlamak içindi. Açıklayamazsam, Skill yayınlanmamalıdır.

Ona sürüm numaraları (v0.5 / v0.9 / v0.10 / v0.12) veriyorum ve her sürümün bir CHANGELOG'u var. Size v0.10'un neden başarısız bir deneme olduğunu ve v0.12'nin bunu nasıl düzelttiğini anlatabilirim.

Onun için bir HANDOVER.md yazdım, teslimatların neye benzediğini, sınırların nerede olduğunu ve diğer araçların ne zaman kullanılacağını açıklıyor. Umarım devralan herkes 30 dakika içinde onu tam olarak anlayabilir.

Kullanıcıların deneme yanılmadan kurtarmak için neyi iyi yapmadığını önceden listeliyorum.

Neden tüm bu zahmete giriyorum?

Çünkü Skill ekosisteminin en büyük sorunu, çoğu Skill'in "bir tane yapabilirim" ile yetinmesi ve çok az kişinin "işi en uç noktaya kadar götürmeyi" hedeflemesidir.

Bir Skill, kendi başına ayakta durabilen küçük bir ürün olmalıdır. Bir Prompt, on dakika içinde bir rakip tarafından kopyalanabilir; bir ürün kopyalanamaz.

Diğer tarafı ise, eğer kendi Skill'imin sınırlarını bile açıklayamıyorsam, başkalarının iş akışlarını ona teslim etmelerini istemeye hakkım yoktur.

Son Sözler

Bu Skill, PPT Skill'imin aslında neyi doğru yaptığını anlamama yardımcı oldu.

Doğru yaptığı şey, en başından itibaren bir ürün olarak ele alınmasıydı. Birçok şablon, ayrıntılı kural ve güzel renk, bunların hepsi bunun yan ürünleridir.

Gelecekte biri bana bir Skill'in ne olduğunu sorarsa, iki cümleyle cevap vereceğim:

Bir Skill bir üründür. Bir Skill'in iyi olup olmadığını anlamak için, yazarı tarafından sevilip sevilmediğine bakın.

歸藏(guizang.ai) - inline image

Eğer siz de metin-görsel içeriği oluşturuyorsanız, umarım bu, kötü düzen yüzünden mahvolan güzel konuları kurtarmanıza yardımcı olur.

Eğer siz de Skill yapıyorsanız, umarım bu, yaptığınız şeyin bir PRODUCT.md'ye sahip olmaya değer olup olmadığını yeniden düşünmenizi sağlar.

GitHub: https://github.com/op7418/guizang-social-card-skill

Codex'inize, Xiaolongxia'nıza, ClaudeCode'unuza veya Workbuddy'nize söyleyin: Bu Skill'i yüklememe yardım et: https://github.com/op7418/guizang-social-card-skill

Tek tıkla kaydet

YouMind ile viral makaleleri AI derin okumayla incele

Kaynağı kaydedin, odaklı sorular sorun, argümanı özetleyin ve viral bir makaleyi tek bir AI çalışma alanında yeniden kullanılabilir notlara dönüştürün.

YouMind'ı keşfet
Üreticiler için

Markdown'ınızı temiz bir 𝕏 makalesine dönüştürün

Kendi uzun yazılarınızı yayımlarken görselleri, tabloları ve kod bloklarını 𝕏 için biçimlendirmek zahmetlidir. YouMind, eksiksiz bir Markdown taslağını temiz ve hemen paylaşılabilir bir 𝕏 makalesine dönüştürür.

Markdown'dan 𝕏'e deneyin

Çözülecek daha fazla kalıp

Son viral makaleler

Daha fazla viral makale keşfet