Codex + Hyperframes: เจาะลึกเบื้องหลังไวรัล Douyin เพื่อครองตลาดสื่อออนไลน์

@369Serena
จีน2 สัปดาห์ที่ผ่านมา · 04 ก.ค. 2569
508K
2.3K
449
66
4.0K

TL;DR

คู่มือฉบับละเอียดเกี่ยวกับการใช้ AI agents และเครื่องมือ video-as-code เพื่อถอดรหัสเนื้อหาไวรัลบน Douyin และสร้างเวิร์กโฟลว์อัตโนมัติที่นำกลับมาใช้ใหม่ได้สำหรับการผลิตวิดีโอคุณภาพสูง

ก่อนหน้านี้ ฉันเคยลองใช้ Codex และ Hyperframes เพื่อถอดโครงสร้างวิดีโอไวรัลจากบัญชี Douyin เกี่ยวกับหนังสือ และเอฟเฟกต์เสียงก็ได้รับคำชมอย่างสม่ำเสมอจากทุกคน

วันนี้ ฉันกำลังเขียนบทความแบบยาวเพื่อสอนคุณทีละขั้นตอนในการถอดโครงสร้างวิดีโอไวรัลบน Douyin และปรับปรุง workflow เพื่อให้คุณก็สามารถมีความสามารถในการสร้างวิดีโอโดยใช้ AI ได้เช่นกัน

https://x.com/369Serena/status/2073012234184282287

1. การเตรียมตัว

ก่อนอื่นเลย ทุกคนต้องเตรียมเครื่องมือให้พร้อม:

  1. คุณต้องมี Agent อย่าง Codex
  1. จากนั้นไปที่ร้านค้าปลั๊กอินเพื่อติดตั้งเครื่องมือสองอย่าง:

(a) Hyperframes: มันสร้างวิดีโอในรูปแบบ HTML ซึ่งเหมาะมากสำหรับการนำเสนอในองค์กร, แอนิเมชันข้อมูล หรือวิดีโอสาธิต

(b) Remotion: เขียนด้วย React ทำให้可以实现วิดีโอเป็นโค้ด เมื่อคุณกำหนดธีมและสไตล์ที่แน่นอนแล้ว มันเหมาะอย่างยิ่งสำหรับการทำซ้ำในปริมาณมากผ่านการเขียนโค้ด ฉันเห็นบล็อกเกอร์หลายคนใช้ Remotion เพื่อสร้างแอนิเมชันในสไตล์ "เสี่ยวหลินซั่ว" ซึ่งใช้ได้ดีมากกับวิดีโอแบบมีคนพูด

นอกจากนี้ คุณยังสามารถติดตั้ง Skills บางอย่างเพื่อช่วยในการถอดโครงสร้างได้ หากคุณต้องการเข้าใจโครงสร้างของวิดีโอไวรัล เช่น ไม่กี่วินาทีแรกดึงดูดผู้ชมได้อย่างไร เอฟเฟกต์เสียงเป็นแบบไหน และจังหวะระหว่างบทพูดและภาพ คุณสามารถถอดโครงสร้างและทำซ้ำผ่าน Skills ต่อไปนี้:

  1. Claude Video: ใช้ถอดโครงสร้างกระบวนการวิดีโอเพื่อให้ทำซ้ำในขั้นตอนถัดไปได้ง่ายขึ้น
  1. Video Use: ฉันแนะนำอย่างยิ่งสำหรับมือใหม่ในการตัดต่อ มันทำหน้าที่เหมือน "ผู้กำกับการตัดต่อวิดีโอ" ที่สามารถเรียกใช้เครื่องมือที่เหมาะสมตามความต้องการของคุณ สำหรับมือใหม่ที่ไม่รู้ว่าเมื่อไหร่ควรใช้เครื่องมือไหน มันจะทำหน้าที่เป็นผู้กำกับมืออาชีพ

นั่นคือการเตรียมงานทั้งหมด

2. Workflow การผลิตวิดีโอ

การสร้างวิดีโอด้วย Codex + Hyperframes สามารถทำตามลำดับนี้:

1️⃣ กำหนดสเปควิดีโอก่อน

ตัวอย่างเช่น: 30 วินาที, 9:16, ภาษาไทย, แนวความรู้, แนะนำหนังสือ, สำหรับ X / TikTok / Xiaohongshu

2️⃣ เขียนบทพากย์

ให้ Codex เขียนบทพากย์ภาษาไทยความยาว 30 วินาทีก่อน อย่าเพิ่งรีบลงมือทำภาพ

3️⃣ ยืนยันสไตล์ภาพ

ตัวอย่างเช่น: วิดีโอความรู้แนวบรรณาธิการ色调เข้ม สไตล์ความรู้ระดับสูง พื้นหลังสีเข้ม ภาพปกหนังสือเป็นหลัก มีการซูมกล้องเล็กน้อย

4️⃣ สร้างสตอรีบอร์ดพร้อมเวลา

แบ่งบทพากย์ออกเป็น 4-6 ส่วนภาพ แต่ละส่วนสอดคล้องกับข้อมูลหลักหนึ่งชิ้น

5️⃣ เตรียม素材

ปกหนังสือ ชื่อเรื่อง คำสำคัญ โลโก้ เพลงประกอบ ข้อความพากย์

6️⃣ สร้างเสียงพากย์

คุณสามารถใช้ Edge TTS, ElevenLabs หรือ workflow ที่เกี่ยวข้องกับสื่อของ Hyperframes

7️⃣ ถอดความเสียงพากย์

ใช้ไฟล์เสียงสุดท้ายเพื่อสร้างคำบรรยาย อย่าเดาเวลาของคำบรรยายด้วยตนเอง

8️⃣ สร้างคอมโพสิชัน Hyperframes

เขียน index.html โดยใช้ data-start / data-duration / data-track-index ที่ถูกต้อง

9️⃣ สร้างคำบรรยาย

ซิงค์คำบรรยายอัตโนมัติตาม transcript

🔟 ดูตัวอย่าง

ดูตัวอย่างก่อน อย่าเรนเดอร์วิดีโอสุดท้ายทันที

1️⃣1️⃣ ตรวจสอบ / ตรวจสอบข้อผิดพลาด

ตรวจสอบข้อผิดพลาด แบบอักษร การล้นของเลย์เอาต์ และคำบรรยายที่บดบัง

1️⃣2️⃣ เรนเดอร์ MP4

เรนเดอร์เมื่อยืนยันว่าทุกอย่างถูกต้องเท่านั้น

นี่คือขั้นตอนทั่วไป ที่จริงแล้ว หลายส่วนไม่ต้องใช้คน干预 แค่เข้าใจขั้นตอนทั่วไปเหล่านี้ก็พอ ส่วนที่ต้องใช้คนจริงๆ นั้นน้อยมาก

3. การถอดโครงสร้างด้วยตนเองเบื้องต้น + การสร้างสคริปต์

ตอนนี้เราต้องถอดโครงสร้างวิดีโอ

ก่อนอื่น เราต้องใช้ Claude Video เพื่อถอดโครงสร้างวิดีโอ ตัวที่ฉันถอดเป็นบัญชีหนังสือ ดังนั้นโครงสร้างของมันง่ายมาก: ไม่กี่วินาทีแรกต้องรักษาผู้ชมไว้ ตามด้วยการแนะนำหรือรีวิวหนังสือ

ขั้นตอนถัดไปสำหรับการสร้างสคริปต์บทพากย์มีดังนี้:

  1. รวบรวมข้อมูล: (a) ใช้ Codex รวบรวมข้อมูลหนังสือ (b) เรียกการเชื่อมต่อ WeChat Reading Skills เพื่อดูส่วนที่ถูกไฮไลต์และความคิดเห็นบ่อยๆ (c) ให้ Codex ค้นหารีวิวหนังสือที่มีชื่อเสียง
  1. สร้างบทนำ: ให้ Codex สร้างบทนำตามข้อเท็จจริงของหนังสือ บทนำนี้ต้อง "ลบกลิ่น AI" สำหรับแพลตฟอร์มโซเชียลมีเดีย คุณสามารถปรับตามความสวยงามของคุณ โดยมีข้อกำหนดเฉพาะรวมถึง: (a) หลีกเลี่ยงสำนวน AI ทั่วไป เช่น "มันไม่ใช่... แต่เป็น..." (b) หลีกเลี่ยงโครงสร้างประโยคที่มีการขนานมากเกินไป (c) สำนวนต้องลื่นไหลและเป็นธรรมชาติ เล่าเรื่องราวของหนังสืออย่างเรียบง่าย ไม่ใช่แนะนำด้วยน้ำเสียงที่หยิ่งยะโส

ส่วนนี้เราต้องดำเนินการตามสองจุด:

  1. ตามโครงสร้างวิดีโอที่ถอดไว้ก่อนหน้านี้
  2. เราต้องทำหน้าที่เป็น gatekeeper เพื่อตรวจสอบว่าสคริปต์นั้น可行ได้หรือไม่

เมื่อสร้างเสร็จแล้ว คุณสามารถเปลี่ยนเนื้อหาที่ Codex รวบรวมและจัดระเบียบเป็น Skill ได้ เพื่อให้สคริปต์บทพากย์สามารถนำกลับมาใช้ใหม่ได้ในอนาคต

ทุกอย่างควรเขียนโดย Codex ตามข้อเท็จจริง หลังจากดำเนินการนี้ มันจะให้สคริปต์บทพากย์แก่ฉัน ซึ่งเป็นการผลิตสคริปต์โดยรวมครั้งแรกที่เสร็จสมบูรณ์

4. การประมวลผลไฟล์เสียง TTS: การได้เสียงที่เป็นธรรมชาติและมีเสน่ห์

เมื่อบทพากย์พร้อมแล้ว อีกส่วนสำคัญของงานที่ฉันยังไม่ได้ทำ automation โดยเชื่อมต่อ API สร้างเสียงคือการปรับแต่งเสียง

อย่างไรก็ตาม ฉันเชื่อว่ามันทำได้ ดังนั้นฉันจะเขียนวิธีปรับแต่งเสียงให้เป็นธรรมชาติ มีเสน่ห์ และเหมาะกับการเล่าเรื่องมากขึ้น

ฉันเคยแชร์ในทวีตก่อนหน้านี้ว่าฉันใช้ ElevenLabs ซึ่ง Codex แนะนำ เสียงภาษาอังกฤษในนั้นสมบูรณ์แบบจริงๆ มีเสียงจากหลายประเทศให้เลือก

แต่เมื่อใช้การสร้างเสียงภาษาไทย ฉันพบว่ามันจำภาษาไทยได้ไม่ดี ทำให้มีคำผิดเยอะมาก ในกรณีนี้ มันไม่ใช่แค่ปัญหา "กลิ่น AI" แต่ใช้ไม่ได้เลย วิธีแก้ที่ Codex ให้ฉันคือใช้ Jianying หรือ BytePlus (Volcengine) API ก่อน

เนื่องจากฉันยังไม่มี BytePlus API ฉันเลยใช้แอป Jianying บนคอมพิวเตอร์

วิธีของฉันง่ายมาก:

  1. สร้างโปรเจกต์ใหม่และหาตัวเลือกข้อความ
  2. ใช้ฟังก์ชัน "ข้อความเป็นเสียง" และเลือกเสียงที่ฉันชอบ
  3. วางสคริปต์บทพากย์ลงไปตรงๆ แล้วคลิกสร้าง
  4. สุดท้าย ส่งออกเสียง (Jianying สามารถส่งออกได้เฉพาะไฟล์ MP4)
  5. ฉันป้อนไฟล์ MP4 นี้ให้ Codex

จากการวิเคราะห์เสียงก่อนหน้าของ Codex ฉันขอให้มันช่วยประมวลผลเสียงให้เป็นธรรมชาติ มีการเล่าเรื่อง และมีเสน่ห์เหมือนวิดีโอ benchmark

กระบวนการของ Codex ในการจัดการเสียงมีดังนี้:

  1. วิเคราะห์อัตโนมัติ: Codex วิเคราะห์พารามิเตอร์เสียงของวิดีโอต้นฉบับก่อนและแก้ไขไฟล์ MP4 ของฉันตามนั้น
  2. ตั้งค่าพารามิเตอร์: ฉันจะใส่ screenshot ของพารามิเตอร์ที่เกี่ยวข้องที่นี่ คุณสามารถส่ง screenshot ให้ Codex และมันจะประมวลผลเอฟเฟกต์นั้นให้คุณ
  3. วิธีง่ายๆ: หรือใช้วิธีที่ง่ายกว่านั้นคือ ให้วิดีโอ benchmark ส่วนหนึ่งแก่ Codex โดยตรงแล้วบอกว่า "ฉันต้องการให้เสียงถูกประมวลผลแบบนี้" แล้ว Codex จะจัดการให้คุณ
Serena - inline image

เสียงที่ประมวลผลด้วยวิธีนี้สมบูรณ์แบบ เมื่อคุณ掌握了ความสามารถในการประมวลผลเสียงนี้แล้ว คุณสามารถนำไปใช้ในการผลิตวิดีโอประเภทอื่นๆ ได้ เช่น:

(a) การอธิบายภาพยนตร์หรือการเล่าเรื่อง

(b) วิดีโอปรัชญาชีวิตหรือสร้างแรงบันดาลใจ

(c) บัญชี科普

ในสถานการณ์เหล่านี้ วิธีการประมวลผลเสียงนี้ใช้ได้อย่างสมบูรณ์

อย่างที่ฉันพูด ส่วนนี้ควรจะทำ automation โดยอัตโนมัติ ในการสร้างเนื้อหาบนโซเชียลมีเดีย หลีกเลี่ยงงาน manual ให้มากที่สุด ในสภาวะที่ "ไม่เจ็บปวด" แบบนี้ การยืนหยัดทำมันง่ายกว่ามาก ดังนั้น ต่อมาฉันจะลองใช้ BytePlus API เพื่อให้ Codex สร้างบทพากย์และไฟล์เสียง TTS โดยอัตโนมัติ

5. Hyperframes สำหรับภาพ, คำบรรยาย และการจับคู่เสียง

ขั้นตอนต่อไปคือการสร้างภาพและจับคู่เสียงกับคำบรรยาย ในขั้นตอนนี้ ฉันไม่ได้干预เลยเพราะ Codex มีแผนทั่วไปอยู่แล้ว ฉันป้อนวิดีโอ benchmark ให้มันแล้ว ตอนนี้มีบทพากย์และเสียงพากย์ Codex ก็สร้างวิดีโอเอง

เวอร์ชันที่สร้างขึ้นหลังจากสร้างวิดีโอจะไม่สมบูรณ์แบบในครั้งแรก อาจเกิดสถานการณ์หลายอย่าง:

  1. เสียงและคำบรรยายไม่ตรงกัน คุณต้องสื่อสารกับ Codex และให้มันจับคู่กัน Codex จะดึงเฟรมโดยอัตโนมัติเพื่อตรวจสอบว่าทำไมถึงไม่ตรงกัน อาจต้องปรับประมาณสองครั้ง
  1. ปัญหาเกี่ยวกับภาพ รวมถึงเนื้อหาภาพ ตำแหน่งคำบรรยาย และรูปแบบผลลัพธ์ สามารถสื่อสารกับ Codex ซ้ำๆ เตือนมันให้ขยับเข้าใกล้วิดีโอที่เราต้องการทำซ้ำมากขึ้น

เมื่อกระบวนการทั้งหมดราบรื่นแล้ว เราสามารถสร้างวิดีโอที่มีความเหมือนสูงได้ หากเราสามารถทำ automation workflow ทั้งหมดได้ เราสามารถรันบัญชีเป็น batch ได้ ไม่ว่าจะเป็นบัญชีหนังสือหรือประเภทอื่นๆ ก็สามารถถอดโครงสร้างและทำซ้ำตามกระบวนการนี้ได้

6. สรุป

สุดท้ายนี้ ฉันหวังว่าบทความนี้จะเป็นประโยชน์กับทุกคน

ฉันก็อยู่ในสถานะเรียนรู้ไปด้วยทำไปด้วย และหวังว่าเราจะสามารถสื่อสารและแลกเปลี่ยนกันมากขึ้น บ่อยครั้งที่มันไม่ใช่เพราะเราทำไม่ได้ แต่เพราะเรายังไม่ได้ลงมือทำ

เช่นเดียวกันกับการใช้ Codex แค่เราเริ่มลงมือทำและคุยกับ Codex ด้วยภาษาธรรมชาติ เราก็จะพบวิธีแก้ปัญหาเหล่านี้ทีละขั้นตอน ฉันเชื่อว่าแค่ทุกคนเริ่มทำ ทุกคนก็สามารถใช้ AI เพื่อหาเลี้ยงชีพในโซเชียลมีเดียได้

ฉันหวังว่าทุกคนจะใช้ยุค AI นี้—ยุคที่คนธรรมดาสามารถ接近ประสิทธิภาพการผลิตที่สูงอย่างไม่มีที่สิ้นสุด—เพื่อทำโซเชียลมีเดีย สร้างสรรค์ และหาวิธีทำซ้ำเพื่อให้มันสร้างความมั่งคั่งได้แม้ในขณะที่คุณนอนหลับ เคลื่อนเข้าใกล้อิสรภาพมากขึ้นอย่างไม่มีที่สิ้นสุด

ฉันคือ Serena สำรวจ AI × Web3 × สื่อสังคมออนไลน์ บันทึกว่าคนธรรมดาจะกู้คืนอำนาจในการควบคุมชีวิตของตนเองได้อย่างไร หวังว่าบทความนี้จะเป็นประโยชน์กับคุณ!

👏

สร้างต่อใน YouMind

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
สำหรับครีเอเตอร์

เปลี่ยน Markdown ของคุณให้เป็นบทความ 𝕏 ที่สะอาดตา

เวลาคุณเผยแพร่งานเขียนยาวของตัวเอง การจัดรูปแบบรูปภาพ ตาราง และบล็อกโค้ดให้เข้ากับ 𝕏 นั้นน่าปวดหัว YouMind เปลี่ยนร่าง Markdown ทั้งฉบับให้เป็นบทความ 𝕏 ที่สะอาดตาและพร้อมโพสต์ทันที

ลอง Markdown เป็น 𝕏

แพตเทิร์นให้ถอดรหัสเพิ่มเติม

บทความไวรัลล่าสุด

สำรวจบทความไวรัลเพิ่มเติม