Làm chủ Seedance 2.5: Hướng dẫn toàn diện về phim ngắn AI

@fuji_ai_
TIẾNG NHẬT10 thg 8, 2026
142K
149
13
3
326

TL;DR

Hướng dẫn toàn diện về cách sử dụng Seedance 2.5 của ByteDance để sản xuất video AI, tập trung vào việc tạo các bộ phim ngắn dọc 30 giây với nhân vật nhất quán và âm thanh đồng bộ thông qua các câu lệnh có cấu trúc.

Thành thật mà nói, tôi đã phải nhìn lại màn hình lần nữa.

Ngày nay, khi mở TikTok hay YouTube, phim ngắn dọc (vertical short drama) không ngừng phát sóng.

Giờ đây, chúng có thể được tạo ra chỉ với một prompt duy nhất.

Hội thoại, hiệu ứng âm thanh, BGM — tất cả đều được bao gồm.

Không quay phim. Không diễn viên. Không dựng phim.

Chi phí khoảng 1.400 yên mỗi video.

Chắc hẳn nhiều người lướt qua và nghĩ: "Nghe bảo ấn tượng lắm." Tôi hiểu cảm giác đó quá rõ.

Lúc đầu, tôi nghĩ: "Chắc chỉ là vài giây video CGI thôi."

Nhưng thứ thực sự tạo ra là một tác phẩm dài 30 giây, nơi chuyển động môi của diễn viên khớp hoàn hảo, và thậm chí còn có những cảnh cắt mà tôi không hề chỉ định.

Đó không chỉ là "video đã được tạo"; mà là "một tác phẩm nghệ thuật đã xuất hiện."

Vì vậy tôi đã viết bài viết này.

Tôi đã đính kèm prompt đầy đủ mà bạn có thể sao chép và dán để sử dụng ngay lập tức.

Ngoài ra, dù bạn đọc trước hay sau bài viết này, tôi điều hành một LINE Open Chat nơi tôi chia sẻ những câu chuyện về ứng dụng AI mà tôi không thể đưa vào bài viết. Ở đó, tôi đang tặng miễn phí "32 Phần thưởng Chiến lược AI Cao cấp". Tham gia miễn phí, nên bạn cứ thoải mái ghé xem.

▼ Open Chat "Fuji AI [Thông tin mới nhất]"

Bạn có thể tham gia qua liên kết trong trang cá nhân của tôi.

Bắt đầu nào.

◾️ Seedance 2.5 là gì?

Seedance 2.5 là mô hình tạo video AI thế hệ mới do ByteDance phát triển. Từ các đầu vào như văn bản, hình ảnh, âm thanh và video, nó có thể tạo ra một video mang tính câu chuyện dài tới 30 giây kèm âm thanh chỉ trong một lần tạo.

Nó được tạo ra bởi ByteDance, công ty mẹ của TikTok. Nó được phát hành vào ngày 31 tháng 7 năm 2026.

Bạn chỉ cần nhớ ba tính năng chính:

① 30 giây trong một lần tạo, kèm âm thanh

Thế hệ trước, 2.0, là 15 giây. Con số này đã tăng gấp đôi. Hơn nữa, mô hình tự xử lý các cảnh cắt. Dù bạn không chỉ định, nó vẫn tự động chuyển từ cảnh quay rộng sang cận cảnh.

② Có thể cung cấp tối đa 50 tài liệu tham chiếu

Phân bổ gồm 30 hình ảnh, 10 video và 10 tệp âm thanh. Bạn có thể cố định khuôn mặt, trang phục, địa điểm và cả giọng nói. "Việc cố định giọng nói" này trở nên rất hiệu quả về sau.

③ Tạo video và âm thanh đồng thời

Nó không tạo video trước rồi thêm âm thanh sau; mà tạo ra cả hai cùng lúc ngay từ đầu. Do đó, chuyển động môi và giọng nói không bị lệch nhau.

Đó là những điều cơ bản về Seedance 2.5. Tuy nhiên, để tôi cảnh báo bạn trước.

Đây không phải là mô hình chỉ đơn giản là "tăng chất lượng hình ảnh."

Blog chính thức không đề cập đến độ phân giải một lần nào. Trong dịch vụ thực tế, bạn chỉ có thể chọn giữa 480P và 720P. Tùy chọn 1080P thậm chí không tồn tại. Một số bài báo trên mạng tuyên bố rằng "phiên bản 4K tuyệt vời" đã được phát hành, nhưng điều đó mâu thuẫn với bảng giá chính thức.

Đây là mô hình được thiết kế cho độ dài và tính nhất quán. Đó là cách hiểu đúng đắn.

◾️ Lý do duy nhất khiến nó là lựa chọn duy nhất cho phim ngắn dọc

Lý do tôi chọn công cụ này rất đơn giản: Độ dài.

Dù video AI của Google có hiệu suất cao đến đâu, nó cũng chỉ có thể tạo ra 10 giây mỗi lần. Điều này về cơ bản không tương thích với phim ngắn dọc. Cấu trúc của phim ngắn dọc là "Gây chú ý → Xây dựng → Đảo chiều → Chốt hạ." Điều này cần chính xác 30 giây. Nếu bạn làm điều này thành ba đoạn 10 giây rồi ghép lại, khuôn mặt sẽ thay đổi ở các cảnh cắt. Bầu không khí cũng thay đổi. Nhân vật chính ở cảnh cắt thứ ba trở thành một người khác so với cảnh đầu tiên. Seedance hiện là công cụ duy nhất có thể xử lý 30 giây trong một lần. Vì vậy, đối với phim ngắn dọc, bạn chọn công cụ này thay vì Google.

◾️ Hãy thử ngay (Chỉ cần sao chép và dán)

Không hề khó. Nếu làm theo các bước, bạn chắc chắn có thể làm được.

[Bước 1: Mở Dreamina]

藤原弘人@AI起業家 - inline image

Cổng kết nối để sử dụng Seedance 2.5 từ Nhật Bản là một dịch vụ tên Dreamina. Nó nằm dưới cùng hệ sinh thái ByteDance với CapCut, và giao diện đã được bản địa hóa hoàn toàn.

[Bước 2: Đăng nhập]

藤原弘人@AI起業家 - inline image

Bạn có thể chọn một trong năm phương thức đăng nhập: Google, TikTok, Facebook, Email hoặc CapCut Mobile. Google là nhanh nhất.

[Bước 3: Chuyển mô hình sang Seedance 2.5]

藤原弘人@AI起業家 - inline image

Nhấp vào "AI Video" ở góc dưới bên trái để xem danh sách mô hình. Chọn "Dreamina Seedance 2.5." Chỉ có 2.5 mới có thể xuất ra 30 giây liên tục.

[Bước 4: Điều chỉnh ba cài đặt]

Đặt các nút ở bên phải của mô hình như sau:

  • Chế độ tạo: Omni-reference (Mặc định là được)
  • Tỷ lệ khung hình và độ phân giải: 9:16 / 720P
  • Thời lượng: 30 giây

Quan trọng là mức tiêu thụ tín dụng được hiển thị ở bên trái nút tạo. Mỗi lần tạo đều tốn tiền, vì vậy hãy tạo thói quen kiểm tra con số này.

[Bước 5: Sao chép, dán và gửi nội dung sau]

Bạn không cần thay đổi gì cả.

▼ Sao chép và dán tất cả nội dung bên dưới ▼

text
1Hãy tạo một phim ngắn dọc 30 giây (9:16). Sử dụng nhịp độ tương tự phim ngắn dọc Trung Quốc, với cảm xúc mạnh và cấu trúc mà cục diện quyền lực hoàn toàn đảo ngược ở cuối.
2[Định nghĩa nhân vật]
3Nhân vật 1 = Người đàn ông Nhật Bản ngoài 40 tuổi. Tóc ngắn, mặc tạp dề đen, là quản lý cửa hàng.
4Nhân vật 2 = Người đàn ông Nhật Bản cuối 20 tuổi. Tóc đen, áo hoodie xám, đeo ba lô.
5Nhân vật 3 = Người phụ nữ Nhật Bản ngoài 30 tuổi. Bộ vest màu navy, cầm một phong bì.
6Luôn sử dụng các tên này từ đây về sau.
7[Bố cục cảnh quay]
8Cảnh 1 (0-3s)
9- Máy quay: Cố định, cận ngực Nhân vật 1
10- Hành động: Nhân vật 1 khoanh tay, cười khẩy và nhìn xuống
11- Âm thanh: (Không có nhạc, chỉ có tiếng ồn cửa hàng) / Nói bằng tiếng Nhật {Chúng tôi không cần những khách hàng không biết xếp hàng.}
12Cảnh 2 (3-9s)
13- Máy quay: Zoom chậm vào khuôn mặt Nhân vật 2
14- Hành động: Nhân vật 2 nhìn xuống và từ từ chỉnh lại quai ba lô
15- Âm thanh: Nói bằng tiếng Nhật {...Tôi xin lỗi} / <Tiếng chén đĩa chạm nhau nhẹ>
16Cảnh 3 (9-16s)
17- Máy quay: Cố định, cảnh quay trung bình của cửa hàng
18- Hành động: Một số khách hàng xung quanh lúng túng nhìn đi nơi khác
19- Âm thanh: (Một nốt trầm đơn lẻ) / <Tiếng cửa lùa mở nhẹ nhàng>
20Cảnh 4 (16-22s)
21- Máy quay: Di chuyển chậm từ lối vào vào trong cửa hàng
22- Hành động: Nhân vật 3 bước vào và dùng hai tay đưa phong bì cùng chìa khóa cho Nhân vật 2
23- Âm thanh: (Nhạc dây lên mạnh mẽ) / Nhân vật 3 nói bằng tiếng Nhật {Tôi từ trụ sở chính đến. Đây là tài liệu bàn giao quản lý bắt đầu từ ngày mai.}
24Cảnh 5 (22-27s)
25- Máy quay: Cố định, cận cảnh đôi tay Nhân vật 2
26- Hành động: Nhân vật 2 trầm lặng nhận chìa khóa. Nhân vật 1 khựng lại, miệng há hở
27- Âm thanh: Nhân vật 2 nói bằng tiếng Nhật {Tôi muốn tự mình xem hiện trường rồi mới quyết định} / Nhân vật 1 nói bằng tiếng Nhật {Hả?}
28Cảnh 6 (27-30s)
29- Máy quay: Cố định, cảnh quay trung bình cả ba người
30- Hành động: Nhân vật 1 lùi lại nửa bước. Nhân vật 2 đáp trả sau một nhịp. Nhân vật 3 khẽ quay mặt đi
31- Âm thanh: (Âm nhạc đột nhiên nhẹ nhõm hơn) / Nhân vật 2 nói bằng tiếng Nhật {Từ ngày mai anh dạy tôi xếp hàng được không?} / Nhân vật 3 nói khẽ bằng tiếng Nhật {Quản lý à, đây là quản lý mới.}
32[Đạo diễn]
33- Live-action / Siêu thực tế / Diễn viên Nhật Bản tự nhiên
34- Quán ramen nhỏ vào ban đêm. Ánh sáng ấm, độ bão hòa thấp
35- Diễn xuất cảm xúc mạnh. Chỉ Nhân vật 1 lên giọng
36- 9:16, chất lượng cao, hình ảnh ổn định, không mờ, không rung
37[Thông số nhất quán]
38Cùng một người, trang phục nhất quán, kiểu tóc không đổi. Giữ nguyên ngoại hình và trang phục trong tất cả các cảnh quay. Không xuất hiện hai hoặc nhiều người có ngoại hình/trang phục giống hệt nhau (không có hiệu ứng song sinh).
39[Điều cấm]
40- Không có phụ đề, chú thích, logo, hình mờ hoặc văn bản trên màn hình
41- Không có người thật hoặc logo thương hiệu thật
42- Không có văn bản có thể đọc được trên biển hiệu, thực đơn hoặc tài liệu
43- Không chạy nước rút, nhảy lớn hoặc xoay dữ dội
44[Kết thúc]
45Truyền tải sự thỏa mãn của khoảnh khắc người nhìn xuống mất vị trí vì một tài liệu duy nhất. Chỉ Nhân vật 1 nên lớn tiếng; nhân vật chính giữ im lặng đến cuối. Sử dụng biểu cảm, diễn xuất và kỹ thuật quay để nội dung rõ ràng ngay cả khi không có phụ đề.

◾️ 6 điều mà tài liệu chính thức khuyên "Đừng làm"

藤原弘人@AI起業家 - inline image

1. Đừng cung cấp bảng xoay nhân vật (turnaround sheets)

Không giống như anime, việc cung cấp góc nhìn trước/bên/sau khiến mô hình nghĩ rằng có ba người khác nhau, dẫn đến vỡ khuôn mặt. Hãy dùng một ảnh chân dung trung tính.

2. Đừng sử dụng tài liệu tham chiếu đến giới hạn

Bạn có thể thêm 50, nhưng khuyến nghị là 4-5. Quá nhiều khiến mô hình mất dấu thứ tự ưu tiên.

3. Đừng chỉ định nhiều chuyển động máy quay trong một cảnh

"Zoom chậm đồng thời lia và xoay vòng" làm sụp đổ hình ảnh. Một cảnh = một chuyển động máy quay.

4. Đừng dán kịch bản trực tiếp vào prompt

Văn bản rườm rà làm mô hình bối rối. Hãy sử dụng định dạng có cấu trúc như prompt ở trên.

5. Đừng cố gắng sửa seed

Sửa seed không hoạt động với dòng Seedance 2.0. Sự nhất quán được tạo ra thông qua hình ảnh tham chiếu và định nghĩa nhân vật.

6. Đừng viết các hành động bạo lực

Tránh chạy nước rút hoặc nhảy. Ưu tiên các chuyển động nhỏ, chậm và liên tục.

◾️ Hội thoại tiếng Nhật sẽ có trọng âm nếu bạn không viết điều này

藤原弘人@AI起業家 - inline image

Với hội thoại tiếng Nhật, luôn chỉ định tên ngôn ngữ.

× "Xin lỗi, cuối cùng thì tôi không làm được"

○ Nói bằng tiếng Nhật {Xin lỗi, cuối cùng thì tôi không làm được}

Nếu không có điều này, nó có thể bị giọng Trung Quốc hoặc bắt đầu nói tiếng Anh. Ngoài ra, hãy sử dụng ngoặc đúng: () cho âm nhạc, <> cho hiệu ứng âm thanh, {} cho hội thoại và 【】 cho phụ đề.

◾️ Nếu bạn viết lại cho câu chuyện của riêng mình, hãy dùng thứ tự này

藤原弘人@AI起業家 - inline image

Nhân vật chính xác + Chi tiết hành động + Địa điểm/Môi trường + Ánh sáng/Tông màu + Kỹ thuật quay + Phong cách video + Chất lượng + Ràng buộc

Hãy nghĩ về nó như một bản đặc tả kỹ thuật, không phải thơ ca.

Bạn thậm chí có thể chỉ định giọng nói

Bạn có thể chỉ định cảm xúc, tông giọng và tốc độ nói trong văn bản:

Nói bằng tiếng Nhật {Hội thoại} với cảm xúc [Cảm xúc], tông giọng [Tông giọng], tốc độ nói [Tốc độ].

◾️ Cách khắc phục khi lần thử đầu tiên thất bại

藤原弘人@AI起業家 - inline image

Cách khắc phục không phải là "thêm từ" mà là "đóng mọi lối thoát."

  1. Xóa tất cả các từ mơ hồ như "nếu có thể" hoặc "càng nhiều càng tốt."
  2. Không viết hai chỉ dẫn trong một dòng.
  3. Viết "cách bạn muốn nó được nhìn nhận" ở phần kết.

◾️ Có một khuôn mẫu cho video 30 giây thành công

藤原弘人@AI起業家 - inline image
  • 0-2s: Gây chú ý (Khó chịu hoặc Bất ngờ)
  • 2-18s: Xung đột (Bị nhìn xuống)
  • 18-26s: Đảo chiều (Thể hiện bằng một vật thể như chìa khóa hoặc tài liệu)
  • 26-30s: Bất ngờ/Kết cục

◾️ Đối với phần tiếp theo, chỉ cần cung cấp video đầu tiên

Để làm một bộ series, hãy đưa video đầu tiên vào tài liệu tham chiếu và chỉ định nó là @Video1 trong prompt. Điều này duy trì khuôn mặt, quần áo và cửa hàng.

◾️ Hai thứ tôi không giao cho AI

  1. Âm thanh: Tôi không hoàn toàn dựa vào nó. Để có chất lượng cao, hãy tạo video im lặng và lồng tiếng sau.
  2. Tạo khung dọc: Câu hỏi thường gặp chính thức ghi chú rằng tạo ở tỷ lệ 9:16 có xác suất xuất hiện phụ đề không mong muốn cao hơn. Tạo ở tỷ lệ 16:9 và cắt thành khung dọc an toàn hơn cho sản xuất hàng loạt.

◾️ Sự thật trung thực về "1.400 yên mỗi video"

Đây là mức giá nếu bạn thành công ngay từ lần đầu. Trong thực tế, với các lần thử lại, chi phí khoảng 8.000 đến 10.000 yên mỗi tập. Tuy nhiên, so với mức giá 160.000 yên trên thị trường cho phim ngắn quay bằng người thật, thì đây là một đẳng cấp khác.

◾️ Bạn có thể kiếm tiền với công cụ này không?

Ở Trung Quốc, 95% phim ngắn dọc đã được tạo bằng AI. Doanh thu trên mỗi 10.000 lượt xem đã giảm 90%. Rào cản gia nhập đã hạ thấp, đồng nghĩa với việc cạnh tranh đã bùng nổ. AI không đảm bảo lợi nhuận; nó đảm bảo khả năng thử nghiệm nhiều ý tưởng với chi phí rẻ. Nhật Bản vẫn đang ở lối vào của giai đoạn này.

◾️ Tóm tắt

  • Seedance 2.5 dành cho độ dài (30 giây) và tính nhất quán, không phải độ phân giải 4K.
  • Sử dụng ngoặc cụ thể và "Nói bằng tiếng Nhật" cho hội thoại.
  • Đừng thêm từ để sửa lỗi; hãy tuyệt đối trong các điều cấm.
  • AI không làm tăng "tỷ lệ thành công", nhưng giảm đáng kể "chi phí thử nghiệm."

◾️ Nếu hôm nay bạn làm một điều

Hãy mở Dreamina và dán prompt từ bài viết này một lần. Đừng chỉ đọc và tin; hãy hành động và trải nghiệm khoảnh khắc bất ngờ đó.

Cuối cùng

Để đảm bảo bạn không chỉ "đọc xong", tôi đang tặng miễn phí 32 phần thưởng cao cấp, bao gồm các hướng dẫn về ChatGPT, Claude và các công việc phụ với AI.

藤原弘人@AI起業家 - inline image

Tham gia tại đây.

Viết lại trong YouMind

Turn one viral article into a full content workflow

Collect the source, decode the pattern, create assets, draft the story, and distribute from one AI workspace.

Explore YouMind
Dành cho nhà sáng tạo

Biến Markdown của bạn thành bài viết 𝕏 gọn gàng

Khi bạn đăng bài viết dài của riêng mình, việc định dạng hình ảnh, bảng và khối mã cho 𝕏 rất mệt mỏi. YouMind biến cả bản nháp Markdown thành một bài viết 𝕏 gọn gàng, sẵn sàng để đăng.

Thử Markdown sang 𝕏

Thêm pattern để giải mã

Bài viết viral gần đây

Khám phá thêm bài viết viral