Prompt MiniMax H3 hoạt động tốt nhất dưới dạng dòng thời gian. Xác định khung mở đầu, hành động hiển thị, đường dẫn camera, âm thanh và trạng thái kết thúc theo thứ tự đó. Đối với quy trình làm việc bằng hình ảnh hoặc tham chiếu, hãy mô tả những gì mỗi đầu vào điều khiển thay vì lặp lại các chi tiết mà mô hình có thể thấy.
Hướng dẫn viết prompt MiniMax H3: trả lời nhanh
- Cấu trúc prompt: khung hình mở đầu, hành động, phản ứng của môi trường, camera, âm thanh và khung hình cuối cùng.
- Chuyển văn bản thành video: xác định toàn bộ cảnh vì không có hình ảnh nguồn nào thiết lập nó.
- Chuyển hình ảnh thành video: giữ nguyên các chi tiết cố định và chỉ mô tả những gì thay đổi sau khung hình một.
- Video theo tham chiếu: chỉ định một công việc rõ ràng cho từng tệp hình ảnh, video hoặc âm thanh.
- Âm thanh: lời thoại riêng biệt, âm thanh vật lý, không khí và nhạc nền.
- Cài đặt C Dance AI: 4 đến 15 giây, với đầu ra 768P và 2K.
Các ví dụ dưới đây là các mẫu viết chứ không phải là kết quả điểm chuẩn được kiểm soát. Phần cộng đồng xác định tài liệu thử nghiệm của nó một cách riêng biệt.
MiniMax H3 là gì?
MiniMax H3, còn được gọi là Hailuo 3.0, là một mô hình video AI tạo ra video và âm thanh nổi gốc từ các tham chiếu văn bản và hình ảnh. Hướng dẫn này áp dụng cấu trúc lời nhắc chính thức cho MiniMax H3 trong C Dance AI.
| Thuộc tính | Phạm vi bài viết hiện tại |
|---|---|
| Quy trình công việc chính | Chuyển văn bản thành video, hình ảnh thành video, khung hình đầu tiên/cuối cùng và video theo tham chiếu |
| Độ dài lời nhắc trong C Dance AI | 1 đến 7.000 ký tự |
| Thời lượng trong C Dance AI | Các số nguyên từ 4 đến 15 giây |
| Độ phân giải trong C Dance AI | 768P hoặc 2K |
| Âm thanh stereo tích hợp | Đối thoại, không khí, âm thanh vật lý và nhạc nền |
| Giới hạn nội dung tham chiếu | Tổng cộng tối đa 9 hình ảnh, 3 video, 3 tệp âm thanh và 12 tệp |
Bạn nên sử dụng chế độ MiniMax H3 nào?
| Cách thức | Những gì đầu vào đã xác định | Lời nhắc phải xác định điều gì | Lỗi thường gặp |
|---|---|---|---|
| Chuyển văn bản thành video | Không có hình ảnh đầu vào | Bố cục mở đầu, chủ thể, hành động, máy quay, âm thanh và phần kết | Bắt đầu bằng chuyển động trước khi thiết lập cảnh |
| Chuyển hình ảnh thành video | Hình thức và bố cục khung hình đầu tiên | Các chi tiết và chuyển động được bảo toàn sau khung hình một | Viết lại hình ảnh thay vì mô tả sự thay đổi |
| Khung hình đầu tiên/cuối cùng | Trạng thái mở đầu và kết thúc | Sự chuyển đổi vật lý giữa cả hai khung | Mô tả hai hình ảnh tĩnh không có hành động kết nối |
| Video theo tham chiếu | Tín hiệu nhận dạng, chuyển động, phong cách hoặc thời gian được chỉ định | Vai trò của từng nội dung và thay đổi mong muốn | Thêm các tài liệu tham khảo xung đột với nhau |
Prompt MiniMax H3 nên được cấu trúc như thế nào?
Bản thảo đầu tiên hữu ích trả lời sáu câu hỏi theo thứ tự:
- Trong khung mở đầu có gì?
- Chủ thể làm gì?
- Môi trường phản ứng thế nào?
- Máy ảnh di chuyển đi đâu?
- Những gì có thể được nghe thấy?
- Khung hình cuối cùng hiển thị điều gì?
Đối với một clip sản phẩm quay một lần, điều đó có thể trở thành:
Video sản phẩm studio live-action. Đồ uống có múi lạnh có thể đứng thẳng trên đá sẫm màu. Một dòng nước hẹp đập vào bề mặt bên cạnh lon, và tia nước cuộn tròn quanh đáy lon trong khi hơi nước ngưng tụ di chuyển xuống kim loại. Máy ảnh tạo một vòng cung chậm theo chiều kim đồng hồ, giữ nhãn hướng về phía ống kính. Ánh sáng viền sắc nét, hạn chế phản xạ. Cảnh quay kết thúc với việc nước lắng xuống và chiếc lon được căn giữa.
Lời nhắc mô tả nguyên nhân và kết quả. Nước chạm vào bề mặt, tia nước di chuyển xung quanh lon và các giọt nước lắng xuống. "Vật lý chất lỏng thực tế" ít hữu ích hơn vì nó đặt tên cho chất lượng mong muốn mà không xác định sự kiện.
Mở không gian làm việc C Dance AI với MiniMax H3 đã chọn khi bạn sẵn sàng kiểm tra lời nhắc.
Lời nhắc thay đổi như thế nào theo chế độ H3?
H3 hỗ trợ một số quy trình công việc và mỗi quy trình cần thông tin khác nhau. Việc lặp lại cùng một lời nhắc trên mọi chế độ sẽ lãng phí khả năng kiểm soát do nội dung đầu vào cung cấp.
Chuyển văn bản thành video: xác định toàn bộ cảnh quay
Chuyển văn bản thành video không có hình ảnh mở đầu để xác định chủ đề hoặc bố cục. Mô tả khung hình ban đầu trước khi hành động bắt đầu.
Cảnh quay người thật, góc trung bình bên trong một tiệm bánh yên tĩnh trước khi mặt trời mọc. Người thợ làm bánh mở cửa chớp bằng gỗ, đặt một ổ bánh mì ấm lên quầy, sau đó cắt một lát khi hơi nước bốc lên. Máy ảnh từ từ đẩy về phía chiếc bánh mì mà không thay đổi độ cao. Không khí đường phố vẫn mờ nhạt đằng sau tiếng rít của cửa chớp và vết cắt sắc nét qua lớp vỏ. Tiếng guitar acoustic nhẹ nhàng vang lên dưới khung cảnh. Kết thúc với cái nhìn cận cảnh về ổ bánh mì được cắt lát.
Hãy mô tả rõ phần mở đầu: khung hình, vị trí chủ thể, bối cảnh và ánh sáng. Một prompt bắt đầu bằng chuyển động nhưng không thiết lập cảnh sẽ buộc mô hình phải quyết định quá nhiều thứ cùng lúc.
Chuyển hình ảnh thành video: mô tả những gì thay đổi sau khung hình một
Hình ảnh được tải lên đã cung cấp hình thức và bố cục. Đừng dành nửa lời nhắc để lặp lại từng chi tiết có thể nhìn thấy được. Xác định những gì phải cố định, sau đó mô tả chuyển động tiếp theo.
Sử dụng hình ảnh đã tải lên làm khung mở chính xác. Giữ nguyên khuôn mặt của người phụ nữ, chiếc áo len màu xanh, chiếc vòng cổ bằng bạc, vị trí ghế ngồi và cách bố trí toa tàu. Cô đưa ánh mắt từ lá thư được gấp lại về phía cửa sổ phủ mưa, rồi gấp tờ giấy dọc theo nếp gấp hiện có của nó. Máy ảnh di chuyển chậm sang bên phải trong khi hình ảnh phản chiếu của cô ấy đi qua kính. Mưa gõ nhẹ vào cửa sổ phía trên nhịp bánh xe lửa trầm thấp. Không có nhạc nền.
Nếu bạn cung cấp cả khung hình đầu tiên và khung hình cuối cùng, hãy mô tả đường dẫn vật lý giữa chúng. Tránh viết hai mô tả hình ảnh tĩnh. Giải thích cách tư thế, đồ vật, máy ảnh và ánh sáng chuyển từ trạng thái mở đầu sang trạng thái kết thúc.
Video theo tham chiếu: cung cấp cho mỗi nội dung một công việc
Quy cách tích hợp H3 của C Dance AI hỗ trợ tối đa chín hình ảnh, ba video và ba tệp âm thanh, với tổng số không quá 12 tệp. Không gian làm việc công khai hiện cung cấp văn bản thành video và hình ảnh thành video; đầy đủ tùy chọn tham chiếu phụ thuộc vào giao diện có sẵn khi bạn tạo. Nhiều tài liệu tham khảo hơn không đảm bảo tính liên tục tốt hơn. Mỗi tệp nên giải quyết một điểm chưa chắc chắn cụ thể.
Sử dụng các vai trò tham chiếu như:
- Hình 1 xác định khuôn mặt và mái tóc của người đó.
- Hình 2 xác định trang phục và bảng màu.
- Video 1 cung cấp chuyển động của cơ thể và nhịp máy quay.
- Âm thanh 1 cung cấp tham chiếu giọng nói hoặc thời gian.
Sau đó viết trực tiếp phép biến đổi:
Sử dụng người ở Hình 1 làm người biểu diễn duy nhất. Giữ nguyên tỷ lệ khuôn mặt, mái tóc đen ngắn và chiếc áo khoác đỏ. Thực hiện theo chuyển động cơ thể và thời gian quay từ Video 1, nhưng đặt hành động ở sân ga tàu điện ngầm như trong Hình 2. Giữ nguyên đường đi của máy ảnh và trình tự tư thế của người biểu diễn từ Video 1. Sử dụng Âm thanh 1 để tính thời gian; không thêm nhạc nền.
Các tài liệu tham khảo xung đột là nguyên nhân phổ biến của sự trôi dạt. Nếu hai hình ảnh hiển thị trang phục hoặc hình dạng khuôn mặt khác nhau, H3 phải quyết định nên giữ lại chi tiết nào. Xóa tham chiếu yếu hơn trước khi thêm văn bản nhắc nhở khác.
Các xét nghiệm H3 cộng đồng cho thấy điều gì?
Quy tắc nhắc nhở chính thức giải thích cú pháp. Các thử nghiệm cộng đồng cho thấy những biến nào xứng đáng được kiểm tra sớm.
Một điểm chuẩn công khai đã tập hợp 1.000 thế hệ H3 ở nhiều chủ đề và phong cách. Lưới mẫu của nó bao gồm các khuôn mặt, kiểu chữ, đám đông, tiếp xúc vật lý, hoạt ảnh, chuyển động của máy ảnh và các cảnh thông thường. Phạm vi đó cung cấp nhiều bằng chứng hơn một clip hấp dẫn, trong khi vẫn yêu cầu các đầu ra riêng lẻ phải được kiểm tra lỗi.

Sự đa dạng rộng rãi có thể che giấu những thất bại riêng lẻ. Để đánh giá tập trung, hãy giữ nguyên đầu vào, thời lượng, chế độ, độ phân giải và một biến đã thay đổi bên cạnh mỗi lần thử.
Một thử nghiệm tham chiếu cộng đồng riêng biệt đến video kết hợp các tham chiếu nhân vật, môi trường và đối tượng trong một cảnh chuyển động. Hai hình ảnh xác định người biểu diễn, một hình ảnh xác định khung cảnh núi non và một hình ảnh xác định những chiếc xe đạp. Những vai trò đó loại bỏ bốn sự mơ hồ về mặt hình ảnh khỏi lời nhắc chung về "hai nhân vật anime đi xe đạp".
Người dùng Reddit irmemon225 đã tạo mẫu quy trình làm việc tham chiếu này. Nó ghi lại một đầu ra từ một bộ tham chiếu; nó không thiết lập tỷ lệ thành công trung bình.
Thử nghiệm cộng đồng thứ hai sử dụng độ phân giải thấp và số bước thấp để tinh chỉnh lời nhắc trước khi kết xuất cuối cùng. Thẻ nháp kiểm tra số lượng đối tượng, hướng camera, vai trò tham chiếu và thứ tự quay. Tăng chất lượng sau khi các yếu tố đó ổn định.
Chuyển động của camera nên được viết như thế nào?
Chọn một đường dẫn camera chính cho một cảnh quay ngắn. H3 hiểu các chuyển động như đẩy vào, kéo ra, xoay, nghiêng, nghiêng, bệ, vòng cung, theo dõi, tạo khung tĩnh, lắc, quan điểm, thu phóng và cuộn.
Viết chuyển động bên trong cảnh:
Camera theo dõi người đi xe đạp ở ngang mặt đường trong khi vẫn giữ nguyên khoảng cách.
Tránh xếp chồng các nhãn như:
máy ảnh động, chụp bằng máy bay không người lái, quỹ đạo, xoay roi, thu phóng, lấy nét
Những hướng dẫn đó cạnh tranh trong cùng một giây. Nếu cảnh quay cần được tiết lộ, hãy nêu rõ góc nhìn bắt đầu, chuyển động và những gì máy ảnh tiết lộ:
Một cảnh quay cận cảnh bắt đầu với bột phủ trên tay người làm bánh. Máy quay từ từ lùi lại, để lộ toàn bộ bàn làm việc và sáu ổ bánh mì đã hoàn thiện trong khi người thợ làm bánh tiếp tục nhào bột.
Chỉ sử dụng đoạn cắt khi cảnh quay tiếp theo đóng góp thông tin mới. Một sự thay đổi nhỏ về khoảng cách thường được xử lý tốt hơn bằng chuyển động của máy ảnh.
Làm thế nào để bạn viết một lời nhắc H3 nhiều lần?
Một clip dài 6 giây không thể mang cùng một câu chuyện như một clip dài 15 giây. Chỉ định thời gian cho từng nhịp trước khi thêm chi tiết.
Quảng cáo sản phẩm dài 10 giây này sử dụng ba cảnh quay:
[Cảnh 1] Quảng cáo người thật đóng, cận cảnh một vận động viên đang buộc một chiếc giày trên đường ướt trước bình minh. Máy ảnh ở mức thấp và tĩnh. Vải kéo chặt và ren bật ra nhẹ nhàng.
[Cảnh 2] Lúc 00:03.000, chuyển sang cảnh quay theo dõi bên hông khi người chạy tăng tốc qua khúc cua đầu tiên. Mỗi bước chân ném một bình xịt nhỏ từ đường đua. Tác động của hơi thở và bàn chân vượt lên trên bầu không khí của thành phố xa xôi.
[Cú đánh 3] Lúc 00:07.000, cắt tới chỗ để giày bên cạnh vạch đích, sau đó đẩy từ từ vào khi người chạy dừng lại. Một xung trầm ngắn kết thúc ở bước chân cuối cùng.
Thời gian cắt dành lại ba giây để thiết lập, bốn giây cho hành động chính và ba giây cho phần kết thúc. Nếu có thêm đối thoại thì nó phải phù hợp với cùng một ngân sách.
Không thêm dấu thời gian cho mọi chuyển động trong một lần chụp liên tục. Sử dụng chúng để đánh dấu các vết cắt khác biệt hoặc các sự kiện tính thời gian cần thiết.
Làm thế nào để bạn nhắc nhở hội thoại và âm thanh stereo tích hợp?
H3 tạo ra video và âm thanh nổi gốc cùng nhau. Lời nhắc trở nên dễ kiểm soát hơn khi phân biệt được ba lớp âm thanh:
- Đối thoại: những lời chính xác được nói bởi một người được xác định.
- Âm thanh: môi trường xung quanh, tiếng bước chân, tác động, vải, mưa, hơi thở hoặc máy móc.
- Nhạc nền: nhạc được khán giả nghe nhưng người trong cảnh không nghe được.
Đối với hai người phát biểu, hãy giữ danh tính của họ ổn định:
[Cảnh 1] Người thật đóng, cảnh trung bình trong một toa tàu nhỏ. Người phụ nữ bên cửa sổ nhẹ nhàng nói (Người nói 1) nói bằng tiếng Anh: "Tôi xuống ở ga tiếp theo." Người soát vé ở cửa với giọng trầm (Người nói 2), trả lời bằng tiếng Anh: "Chúng tôi sẽ đến nơi sau hai phút nữa." Miệng của họ chỉ di chuyển trong dòng riêng của họ.
Cảnh quan âm thanh: Tiếng ồn bánh xe đều đặn, mưa nhẹ đập vào kính và một cú đấm vé nhẹ.
Nhạc nền: Những nốt piano thưa thớt ở nhịp độ chậm, mờ dần trước khi người nhạc trưởng trả lời.
Giữ bản sao nói ngắn gọn. Đọc to nó với một bộ đếm thời gian. Nếu một câu chỉ mất 5 giây để nói thì câu đó không thể khớp một cách tự nhiên bên cạnh một dòng khác và một số hành động trong một video dài 6 giây.
Đối với phần lồng tiếng, hãy nói rằng nó ở ngoài màn hình và môi của đối tượng trên màn hình vẫn đóng. Điều này làm giảm khả năng H3 gán lời tường thuật cho nhân vật hiển thị.
Bạn có thể điều chỉnh những ví dụ nhắc nhở MiniMax H3 nào?
Những lời nhắc này bao gồm các vấn đề sản xuất khác nhau. Thay thế chủ đề và chi tiết thương hiệu nhưng vẫn giữ nguyên logic hành động.
Bản trình diễn của người sáng tạo theo chiều dọc
Video hành động trực tiếp theo chiều dọc trên điện thoại trong một căn hộ sáng sủa. Một người phụ nữ hướng về phía ống kính trong khi cầm một chiếc máy hút bụi cầm tay nhỏ gọn trong tay phải. Cô ấy chỉ vào vòi bằng ngón trỏ trái, cúi người về phía ghế sofa và loại bỏ một dòng vụn bánh trong một lần. Máy ảnh có chuyển động cầm tay nhẹ nhàng nhưng vẫn giữ được tay và sản phẩm trong khung hình. Ánh sáng cửa sổ tự nhiên. Động cơ khởi động khi vòi phun chạm tới ghế sofa, sau đó dừng ở cuối. Không có đoạn cắt và không có nhạc nền.
Hoạt hình thời trang khung hình đầu tiên
Sử dụng bức chân dung đã tải lên làm khung hình đầu tiên chính xác. Giữ nguyên khuôn mặt, mái tóc tết, áo khoác màu xanh lá cây và vị trí của con phố phía sau cô ấy. Cô quay vai về phía con đường, bước hai bước đều đặn và nhìn lại qua vai trái. Máy ảnh theo dõi lùi ở tốc độ đi bộ và giữ nguyên bố cục toàn thân. Gió dịch chuyển vạt áo theo cùng hướng với lượt của cô. Kết thúc với khuôn mặt của cô ấy được nhìn thấy ở góc nhìn nghiêng 3/4.
Một cảnh hành động vật lý
Cảnh quay toàn thân người thật đóng trong một nhà kho trống. Người biểu diễn đóng thế chạy về phía một hàng rào gỗ thấp, đặt cả hai chân, vượt qua nó, tiếp đất bằng đầu gối cong, lăn qua vai phải và bắt đầu chạy. Bụi bay lên khi va chạm và lắng xuống phía sau anh ta. Một chiếc máy ảnh cầm tay ổn định theo sau từ phía sau ba mét mà không vượt qua anh ta. Ánh sáng bên cứng xuyên qua cửa sổ cao. Một cảnh quay liên tục có tiếng bước chân, chuyển động của quần áo, tác động tiếp đất và không có âm nhạc.
Thay thế ký tự dẫn tham chiếu
Sử dụng Video 1 làm nguồn cho thời gian quay, góc máy, chuyển động cơ thể và hành động nền. Chỉ thay thế người biểu diễn trong Video 1 bằng người được xác định bởi Hình ảnh 1. Giữ nguyên khuôn mặt, mái tóc, quần áo và tỷ lệ cơ thể từ Hình ảnh 1 trong suốt clip. Giữ nguyên mọi người, vật thể, chuyển động của camera và âm thanh môi trường trong Video 1. Không sao chép nền từ Hình 1.
Ví dụ cuối cùng cần chế độ Tham chiếu. Lời nhắc chuyển hình ảnh sang video thông thường không có thời gian và chuyển động của video nguồn để lưu giữ.
Tại sao MiniMax H3 bỏ qua hướng dẫn nhắc nhở?
Khi một đầu ra bị lỗi, hãy thay đổi lệnh nhỏ nhất giải thích lỗi đó.
| Sự thất bại | Có thể có vấn đề nhắc nhở | Bản sửa đổi đầu tiên |
|---|---|---|
| Cắt ngẫu nhiên | Một số chuyển động của máy ảnh hoặc thay đổi cảnh cạnh tranh | Yêu cầu một lần chụp liên tục và một đường dẫn camera |
| Nói sai người | Người nói không được xác định một cách nhất quán | Gán cho mỗi người một nhãn ổn định và rút ngắn thời gian trao đổi |
| Cuộc đối thoại trở nên vội vã | Dòng này quá dài trong suốt thời gian | Đặt thời gian cho dòng hoặc tăng thời lượng clip |
| Sản phẩm thay đổi hình dạng | Hành động, máy ảnh và kiểu dáng làm quá tải cảnh quay | Khóa hướng sản phẩm và loại bỏ chuyển động phụ |
| Sự trôi dạt danh tính tham chiếu | Tài liệu tham khảo xung đột hoặc có vai trò không rõ ràng | Giữ hình ảnh nhận diện rõ ràng nhất và nêu rõ từng vai trò còn lại |
| Khung hình đầu tiên và cuối cùng không kết nối | Quá trình chuyển đổi vật lý bị thiếu | Mô tả các thay đổi về tư thế, đối tượng và máy ảnh trung gian |
| Âm thanh có vẻ không liên quan | Âm thanh chỉ được thể hiện dưới dạng tâm trạng | Đặt tên cho nguồn, thời gian và thay đổi về âm lượng |
Không viết lại toàn bộ lời nhắc sau mỗi lần thất bại. Nếu máy quay sai nhưng chủ thể vẫn nhất quán, hãy giữ nguyên ngôn ngữ của chủ thể và sửa lại câu camera. Điều này làm cho mỗi lần thử lại đều có nhiều thông tin.
Bạn nên chọn thời lượng và độ phân giải nào?
Tích hợp C Dance AI hiện tại chấp nhận thời lượng số nguyên từ 4 đến 15 giây. Nó cung cấp đầu ra 768P và 2K và mặc định là thế hệ 2K 6 giây.
Tính toán tín chỉ cơ sở hiện tại:
| Cài đặt | Tín dụng |
|---|---|
| 768P | 50 mỗi giây đầu ra |
| 2K | 80 mỗi giây đầu ra |
| Mỗi hình ảnh tham chiếu sau năm hình ảnh đầu tiên | 25 tín chỉ bổ sung |
Do đó, quá trình tạo văn bản thành video dài 6 giây bắt đầu ở mức 300 tín chỉ ở 768P hoặc 480 tín chỉ ở 2K. Theo hợp đồng tham chiếu, thời lượng video tham chiếu và hình ảnh tham chiếu bổ sung có thể tăng tổng thời lượng. Không gian làm việc hiển thị tính toán trước khi gửi.
Bản nháp trong thời gian ngắn nhất có thể duy trì hành động và đối thoại. Sử dụng 768P cho các bài kiểm tra bố cục ban đầu khi chưa có câu hỏi chi tiết cuối cùng. Chuyển sang 2K sau khi thời gian của lời nhắc và hoạt động của camera ổn định.
Bạn nên kiểm tra những gì trước khi tạo?
Đọc lời nhắc một lần và xác nhận:
- Khung mở đầu rõ ràng.
- Clip có một hành động chính.
- Nguyên nhân và kết quả nhìn thấy được đều được mô tả.
- Hướng dẫn của máy ảnh không xung đột.
- Các vết cắt vừa vặn trong khoảng thời gian đã chọn.
- Mỗi người nói và người tham khảo giữ một danh tính.
- Đối thoại có thể được nói trong thời gian.
- Không khí và âm nhạc có công việc riêng biệt.
- Trạng thái kết thúc có thể nhìn thấy được và có thể đạt được.
Sau đó, quay lại trang chủ C Dance AI hoặc mở Workspace đã chọn sẵn MiniMax H3. Lưu prompt và cài đặt cho mỗi lần thử, ghi rõ lỗi và chỉ điều chỉnh một biến trước khi thử lại.
Câu hỏi thường gặp về prompt MiniMax H3
Prompt MiniMax H3 nên bao gồm những gì?
Bắt đầu với chủ đề và hành động hiển thị, sau đó xác định cài đặt, đường dẫn camera, thứ tự quay, lời thoại, âm thanh vật lý và nhạc nền mà clip cần. Giữ mỗi hướng dẫn tương thích với thời lượng đã chọn.
Video MiniMax H3 trong C Dance AI có thể dài tối đa bao nhiêu?
Tích hợp C Dance AI hiện tại chấp nhận thời lượng số nguyên từ 4 đến 15 giây và cung cấp đầu ra 768P và 2K.
MiniMax H3 có tạo ra âm thanh không?
Có. MiniMax H3 có thể tạo âm thanh stereo đồng bộ với video. Prompt có thể chỉ định riêng lời thoại, không khí, hiệu ứng âm thanh vật lý và nhạc nền.
MiniMax H3 có thể sử dụng tài liệu tham khảo hình ảnh, video và âm thanh không?
Quy cách tích hợp H3 hỗ trợ tham chiếu hình ảnh, video và âm thanh. Không gian làm việc công khai của C Dance AI hiện cung cấp văn bản thành video và hình ảnh thành video; đầy đủ tùy chọn tham chiếu phụ thuộc vào giao diện có sẵn khi bạn tạo.
Tôi nên nhắc cuộc đối thoại trong MiniMax H3 như thế nào?
Xác định từng người nói một cách nhất quán, viết chính xác câu thoại, chỉ định ngôn ngữ và dành đủ thời gian cho câu thoại. Tách biệt đoạn hội thoại khỏi không khí và nhạc nền để vai trò của chúng vẫn rõ ràng.
Tại sao MiniMax H3 bỏ qua các phần của lời nhắc?
Lời nhắc có thể chứa quá nhiều hành động, chuyển động camera xung đột, vai trò tham chiếu không rõ ràng hoặc nhiều đoạn hội thoại hơn mức clip có thể chứa. Xóa các hướng dẫn phụ và kiểm tra từng thay đổi một.

