Підказки MiniMax H3 найкраще працюють як часові шкали. Визначте початковий кадр, видиму дію, шлях камери, звук і кінцевий стан у такому порядку. Для зображень або довідкових робочих процесів опишіть, чим керує кожен вхід, замість повторення деталей, які вже бачить модель.
MiniMax H3 підказка: швидка відповідь
- Структура підказки: початковий кадр, дія, реакція середовища, камера, аудіо та фінальний кадр.
- Перетворення тексту на відео: визначте всю сцену, оскільки жодне вихідне зображення не встановлює її.
- Зображення у відео: зберігайте фіксовані деталі та описуйте лише те, що змінюється після першого кадру.
- Посилання на відео: призначте одне чітке завдання кожному зображенню, відео чи аудіофайлу.
- Аудіо: окремі діалоги, фізичний звук, атмосфера та фонова музика.
- Налаштування C Dance AI: від 4 до 15 секунд, вихід 768P і 2K.
Наведені нижче приклади є шаблонами написання, а не результатами контрольованих тестів. Розділ спільноти визначає свій тестовий матеріал окремо.
Що таке MiniMax H3?
MiniMax H3, також відома як Hailuo 3.0, — це відеомодель штучного інтелекту, яка генерує відео та рідний стереоаудіо з тексту та візуальних посилань. Цей посібник застосовує офіційну структуру підказок до MiniMax H3 у C Dance AI.
| Власність | Поточний обсяг статті |
|---|---|
| Основні робочі процеси | Перетворення тексту на відео, зображення на відео, перший/останній кадр і посилання на відео |
| Довжина запиту в C Dance AI | Від 1 до 7000 символів |
| Тривалість у C Dance AI | Цілі числа від 4 до 15 секунд |
| Роздільна здатність у C Dance AI | 768P або 2K |
| Рідне аудіо | Діалоги, атмосфера, фізичний звук і фонова музика |
| Довідковий договір | Всього до 9 зображень, 3 відео, 3 аудіофайлів і 12 файлів |
Який режим MiniMax H3 слід використовувати?
| Режим | Що вже визначено введенням | Що має визначати підказка | Поширена помилка |
|---|---|---|---|
| Перетворення тексту на відео | Нічого візуального | Початкова композиція, тема, дія, камера, звук і кінцівка | Починаючи з руху перед створенням сцени |
| Зображення у відео | Зовнішній вигляд і композиція першого кадру | Збереглися деталі та рух після першого кадру | Переписування зображення замість опису змін |
| Перший/останній кадр | Початковий і кінцевий стани | Фізичний перехід між обома кадрами | Опис двох нерухомих зображень без сполучної дії |
| Посилання на відео | Призначена ідентичність, рух, стиль або моменти | Одна роль на актив і запланована трансформація | Додавання посилань, які суперечать одне одному |
Як має бути структуровано підказку MiniMax H3?
Корисна перша чернетка відповідає на шість запитань:
- Що у початковій рамці?
- Що робить предмет?
- Як реагує оточення?
- Куди рухається камера?
- Що можна почути?
- Що показує останній кадр?
Для однознімкового кліпу продукту це може бути:
Відео студійного продукту в прямому ефірі. Холодна банка цитрусового напою стоїть вертикально на темному камені. Вузький струмінь води вдаряє по поверхні біля банки, і бризки згортаються навколо її основи, а конденсат рухається вниз по металу. Камера робить одну повільну дугу за годинниковою стрілкою, тримаючи етикетку спрямованою до об’єктива. Чітке світло, стримані відблиски. Постріл закінчується відстоюванням води та центруванням банки.
Підказка описує причину та наслідок. Вода потрапляє на поверхню, бризки рухаються навколо банки, а краплі осідають. «Реалістична фізика рідини» менш корисна, оскільки вона називає бажану якість без визначення події.
Відкрийте робоче середовище C Dance AI із вибраним MiniMax H3, коли будете готові перевірити підказку.
Як змінюється підказка в режимі H3?
H3 підтримує кілька робочих процесів, і для кожного з них потрібна різна інформація. Повторення однієї підказки в кожному режимі втрачає контроль, наданий вхідними ресурсами.
Перетворення тексту на відео: визначте весь знімок
Перетворення тексту на відео не має початкового зображення для визначення теми чи композиції. Опишіть початковий кадр перед початком дії.
Живий кадр середнього масштабу в тихій пекарні перед сходом сонця. Пекар відкриває дерев’яні віконниці, кладе теплий буханець на прилавок, а потім відрізає одну скибку, коли піднімається пара. Камера повільно штовхається до хліба, не змінюючи висоти. Вулична атмосфера залишається слабкою за скрипом віконниць і різким прорізом кірки. Під сценою грає тиха акустична гітара. Закінчується на нарізаному батоні.
Зберігайте бетонне відкриття: обрамлення, положення об’єкта, обстановку та світло. Підказка, яка починається з руху, але ніколи не встановлює сцену, змушує модель вирішувати занадто багато відразу.
Зображення у відео: опишіть, що змінюється після першого кадру
Завантажене зображення вже забезпечує вигляд і композицію. Не витрачайте половину підказки на повторення кожної видимої деталі. Визначте, що має залишатися фіксованим, а потім опишіть наступний рух.
Використовуйте завантажене зображення як початкову рамку. Зберегти жіноче обличчя, блакитний кардиган, срібне намисто, положення сидіння та макет вагона. Вона піднімає погляд від складеного листа в бік залитого дощем вікна, а потім складає папір уздовж наявної складки. Камера повільно рухається вправо, поки її відображення перетинає скло. Дощ стукає у вікно над тихим ритмом коліс поїзда. Без фонової музики.
Якщо ви надаєте як перший, так і останній кадр, опишіть фізичний шлях між ними. Уникайте написання двох описів статичних зображень. Поясніть, як поза, об’єкти, камера та світло переміщуються від початкового стану до кінцевого.
Посилання на відео: дайте кожному активу одне завдання
Договір провайдера H3, підключений до C Dance AI, підтримує до дев’яти зображень, трьох відео та трьох аудіофайлів, загалом 12 файлів. Загальнодоступний робочий простір наразі підтримує перетворення тексту у відео та зображення у відео; Елементи керування з повним посиланням залежать від інтерфейсу, доступного під час створення. Більше посилань не гарантує кращої безперервності. Кожен файл має вирішити певну невизначеність.
Використовуйте довідкові ролі, такі як:
- Зображення 1 визначає обличчя та волосся людини.
- Зображення 2 визначає наряд і колірну палітру.
- Відео 1 забезпечує рух тіла та ритм камери.
- Аудіо 1 надає голос або опорний час.
Потім запишіть перетворення безпосередньо:
Використовуйте людину із зображення 1 як єдиного виконавця. Зберегти пропорції обличчя, коротке чорне волосся та червону куртку. Слідкуйте за рухом тіла та хронометражем зйомки з відео 1, але розмістіть дію на платформі метро, показаній на зображенні 2. Зберігайте шлях камери та послідовність пози виконавця з відео 1. Використовуйте аудіо 1 для хронометражу; не додавайте фонову музику.
Конфліктні посилання є поширеним джерелом дрейфу. Якщо два зображення демонструють різні вбрання або форми обличчя, H3 повинен вирішити, які деталі зберегти. Вилучіть слабше посилання, перш ніж додавати текст підказки.
Що показують тести спільноти H3?
Офіційні правила підказок пояснюють синтаксис. Тести спільноти показують, які змінні заслуговують на ранню перевірку.
Один загальнодоступний тест зібрав 1000 поколінь H3 за багатьма темами та стилями. Його зразкова сітка охоплює обличчя, типографіку, натовп, фізичний контакт, анімацію, рух камери та звичайні сцени. Цей діапазон надає більше доказів, ніж один привабливий кліп, але все ще вимагає перевірки окремих вихідних сигналів на наявність збоїв.

Широка різноманітність може приховати окремі невдачі. Для цілеспрямованої оцінки зберігайте введення, тривалість, режим, роздільну здатність і одну змінну змінну біля кожної спроби.
Окремий тест посилання на відео спільноти поєднав посилання на персонажів, середовище та об’єкти в одній рухомій сцені. Два зображення визначають виконавців, одне визначає гірську обстановку, а одне визначає велосипеди. Ці ролі усувають чотири візуальні неоднозначності із загального підказки для «двох персонажів аніме, які їдуть на велосипедах».
Користувач Reddit irmemon225 створив цей приклад довідкового робочого процесу. Він документує один вихід з одного еталонного набору; він не встановлює середній рівень успіху.
Другий тест спільноти використовував низьку роздільну здатність і низьку кількість кроків для уточнення підказок перед остаточним відтворенням. У чернетці перевіряється кількість об’єктів, напрямок камери, контрольні ролі та порядок знімків. Підвищуйте якість після того, як ці елементи стануть стабільними.
Як слід писати рух камери?
Виберіть один домінуючий шлях камери для короткого кадру. H3 розуміє такі рухи, як штовхання, витягування, панорамування, вантажівка, нахил, п’єдестал, дуга, стеження, статичне кадрування, струшування, точка зору, масштабування та крен.
Напишіть рух всередині сцени:
Камера стежить за велосипедистом на рівні вулиці, зберігаючи ту саму відстань.
Уникайте купи етикеток, таких як:
динамічна камера, зйомка з дрона, орбіта, панорамування, масштабування, стійковий фокус
Ці інструкції змагаються за ті самі секунди. Якщо знімок потребує розкриття, вкажіть початковий ракурс, рух і те, що показує камера:
Близький кадр починається на борошні, що покриває руки пекаря. Камера повільно від’їжджає назад, показуючи повний робочий стіл і шість готових хлібів, а пекар продовжує місити.
Використовуйте скорочення лише тоді, коли наступний знімок додає нову інформацію. Незначна зміна відстані зазвичай краще сприймається рухом камери.
Як написати підказку H3 для кількох знімків?
6-секундний кліп не може нести ту саму історію, що 15-секундний кліп. Призначте час для кожного такту перед додаванням деталей.
Ця 10-секундна реклама продукту використовує три кадри:
[Кадр 1] Рекламний ролик у прямому ефірі, вид зблизька бігуна, який зав’язує одне взуття на мокрій доріжці перед світанком. Камера залишається низькою та нерухомою. Тканина натягується, а мереживо м’яко защеплюється.
[Кадр 2] На 00:03.000 перейдіть до кадру бічного стеження, коли бігун прискорюється в першому повороті. Кожен крок викидає невеликі бризки з доріжки. Дихання і удари ніг підносяться над далеким міським оточенням.
[Кадр 3] О 00:07.000 зрізайте до майданчика для черевиків біля фінішної лінії, а потім повільно натискайте, коли бігун зупиняється. Короткий басовий імпульс закінчується останнім кроком.
Час скорочення залишає три секунди для підготовки, чотири для основної дії та три для фінішу. Якщо додається діалог, він має вписуватися в той самий бюджет.
Не додавайте мітки часу до кожного руху в одному безперервному знімку. Використовуйте їх для позначення чітких фрагментів або важливих запланованих подій.
Як підказати діалог і рідне аудіо?
H3 генерує відео та рідний стереозвук разом. Підказкою стає легше керувати, коли вона розрізняє три аудіорівні:
- Діалог: точні слова, сказані визначеною особою.
- Звуковий ландшафт: атмосфера, кроки, удари, тканина, дощ, дихання чи механізми.
- Фонова музика: музика, яку чують глядачі, але не люди на сцені.
Для двох мовців зберігайте їхню ідентичність стабільною:
[Кадр 1] Живий, середній кадр у маленькому купе поїзда. Жінка біля вікна тихенько (Speaker 1) каже англійською: «I get off at the next station». Кондуктор біля дверей тихим голосом (Speaker 2) відповідає англійською: «Ми прибудемо через дві хвилини». Їхні роти рухаються лише під час власних реплік.
Звукове середовище: постійний шум колеса, легкий дощ на склі та один м’який удар квитка.
Фонова музика: рідкі ноти фортепіано в повільному темпі, що завмирають перед відповіддю диригента.
Зберігайте коротку голосову копію. Прочитайте вголос із таймером. Якщо промовлення речення займає п’ять секунд, воно не може природним чином поміститися поруч із іншим рядком і кількома діями у 6-секундному відео.
Для озвучування скажіть, що це поза кадром і що губи об’єкта на екрані залишаються закритими. Це зменшує ймовірність того, що H3 призначить оповідання видимому персонажу.
Які підказкові приклади MiniMax H3 ви можете адаптувати?
Ці підказки охоплюють різні виробничі проблеми. Замініть предмет і деталі бренду, але збережіть логіку дії.
Демонстрація вертикального творця
Вертикальна телевізійна відеокамера в світлій квартирі. Жінка дивиться в об’єктив, тримаючи в правій руці компактний портативний пилосос. Вона вказує на насадку вказівним пальцем лівої руки, нахиляється до дивана та видаляє одну лінію крихт за один прохід. Камера легко рухається рукою, але її руки та виріб утримуються в кадрі. Природне віконне світло. Мотор запускається, коли насадка досягає дивана, а потім зупиняється в кінці. Без нарізок і фонової музики.
Перший кадр модної анімації
Використовуйте завантажений портрет як точний перший кадр. Збережіть обличчя моделі, заплетене волосся, зелене пальто та позицію вулиці за нею. Вона повертається плечима до дороги, робить два розмірених кроки й озирається через ліве плече. Камера рухається назад зі швидкістю ходьби та зберігає композицію всього тіла. Вітер рухає поділ пальто в тому ж напрямку, що й її поворот. У кінці її обличчя видно в профіль на три чверті.
Сцена фізичного дії
Жива зйомка всього тіла на порожньому складі. Виконавець каскадерів біжить до низького дерев’яного бар’єру, заводить обидві ноги, очищає його, приземляється із зігнутими колінами, перекидається через праве плече та починає бігти. При ударі пил піднімається і осідає за ним. Стабілізована ручна камера слідує за ним із трьох метрів, не обганяючи його. Жорстке бокове світло через високі вікна. Один безперервний кадр із кроками, рухом одягу, ударом приземлення та без музики.
Заміна символів на основі посилання
Використовуйте відео 1 як джерело часу зйомки, ракурсів камери, рухів тіла та фонових дій. Замініть лише виконавця у Відео 1 особою, визначеною Зображенням 1. Збережіть обличчя, волосся, одяг і пропорції тіла із Зображення 1 у всьому кліпі. Зберігайте будь-яку іншу людину, об’єкт, рух камери та звуки навколишнього середовища з відео 1 без змін. Не копіюйте фон із зображення 1.
Для останнього прикладу потрібен довідковий режим. Звичайний запит із зображення на відео не має часу та руху вихідного відео, які потрібно зберегти.
Чому MiniMax H3 ігнорує підказки?
Якщо результат не вдається, змініть найменшу інструкцію, яка пояснює несправність.
| провал | Ймовірна швидка проблема | Перша редакція |
|---|---|---|
| Випадкові скорочення | Конкурують кілька рухів камери або зміни сцени | Запит на один безперервний знімок і один шлях камери |
| Неправильна людина говорить | Виступаючі не ідентифікуються послідовно | Призначте кожному мовцю стабільну мітку та скоротіть обмін |
| Діалог стає поспішним | Черга задовга для тривалості | Визначте час репліки вголос або збільште тривалість кліпу |
| Виріб змінює форму | Екшн, камера та стиль перевантажують знімок | Зафіксуйте орієнтацію продукту та видаліть вторинний рух |
| Еталонні дрейфи ідентичності | Посилання суперечать або мають незрозумілі ролі | Зберігайте найчіткіший образ особистості та вказуйте кожну роль, що залишилася |
| Перший і останній кадри не з’єднуються | Фізичний перехід відсутній | Опишіть проміжну позу, об’єкт і зміни камери |
| Здається, що звук не пов’язаний | Аудіо виражається лише як настрій | Назвіть джерело, час і зміну гучності |
Не переписуйте всю підказку після кожної помилки. Якщо камера помилилася, але об’єкт залишився незмінним, збережіть мову об’єкта та перегляньте речення про камеру. Це робить кожну повторну спробу інформативною.
Яку тривалість і роздільну здатність вибрати?
Поточна інтеграція C Dance AI приймає цілі числа тривалості від 4 до 15 секунд. Він пропонує вихід 768P і 2K, а за замовчуванням генерується 2K за 6 секунд.
Розрахунок поточного базового кредиту:
| Налаштування | Кредити |
|---|---|
| 768P | 50 за секунду виведення |
| 2K | 80 на вихідну секунду |
| Кожне контрольне зображення після перших п'яти | 25 додаткових кредитів |
Таким чином, 6-секундне створення тексту у відео починається з 300 кредитів у 768P або 480 кредитів у 2K. Згідно з умовним контрактом, тривалість еталонного відео та додаткові еталонні зображення можуть збільшити загальну суму. Робоча область показує розрахунок перед поданням.
Чернетка за найкоротший час, який може утримувати дію та діалог. Використовуйте 768P для ранніх тестів композиції, коли остаточні деталі ще не є питанням. Перейдіть до 2K після того, як час підказки та поведінка камери стануть стабільними.
Що потрібно перевірити перед створенням?
Прочитайте підказку один раз і підтвердьте:
- Початкова рамка чітка.
- Кліп має одну основну дію.
- Описано як причину, так і видимий наслідок.
- Інструкції камери не суперечать.
- Частини вміщуються в межах вибраної тривалості.
- Кожен спікер і посилання зберігає одну ідентичність.
- Діалог можна говорити вчасно.
- Атмосфера та музика мають різні завдання.
- Кінцевий стан видимий і досяжний.
Потім поверніться на головну C Dance AI або відкрийте Workspace з уже вибраною MiniMax H3. Зберігайте промпт і налаштування кожної спроби, чітко записуйте помилку та змінюйте лише одну змінну перед повтором.
MiniMax H3 підказка FAQ
Що має містити підказка MiniMax H3?
Почніть з об’єкта та видимої дії, а потім визначте параметри, шлях камери, порядок знімків, діалоги, фізичний звук і фонову музику, які потрібні для кліпу. Тримайте кожну інструкцію сумісною з вибраною тривалістю.
Скільки може бути відео MiniMax H3 у C Dance AI?
Поточна інтеграція C Dance AI приймає цілі числа тривалості від 4 до 15 секунд і пропонує вихід 768P і 2K.
MiniMax H3 генерує звук?
так MiniMax H3 може генерувати рідний стереоаудіо з відео. Підказки можуть керувати діалогами, атмосферою, фізичними звуковими ефектами та фоновою музикою.
Чи може MiniMax H3 використовувати посилання на зображення, відео та аудіо?
Договір провайдера H3 підтримує посилання на зображення, відео та аудіо. C Dance AI наразі демонструє перетворення тексту у відео та зображення у відео у загальнодоступному робочому просторі; Елементи керування з повним посиланням залежать від інтерфейсу, доступного під час створення.
Як мені викликати діалог у MiniMax H3?
Послідовно визначте кожного мовця, напишіть точну репліку, вкажіть мову та залиште достатньо часу для репліки. Відокремте діалог від атмосфери та фонової музики, щоб їхні ролі залишалися зрозумілими.
Чому MiniMax H3 ігнорує частини підказки?
Підказка може містити забагато дій, суперечливих рухів камери, незрозумілих опорних ролей або більше діалогів, ніж може вмістити кліп. Видаліть вторинні інструкції та перевірте одну зміну за раз.

