Подсказки MiniMax H3 лучше всего работают в качестве временных шкал. Определите начальный кадр, видимое действие, путь камеры, звук и конечное состояние именно в этом порядке. Для рабочих процессов с изображениями или эталонами опишите, что контролирует каждый элемент ввода, вместо того, чтобы повторять детали, которые модель уже видит.
MiniMax H3 оперативное руководство: быстрый ответ
- Подсказка структуры: начальный кадр, действие, реакция окружающей среды, камера, звук и финальный кадр.
- Преобразование текста в видео: определите всю сцену, поскольку ее не определяет ни одно исходное изображение.
- Преобразование изображения в видео: сохраните фиксированные детали и опишите только то, что меняется после первого кадра.
- Ссылка на видео: назначьте одно четкое задание каждому изображению, видео или аудиофайлу.
- Аудио: отдельные диалоги, физический звук, атмосфера и фоновая музыка.
- Настройки C Dance AI: от 4 до 15 секунд, с выходом 768P и 2K.
Приведенные ниже примеры представляют собой написание шаблонов, а не контролируемых результатов тестов. В разделе сообщества тестовый материал указывается отдельно.
Что такое MiniMax H3?
MiniMax H3, также известная как Hailuo 3.0, — это видеомодель искусственного интеллекта, которая генерирует видео и собственный стереозвук на основе текста и визуальных ссылок. В этом руководстве официальная структура подсказок применяется к MiniMax H3 в C Dance AI.
| Свойство | Текущий объем статьи |
|---|---|
| Основные рабочие процессы | Преобразование текста в видео, изображение в видео, первый/последний кадр и ссылка на видео. |
| Длина подсказки в C Dance AI | от 1 до 7000 символов |
| Продолжительность в C Dance AI | Целые числа от 4 до 15 секунд. |
| Разрешение в C Dance AI | 768P или 2К |
| Родной звук | Диалоги, атмосфера, физический звук и фоновая музыка |
| Справочный контракт | Всего до 9 изображений, 3 видео, 3 аудиофайлов и 12 файлов. |
Какой режим MiniMax H3 следует использовать?
| Режим | Что входные данные уже определяют | Что должно определять приглашение | Распространенная ошибка |
|---|---|---|---|
| Преобразование текста в видео | Ничего визуального | Вступительная композиция, сюжет, действие, камера, звук и финал. | Начиная с движения, прежде чем создавать сцену |
| Преобразование изображения в видео | Внешний вид и композиция первого кадра | Сохранились детали и движение после первого кадра. | Переписывание образа вместо описания изменений |
| Первый/последний кадр | Начальное и конечное состояния | Физический переход между обоими кадрами | Описание двух неподвижных изображений без связующего действия. |
| Ссылка на видео | Назначенные признаки идентичности, движения, стиля или временных сигналов. | Одна роль на каждый актив и предполагаемое преобразование | Добавление ссылок, которые конфликтуют друг с другом |
Как должно быть структурировано приглашение MiniMax H3?
Полезный первый черновик по порядку отвечает на шесть вопросов:
- Что находится в первом кадре?
- Что делает предмет?
- Как реагирует окружающая среда?
- Куда движется камера?
- Что можно услышать?
- Что показывает финальный кадр?
Для одноразового видеоролика о продукте это может выглядеть так:
Живое видео о продукте студии. Холодный цитрусовый напиток может стоять вертикально на темном камне. Узкая струя воды ударяется о поверхность рядом с банкой, брызги закручиваются вокруг ее основания, а конденсат стекает по металлу. Камера делает одну медленную дугу по часовой стрелке, держа этикетку лицом к объективу. Четкий ободковый свет, сдержанные блики. Кадр заканчивается тем, что вода успокоилась и банка по центру.
В подсказке описываются причина и следствие. Вода попадает на поверхность, брызги движутся по банке, а капли оседают. «Реалистичная физика жидкости» менее полезна, поскольку она называет желаемое качество, не определяя само событие.
Откройте рабочую область C Dance AI с выбранным MiniMax H3, когда вы будете готовы протестировать приглашение.
Как меняется приглашение в режиме H3?
H3 поддерживает несколько рабочих процессов, и каждому из них требуется разная информация. Повторение одного и того же приглашения в каждом режиме приводит к потере контроля, предоставляемого входными активами.
Преобразование текста в видео: определите весь кадр
Преобразование текста в видео не имеет начального изображения, которое бы отражало тему или композицию. Опишите начальный кадр перед началом действия.
Съемка со средним углом обзора в реальном времени в тихой пекарне перед восходом солнца. Пекарь открывает деревянные ставни, кладет на прилавок теплую буханку, затем отрезает один ломтик, поднимая пар. Камера медленно приближается к хлебу, не меняя высоты. Уличная атмосфера остается слабой за скрипом ставен и хрустящей коркой, прорезающей корку. Под сценой играет мягкая акустическая гитара. Завершите просмотр нарезанного хлеба с близкого расстояния.
Сохраняйте начало конкретным: кадр, положение объекта, обстановка и свет. Подсказка, которая начинается с движения, но никогда не описывает сцену, вынуждает модель решать слишком многое сразу.
Преобразование изображения в видео: опишите, что меняется после первого кадра.
Загруженное изображение уже обеспечивает внешний вид и композицию. Не тратьте половину подсказки на повторение каждой видимой детали. Определите, что должно оставаться фиксированным, затем опишите следующее движение.
Используйте загруженное изображение в качестве первого кадра. Сохраните лицо женщины, синий кардиган, серебряное ожерелье, положение сиденья и расположение вагона. Она переводит взгляд со сложенного письма на залитое дождем окно, затем складывает бумагу по существующей складке. Камера медленно движется вправо, а ее отражение пересекает стекло. Дождь стучит в окно под низкий ритм колес поезда. Никакой фоновой музыки.
Если вы предоставляете и первый, и последний кадр, опишите физический путь между ними. Избегайте написания двух статических описаний изображений. Объясните, как поза, объекты, камера и свет переходят из начального состояния в конечное.
Отсылка к видео: дайте каждому активу одну работу
Контракт провайдера H3, встроенный в C Dance AI, поддерживает до девяти изображений, трех видео и трех аудиофайлов, всего 12 файлов. Общедоступное рабочее пространство в настоящее время обеспечивает преобразование текста в видео и изображения в видео; элементы управления с полными ссылками зависят от интерфейса, доступного при создании. Большее количество ссылок не гарантирует лучшей преемственности. Каждый файл должен разрешать определенную неопределенность.
Используйте справочные роли, такие как:
- Изображение 1 определяет лицо и волосы человека.
- Изображение 2 определяет наряд и цветовую палитру.
- Видео 1 передает движения тела и ритм камеры.
- Аудио 1 обеспечивает опорный голос или синхронизацию.
Затем напишите преобразование напрямую:
Используйте человека с изображения 1 в качестве единственного исполнителя. Сохраните пропорции лица, короткие черные волосы и красную куртку. Следуйте движению тела и времени съемки из Видео 1, но разместите действие на платформе метро, показанной на изображении 2. Сохраните траекторию движения камеры и последовательность поз исполнителя из Видео 1. Используйте Аудио 1 для определения времени; не добавляйте фоновую музыку.
Противоречивые ссылки являются частым источником отклонений. Если на двух изображениях изображены разные наряды или формы лица, H3 должен решить, какие детали оставить. Удалите более слабую ссылку, прежде чем добавлять дополнительный текст подсказки.
Что показывают тесты сообщества H3?
Официальные правила подсказок объясняют синтаксис. Тесты сообщества показывают, какие переменные заслуживают ранней проверки.
В одном общедоступном тесте было собрано 1000 поколений H3 по многим предметам и стилям. Его примерная сетка охватывает лица, типографику, толпу, физический контакт, анимацию, движение камеры и обычные сцены. Этот диапазон предоставляет больше доказательств, чем один привлекательный клип, но при этом требует проверки отдельных выходов на предмет сбоев.

Широкое разнообразие может скрыть отдельные неудачи. Для более точной оценки сохраняйте рядом с каждой попыткой введенные данные, продолжительность, режим, разрешение и одну измененную переменную.
Отдельный тест сообщества на отсылку к видео объединил отсылки к персонажам, окружающей среде и объектам в одной движущейся сцене. Два изображения определяют исполнителей, одно — горную обстановку, а другое — велосипеды. Эти роли устраняют четыре визуальные двусмысленности из общей подсказки «два персонажа аниме едут на велосипедах».
Пользователь Reddit irmemon225 создал этот образец справочного рабочего процесса. Он документирует один результат из одного набора ссылок; он не устанавливает средний уровень успеха.
Во втором тесте сообщества использовалось низкое разрешение и малое количество шагов для уточнения подсказок перед окончательным рендерингом. При черновом пропуске проверяется количество объектов, направление камеры, опорные роли и порядок кадров. Повышайте качество после того, как эти элементы станут стабильными.
Как следует писать движение камеры?
Выберите один доминирующий путь камеры для короткого снимка. H3 понимает такие движения, как вталкивание, выдвижение, панорамирование, перемещение, наклон, подставка, дуга, отслеживание, статическое кадрирование, встряхивание, точка обзора, масштабирование и вращение.
Напишите движение внутри сцены:
Камера отслеживает движение рядом с велосипедистом на уровне улицы, сохраняя то же расстояние.
Избегайте набора ярлыков, таких как:
динамическая камера, съемка с дрона, орбита, панорамирование, зум, фокусировка со стойки
Эти инструкции конкурируют за одни и те же секунды. Если кадр требует раскрытия, укажите начальный вид, движение и то, что показывает камера:
Крупный план начинается с муки, покрывающей руки пекаря. Камера медленно отодвигается назад, показывая полный рабочий стол и шесть готовых буханок, пока пекарь продолжает замешивать тесто.
Используйте монтаж только тогда, когда следующий кадр дает новую информацию. Небольшое изменение расстояния обычно лучше обрабатывается движением камеры.
Как написать многократную подсказку H3?
6-секундный клип не может нести ту же историю, что и 15-секундный. Назначьте время для каждой доли, прежде чем добавлять детали.
В этой 10-секундной рекламе продукта используются три кадра:
[Кадр 1] Рекламный ролик, крупный план бегуна, завязывающего один ботинок на мокрой дорожке перед рассветом. Камера остается низкой и неподвижной. Ткань туго натягивается, а шнурок мягко защелкивается.
[Кадр 2] На 00:03.000 — кадр бокового отслеживания, когда бегун ускоряется при первом повороте. Каждый шаг сбрасывает с трассы небольшие брызги. Дыхание и удары ног возвышаются над атмосферой далекого города.
[Кадр 3] На 00:07.000 перейдите к приземлению обуви рядом с финишной линией, затем медленно толкайтесь вперед, когда бегун останавливается. Короткий басовый импульс заканчивается последним шагом.
Сокращенное время оставляет три секунды на подготовку, четыре на основное действие и три на финиш. Если диалог добавляется, он должен укладываться в тот же бюджет.
Не добавляйте временные метки к каждому движению в одном непрерывном кадре. Используйте их, чтобы отметить отдельные фрагменты или важные временные события.
Как вы предлагаете диалог и собственный звук?
H3 генерирует видео и собственный стереозвук вместе. Подсказкой становится легче управлять, если она различает три аудиослоя:
- Диалог: точные слова, сказанные идентифицированным человеком.
- Звуковой ландшафт: атмосфера, шаги, удары, ткань, дождь, дыхание или механизмы.
- Фоновая музыка: музыка, которую слышит публика, но не люди на сцене.
Для двух говорящих сохраняйте стабильность их личности:
[Кадр 1] Живое действие, средний план в небольшом купе поезда. Женщина у окна тихо говорит (Диктор 1) по-английски: «Я выхожу на следующей станции». Кондуктор у двери тихим голосом (Диктор 2) отвечает по-английски: «Прибудем через две минуты». Их рты двигаются только во время собственных строк.
Звуковой ландшафт: устойчивый шум колес, легкий дождь по стеклу и один тихий удар по билету.
Фоновая музыка: редкие фортепианные ноты в медленном темпе, исчезающие до ответа дирижера.
Делайте устный текст кратким. Прочитайте вслух с таймером. Если на произнесение предложения уходит пять секунд, оно не может естественным образом разместиться рядом с другой строкой и несколькими действиями в 6-секундном видео.
Что касается закадрового голоса, скажите, что он находится за кадром и что губы субъекта на экране остаются закрытыми. Это снижает вероятность того, что H3 назначит повествование видимому персонажу.
Какие примеры подсказок MiniMax H3 вы можете адаптировать?
Эти подсказки охватывают различные производственные проблемы. Замените тему и детали бренда, но сохраните логику действия.
Демонстрация вертикального создателя
Вертикальное живое видео с телефона в светлой квартире. Женщина смотрит на объектив, держа в правой руке компактный ручной пылесос. Она указывает на насадку указательным пальцем левой руки, наклоняется к дивану и удаляет одну полоску крошек за один проход. Камера легко перемещается вручную, но ее руки и продукт остаются в кадре. Естественный свет из окна. Мотор запускается, когда насадка достигает дивана, затем останавливается в конце. Никаких нарезок и фоновой музыки.
Модная анимация из первого кадра
Используйте загруженный портрет в качестве первого кадра. Сохраните лицо модели, заплетенные волосы, зеленое пальто и положение улицы позади нее. Она поворачивает плечи к дороге, делает два размеренных шага и оглядывается через левое плечо. Камера движется назад со скоростью ходьбы и сохраняет композицию всего тела. Ветер сдвигает подол пальто в том же направлении, что и ее ход. В конце ее лицо видно в профиль в три четверти.
Физическая сцена действия
Съемка в полный рост на пустом складе. Каскадер бежит к невысокому деревянному барьеру, ставит на него обе ноги, преодолевает его, приземляется с согнутыми коленями, перекатывается через правое плечо и переходит на бег. Пыль поднимается при ударе и оседает позади него. Стабилизированная ручная камера следует за ним с трех метров назад, не обгоняя его. Жёсткий боковой свет через высокие окна. Один непрерывный кадр с шагами, движением одежды, ударом приземления и без музыки.
Замена персонажа по ссылке
Используйте Видео 1 в качестве источника информации о времени съемки, ракурсах камеры, движениях тела и фоновых действиях. Замените только исполнителя в видео 1 на человека, определенного на изображении 1. Сохраните лицо, волосы, одежду и пропорции тела из изображения 1 на протяжении всего клипа. Оставьте всех остальных людей, предметы, движения камеры и звуки окружающей среды из Видео 1 без изменений. Не копируйте фон с изображения 1.
Последний пример нуждается в эталонном режиме. Обычная подсказка преобразования изображения в видео не требует сохранения синхронизации и движения исходного видео.
Почему MiniMax H3 игнорирует подсказки?
При сбое вывода измените наименьшую инструкцию, объясняющую сбой.
| Отказ | Вероятная оперативная проблема | Первая редакция |
|---|---|---|
| Случайные разрезы | Конкурируют несколько движений камеры или смены сцен. | Запросите один непрерывный снимок и один путь камеры |
| Не тот человек говорит | Выступающие не идентифицируются последовательно | Присвойте каждому выступающему стабильный ярлык и сократите обмен мнениями. |
| Диалог становится торопливым | Линия слишком длинная для данного времени | Произнесите фразу вслух или увеличьте длину клипа. |
| Изделие меняет форму | Действие, камера и стиль перегружают кадр. | Зафиксируйте ориентацию продукта и удалите вторичное движение |
| Отклонение эталонной идентичности | Ссылки конфликтуют или имеют неясную роль | Сохраняйте максимально четкий образ личности и обозначьте каждую оставшуюся роль. |
| Первый и последний кадры не соединяются | Физический переход отсутствует | Опишите промежуточную позу, объект и изменения камеры. |
| Звук кажется несвязанным | Аудио выражается только как настроение | Назовите источник, время и изменение громкости. |
Не переписывайте подсказку целиком после каждого сбоя. Если камера ошиблась, но тема осталась неизменной, сохраните язык темы и измените предложение камеры. Это делает каждую повторную попытку информативной.
Какую продолжительность и разрешение выбрать?
Текущая интеграция C Dance AI принимает целые числа длительностью от 4 до 15 секунд. Он предлагает вывод 768P и 2K, а по умолчанию используется 6-секундная генерация 2K.
Текущий базовый расчет кредита:
| Параметр | Кредиты |
|---|---|
| 768P | 50 за выходную секунду |
| 2К | 80 на выходную секунду |
| Каждое эталонное изображение после первых пяти | 25 дополнительных кредитов |
Таким образом, 6-секундная генерация текста в видео начинается с 300 кредитов в формате 768P или 480 кредитов в 2K. В соответствии с эталонным контрактом продолжительность эталонного видео и дополнительные эталонные изображения могут увеличить общую сумму. В рабочей области отображаются расчеты перед отправкой.
Составьте проект в кратчайшие сроки, чтобы сохранить действие и диалог. Используйте 768P для ранних тестов композиции, когда окончательная детализация еще не является вопросом. Перейдите к разрешению 2K после того, как время подсказки и поведение камеры станут стабильными.
Что следует проверить перед созданием?
Прочтите подсказку один раз и подтвердите:
- Начальная рамка ясна.
- В клипе одно основное действие.
- Описаны причина и видимое следствие.
- Инструкции к камере не противоречат.
- Сокращения соответствуют выбранной продолжительности.
- Каждый оратор и ссылка сохраняют одну идентичность.
- Диалог можно вести во времени.
- Атмосфера и музыка имеют разные задачи.
- Конечное состояние видимо и достижимо.
Затем вернитесь на главную C Dance AI или откройте Workspace с уже выбранной MiniMax H3. Сохраняйте промпт и настройки каждой попытки, ясно фиксируйте ошибку и меняйте только одну переменную перед повтором.
MiniMax H3 подскажите FAQ
Что должно включать в себя приглашение MiniMax H3?
Начните с объекта и видимого действия, затем определите обстановку, путь камеры, порядок кадров, диалоги, физический звук и фоновую музыку, необходимые для клипа. Следите за тем, чтобы каждая инструкция соответствовала выбранной продолжительности.
Как долго видео MiniMax H3 может находиться в C Dance AI?
Текущая интеграция C Dance AI принимает целые числа продолжительностью от 4 до 15 секунд и обеспечивает вывод 768P и 2K.
Генерирует ли MiniMax H3 звук?
Да. MiniMax H3 может генерировать собственный стереозвук вместе с видео. Подсказки могут управлять диалогом, атмосферой, физическими звуковыми эффектами и фоновой музыкой.
Может ли MiniMax H3 использовать ссылки на изображения, видео и аудио?
Контракт поставщика H3 поддерживает ссылки на изображения, видео и аудио. C Dance AI в настоящее время предоставляет общедоступную рабочую среду для преобразования текста в видео и изображения в видео; элементы управления с полными ссылками зависят от интерфейса, доступного при создании.
Как мне вызвать диалог в MiniMax H3?
Последовательно определите каждого говорящего, напишите точную фразу, укажите язык и оставьте достаточно времени для этой строки. Отделите диалоги от атмосферы и фоновой музыки, чтобы их роли оставались ясными.
Почему MiniMax H3 игнорирует части приглашения?
Подсказка может содержать слишком много действий, противоречивые движения камеры, неясные роли или больше диалогов, чем может поместиться в клипе. Удалите второстепенные инструкции и тестируйте одно изменение за раз.

