3SELLER Journal 3SELLER →

Как научиться делать мультфильмы с помощью ИИ: 5 шагов от сценария до монтажа за 2 вечера

07.10.2026

Помню, как год назад потратил три недели на покадровую анимацию в After Effects. Три недели на ролик длиной в одну минуту. Сегодня такой же по качеству мультфильм можно собрать за два вечера, используя нейросети. Если хотите научиться делать мультфильмы с помощью ИИ, вот процесс, который я сам гоняю больше года. Он работает и для коротких роликов в соцсети, и для полноценных серий.

Причины моего перехода на нейросети простые. Во-первых, скорость. То, что раньше занимало недели, теперь занимает часы. Во-вторых, цена. Студийная анимация стоит десятки тысяч рублей за минуту, а нейросети обходятся в несколько сотен. В-третьих, доступность. Вам не нужно уметь рисовать, чтобы создать персонажа, и не нужно знать After Effects, чтобы его оживить. Достаточно уметь грамотно описать задачу.

Сначала сценарий. Без него нейросеть бесполезна

Большинство новичков начинают с картинок и быстро разочаровываются. Причина банальная: нет истории. Нейросеть сгенерирует красивые кадры, но они не будут складываться в сюжет. Поэтому первым делом придумайте, о чём ваш мультфильм. Идея, герой, конфликт, развязка. Хватит нескольких предложений, остальное достроит нейросеть.

Я беру Chat GPT и прошу придумать историю. Промт выглядит примерно так: «Придумай короткий мультфильм на 60 секунд про робота, который чинит музыкальную шкатулку. Разбей на 6 сцен. Для каждой сцены укажи действие, реплику, ракурс камеры и свет». На выходе получается структура, с которой можно работать дальше.

Если просто попросить «напиши мультик», будет каша. Нейросети нужен контекст: хронометраж, количество сцен, жанр, настроение. Чем больше параметров вы зададите, тем лучше результат. Когда сценарий готов, прочитайте его вслух. Слабые места слышно сразу. Если где-то провисает динамика, попросите нейросеть переписать эту сцену.

Если застряли на идее, попросите нейросеть сгенерировать десять вариантов. Потом выберите один и попросите развить его. Такой метод хорошо работает, потому что нейросеть предлагает неожиданные сочетания, которые человек вряд ли придумал бы сам. У меня так появился сюжет про кота-космонавта, который спасает сломанный спутник при помощи музыкальной шкатулки.

Как устроен процесс генерации мультфильма

Весь процесс можно разбить на пять шагов. Сначала вы описываете идею и выбираете стиль. Дальше нейросеть создаёт персонажей и фоны. Затем оживляет кадры, добавляет голос и музыку. В конце вы монтируете финальный ролик. На каждом этапе можно вмешиваться и вносить правки.

Вот как это выглядит на практике. Допустим, вы описали историю про кота-космонавта. Нейросеть обработает описание и предложит стиль: 2D, 3D, пиксель-арт или что-то в духе старых диснеевских мультфильмов. Вы выбираете подходящий, настраиваете детали: цветовая палитра, характер персонажа, тон повествования. Потом жмёте кнопку генерации, и нейросеть собирает мультфильм: персонажи двигаются, играет музыка, сцены сменяют друг друга. Остаётся просмотреть, поправить и экспортировать.

Такой путь предлагают сервисы вроде Renderforest. Он хорош для быстрых задач, когда нужен аккуратный ролик без глубокой проработки персонажей. Но если вы хотите полный контроль над каждым кадром, придётся собирать пайплайн из отдельных инструментов. О нём и поговорим.

Генерация персонажей и кадров: Midjourney, Nano Banana и консистентность

Самый частый вопрос, который мне задают: как сделать, чтобы персонаж не менялся от кадра к кадру. Это главная боль при создании мультфильмов с помощью ИИ. Персонаж в первом кадре выглядит одним, а в пятом уже совсем другим. Лицо другое, куртка другого цвета, рост перепутан. На Reddit аниматоры, работающие с ИИ, называют это проблемой консистентности и сходятся в одном: без референсов персонаж будет плыть.

Проблема решается референсами. Я генерирую героя десять раз в одном стиле, выбираю удачный вариант и сохраняю его как эталон. Дальше каждый новый кадр создаю с привязкой к этому эталону. В Midjourney это работает через ссылку на изображение, в Nano Banana тоже. На выходе получается гораздо более стабильный персонаж.

Nano Banana вообще удобная штука для мультфильмов. Она хорошо держит стиль и умеет выдавать цельные иллюстрации с персонажами, которые потом легко оживлять. Она доступна через 3GPT, и я расскажу об этом позже.

Промт для кадра должен быть конкретным. Вместо «лес» пишите «густой еловый лес ранним утром, туман стелется по земле, тёплый свет пробивается сквозь кроны, лёгкая дымка, стиль Гибли». Чем больше деталей, тем ближе результат к замыслу. Мой шаблон: локация, время суток, погода, ракурс, настроение, стиль, художник-референс.

И не забывайте про соотношение сторон. Для YouTube берёте 16:9, для Reels и TikTok 9:16. Лучше сразу выставить параметры в генераторе, чем потом обрезать готовые кадры и терять композицию.

Лучше всего у нейросетей получаются 2D-анимация и пиксель-арт. С 3D сложнее: модели часто ошибаются с анатомией и светом. Если вы новичок, выбирайте 2D или стиль, близкий к старым мультфильмам. Такой подход прощает больше ошибок и выглядит целостно.

Оживляем кадры: от Kling AI до Veo 3

Когда кадры готовы, начинается самое интересное. Статичная картинка превращается в движение. Для этого я использую Kling AI или Veo 3. Загружаете кадр, пишете, что должно произойти: «персонаж поворачивает голову», «камера отъезжает назад», «листья падают на ветру». Нейросеть добавляет движение и создаёт короткий видеофрагмент.

С первого раза, как правило, получается не очень. Персонаж может дёргаться, фон может плыть, рука может неестественно выгнуться. Это нормально. Генерируете снова, меняете формулировку, пробуете другой ракурс. Обычно из пяти-шести попыток удачных выходит одна-две.

Длительность таких клипов обычно небольшая, несколько секунд. Для монтажа этого достаточно: вы склеиваете короткие куски в единую сцену. Если движение не зацикливается, не страшно. На монтаже всегда можно поставить переход.

Совет: не заставляйте нейросеть делать сложное движение в одном куске. Лучше разбейте действие на простые шаги: сначала поворот головы, потом взмах руки, потом улыбка. Каждый шаг генерируйте отдельно. Так проще контролировать результат и не переделывать всё с нуля.

Есть и второй путь: полностью автоматические мультмейкеры. Вы описываете сюжет, выбираете стиль, и ИИ сам собирает всё: персонажей, движение, музыку, переходы. Такой подход экономит время, но даёт меньше контроля. Лично я комбинирую оба подхода в зависимости от задачи.

Озвучка и звук: голос, музыка, шумы

Мультфильм без звука ощущается как наполовину готовый. Даже самый простой ролик преображается, когда появляется голос персонажа и фоновая музыка.

Для озвучки я использую ElevenLabs. Текст реплик беру из сценария, выбираю голос, регулирую скорость и интонации. У сервиса много хороших голосов, включая детские и эмоциональные. Для мультфильмов это находка.

Если в мультфильме несколько персонажей, сделайте каждому отдельный голос. Главное, следите, чтобы голоса отличались по тембру и скорости. Иначе зритель запутается, кто говорит.

Музыку можно сгенерировать отдельно. Некоторые нейросети умеют создавать фоновые треки под настроение: спокойные, тревожные, весёлые. Для короткого ролика достаточно одной мелодии, которая не перебивает голос.

Важный совет: не встраивайте звук в видеофрагменты, склеивайте его на монтажном столе. Сгенерируйте видео с дорожкой, потом отделите аудио и работайте с ним отдельно. Так проще менять тайминги, выравнивать громкость и синхронизировать реплики с движением губ.

Монтаж: где склеить и что перегенерировать

Финальная сборка происходит в любом видеоредакторе, хоть в CapCut, хоть в DaVinci Resolve. Собираете готовые фрагменты, подрезаете лишнее, добавляете переходы и титры.

Если какой-то кусок не смотрится, не пытайтесь спасти его монтажными хитростями. Лучше вернитесь в генерацию и перегенерируйте его с другим промтом. Это займёт меньше времени и даст более качественный результат.

Очень удобно, когда в инструменте анимации есть умное выделение. Выбираете объект, например персонажа, и перемещаете его отдельно от фона. Так можно поправить композицию без полной перегенерации кадра.

И держите свои файлы в порядке. Картинки в одну папку, звуки в другую, готовые видео в третью. Банально, но именно хаос в файлах убивает больше проектов, чем плохие нейросети.

При экспорте выбирайте разрешение 1080p и частоту кадров 24 или 30. Этого достаточно для любого видеохостинга. Не гонитесь за 4K, нейросети пока не дают стабильно хорошего 4K-изображения, а время рендера вырастет в разы.

Промты, которые я использую каждый день

Вот мой базовый промт для персонажа: «Молодой кот в скафандре, мультяшный стиль, большие глаза, тёплая цветовая гамма, сидит в кабине космического корабля, иллюминатор справа, мягкий свет». Такая конструкция даёт нейросети достаточный контекст, но оставляет свободу для творчества.

Для фона: «Внутренности космического корабля, металлические панели, кнопки разных цветов, небольшой иллюминатор, за окном видна планета, стиль аниме, детализировано». Фон должен быть менее детальным, чем персонаж, чтобы не отвлекать внимание.

Для движения: «Кот медленно поворачивает голову и улыбается, камера держит крупный план, плавное движение, естественная анимация». Короткое описание действия плюс желаемый стиль движения, больше ничего не нужно.

Сохраняйте удачные промты в отдельный файл. Через неделю у вас будет своя библиотека приёмов, которая ускоряет работу в два раза.

Сколько времени и денег стоит мультфильм на ИИ

Минутный ролик с простым сюжетом обходится мне примерно в 300-500 рублей на генерацию, если считать все пробные версии. Если работать только на бесплатных тарифах, время растянется, но деньги не понадобятся вовсе.

Время сильно зависит от сложности. Простой мультик на 30 секунд можно собрать за пару часов, если уже есть опыт. Первый мультфильм займёт вечер. Третий будет готов уже за час, потому что все инструменты уже под рукой.

Главный совет: не пытайтесь сделать сразу шедевр. Соберите простой сюжет, пройдите все этапы, посмотрите на ошибки. Второй ролик будет значительно лучше первого, а пятый уже можно смело показывать людям.

Ошибки, которые замедляют ваш прогресс

Первая ошибка: пытаться объять необъятное. Человек хочет сразу сделать сложный мультфильм с десятком персонажей и графиком на месяц. В итоге бросает на второй день. Начните с микроформата: один герой, одна локация, простая задача героя.

Вторая ошибка: не читать инструкции к нейросетям. У каждой модели есть свои особенности. Где-то работает один формат промтов, где-то другой. Потратьте десять минут на чтение документации, сэкономите дни.

Третья ошибка: бояться перегенерировать. Если результат не понравился, просто жмите кнопку снова. Нейросеть стоит копейки, а ваше время дорого. Не пытайтесь доработать кривой кадр в фотошопе, лучше сделать нормальный сразу.

Четвёртая ошибка: пропускать этап звука. Некоторые думают, что звук можно добавить потом. На деле плохой звук убивает даже хорошую картинку.

Как 3GPT может мне помочь

Я живу в России и хорошо знаю, как выглядит доступ к иностранным нейросетям: бан, отказ от российских карт, проблемы с оплатой. Решение нашёл через сервис 3GPT от 3SELLER. Это ИИ-роутер, который даёт доступ к флагманским моделям без иностранных карт и VPN-танцев.

Внутри доступны Chat GPT 6 Astra, Claude Fable 5 и 5.1, Claude Opus 5.5, Chat GPT 5.5, Chat GPT 6.1 Sol, Nano Banana для изображений и генерация видео. Для мультфильмов особенно важен Nano Banana. Он отлично держит стиль персонажа, а это главная боль при создании анимации.

Цена за доступ: 149 рублей. Пополнить баланс можно российской картой, через СБП или криптовалютой. Никаких зарубежных платёжек.

Кстати, сервис пригодится не только для мультфильмов. Когда я не рисую, я переключаюсь на рабочие задачи: создаю продающие тексты, сайты. Это удобно, когда всё нужное собрано в одном окне.

3GPT интерфейс генерации текстов и изображений

Создавайте и обрабатывайте максимально реалистичные изображения. Создавайте видеоролики и генерируйте голос. Всё это доступно в 3GPT.

Готовые ИИ-агенты для тех, кто не хочет строить пайплайн вручную

Кроме моделей, у 3GPT есть фишка: готовые ИИ-агенты под конкретные задачи. Переходите на страницу https://3seller.com/ai/agents, выбираете агента и начинаете общение. Модель агента можно менять прямо в чате. Это удобно, когда не хочется каждый раз прописывать контекст с нуля.

Выбор ИИ-агента в 3GPT

Получить доступ ко всем флагманским моделям нейросетей из России можно на официальном сайте 3GPT.

Практический шаг: соберите первый 30-секундный ролик

Весь пайплайн выглядит так: сценарий в Chat GPT, кадры в Nano Banana или Midjourney, оживление в Veo 3 или Kling AI, озвучка в ElevenLabs, монтаж в любом редакторе. На первый раз достаточно 30 секунд готового видео.

Сделайте простой сюжет: робот хочет выпить кофе, но кофемашина сломалась. Три-четыре сцены, один голос, одна музыкальная дорожка. Не гонитесь за сложностью. Ваша задача: пройти все этапы и понять, где вы теряете время, какие инструменты вам подходят, а какие раздражают.

Через неделю соберёте второй ролик. Он будет заметно лучше первого. Через месяц вы уже не будете думать о том, как научиться делать мультфильмы с помощью ИИ, потому что вы будете делать их на автомате.

← Вернуться к блогу

Читать дальше