Powered by Smartsupp
Навигация по сайту
Каталог магазина
Маркетплейс цифровых товаров

Как создать AI-модель девушки с постоянной внешностью

Как создать AI-модель в 2026 году: от сбора датасета до генерации видео в ComfyUI

Как создать AI-модель девушки с постоянной внешностью

В нише виртуальных инфлюенсеров и AI-моделей ключевой фактор — узнаваемость. Чтобы вести профили в соцсетях и продавать подписки на Fanvue, девушка должна сохранять одно и то же лицо и пропорции тела на всех снимках и в коротких видео.

Если задавать внешность только через текстовые промпты, нейросеть на каждом кадре будет выдавать нового человека. Чтобы зафиксировать черты лица и комплекцию, нужно собрать базу фотографий и обучить отдельную модель — LoRA.

В этой статье мы подробно разобрали создание AI-модели в 2026 году: от подготовки исходников и тренировки LoRA до запуска генераций в ComfyUI через серверы RunPod.

Что такое LoRA и зачем она нужна

Базовые нейросети (например, Flux.1 или SDXL) генерируют реалистичные картинки людей, но на каждый запрос создают случайное лицо. Даже если подробно прописать цвет волос, форму носа или рост, получить одного и того же человека на двух разных снимках не выйдет.

Эту проблему решает LoRA — дополнительный файл с весами, который обучают на 35–40 фотографиях конкретного человека и подключают к базовой нейросети. В процессе обучения LoRA запоминает черты лица, разрез глаз, форму скул и пропорции фигуры.

На выходе получается готовый файл с расширением .safetensors (весом от 50 МБ до 1,5 ГБ).

Логика работы с LoRA выглядит так:

  1. Загружаем файл .safetensors в программу для генерации (например, в ComfyUI или онлайн-сервис вроде Civitai).

  2. В текстовый запрос добавляем триггер-ворд (trigger word). Это уникальное кодовое слово (например, model_girl или kate_woman), которое задается при обучении. Оно указывает нейросети, что нужно взять внешность из загруженного файла LoRA.

  3. В остальной части промпта прописываем только позу, одежду и окружение (например: model_girl in a red dress walking down a street in Tokyo). Нейросеть берет лицо из файла LoRA и генерирует сцену с нужной внешностью.

Подготовка датасета: пошаговая сборка базы

Качество LoRA напрямую зависит от картинок, которые вы берете для обучения. Если взять размытые фото или снимки девушек с разным телосложением, нейросеть будет постоянно менять черты лица и выдавать артефакты.

Для стабильного результата нужно подготовить 35-40 четких изображений одной модели. Сгенерировать столько одинаковых кадров несуществующей девушки через обычные промпты не получится. Поэтому базу собирают из двух составляющих: референса лица и донора фигуры.

Шаг 1. Поиск исходников

  • Лицо: на Pinterest находим одну качественную фотографию девушки с четкими чертами и нормальным дневным светом. Это лицо будет внешностью модели.

Как создать AI-модель девушки с постоянной внешностью-1

  • Тело: в Instagram находим профиль реального блогера с 30-40 фотографиями. Главное условие — на всех снимках должны быть одинаковые пропорции тела и одна комплекция.

Шаг 2. Перенос лица на фигуру Чтобы получить 35-40 кадров будущей модели в разных позах и локациях, лицо с Pinterest переносим на снимки из Instagram:

  1. Открываем сервис для замены лиц (например, Wavespeed с моделью Dream V4 Edit).

  2. Загружаем фотографию лица в первый слот и снимок с фигурой во второй слот.

  3. В поле промпта на английском языке прописываем команду взять лицо с первого кадра и перенести его на тело, позу и одежду со второго снимка.

«photo of the woman from image 1 with the exact body, pose and outfit from image 2, natural skin texture, realistic lighting, 8k, high quality, raw photo».

Как создать AI-модель девушки с постоянной внешностью-2

  1. Повторяем это действие для всех 30–40 фотографий донора и скачиваем готовые изображения.

Шаг 3. Отбор кадров В папку для обучения отбираем от 35 до 40 снимков:

  • 20-25 портретов: лицо крупным и средним планом с разных ракурсов (анфас, полуоборот, профиль), с разным светом и эмоциями.

  • 15-20 кадров в полный рост: фигура в обычной одежде, а также в купальниках или белье, чтобы нейросеть поняла пропорции и форму тела.

Не добавляйте в базовый набор кадры с полной обнаженкой . Снимки без одежды на этапе обучения размывают черты лица и делают кожу пластиковой. Базовую LoRA всегда обучают на портретах и купальниках, а адалт-сцены создают отдельно на этапе постобработки.

Шаг 4. Подготовка текстовых описаний. Нейросеть должна понимать, где на фото находится сама модель, а где фон, одежда и свет. Если не дать текстовое описание, нейросеть посчитает задний план или цвет платья частью внешности девушки и начнет добавлять их на каждый новый кадр.

Чтобы разделить внешность и окружение:

  1. К каждому изображению создаем отдельный текстовый файл с точно таким же названием: к 1.jpeg делаем 1.txt, к 2.jpeg — 2.txt.

  2. Внутри файла кратко описываем позу, одежду, угол камеры и локацию.

Как создать AI-модель девушки с постоянной внешностью-3

Пример содержимого файла 1.txt: 

«a young woman sitting at a wooden table in a cafe, wearing a white oversized shirt, holding a coffee cup, daylight from the window, cinematic lighting, realistic photo».

При этом нельзя описывать постоянные черты лица, цвет волос или глаз. Если вписать в файл,например, blonde hair, blue eyes, нейросеть зафиксирует светлые волосы как постоянную внешность модели. В дальнейшем перекрасить волосы или изменить макияж через промпт уже не выйдет.

Шаг 5. Упаковка архива Все пары файлов складываем в одну папку и упаковываем в архив .zip. Этот архив загружаем в трейнер для запуска обучения.

Что такое базовые модели

LoRA не работает сама по себе. Это файл дополнения, который обучают под конкретную базовую модель (движок нейросети).

Базовая модель это основной генератор, который умеет с нуля рисовать людей, одежду, свет и локации. LoRA только задает этому генератору форму лица и пропорции тела.

В 2026 году для создания моделей используют три основных движка:

  • Flux.1. Движок для реалистичных фотографий. Он лучше других моделей передает текстуру кожи, поры, мелкие волоски и правильно понимает длинные описания на английском языке.

  • SDXL (Stable Diffusion XL). Более легкая модель. Картинки получаются чуть менее детализированными, но под этот движок создано больше всего готовых дополнений и инструментов для постобработки.

  • Z-Image. Модель для создания четких студийных портретов с высокой резкостью каждого кадра.

Если обучить LoRA под движок Z-Image или Flux, запустить этот же файл на SDXL не получится. Нейросеть выдаст ошибку либо нарисует случайного человека.

Пошаговое обучение LoRA

Для тренировки модели под Z-Image используют облачную платформу WaveSpeed AI. Внутри сервиса есть готовый инструмент для обучения без необходимости настраивать код или сервера вручную.

Шаг 1. Переход в раздел обучения

  1. Открываем сайт WaveSpeed AI и проходим регистрацию.

  2. В верхнем меню переходим в каталог моделей (Explore / Models) или открываем раздел инструментов тренировки (Training Tools).

  3. Через строку поиска находим модель Z-Image LoRA Trainer (или вбиваем z-trainer) и открываем ее страницу.

Как создать AI-модель девушки с постоянной внешностью-4

Шаг 2. Загрузка базы и настройка параметров На странице трейнера заполняем поля для старта процесса:

  1. Загрузка архива: перетаскиваем ранее собранный архив .zip с фотографиями и текстовыми файлами в окно загрузки датасета.

  2. Trigger Word: указываем кодовое слово на английском языке (например, world или kate_face). Это метка, по которой нейросеть будет активировать лицо персонажа при дальнейших генерациях.

  3. Шаги (Steps): в поле шагов выставляем значение 3000. Такого количества итераций достаточно, чтобы модель точно запомнила черты лица и пропорции тела без появления артефактов и пятен на коже.

Остальные технические параметры оставляем без изменений.

Как создать AI-модель девушки с постоянной внешностью-5

Шаг 3. Запуск и скачивание готовой модели

  1. Нажимаем кнопку Run внизу страницы.

  2. Дожидаемся окончания генерации. Сервис обработает базу снимков и соберет итоговый файл с расширением .safetensors.

  3. Скачиваем полученный файл .safetensors на компьютер.

Этот файл содержит обученную внешность девушки. На следующем этапе мы подключим его к генератору ComfyUI на облачном сервере для создания фотографий и видеороликов.

Развертывание ComfyUI на RunPod и генерация контента

Генерировать тяжелые модели и видеоролики на обычном ноутбуке или слабом ПК не получится, так как для работы требуется видеокарта минимум с 16 или 24 ГБ видеопамяти.

Чтобы не покупать дорогое железо, используют облачный сервис RunPod. На этой платформе можно арендовать сервер с мощной видеокартой на нужное количество часов. Для старта достаточно пополнить баланс на сумму от 15 до 20 долларов. Этого бюджета хватает примерно на месяц активной работы.

Шаг 1. Создание постоянного диска

Перед запуском сервера нужно создать постоянное хранилище, куда скачаются базовые модели и генератор ComfyUI. Если запускать сервер без отдельного диска, при каждом выключении все файлы будут удаляться.

  1. Регистрируемся на платформе RunPod и пополняем баланс через зарубежную карту или платежные сервисы.

  2. В левом меню переходим во вкладку Storage и нажимаем кнопку New Network Volume.

Как создать AI-модель девушки с постоянной внешностью-6

  1. В параметрах диска задаем настройки:

  • Размер памяти: указываем 300 GB. Этот объем нужен для хранения базовых чекпоинтов, видеомоделей и файлов LoRA.

  • Выбор видеокарты: привязываем диск к категории RTX Pro 6000 или аналогичным картам вроде A100.

  • Регион: выбираем локацию с максимальной доступностью карт с пометкой High Availability.

Как создать AI-модель девушки с постоянной внешностью-7

  1. Нажимаем кнопку Create Volume для создания диска.

Шаг 2. Запуск сервера и настройка шаблона (Configure Pod)

Когда диск создан, запускаем рабочий сервер:

  1. В карточке созданного диска нажимаем кнопку Configure Pod.

Как создать AI-модель девушки с постоянной внешностью-9

  1. В списке доступных шаблонов выбираем готовый контейнер под ComfyUI, например сборку AI Influencers или Wan 2.1 / Wan 2.2 One-Click V11.

Как создать AI-модель девушки с постоянной внешностью-10

Как создать AI-модель девушки с постоянной внешностью-11

  1. Нажимаем кнопку Edit Template и переходим во вкладку Environment Variables (переменные окружения).

Как создать AI-модель девушки с постоянной внешностью-12

  1. Прописываем параметры для автоматической загрузки видеомоделей:

  • download_wan2_2: выставляем значение true.

  • wan_animate: выставляем значение true.

Как создать AI-модель девушки с постоянной внешностью-13

  1. Сохраняем параметры кнопкой Set Overrides.

  2. Проверяем, что в блоке хранилища отображается созданный диск на 300 ГБ, и нажимаем Deploy on Demand.

Как создать AI-модель девушки с постоянной внешностью-14

  1. Ждем от 8 до 10 минут, пока сервер развернется и подгрузит все библиотеки.

Шаг 3. Загрузка LoRA через JupyterLab

Чтобы закинуть обученную модель на сервер RunPod без сторонних программ, используют JupyterLab — встроенный файловый менеджер, который открывается прямо в браузере.

  1. В карточке запущенного сервера нажимаем кнопку Connect и выбираем Connect to JupyterLab.

Как создать AI-модель девушки с постоянной внешностью-15

  1. В левой панели проводника открываем директорию: ComfyUI / models / loras.

  2. Нажимаем кнопку загрузки файлов (иконка со стрелкой вверх) или просто перетаскиваем мышкой ранее скачанный файл с расширением .safetensors.

Как создать AI-модель девушки с постоянной внешностью-16

  1. Дожидаемся окончания загрузки файла в папку на сервере.

Шаг 4. Запуск ComfyUI и загрузка воркфлоу

ComfyUI устроен не как обычные нейросети с одним полем для ввода текста. Это визуальный конструктор, где каждый отдельный этап генерации (загрузка базовой модели, подключение LoRA, обработка промпта, рендеринг и финальная сборка видео) представлен в виде отдельного блока — ноды. Все эти блоки соединяются между собой в единую схему.

Чтобы не собирать и не настраивать десятки блоков вручную с нуля, используют готовый воркфлоу. Это файл в формате .json, внутри которого уже выставлены все рабочие параметры, указаны нужные размеры кадров, шаги генерации и прописаны связи между всеми блоками.

Достаточно просто перетащить этот готовый файл в окно программы, и настроенная рабочая цепочка развернется сама. Скачать готовый воркфлоу для генерации фото и видео можно по ссылке.

Как загрузить схему в работу:

  1. В панели управления RunPod в карточке запущенного сервера нажимаем кнопку Connect и выбираем пункт Connect to ComfyUI Web UI.

Как создать AI-модель девушки с постоянной внешностью-17

  1. В новой вкладке браузера откроется рабочее пространство генератора.

  2. Скачанный файл workflow.json зажимаем левой кнопкой мыши и перетаскиваем прямо в рабочее поле ComfyUI.

  3. На экране появится готовая схема из соединенных блоков для генерации изображений и видеороликов.

Как создать AI-модель девушки с постоянной внешностью-18

Шаг 5. Настройка промпта и запуск генерации После загрузки воркфлоу настраиваем параметры сцены:

  1. В блоке позитивного промпта (Positive Prompt) пишем описание кадра. Первым словом указываем Trigger Word, который задавали при обучении, а затем прописываем одежду, действие и локацию. Не используйте слова вроде animated, 3d render или cartoon, чтобы картинка не стала мультяшной.

  2. Блок негативного промпта (Negative Prompt) оставляем без изменений со стандартными настройками из шаблона.

  3. В блоке выбора изображения (Load Image) загружаем портрет модели, по которому будет строиться видео.

  4. На панели справа нажимаем кнопку Queue Prompt для старта генерации.

Шаг 6. Сохранение готового видео Генерация ролика на сервере с видеокартой RTX Pro 6000 занимает от 2 до 5 минут:

  1. Все готовые дубли видео отображаются в блоке ассетов.

  2. Из списка выбираем последний сгенерированный ролик: он получается самым плавным по FPS и без просадок по качеству.

  3. Скачиваем готовый видеофайл на компьютер или забираем его напрямую из папки ComfyUI / output на диске сервера.

Как создать AI-модель девушки с постоянной внешностью-19

Продвинутый воркфлоу: замена персонажа на готовых видео

Выше мы разобрали базовый воркфлоу, который помогает понять общую логику работы с ComfyUI и получить первые результаты.

Для регулярных публикаций в соцсетях генерации по одной фотографии недостаточно. Если в кадре есть сложные действия (человек идет по улице, занимается в зале или примеряет вещи), нейросеть при обработке статичного кадра искажает черты лица и пропорции тела, а движения получаются неестественными.

Чтобы ролики выглядели реалистично, используют формат Video-to-Video. Это технология, при которой нейросеть берет готовое донорское видео с нужными движениями и заменяет человека в кадре на сгенерированную AI-модель. 

Задний план, ракурс камеры и освещение остаются от исходного ролика, а лицо, фигура и одежда меняются под референс. Скачать продвинутый воркфлоу можно по ссылке.

Что добавили в продвинутый воркфлоу

Чтобы модель оставалась похожа на себя на каждом кадре, а движения выглядели естественно, в воркфлоу встроили три инструмента.

Face Memory. Сюда загружаем четкую фотографию без очков и головных уборов. Нода считывает внешность со снимка и переносит ее на исходное видео. В итоге черты лица не плывут и модель остается узнаваемой даже при резких поворотах головы.

Как создать AI-модель девушки с постоянной внешностью-20

Replace Mask. Инструмент автоматически накладывает маску на человека в видео-доноре, указывая нейросети, какую именно область нужно перерисовать:

  • Если фигура и оттенок кожи донора подходят под нашу модель, маску оставляем только на лице и меняем только его.

  • Если нужно полностью поменять одежду и комплекцию, ползунком растягиваем маску на все тело. Тогда нейросеть целиком вырезает человека из кадра и вставляет на его место нашу модель с фотографии, не трогая фон и окружение.

Как создать AI-модель девушки с постоянной внешностью-21

Физика тела. Ползунок регулирует естественность движений фигуры при ходьбе или беге. Выставляем значение в диапазоне от 0.25 до 0.5. Если выставить цифру больше, тело в движении будет выглядеть слишком мягким и неестественным.

Если вы только начинаете разбираться с ComfyUI, этот воркфлоу на первый взгляд может показаться перегруженным. Но пугаться не стоит: вам нужно только загрузить готовый файл и вставить свои фото и видео в нужные ноды.

Если вылезет ошибка или запутаетесь в параметрах, сделайте скриншот окна программы и отправьте в ChatGPT или Claude — нейросеть сразу объяснит, что пошло не так и какую настройку поправить.

Вывод

Создание AI-модели не требует мощного железа или сложной настройки программ с нуля. Аренда облачного сервера на RunPod решает вопрос с нехваткой видеопамяти, а готовые воркфлоу в ComfyUI позволяют сразу запускать генерации без ручной сборки нод.

Результат работы упирается в подготовку датасета. Если нормально отобрать 35–40 исходников и правильно составить текстовые описания к файлам, обученная LoRA будет стабильно выдавать лицо модели на любых кадрах. А связка из роликов-доноров и формата Video-to-Video дает возможность штамповать реалистичные видео под соцсети в любых объемах.