Исходный размер 1140x1600

Обучение генеративной нейросети под собственный стиль рисования

Идея проекта

Идея проекта заключалась в до-обучении нейросети на собственном стиле рисования.

Особенности стиля: использование аэрографа и лассо, стилизованные волосы и складки, "рендер" поверхностей с отчетливым контуром после лассо и аэрографа, следы "карандашного" контура.

Часть работ — крупные портреты, сделанные по фото или кадрам из фильмов. Часть работ — стадики скульптур двух скульпторов с отличительными чертами стиля: Бет Кавенер (животные) и Choi Xooang (люди).

Итоговая цель: получить серию с людьми и животными в похожих локациях и цветовой гамме, с узнаваемым почерком.

Исходные изображения для обучения

Для до-обучения нейросети изображения были уменьшены и кадрированы до размера 512х512 пикселей. В блоке приводятся изображения в своем исходном размере. Всего в датасете было 12 изображений.

big
Исходный размер 4181x2480
big
Исходный размер 4181x2480
Исходный размер 3508x2480
Исходный размер 3508x2480

Процесс обучения

Обучение было выполнено со следующими настройками: -resolution=512 -max_train_steps=1000 -checkpointing_steps=250

В остальном соответствовало базовому обучению с курса.

Обучение длилось полтора часа, после чего модель была выгружена на Hugging face.

Для удобства в ноутбук был добавлен код для множественной генерации (в одной ячейке несколько промтов), а так же возможность сохранять получившиеся изображения в папку outputs. Изображения сохранялись со временем генерации + промтом, по которому были сгенерированы.

Так же была добавлена возможность упаковать папку в zip, чтобы в последующем скачать за одно действие.

Данные изменения были осуществленны с помощью Chat GPT.

Исходный размер 1932x805

Первые иттерации

Первые генерации были выполнены со 100% влиянием дообучения. Хотя часть стилевых черт удалось ухватить, картинки все еще были не такого высокого качества.

Исходный размер 996x997

Здесь видно, как нейросетью был ухвачен стиль волос и челки, сделанный лассо.

Исходный размер 991x993

Лиса уже имеет черты фактурной шерсти, как в примерах, пусть и идет в комплекте с некоторой размытостью и артефактами.

Исходный размер 1024x1024

С добавлением окружения картинка стала чуть лучше, все еще сохраняется текстура волос.

Исходный размер 1024x1024

На этом изображении хорошо переданы мазки лассо на лице: видны явные контуры. В целом наиболее удачная картинка в контексте похожести. *Ни одной из картин не удалось сохранить карандашного подслоя, возможно это не было так явно выражено в датасете.

Итоговая серия изображений

Генерации были выполнены со следующими настройками: pipe.load_lora_weights("rybkakon_style_LoRA/checkpoint-500") pipe.fuse_lora(lora_scale=0.8)

Обучение генеративной нейросети под собственный стиль рисования
Проект создан 10.04.2025
Мы используем файлы cookies для улучшения работы сайта и большего удобства его использования. Более подробную информац...
Показать больше