Выбрать язык

AI-апскейлер аниме

Увеличивайте аниме, мангу и рисованную графику в 2 или 4 раза моделью, настроенной на контурную графику, сохраняя чёткие края и плоские цвета.

Mehmet Demiray (Мехмет Демирай) Опубликовано Обновлено
Поделиться
Работает прямо в браузере, файлы не загружаются на сервер. Модель ИИ (около 2,5 МБ) скачивается один раз при первом запуске.
Оба варианта занимают одинаковое время. 2× дает то же качество при размере в два раза меньше, чем 4×.
PNG лучше всего сохраняет четкость линий, а JPEG и WebP дают меньший размер файла.

Оптимизировано для аниме, манги и иллюстраций с плашками цвета и четкими линиями. Для обычных фотографий используйте наш AI Image Upscaler.

Почему аниме нужен свой апскейлер

Рисованная графика ломает предположения, на которые опираются фото-апскейлеры. Фотография полна мягких градиентов, шума матрицы и органической текстуры, и фото-модели учатся воспроизводить именно это. Дайте им чистый аниме-кадр, и они примут плоские цветовые заливки за текстуру, которую нужно придумать, размывая градиенты в контуры и добавляя зерно там, где художник его не рисовал.

Модель, настроенная на аниме, усваивает противоположные приоритеты. Линии должны оставаться тонкими и непрерывными, цветовые заливки должны оставаться идеально плоскими, а резкая граница между ними должна оставаться резкой. Этот инструмент использует аниме-вариант семейства Real-ESRGAN, обученный на кадрах анимации, поэтому увеличенная графика сохраняет чёткий, выверенный вид оригинала, а не уходит в фотографическую мягкость.

Практическое правило простое. Скриншоты из аниме, страницы манги, цифровые иллюстрации, стикеры и игровой арт, всё это сюда. Фотографиям же место в AI Апскейлер, который обучен именно на тех текстурах, что эта модель намеренно подавляет.

Маленькая модель, быстрый старт

Анимация хорошо сжимается как задача обучения. Плоские цвета и чистые линии требуют куда меньше ёмкости сети, чем фотографическая текстура, поэтому аниме-модель весит всего около 2,5 МБ, долю от веса фото-модели. Она скачивается за мгновения при первом запуске, сохраняется браузером и больше никогда не требует загрузки.

Всё работает на вашем устройстве. Изображение разрезается на перекрывающиеся плитки, каждая плитка проходит через сеть, а куски бесшовно сшиваются обратно. На машинах с современным графическим чипом браузер задействует WebGPU, и типичное изображение готово за несколько секунд. Без него более медленный запасной вариант на процессоре даёт точно такой же результат.

Сама сеть всегда увеличивает в четыре раза за один проход. Когда вы выбираете увеличение в 2 раза, инструмент просто выполняет тот же проход и уменьшает результат вдвое, поэтому оба варианта занимают одинаковое время. Вы никогда не платите больше за меньший результат, так что выбирайте исходя только из нужного размера.

PNG или WebP для контурной графики

Контурная графика наказывает за сжатие с потерями заметнее, чем фотографии. JPEG, в частности, вносит слабый ореол вокруг резких краёв, ровно там, где аниме-изображения наиболее чувствительны. PNG хранит увеличенный результат без потерь и рекомендуется по умолчанию для графики, которая вам дорога, особенно если её будут редактировать снова.

WebP, это крепкая золотая середина. На уровне качества, который использует этот инструмент, артефакты WebP на контурной графике трудно заметить, а файлы выходят в несколько раз меньше PNG. Для публикации в чатах и сообществах, где размер файла важен, WebP обычно практичный выбор. JPEG остаётся доступным для мест, которые не принимают ничего другого.

Принимается ввод до 2 048 пикселей по длинной стороне, а результат достигает 8 192 пикселей при увеличении в 4 раза. Этого достаточно, чтобы превратить скриншот 640 на 360 в обои, а маленький стикер в арт, готовый к печати.

Что увеличивается хорошо, а что с трудом

Идеальный ввод, это чистый цифровой арт. Скриншоты прямо из видео, экспортированные иллюстрации и оригинальные рисунки увеличиваются превосходно, с контурами, которые остаются резкими при увеличении в 4 раза. Со сканами манги сложнее. Хороший скан работает отлично, но сильное сжатие JPEG в старых сканах воспринимается как детали, и модель может впечатать эти артефакты в увеличенную страницу. Когда скан выглядит блочным, прогон его через Подавление шума AI часто спасает дело.

Пиксель-арт, это особый случай. Эта модель сглаживает и скругляет, что противоположно тому, чего обычно хотят от пиксель-арта. Если цель, это более крупные пиксели с сохранённым блочным шармом, то масштабирование методом ближайшего соседа сохраняет такой вид лучше любого AI.

Смешанные изображения, например фото с вкомпонованным аниме-персонажем, везде склонятся к рисованному виду. А если вы хотите создать новую графику, а не увеличить существующие изображения, то Нейросеть для аниме генерирует оригинальные картинки в аниме-стиле по текстовому запросу.

Самые частые вопросы.

Как увеличить аниме-изображение?

Перетащите изображение, выберите увеличение в 2 или 4 раза, выберите формат и нажмите кнопку. AI, настроенный на аниме, увеличивает его, сохраняя чёткие линии и плоские цвета, а результат вы скачиваете напрямую.

Нужен ли аккаунт?

Нет. Здесь нет регистрации, нет водяного знака и нет ограничения на количество обрабатываемых изображений. Модель скачивается один раз, около 2,5 МБ, и всё работает в вашем браузере.

Чем это отличается от обычного фото-апскейлера?

Обучающими данными. Эта модель училась на кадрах анимации, поэтому держит контуры резкими, а цветовые заливки чистыми. Фото-модель вроде AI Апскейлер добавляет фотографическую текстуру, которая размывает и загрязняет рисованную графику.

Это как waifu2x?

Та же задача, более новое семейство моделей. Оба увеличивают изображения в аниме-стиле с помощью AI, но этот инструмент использует более свежую аниме-архитектуру Real-ESRGAN и работает полностью в браузере, ничего не загружая.

Почему 2x и 4x занимают одинаковое время?

Сеть всегда увеличивает в 4 раза внутри себя. Вариант с увеличением в 2 раза просто уменьшает этот результат вдвое, поэтому тяжёлая работа AI в обоих режимах одинаковая.

Почему мой скан манги вышел хуже, чем ожидалось?

Артефакты сжатия в старых сканах усиливаются так, будто это нарисованные детали. Сначала уберите шум со скана в Подавление шума AI, затем увеличьте очищенную версию. Более чистый исходник даёт разительную разницу.

Работает ли он на пиксель-арте?

Запускается, но сглаживает пиксели, что обычно портит стиль. Для пиксель-арта простое увеличение методом ближайшего соседа в редакторе изображений сохраняет блочный вид лучше.

Моя графика куда-нибудь загружается?

Нет. Модель работает на вашем устройстве, и изображение не покидает браузер. Это относится и к однократному скачиванию модели, которое идёт только от сервера к вам.

Источники

  1. Real-ESRGAN: Training Real-World Blind Super-Resolution with Pure Synthetic Data · arXiv · Xintao Wang, Liangbin Xie, Chao Dong, Ying Shan · 2021
  2. Real-ESRGAN reference implementation (realesr-animevideov3 model) · GitHub · Xintao Wang · 2022
  3. ONNX Runtime Web documentation · ONNX Runtime