Wybierz język

Renowacja twarzy AI

Odtwórz rozmyte lub niskiej rozdzielczości twarze na zdjęciach. Wykrywa do 4 twarzy, wyostrza każdą modelem GFPGAN i bezszwowo je wtapia.

Mehmet Demiray Opublikowano Zaktualizowano
Udostępnij
Działa w przeglądarce, nic nie jest wysyłane. Model AI o rozmiarze około 163 MB pobiera się raz przy pierwszym użyciu.
JPEG najlepiej nadaje się do zdjęć, PNG zachowuje pełną jakość

Odnajduje każdą twarz, przywraca ją i wkleja z powrotem do zdjęcia. Najlepiej działa na starych, rozmytych lub niskiej jakości portretach. Maksymalnie 4 twarze na zdjęcie.

Dlaczego twarze gubią się pierwsze

Na większości cennych starych zdjęć twarze są najmniejszą ważną rzeczą w kadrze. Portret grupowy z aparatu na kliszy potrafi dać każdej twarzy tylko kilkaset pikseli, a każde pokolenie kopiowania, skanowania i kompresji odgryza właśnie ten obszar. Druk go zmiękcza, czas wyblakuje, a wczesne aparaty cyfrowe dokładały do tego szum.

Zwykłe wyostrzanie tego nie naprawi, bo wyostrzanie tylko podkreśla krawędzie, które wciąż istnieją. Twarz, która zapadła się w plamę, nie ma już krawędzi do podkreślenia. Potrzebuje rekonstrukcji: systemu, który wie, jak wyglądają ludzkie twarze, i potrafi odbudować wiarygodne oczy, skórę i włosy pozostające wierne danej osobie.

To właśnie robi sieć do renowacji twarzy i dlatego wyniki wyglądają efektownie w porównaniu z jakimkolwiek filtrem. Model wnosi wiedzę o twarzach w ogóle i stosuje ją do konkretnej twarzy na Twoim zdjęciu.

Wykryj, odtwórz, wtop z powrotem

Proces przebiega w trzech etapach, wszystkie wewnątrz Twojej przeglądarki. Najpierw lekki detektor przeszukuje zdjęcie i znajduje każdą twarz wraz z pięcioma punktami charakterystycznymi: oczami, czubkiem nosa i kącikami ust. Na jednym zdjęciu obsługiwane są do 4 twarzy.

Po drugie, każda twarz jest obracana i skalowana do standardowej pozycji na podstawie tych punktów, a wyrównany wycinek przechodzi przez GFPGAN, sieć z generatywnym priorytetem twarzy. Mówiąc wprost, niesie ona głęboką pamięć tego, jak wyglądają ostre twarze, i na podstawie Twojej rozmytej twarzy decyduje, którą ostrą twarz odtworzyć. Tożsamość, poza i wyraz pochodzą z Twojego zdjęcia, ostrość pochodzi z modelu.

Po trzecie, odtworzona twarz jest przekształcana z powrotem na swoje dokładne miejsce i wtapiana miękką krawędzią, więc nie ma widocznej granicy łaty. Reszta zdjęcia pozostaje nietknięta, zmieniają się tylko twarze. Ponieważ rekonstrukcja generuje drobny detal, traktuj mikrocechy takie jak tekstura skóry jako wiarygodne, a nie dokumentalne, osoba pozostaje rozpoznawalnie sobą.

Twarze nigdy nie opuszczają urządzenia

Zdjęcia twarzy to najbardziej osobiste obrazy, jakie większość ludzi posiada, co czyni zwykły przepływ renowacji z wysyłką na serwer niewygodnym kompromisem. To narzędzie go usuwa. Oba modele, mały detektor i sieć renowacji o rozmiarze 163 MB, pobierają się do Twojej przeglądarki raz, a potem każde zdjęcie jest przetwarzane lokalnie. Nic, co odnawiasz, nie jest nigdy przesyłane.

Renowacja jest cięższa niż pozostałe narzędzia do obrazów tutaj, spodziewaj się mniej więcej dziesięciu sekund na twarz na komputerze, a na telefonach dłużej. Wskaźnik kroków pokazuje pobieranie modelu przy pierwszym użyciu, a potem postęp osobno dla każdej twarzy. Przyjmowane są zdjęcia do 2048 pikseli na dłuższym boku, większe skany trzeba najpierw zmniejszyć.

Warto znać świadomą decyzję projektową: renowacja działa na procesorze, a nie na układzie graficznym, bo ta konkretna sieć potrzebuje dodatkowej precyzji numerycznej, by dawać poprawne kolory. Wolniej, ale prawidłowo.

Co dobrze się odtwarza

Twarze z przodu i niemal z przodu odtwarzają się pięknie, odpowiadają temu, co sieć widziała w treningu najczęściej. Wyraźne profile, mocno przechylone głowy oraz twarze częściowo zasłonięte dłońmi lub przedmiotami odtwarzają się mniej pewnie. Małe twarze są w porządku, o ile detektor potrafi je znaleźć, jeśli jakąś pominie, przytnij zdjęcie tak, by twarz wypełniała więcej kadru, i uruchom ponownie.

Bardzo zniszczone zdjęcia korzystają z przygotowania. Odszum ziarnisty skan najpierw za pomocą Odszumianie Zdjęć AI, żeby detektor widział strukturę, a nie plamki. Po renowacji czarno-białe portrety naturalnie łączą się z Koloryzacja zdjęć AI, a jeśli całe zdjęcie ma być większe, zakończ na Powiększanie Zdjęć AI.

Trzymaj oryginalny plik obok odtworzonego. Rekonstrukcja jest uczciwa co do tożsamości, ale generatywna co do drobnego detalu, a dla archiwów rodzinnych para przed i po opowiada pełniejszą historię.

Najczęściej zadawane pytania.

Jak naprawić rozmytą twarz na zdjęciu?

Prześlij zdjęcie i naciśnij przycisk. Narzędzie znajduje każdą twarz, odtwarza ją dedykowanym AI do twarzy i bezszwowo wtapia z powrotem. Pobierasz całe zdjęcie z odtworzonymi twarzami.

Czy potrzebuję konta i czy jest znak wodny?

Ani jedno, ani drugie. Narzędzie jest darmowe bez rejestracji, a wynik nie niesie znaku wodnego. Modele pobierają się raz do Twojej przeglądarki i cała praca dzieje się na Twoim urządzeniu.

Czy moje zdjęcia są wysyłane? To zdjęcia rodzinne.

Nie. Wykrywanie twarzy, renowacja i wtapianie działają lokalnie w Twojej przeglądarce. Po jednorazowym pobraniu modelu, około 163 MB, nic nie jest nigdzie przesyłane, w żadną stronę.

Czy odtworzona twarz to naprawdę ta osoba?

Tożsamość, poza i wyraz pochodzą z Twojego zdjęcia, więc osoba pozostaje rozpoznawalna. Drobne detale jak tekstura skóry są odtwarzane przez AI, więc traktuj je jako wierną, wiarygodną wersję, a nie zapis kryminalistyczny.

Ile twarzy potrafi odtworzyć na jednym zdjęciu?

Do 4 twarzy na jedno uruchomienie, przetwarzanych po kolei. Zdjęcia grupowe działają, każda wykryta twarz jest osobno wyrównywana, odtwarzana i wtapiana z powrotem.

Dlaczego na moim zdjęciu nie znaleziono twarzy?

Bardzo małe, mocno odwrócone lub silnie zacienione twarze mogą umknąć detektorowi. Przytnij zdjęcie tak, by twarz wypełniała więcej kadru, i spróbuj ponownie. Odszumienie ziarnistego skanu najpierw za pomocą Odszumianie Zdjęć AI również pomaga w wykrywaniu.

Czym to się różni od filtra wyostrzającego?

Wyostrzanie wzmacnia krawędzie, które wciąż istnieją, co nic nie daje twarzy zamienionej w plamę. To narzędzie odtwarza twarz za pomocą sieci trenowanej na ostrych twarzach, przywracając detal, którego wyostrzanie nie potrafi stworzyć.

Dlaczego renowacja trwa dłużej niż pozostałe narzędzia?

Sieć do twarzy celowo działa z wysoką precyzją numeryczną na Twoim procesorze, bo na ścieżkach graficznych o niższej precyzji daje błędne kolory. Spodziewaj się około dziesięciu sekund na twarz na komputerze.

Czy mogę pokoloryzować zdjęcie po renowacji twarzy?

Tak, i ta kolejność działa najlepiej. Najpierw odtwórz twarze, żeby Koloryzacja zdjęć AI miało czyste rysy do pokolorowania, potem koloryzuj, a powiększ na końcu, jeśli potrzebujesz większego obrazu.

Źródła

  1. Towards Real-World Blind Face Restoration with Generative Facial Prior (GFP-GAN) · arXiv · Xintao Wang, Yu Li, Honglun Zhang, Ying Shan · 2021
  2. GFPGAN reference implementation · GitHub · Tencent ARC
  3. YuNet face detection model (OpenCV Zoo) · GitHub · Shiqi Yu