🌫️Z hałasu - zdjęcie
Twórcy sieci neuronowych NIE zaczynają od czystej karty, ale od czystego szumu – jak zmarszczki na starym telewizorze. Wybierz, co chcesz „odgadnąć” i przesuń suwak: z każdym krokiem model usuwa część szumu, aż z chaosu wyłoni się obraz.
Co rysujemy:
Jak to działa: dyfuzja
Modelka została przeszkolona w drugą stronę: zrobiła miliony prawdziwych zdjęć i stopniowo ZAMRAŻAŁA je, aż do uzyskania efektu falowania, pamiętając o każdym kroku. Nauczyła się więc przewidywać, jak wygląda „nieco mniej hałaśliwa” wersja dowolnego hałasu.
Gdy poprosisz o zdjęcie, model zaczyna od czystego losowego szumu i wielokrotnie stosuje tę umiejętność: usuwając kroplę szumu, potem kolejną i kolejną – kilkadziesiąt kroków. Podpowiedź (co narysować) na każdym kroku informuje, W JAKIM kierunku usunąć szum, aby pojawiło się dokładnie to, co jest potrzebne.
Dlatego więcej kroków oznacza czystszy wynik, a dokładny monit oznacza dokładniejszy obraz. Z tekstem działa ta sama zasada „wielu drobnych udoskonaleń zamiast jednego skoku”: jasne zapytanie prowadzi model krok po kroku do pożądanego rezultatu. Możesz ćwiczyć na bezpłatnej lekcji.
Zacznij za darmo