ChatGPT Sketch: rysujesz bazgroła, AI robi z tego obraz
Przejdź do treści i przykładów
Źródło: Link
Ile razy chciałaś pokazać AI, o jaki obraz Ci chodzi, ale słowa nie wystarczały? OpenAI rozwiązało ten problem w prosty sposób - pozwala Ci po prostu narysować to, co masz w głowie. Nawet jeśli rysujesz jak dziecko uzbrojone w myszkę komputerową, a najprawdopodobniej właśnie tak będzie.
We wtorek OpenAI ogłosiło aktualizację ChatGPT Images 2.5. Razem z nią pojawiła się nowa funkcja o nazwie Sketch. Chodzi o coś prostego: rysujesz odręczny szkic bezpośrednio w oknie czatu, a potem mówisz ChatGPT, jak ma go zamienić w gotowy, szczegółowy obraz.
Sketch to nowy sposób komunikowania ChatGPT, czego oczekujesz od wygenerowanego obrazu - nie tylko opisem tekstowym, ale też rysunkiem. Zamiast pisać trzy akapity, próbując oddać słowami układ kompozycji, wystarczy naszkicować to ręcznie - albo myszką, jeśli tabletu graficznego akurat nie masz pod ręką.
Dziennikarz The Verge, Jay Peters, przetestował funkcję na własnej skórze. Narysował prowizoryczny szkic kota za pomocą myszki komputerowej, dodał instrukcję tekstową, a ChatGPT zamienił to w realistyczne zdjęcie kota. Rysunek nie musiał być dobry. Wystarczyło, że pokazywał ogólny zamysł - układ, proporcje, kompozycję - a resztę dopracowała AI.
Wystarczy wpisać @Sketch w oknie czatu ChatGPT. Otworzy się wtedy panel do rysowania, w którym naszkicujesz swój pomysł prosto na ekranie. Gdy skończysz, dodajesz instrukcję tekstową - na przykład jaki styl, kolorystykę czy nastrój ma mieć finalny obraz - a ChatGPT generuje wynik na podstawie obu tych rzeczy naraz: szkicu i opisu.
To rozwiązanie ma sens szczególnie dla osób, które wiedzą dokładnie, jak coś ma wyglądać kompozycyjnie, ale nie potrafią tego opisać słowami. Marketing, projektowanie grafik na social media, szybkie makiety - to obszary, gdzie różnica między "opisz mi to" a "pokaż mi to" bywa ogromna.
Tak, i to jest druga nowość w tej aktualizacji. ChatGPT Images 2.5 pozwala teraz zostawiać komentarze bezpośrednio na konkretnych fragmentach wygenerowanego obrazu. Peters wykorzystał tę funkcję, żeby zmienić kolor oczu wygenerowanego kota z niebieskiego na zielony. Zamiast opisywać całą scenę od nowa, po prostu zaznaczył fragment i napisał, co ma się zmienić.
To rozwiązuje frustrujący problem, który znała każda osoba pracująca z generatorami obrazów: chcesz poprawić jeden detal, a model potrafi przy okazji przerobić całą kompozycję. Punktowe komentarze na obrazie to podejście bliższe temu, jak realnie pracuje się z grafikiem - zaznaczasz, co Ci nie pasuje, zamiast zamawiać dzieło od nowa.
Największą barierą w korzystaniu z narzędzi do generowania obrazów AI nigdy nie była znajomość promptów - to bariera językowa między tym, co widzisz w głowie, a tym, co potrafisz opisać słowami. Sketch tę barierę częściowo usuwa. Nie musisz umieć rysować - musisz tylko umieć zaznaczyć, gdzie coś ma być.
To podejście wpisuje się w szerszy trend na rynku generatorów obrazów, gdzie konkurencja stawia na intuicyjność zamiast czystej mocy obliczeniowej. Podobny kierunek widać choćby w narzędziach opisanych w naszym porównaniu narzędzi do generowania obrazów AI, gdzie liczy się nie tylko jakość wyniku, ale i to, ile czasu zajmuje dojście do niego. Jeśli dopiero zaczynasz przygodę z generowaniem grafik, zerknij też na przegląd jak generować obrazy w Midjourney, DALL-E i Flux - Sketch może okazać się najprostszym punktem wejścia z tych wszystkich metod.
OpenAI idzie w stronę łączenia rysunku z tekstem, podczas gdy inni gracze eksperymentują z zupełnie innymi podejściami do generowania grafiki. Na przykład Claude generuje obrazy kodem SVG zamiast pikselami, a Google w Nano Banana 2 stawia na darmowy dostęp do funkcji premium. Każda firma szuka własnej drogi do tego samego celu: żeby generowanie obrazów AI przestało wymagać nauki specjalnego języka promptów.
Nie umiesz rysować? Nie umiesz pisać promptów? Nie szkodzi. Na darmowym webinarze pokazujemy, jak zacząć pracę z generatorami obrazów AI od zera - bez żargonu i bez poczucia, że coś robisz źle. Zapisz się na darmowy webinar →
Narzędzie samo w sobie nie zrobi za Ciebie kreatywnej pracy. Usuwa jednak jeden konkretny problem - moment, w którym siedzisz przed pustym oknem czatu i nie wiesz, jak ubrać w słowa coś, co widzisz oczami wyobraźni. Czasem prostszy jest po prostu bazgroł.
Wystarczy wpisać @Sketch w oknie czatu ChatGPT - otworzy się panel do rysowania. Po naszkicowaniu obrazu dodajesz instrukcję tekstową opisującą, jak ma wyglądać finalny efekt.
Nie. Testy dziennikarza The Verge pokazały, że nawet bardzo prosty rysunek narysowany myszką komputerową wystarczył, by AI wygenerowała szczegółowy, realistyczny obraz zgodny z zamysłem.
Tak. ChatGPT Images 2.5 pozwala zostawiać komentarze bezpośrednio na wybranych fragmentach obrazu, dzięki czemu możesz zmienić pojedynczy detal, na przykład kolor oczu, bez przepisywania całego promptu.
Klasyczne generowanie opiera się wyłącznie na opisie słownym, co bywa trudne przy skomplikowanych kompozycjach. Sketch łączy rysunek odręczny z tekstem, dzięki czemu AI ma dokładniejszy punkt odniesienia co do układu i proporcji.
Na podstawie: The Verge
10 gotowych promptów do codziennej pracy + 5 narzędzi + plan na pierwszy tydzień. PDF, 4 strony konkretu.