ChatGPT Images 2.5: szybsza grafika i precyzyjna edycja

Skala korzystania z generowania obrazów w narzędziach OpenAI jest już bardzo duża: co tydzień w ChatGPT Images i modelach GPT-Image w API powstaje ponad 3 miliardy obrazów. Z narzędzi tych korzystają zespoły kreatywne, marketingowe, handlu detalicznego i mediowe.

Images 2.5 ma dawać bardziej naturalne światło i bogatsze tekstury, lepiej zachowywać obiekty ze zdjęć referencyjnych i pewniej trzymać się instrukcji edycyjnych w kolejnych turach rozmowy. Opóźnienie generowania obrazu zostało skrócone nawet o 50% w porównaniu z Images 2.0.

Druga część zmian dotyczy samego interfejsu ChatGPT. Sketch pozwala rysować bezpośrednio w ChatGPT i użyć szkicu jako punktu odniesienia dla finalnego obrazu. Szablony ułatwiają start w popularnych formatach, takich jak ulotki i zdjęcia produktowe. Komentarze można teraz umieszczać bezpośrednio na obrazie, a przy udostępnianiu obrazu da się dołączyć prompt, którym został wygenerowany.

Dla programistów w API pojawiają się dwa modele. GPT-Image-2.5 Flare wnosi te same usprawnienia jakości, edycji i szybkości oraz jest domyślnym wyborem dla większości zastosowań, dostarczając obrazy wyższej jakości niż GPT-Image-2 przy 50% niższym opóźnieniu. GPT-Image-2.5 Sunburst jest przeznaczony do premiumowych (premium) procesów wizualnych wymagających ściślejszej kontroli nad kolejnymi edycjami, kosztem dłuższego czasu generowania.

„Najbardziej zaimponowało nam w GPT-Image-2.5 Flare to, jak dobrze rozumie, czego nie zmieniać. Można wprowadzić istotną zmianę, nie tracąc charakteru, kompozycji ani tożsamości wizualnej oryginalnego obrazu” - powiedział Axultan Alimkulov, Head of Product (dyrektor ds. produktu) w Higgsfield AI.

Co to znaczy dla Twojej firmy

Zapowiadane usprawnienia dotyczą przede wszystkim edycji: model ma pewniej trzymać się instrukcji w kolejnych turach rozmowy i zachowywać elementy, których nie miał zmieniać. Dla firm oznacza to przede wszystkim krótszy czas oczekiwania na obraz - opóźnienie generowania zostało skrócone nawet o połowę względem poprzedniej wersji.

Warto pamiętać, że materiały reklamowe i sprzedażowe zwykle wymagają weryfikacji przed publikacją. OpenAI wskazuje przy tym, że obrazy tworzone tymi narzędziami są oznaczane metadanymi C2PA i niewidocznym znakiem wodnym.

Dla praktyka

Images 2.5 jest udostępniany użytkownikom ChatGPT, ChatGPT Work i Codex na wszystkich poziomach planów, na desktopie, w aplikacji mobilnej i w przeglądarce.

Żeby uruchomić rysowanie odręczne, wpisz w ChatGPT „@Sketch”. Szkic działa jako wskazówka wizualna - warto dorzucić do niego opis stylu i pozostałych detali.

Zamiast pustego pola startowego możesz wybrać szablon, na przykład „Poster” albo „Merch”, i uzupełnić go o treść do przekazania, elementy projektu i style. Przy poprawkach możesz korzystać z komentarzy nanoszonych bezpośrednio na obraz.

W API domyślnym wyborem dla większości zastosowań jest GPT-Image-2.5 Flare: treści dla twórców i social media, doświadczenia produktowe, wyszukiwanie wizualne, szybkie prototypowanie obrazów i generowanie o wysokim wolumenie. Po Sunburst sięgaj przy kreacjach kampanijnych gotowych do produkcji i dopracowanych zdjęciach produktowych, gdzie liczy się kontrola nad kolejnymi edycjami; trzeba jednak liczyć się z dłuższym czasem generowania.

Obrazy tworzone tymi narzędziami są oznaczane metadanymi C2PA i niewidocznym znakiem wodnym.

Źródła

Michał Wiercimok
O autorze
Michał Wiercimok
Ekspert marketingu internetowego

Michał Wiercimok - specjalista marketingu internetowego z ponad 20-letnim doświadczeniem. Prowadzi własną agencję marketingową i doradza firmom w zakresie Google Ads, SEO, analityki (GA4) oraz wykorzystania sztucznej inteligencji w marketingu. Zrealizował ponad 100 projektów dla klientów z różnych branż; wyróżniony w programie Google Partners Rising Stars (2016). Działa z Katowic.