ChatGPT Images 2.5: szybsza grafika i precyzyjna edycja
Skala korzystania z generowania obrazów w narzędziach OpenAI jest już bardzo duża: co tydzień w ChatGPT Images i modelach GPT-Image w API powstaje ponad 3 miliardy obrazów. Z narzędzi tych korzystają zespoły kreatywne, marketingowe, handlu detalicznego i mediowe.
Images 2.5 ma dawać bardziej naturalne światło i bogatsze tekstury, lepiej zachowywać obiekty ze zdjęć referencyjnych i pewniej trzymać się instrukcji edycyjnych w kolejnych turach rozmowy. Opóźnienie generowania obrazu zostało skrócone nawet o 50% w porównaniu z Images 2.0.
Druga część zmian dotyczy samego interfejsu ChatGPT. Sketch pozwala rysować bezpośrednio w ChatGPT i użyć szkicu jako punktu odniesienia dla finalnego obrazu. Szablony ułatwiają start w popularnych formatach, takich jak ulotki i zdjęcia produktowe. Komentarze można teraz umieszczać bezpośrednio na obrazie, a przy udostępnianiu obrazu da się dołączyć prompt, którym został wygenerowany.
Dla programistów w API pojawiają się dwa modele. GPT-Image-2.5 Flare wnosi te same usprawnienia jakości, edycji i szybkości oraz jest domyślnym wyborem dla większości zastosowań, dostarczając obrazy wyższej jakości niż GPT-Image-2 przy 50% niższym opóźnieniu. GPT-Image-2.5 Sunburst jest przeznaczony do premiumowych (premium) procesów wizualnych wymagających ściślejszej kontroli nad kolejnymi edycjami, kosztem dłuższego czasu generowania.
„Najbardziej zaimponowało nam w GPT-Image-2.5 Flare to, jak dobrze rozumie, czego nie zmieniać. Można wprowadzić istotną zmianę, nie tracąc charakteru, kompozycji ani tożsamości wizualnej oryginalnego obrazu” - powiedział Axultan Alimkulov, Head of Product (dyrektor ds. produktu) w Higgsfield AI.
Co to znaczy dla Twojej firmy
Zapowiadane usprawnienia dotyczą przede wszystkim edycji: model ma pewniej trzymać się instrukcji w kolejnych turach rozmowy i zachowywać elementy, których nie miał zmieniać. Dla firm oznacza to przede wszystkim krótszy czas oczekiwania na obraz - opóźnienie generowania zostało skrócone nawet o połowę względem poprzedniej wersji.
Warto pamiętać, że materiały reklamowe i sprzedażowe zwykle wymagają weryfikacji przed publikacją. OpenAI wskazuje przy tym, że obrazy tworzone tymi narzędziami są oznaczane metadanymi C2PA i niewidocznym znakiem wodnym.
Dla praktyka
Images 2.5 jest udostępniany użytkownikom ChatGPT, ChatGPT Work i Codex na wszystkich poziomach planów, na desktopie, w aplikacji mobilnej i w przeglądarce.
Żeby uruchomić rysowanie odręczne, wpisz w ChatGPT „@Sketch”. Szkic działa jako wskazówka wizualna - warto dorzucić do niego opis stylu i pozostałych detali.
Zamiast pustego pola startowego możesz wybrać szablon, na przykład „Poster” albo „Merch”, i uzupełnić go o treść do przekazania, elementy projektu i style. Przy poprawkach możesz korzystać z komentarzy nanoszonych bezpośrednio na obraz.
W API domyślnym wyborem dla większości zastosowań jest GPT-Image-2.5 Flare: treści dla twórców i social media, doświadczenia produktowe, wyszukiwanie wizualne, szybkie prototypowanie obrazów i generowanie o wysokim wolumenie. Po Sunburst sięgaj przy kreacjach kampanijnych gotowych do produkcji i dopracowanych zdjęciach produktowych, gdzie liczy się kontrola nad kolejnymi edycjami; trzeba jednak liczyć się z dłuższym czasem generowania.
Obrazy tworzone tymi narzędziami są oznaczane metadanymi C2PA i niewidocznym znakiem wodnym.

