Gemini przekroczył miliard użytkowników miesięcznie
Wśród danych o użytkownikach aplikacji Gemini jest jeden szczegół, który powinien zainteresować każdego, kto prowadzi firmę: małe przedsiębiorstwa zostały opisane jako grupa korzystająca z narzędzia najintensywniej. Wykorzystują generowanie obrazu, wideo i dźwięku w jednym miejscu do przygotowywania materiałów marketingowych.
Pozostałe dane o korzystaniu z aplikacji: 63 procent użytkowników rozmawia z Gemini głosem, a rodzice zajęci codziennymi obowiązkami są o 43 procent bardziej skłonni używać narzędzia do zwykłych zadań. Aplikacja generuje ponad 150 milionów obrazów dziennie.
Sierpniowe podsumowanie obejmuje też premiery modeli. Gemini 3.7 Flash został opisany jako najinteligentniejszy model roboczy do kodowania i agentów, a pojawił się zaledwie trzy tygodnie po Gemini 3.6 Flash. Cena wprowadzająca wynosi połowę pierwotnego kosztu modelu 3.6 Flash za milion tokenów.
Drugi nowy model to Gemini 3.5 Transcribe, przeznaczony do zamiany mowy na tekst w czasie rzeczywistym - do agentów głosowych, napisów na żywo i analizy rozmów po ich zakończeniu. W opisie podkreślono, że w odróżnieniu od zwykłych modeli radzi sobie z hałasem i żargonem branżowym.
Do generowania wideo trafił Gemini Omni 1.1 Flash. Nowe możliwości to wydłużanie sceny, interpolacja między pierwszą a ostatnią klatką, skalowanie do 4K oraz szybsze prototypowanie. Model jest dostępny w Google Flow, Google AI Studio, na platformie Gemini Enterprise Agent Platform i w aplikacji Gemini.
W wyszukiwarce pojawiły się funkcje związane z nauką: interaktywne wizualizacje trudnych pojęć, generowanie testów próbnych do egzaminów SAT, ACT, GRE i LSAT, nauka krok po kroku z Lens oraz notatniki. Google oferuje też uprawnionym studentom na całym świecie rok planu Google AI bez opłat.
Co to znaczy dla Twojej firmy
Skala korzystania z aplikacji Gemini - miliard użytkowników miesięcznie i status najszybciej rosnącego produktu w historii Google - pokazuje, jak szeroko narzędzia AI weszły do codziennego użytku. Warto też zauważyć, że małe firmy zostały opisane jako grupa korzystająca najintensywniej z generowania obrazu, wideo i dźwięku do materiałów marketingowych. To rynek, na którym coraz więcej małych podmiotów sięga po te same narzędzia produkcyjne.
Dla praktyka
Zacznij od sprawdzenia, które z wymienionych funkcji są w ogóle dostępne po polsku. Wiele nowości Google uruchamia etapami i najpierw po angielsku, więc zanim zaplanujesz proces oparty na danym narzędziu, przetestuj je na własnym koncie, a nie na podstawie zapowiedzi.
Do generowania wideo masz cztery miejsca: Google Flow, Google AI Studio, Gemini Enterprise Agent Platform i aplikację Gemini. Do prostych materiałów promocyjnych wystarczy aplikacja, do pracy zespołowej i eksperymentów z ustawieniami lepiej sprawdzi się AI Studio.
- Gemini 3.5 Transcribe opisano jako model do agentów głosowych, napisów na żywo i analizy rozmów po ich zakończeniu - jeśli pracujesz nad którymś z tych zastosowań, sprawdź go na własnych nagraniach, z branżowym słownictwem i realnym hałasem w tle.
- Przy modelach do kodowania i agentów pamiętaj, że podana stawka Gemini 3.7 Flash to cena wprowadzająca, czyli połowa pierwotnego kosztu modelu 3.6 Flash za milion tokenów.
- Przed przeniesieniem produkcji treści na generatory zaplanuj etap weryfikacji przez człowieka, zwłaszcza tam, gdzie w materiałach pojawiają się ceny, warunki usługi czy szczegóły oferty.
- Przy planowaniu treści bierz pod uwagę, że część odbiorców rozmawia z asystentem głosem - w danych z aplikacji Gemini zrobiło tak 63 procent użytkowników.
Czego nie robić: nie traktuj comiesięcznego podsumowania zapowiedzi jako gotowej listy zmian do wdrożenia. Rozsądniej jest przez kilka tygodni obserwować, jak zmienia się ruch z wyszukiwarki na Twoich podstronach informacyjnych, i dopiero wtedy decydować o zmianach.

