Google poinformowało o debiucie nowego modelu sztucznej inteligencji. Nano Banana 2.1 ma generować jeszcze lepsze grafiki, a przy okazji robić to znacznie taniej. Czy faktycznie było na co czekać?
Nano Banana 2.1 – co potrafi nowy model od Google?
Dosyć długo czekaliśmy na debiut Nano Banana 2.1, bo poprzednia generacja pojawiła się na rynku pod koniec lutego bieżącego roku. Nic zatem dziwnego, że użytkownicy oczekiwali wzrostu wydajności, jakości oraz obniżki cen. Czy korporacja spełniła oczekiwania? To oczywiście zależy od użytkownika, którego postanowicie spytać.
Oficjalny post nie zdradza zbyt wielu szczegółów, Google informuje tam wyłącznie o uzyskiwaniu lepszych wyników niż w przypadku poprzednika (wow, naprawdę?) i działaniu wydajniej na następujących płaszczyznach:
- projektowanie wizualne
- edycja z użyciem masek
- spójność generowanych obiektów
- bardziej naturalny wygląd grafik
Szerszy obraz odkrywamy po odwiedzeniu podstrony Google DeepMind, gdzie podzielono się nawet słabymi stronami nowego modelu. Tam też zawarto informację o oparciu na Gemini 3.6 Flash oraz oknie kontekstowym mieszczącym maksymalnie milion tokenów wejściowych i 64 tysiące tokenów wyjściowych. Użytkownicy mogą natomiast wrzucać jako referencję nie tylko tekst, ale i inne zdjęcia.
Nano Banana 2.1 ma ponadto znacznie lepiej radzić sobie w generowaniu skomplikowanych wykresów czy szczegółowych diagramów, choć to raczej mieć obosieczny. Karta informacyjna sugeruje bowiem występujące problemy z wypluwaniem niewielkich czcionek oraz spójnością znaków. Na razie więc trudno o realnie wyglądające wykresy, diagramy i infografiki.
Jeśli zaś chodzi o dostępność, to tutaj wdrażanie ruszyło pełną parą, bo także w obrębie wyszukiwarki czy innych usług Google wykorzystujących sztuczną inteligencję (Gemini, Stitch, Flow). Natomiast cena samego obrazu (1 tysiąc tokenów) w Gemini API wynosi 0,034 dolara – to czterokrotnie mniej niż w przypadku wersji Pro.
Źródło tekstu i zdjęcia otwierającego: Google