A Google kiadta a Gemini 3.6 Flash modellre épülő Nano Banana 2.1 képalkotó és képszerkesztő eszközt. Az új verzió a korábbinál természetesebb képeket ígér, miközben a képgenerálás ára nagyjából a felére csökkent. A fejlesztőknek érdemes sietniük a váltással, mert a Google október 29-én leállítja a korábbi API-verziót.
A frissítés javítja a panorámaképek hibáit, pontosabb szövegmegjelenítést és infografika-elrendezést biztosít, valamint akár 14 referenciaképet is képes kezelni. A modell három állítható gondolkodási szinttel rendelkezik, ám a tesztek szerint a Pro verzió minőségét még nem éri el. Ismert gyengeségei közé tartoznak a hallucinációk és a maszkolási hibák.
Az új modell fokozatosan válik elérhetővé a Gemini alkalmazásban, a Google AI Studióban és a Google Ads felületén. A képkimenet ára millió tokenenként 30 dollárra csökkent, a bemeneti tokenek ára viszont a háromszorosára, 1,50 dollárra emelkedett.
Az eredeti szöveg (Perplexity Discover)
A Google 2026. október 6-án adta ki a Nano Banana 2.1-et. Az új képgeneráló és képszerkesztő modell a Gemini 3.6 Flash-re épül, és a Google képenként nagyjából feleannyit számláz érte, mint a Nano Banana 2-ért. A Google az X-en azt írta, hogy a modell „minden téren felülmúlja a korábbi modelleinket, és jelentősen fejlődött a vizuális tervezés, a maszkalapú szerkesztés és a témakonzisztencia terén, így természetesebb hatású képeket készíthet vele".
A kiadás leváltja a februárban megjelent Nano Banana 2-t. A fejlesztőknek van egy határidejük: a Google október 29-én leállítja a régebbi gemini-3.1-flash-image modellt.
A Google Gemini API árazási oldala szerint a Nano Banana 2.1 képkimenete millió tokenenként $$30$$ dollárba kerül. Ez nagyjából 3,4 cent egy 1K-s, 5 cent egy 2K-s és 7,6 cent egy 4K-s képért. A Nano Banana 2 ugyanezekért a méretekért 6,7, 10,1 és 15,1 centet kért. A bemeneti tokenek viszont drágábbak, mint korábban: milliónként $$1,50$$ dollárra emelkedtek a korábbi $$0,50$$ dollárról, és az oldal nem említ ingyenes csomagot. A kötegelt feldolgozás a képárakat még egyszer megfelezi.
A Google fejlesztői dokumentációja jobb vizuális minőséget, a széles panorámaképeken jelentkező csempézési hibák javítását, jobb szövegmegjelenítést és infografikaelrendezést, legfeljebb 14 referenciaképet, valamint három állítható „gondolkodási” szintet említ. A Google a modellt a Nano Banana Pro hatékonyabb párjának nevezi. A The Decoder szerint a Pro a gyakorlatban gyakran még mindig érezhetően jobb képeket készít.
A Google saját, emberi preferenciákon alapuló teszteket futtatott, és az eredményeket közzétette a modellkártyán. A Nano Banana 2.1 gondolkodó módban 1050-es Elo-pontszámot ért el, szemben a Nano Banana 2 990-es és a Pro 935-ös pontszámával. A független rangsorok kevésbé hízelgők. A Kingy AI a bemutató napján megnézte az Arena szövegből képet generáló ranglistáját, és az ötödik helyen találta a modellt, az OpenAI GPT Image 2.5 változatai és a Microsoft MAI-Image-2.6 modellje mögött.
A modell fokozatosan érkezik a Gemini alkalmazásba, a Keresés AI Módjába, a Google AI Studióba, valamint a Flow, a Stitch, a Google Ads és a Gemini Enterprise Platform szolgáltatásokba. Robby Stein, a Google Keresésért felelős termékekkel foglalkozó alelnöke az X-en azt írta, hogy „a Nano Banana 2.1 megérkezik a Keresés AI Módjába!". A Search Engine Roundtable beszámolója szerint az AI Overviews (AI-áttekintések) egyelőre úgy tűnik, még nem az új verziót használja.
A modellkártya több ismert gyengeséget is felsorol: hallucinációkat, elmosódó apró szövegeket, tökéletlen karakterkonzisztenciát és hibákat a maszkolt szerkesztések során. A Kingy AI azt is észrevette, hogy a Google dokumentációi ellentmondanak egymásnak a kontextusablak korlátait illetően: a modellkártya szerint ez 1 millió token, az API-specifikációban viszont 131 072 szerepel. Kingy azt tanácsolta a fejlesztőknek, hogy az átállás előtt teszteljék le a valós működést, mivel az átállási határidő október 29.