Google Nano Banana 2: Revoluce v generování AI obrázků | Tech podcast
Tato epizoda analyzuje uvedení nového modelu Nano Banana 2 od společnosti Google, který představuje zásadní posun v oblasti generování obrázků. Technologie kombinuje rychlost Google Gemini s vysokou kvalitou verze Pro, přičemž zrychluje proces tvorby o 20 %. Tyto AI novinky česky se zaměřují na dopady v digitálním marketingu, vyhledávání a efektivitě pracovních postupů. Podcast o umělé inteligenci rovněž zmiňuje bezplatný přístup k těmto funkcím skrze platformu Flow.
Hlavní body
- Google plošně nasazuje model Nano Banana 2 ve 141 zemích světa.
- Nová technologie zrychluje generování AI obrázků o 20 % oproti předchozím verzím.
- Model přináší vylepšenou konzistenci subjektů, což je klíčové pro profesionální workflow.
- Kombinace rychlosti Google Gemini a kvality Nano Banana Pro mění standardy v reklamě a vyhledávání.
- Platforma Flow nabízí uživatelům nejnovější funkce generativní AI zcela zdarma.
- Společnost RAW future s.r.o. poskytuje vzdělávání v oblasti AI skrze workshopy a webináře.
Přepis epizody
Vítejte u 72. epizody podcastu Kde skončí zítřek. Ahoj Martine, dnes se podíváme na novou hračku od Google. Imagen 2. Ahoj Roube, ano, Google představil Imagen 2, což je jejich nejnovější model pro generování obrázků. Měl by kombinovat to nejlepší z Imagen Pro a rychlost Gemini Flash.
Sponzorem tohoto podcastu je firma Raw Future SRO, která pořádá workshopy, přednášky a webináře o umělé inteligenci.
Znamená to, že by měl mít pokročilé znalosti o světě a kvalitu výstupu jako Imagen Pro, ale zároveň by měl být rychlý jako Gemini Flash. Což umožňuje rychlejší úpravy a iterace. Imagen Pro se vyznačovala schopností generovat vysoce detailní a realistické obrázky, ale její rychlost byla limitující, zejména při komplexnějších úlohách. Gemini Flash naopak exceloval v rychlosti, ale kvalita výstupu nebyla vždy na stejné úrovni. Cílem Imagen 2 je tedy překlenout tuto mezeru a nabídnout uživatelům optimální kombinaci obou vlastností. Takže něco jako Best of Both Worlds?
Dejte nám follow v aplikaci, ve které nás posloucháte, aby vám už žádná novinka o AI neunikla. A kde všude bude Imagen 2 dostupná? A co to znamená pro uživatele? V čem se to projeví konkrétně? A co vyhledávání? Tam se to projeví jak?
Ve vyhledávání by měla být Imagen 2 dostupná v AI Mode a Lens, a to jak v aplikaci Google, tak v mobilních a desktopových prohlížečích. Google uvádí, že je to dostupné ve 141 nových zemích a teritoriích a v osmi dalších jazycích. To znamená, že mnohem více uživatelů bude mít přístup k pokročilým funkcím generování obrázků přímo ve vyhledávání, což jim umožní snadněji nalézt vizuální obsah. Představ si, co to znamená pro vyhledávání. Předpokládá se, že cena za 1000 vygenerovaných obrázků bude kolem 5 dolarů, ale to se může lišit v závislosti na složitosti úkolu a rozlišení obrázku. Konkrétněji, cena za jeden obrázek o rozlišení 512 x 512 pixelů by měla být kolem 0,005 dolaru, zatímco obrázek ve 4K rozlišení by mohl stát až 0,10 dolaru.
Dobře, to můžeme dohledat. A co Google Cloud? V Google Cloudu je Imagen 2 dostupná v preview verzi z Gemini API ve Vertex AI. To umožňuje vývojářům a firmám integrovat pokročilé funkce generování obrázků do svých aplikací a služeb. Vertex AI nabízí širokou škálu nástrojů a služeb pro trénování a nasazování modelů umělé inteligence. Takže Imagen 2 se snadno integruje do stávajících workflow. To je výhodné pro firmy, které chtějí automatizovat tvorbu vizuálního obsahu, marketingové kampaně nebo pro interní použití.
A co Flow? To je nějaká nová platforma? Flow je platforma pro generování obrázků a Imagen 2 je tam novým výchozím modelem pro všechny uživatele Flow. A to bez nutnosti platit kredity. To znamená, že uživatelé Flow budou mít automaticky přístup k nejnovějším funkcím generování obrázků bez jakýchkoliv dalších nákladů, což by mělo výrazně zvýšit jejich produktivitu. A nakonec Google Ads? Takže to vypadá, že Google to nasazuje opravdu plošně.
A co nějaké konkrétní vlastnosti a vylepšení oproti původní Imagen? To by mělo umožnit například vytváření storyboardů a budování příběhů bez změny vzhledu vstupů. To je klíčové pro profesionály, kteří potřebují vytvářet komplexní vizuální obsahy s konzistentním vzhledem postav a objektů. Dříve bylo obtížné udržet konzistenci i u dvou postav. Nyní je možné pracovat až s pěti. Představ si, že vytváříš komiks a potřebuješ, aby hlavní hrdina vypadal stejně v každém panelu. A co dalšího? Takže méně halucinací a více reality? Už by mělo zajistit, že vizuály budou ostré, ať už jsou určené pro vertikální příspěvek na sociální síti nebo pro širokoúhlé pozadí. Podpora rozlišení až 4K je klíčová pro profesionální použití, kde je vyžadována vysoká kvalita obrazu. Možnost volby poměru stran umožňuje optimalizovat obrázky pro různé platformy a formáty. To je důležité pro grafiky, kteří potřebují vytvářet obrázky pro různé účely. To je určitě pro profesionály, kteří potřebují obrázky v konkrétních formátech. A co vizuální kvalita? Google uvádí, že Imagen 2 přináší živější osvětlení, bohatší textury a ostřejší detaily, a to při zachování vysoké kvality, kterou uživatelé očekávají od Imagen modelů. To znamená, že obrázky by měly být vizuálně atraktivnější a realističtější než ty, které generovaly předchozí modely. Takže celkově by to měl být velký krok vpřed v kvalitě a rychlosti generování obrázků.
Co to znamená v praxi? Takže se snaží bojovat proti dezinformacím a fake news? To je docela působivé číslo. A co C2PA verifikace? Kdy bude dostupná? C2PA verifikace do aplikace Gemini. To by mělo uživatelům umožnit snadno ověřit původ obrázků a zjistit, zda byly generovány pomocí AI. C2PA verifikace bude fungovat tak, že uživatelé budou moci nahrát obrázek do Gemini a systém automaticky ověří jeho původ a zobrazí informace o tom, zda byl generován pomocí AI a jaké nástroje byly použity. To by mělo usnadnit ověřování pravdivosti vizuálního obsahu a boj proti dezinformacím. Takže se zdá, že Google bere zodpovědnost za AI generovaný obsah vážně. Ano, snaží se zajistit, aby uživatelé měli k dispozici nástroje, které jim umožní rozpoznat AI generovaný obsah a ověřit jeho původ. To je důležité pro budování důvěry v AI a pro prevenci šíření dezinformací. Google investuje značné prostředky do vývoje technologií pro identifikaci AI generovaného obsahu a spolupracuje s dalšími firmami a organizacemi na vývoji standardů pro transparentnost a zodpovědnost v oblasti AI.
A co nějaké příklady použití Imagen 2? Google uvádí nějaké konkrétní případy? Ano, Google uvádí několik příkladů. Například generování infografiky okolo běhu vody, tvorba triptychů infografiky porovnávající tři typy oblaků, vytvoření obrázků muzea Clos Lucé ve stylu syntetického kubismu nebo lokalizace cedule Native Wildlife do indického prostředí, včetně překladu textu do hindštiny. Tyto příklady ukazují, že Imagen 2 je schopna generovat širokou škálu vizuálních obsahů, od jednoduchých infografik až po složitá umělecká díla. Generování infografiky okolo běhu vody může být užitečné pro učitele a studenty, zatímco tvorba obrázku muzea Clos Lucé ve stylu syntetického kubismu může být zajímavá pro umělce a milovníky umění.
A co konzistence subjektu? Uvádí Google nějaký příklad? Ano, uvádí příklad vytvoření obrázku čtrnácti postav a předmětů, které se baví na farmě, s důrazem na zachování identity všech postav a předmětů. To je dobrý testovací případ pro konzistenci subjektů, protože je obtížné udržet konzistentní vzhled všech postav a předmětů v takto složité scéně. To je dobrý testovací případ pro konzistenci subjektů.
A co přesné následování instrukcí? To zní jako náročný úkol pro AI. A co vizuální kvalita? Google uvádí příklad leteckého snímku dramatické, mlhavé krajiny, pravděpodobně údolí nebo kotliny, charakterizované zvlněnými zelenými kopci a klikatící se řekou nebo jezerem. To zní jako krásný obrázek a ukazuje, že Imagen 2 je schopna generovat vysoce kvalitní a realistické krajiny. Představ si, že vidíš krajinu z letadla a potřebuješ ji nakreslit tak, aby vypadala co nejrealističtěji. To zní jako krásný obrázek.
A co nějaký příklad pro Google Ads? Tam Google neuvádí konkrétní příklad, ale obecně by měla Imagen 2 vylepšit návrhy při vytváření kampaní. Takže celkově se zdá, že Imagen 2 je velký krok vpřed v generování obrázků pomocí AI. Ano, kombinuje rychlost a kvalitu a nabízí uživatelům pokročilé nástroje pro tvorbu vizuálního obsahu. A co je důležité? Google se snaží zajistit transparentnost a zodpovědnost při používání AI. Google investuje značné prostředky do výzkumu a vývoje v oblasti AI a snaží se vyvíjet technologie, které jsou bezpečné, spolehlivé a prospěšné pro společnost.
A co konkurence? Jak si Imagen 2 stojí v porovnání s ostatními modely pro generování obrázků? To je těžké říct, protože nemáme k dispozici žádné benchmarky ani srovnávací testy. Ale Google se snaží zdůraznit, že Imagen 2 nabízí unikátní kombinaci rychlosti, kvality a pokročilých funkcí, jako je konzistence subjektů a přesné následování instrukcí. Konkurence v oblasti generování obrázků pomocí AI je velmi silná a neustále se vyvíjí. Modely jako DALL-E 3 od OpenAI a MidJourney nabízejí také velmi vysokou kvalitu a širokou škálu funkcí. Takže budeme muset počkat na první recenze a srovnávací testy, abychom si udělali objektivní obrázek.
Dobře Martine, díky za podrobný přehled o Imagen 2. Podpořit a sledovat nás lze na Substacku, všech sociálních sítích i na webu www.rawfuture.cz. Krátké upozornění. Tento podcast vzniká s pomocí umělé inteligence, která asistuje při přípravě obsahu i hlasové syntéze. Navzdory snaze o dokonalost může epizoda obsahovat drobné nepřesnosti.