← Zpět na hlavní stránku

Claude AI a vibe coding: Jak ovládnout nejnovější AI novinky česky

·57:42
Shrnutí epizody

Tato epizoda se věnuje fenoménu vibe codingu, díky kterému vznikla aplikace Filmbot a kapesní překladač využívající model Google Gemini 3.5. Podcast o umělé inteligenci dále analyzuje zaostávání Evropy v technologickém závodě a náchylnost modelu Mistral k ruské propagandě. Představuje také praktické AI novinky česky, jako je plugin Caveman pro úsporu tokenů nebo pokročilé úpravy fotografií v ChatGPT.

Hlavní body

Přepis epizody

Před třemi týdny byl nebezpečný a už není. GPT 5-6 se navedl sám sebe, aby zametl stopy. Jsme tady jako skanzen. Trošku. Udělej mi Minecraft, tady máš Tetris. Dal jsem mu maximum effort, aby na to makal. Nechte si raději nakreslit pelikána na kole, abyste viděli, co to dovede.

Ahoj, Richarde. Ahoj, diváci. Ahoj, posluchači. Máme tu osmý díl našeho live podcastu, kde skončí zítřek. Tak vás teď všechny vítám. Ahoj. A neviděli jsme se tři týdny, si myslím, protože minule jsme tady měli speciál s Davidem Spáčilem o AI videu, který si určitě pusťte, jestli vám utekl a neslyšeli jste ho, protože se bavíme o spoustě zajímavých věcí ohledně generování videa v současných trendech, ale zabrousili jsme i do nějakého cestování, protože David je velký cestovatel a bavili jsme se například o Islandu a o dalších cizokrajných krajinách. A co tu máme dnes? Zase nějakou nálož nových modelů a nějaké speciality? Nové modely určitě probereme. Můžeme probrat i trošku toho vedra, které nás tady posledních pár dní zužuje a nemá vůbec nic společného s AI, ale je to docela pekelné. Ale ano, nové modely už přišly. Myslíš, že nemá nic společného s AI? V Americe, všechna ta datová centra, nedostatek vody. Ono byste tam nějaké paralely našli. Asi ano, to je pravda, ale já spíše řeším to, že musím překonávat to vedro a tam s tím nemá AI nic společného. Ano, je to trošku peklíčko. Já jsem myslel, že nám současná vláda ale zrušila klimatickou krizi. Ano, to je pravda. Vlastně je zrušená. V noci je tma, ne? Tak jaká krize? Hele, tma pořád je. To se ještě nezměnilo. A vedro je taky. Vedro je taky. No, tyjo, já teď razím na týden si vymýt hlavu do Karlových Varů. Nemyslím večírky, ale filmy. To vždycky krásně přemaže mozek. Tak jsem se díval na předpověď a v Karlových Varech je vždycky zima, když tam jsme, když je festival. Tak tam hlásí na noc krásných 10 stupňů, takže už se těším, jak se zchladím. Málo. To mě trošku spíše překvapilo, ale já si pamatuju z Karlových Varů vždycky kino Orléans. Ano, Espace Orléans. Ano, Espace Orléans. Gumové nafukovací kino, které bylo vždycky pěkná sauna. To bylo perfektní. Když člověk do té doby nevěděl, jak to smrdí v gumárnách, tak tady se to dozvěděl. To byla fakt, kdo to nezažil, taková obrovská nafukovací hala. S velmi pohodlnými sedačkami. Ano, ano. Tam ty zadní sedadla, nebo ty zadní řady tak postupně klesaly, takže z nich nebylo vůbec nic vidět. Ano, ano. Přesně. Ale pamatuju si přesně ty extrémy v tom, jak jsem zažil tam nějakou průtrž mračen, kde na 10 lidí v sále kapala voda. Ano, ano, ano. A pak ta vedra, to bylo taky výživné. Já si tam pamatuju, že jsem tam byl na filmu o Kim Ki-dukovi, jak si stavěl espresso mašinku. Ale to je jedno, to sem nepatří, pojďme dál.

Hele, když jsme u toho festivalu, tak jsem tady chtěl divákům, posluchačům a čtenářům představit takovou libůstku, co na základě toho, že švagr chtěl naprogramovat takovou věc, která by mu na festival doporučila nějaké zajímavé filmy podle toho, co viděl v předchozích ročnících. Já jsem se toho chytil trošku velkolepě a udělal jsem takovou aplikaci, kterou jsem nazval jednoduše FilmBot. Najdete ji na adrese filmbot.rofuture.cz a když se tam zaregistrujete a vyplníte si nějaký váš filmový profil, to znamená, že tam naházíte třeba odkazy na filmy z ČSFD, které se vám líbí, vyplníte si tam třeba oblíbené režiséry, herce nebo další profese, tak pokud jich tam dáte dostatek, tak ten FilmBot si vás nějakým způsobem zaškatulkuje, co se vám líbí, co se vám nelíbí a přes takový vícekrokový ohodnocovací mechanismus je schopný potom vám doporučit filmy, které byste na festivalu, ale zároveň i na VOD platformách a v kinech, které by se vám mohly líbit. Takže to můžou diváci vyzkoušet, aspoň to někdo pořádně otestuje, jestli to funguje nebo nefunguje. Já podle toho zkusím trošku jet teď na festivalu a uvidíme, jestli se to trefuje dobře do mého vkusu, ale co jsem se díval na ta první doporučení s velkou pravděpodobností, tak ta vycházejí slibně, že si myslím, že se to trefí. U tebe to není úplně složité, když tam dáš deset korejských filmů, tak ti to doporučí další korejské filmy, ale ne, já jsem to taky testoval samozřejmě a mně to moje francouzské komedie taky doporučuje. Uvidíme, jestli FilmBot bude mít úspěch, jestli bude dobře fungovat, když tak to ještě poladíme a příští rok už to prodáme Karlovarskému festivalu a bude vám filmy doporučovat AI a my budeme šťastní, že jsme podpořili takovou akci, která nás dlouhodobě baví.

Ještě když jsme u toho programování a nějakých osobních projektů, abychom vás trošku navnadili, co v tom dnes jde dělat, tak jsem tady měl takovou úplnou maličkost, protože jsem si říkal, mám tam ještě nějaké kredity v rámci předplatného u Claude a je potřeba to předplatné těžit minimálně na 99 %, tak jsem tuhle odcházel z domu a říkám si, ještě tam je, co zbývá v tom čtyřhodinovém okně, než se to resetuje, tak mu tam pošlu takovou appku, co jsem slyšel, že by mohla docela dobře fungovat a uvidíme, co z toho vypadne. Gemini teď uvolnilo model 3.5, Gemini 3.5 a teď, tyjo, jak je přesně to označení, to tady někde mám napsané, že? Gemini 3.5 Live Translate a často můžete dělat překlad do cizích jazyků v reálném čase, takový ten simultánní překlad, co znáte z nějakých konferencí nebo ze starých VHSek, že? Ano, ano, ano. Není to tak vtipné, jako staré VHSky, ale dokážete to poslouchat cizí jazyk a reálně vám to rovnou posílat v cizím jazyce do ucha. Takže jsem odcházel z domu a jenom jsem do VSCode kódovi (Claude), řekl: „Hele, potřebuju tady s tím modelem udělat aplikaci, která dělá živý překlad, bude to jako PWA webová aplikace, v mobilu to pojede, udělej si tady smyčku, programuj to, kontroluj to, opravuj to a takhle jeď, dokud to celé nenaprogramuješ, mělo by to být jednoduché, hezké.“ Ano, úplně jsem takhle vágně mu to zadal a odešel jsem pryč, dal jsem mu maximum effort, aby na to makal. A vrátil jsem se, člověče, předělal jsem dvě rozbalovací menu, která byla špatně rozklikávatelná, poslal jsem mu potom z Claude kódu lepší design, opravil jsem jedno tlačítko, o kterém nevěděl, že chci, aby fungovalo, protože to byl grafický prvek, tak nevěděl, že chci, aby to fungovalo jako tlačítko na start-stop a tady s tou minimální korekcí a minimálním zásahem a se strašně vágním zadáním, on to tam nabušil, a já jsem úplně fascinovaný, kam se to zase posunulo a co to všechno už teď zvládne vymyslet za tebe, aniž bys to nějak složitě promptoval, je to fakt úžasné. Je to taková užitečná aplikace, že když někam člověk jede, tak to není žádná snaha přijít za každou cenu s nějakou blbostí, ale ano, to je fajn, já jsem se na to díval. A je to hrozně závislé jenom na tom modelu, který tam pustíš, že teď to funguje nějak, není to stoprocentní, ale není to vlastnost té aplikace, je to vlastnost toho modelu. Když se Gemini dostane do verze za chvíli, nevím, pět, a vymaká to, aby ten překlad byl lepší, aby to lépe rozumělo mluvčím, tak ta aplikace už stačí tam přepnout ten model a bude to fungovat lépe podle toho, jak se bude vyvíjet ten model. Takže je to úplné, ano, zase, kdybyste si to chtěli vyzkoušet, tak myslím, že to mám puštěné na překladač, já to raději ověřím, překladač.rofeuchar.cz. Musíte si tam teda vyplnit svůj API klíč do Gemini, jako to za vás platit nebudu, ale není to zase tak strašně drahé, vychází to podle toho, jak moc samozřejmě toho mluvení tam je, ale zhruba u nějakého třeba filmu by to mělo vycházet asi 50 Kč na hodinu. Ano, to je docela v pohodě. Není to tak strašné,

Může udělat svou vlastní aplikaci, není to problém. Na cokoliv. Akorát to chce nápad.

A když jsme si řekli, jak to hezky funguje a co všechno s tím jde dělat, tak se asi můžeme podívat na tu smršť různých novinek AI modelů, co tady teď máme. Je to tak. Takže co ten Claude? Claude vydal nový Sonet 5 a hned v zápětí se objevila i zpráva, že se opět uvolňuje Opus. Ale po třech týdnech to nějak vyřešili a najednou to může být venku, takže... Poledne pustili, nebo ráno? Já jsem to zaznamenal tak kolem poledne, že pustili ten Sonet. Sonet a vlastně za nějaké tři hodinky jsem to zaznamenal já. Než jsem stihnul otestovat Sonet, tak už tady byl zpátky. Ale těžko říct, před třemi týdny byl nebezpečný. A už není. Už není. Tak těžko říct. Možná bezpečnostní vrstva se rozrostla o pár tisíc řádků, co všechno dělat nemůže. Je tam nějaká časová výjimka, kdy to museli na tu kritickou infrastrukturu, pamatujete se, jak to tam bylo.

Tak teď se zdá, že už je to všechno v pořádku a můžeme si s tím všichni hrát. Ale to se pořád bavíme o tom Opusu jako takovém. Jasně. Ten někde leží a možná na něm něco staví dalšího, ale běžným uživatelům byl zveřejněný ten Opus, který má bezpečnostní vrstvy a pod nimi až je někde ten Opus, který to všechno zpracovává.

Ale říkám, je to spíš na nějakou hlubší debatu o tom, jestli se to asi bude stávat častěji. Nebo možná se na to musíme připravit, že ten souboj Spojených států a Číny, kdy každý má své modely, tak možná to opravdu bude častější, že řeknou, tak tohle tady do Evropy nepustíme. Ne, že bychom v Evropě neměli také nějaké společnosti, které to vyvíjí, ale... Myslím Mistral? Myslím Mistral, ten jasně, a máme DeepL pořád, to je také. Máme Eleven Labs. Máme Eleven Labs. Takže maximálně jim k tomu můžeme natáčet voice-overy, k té debatě o tom, jaký model nám pustí a jaký ne. Tak to by asi také šlo, ale přece jenom si řekněme na rovinu, že ti hlavní hráči jsou teď Čína a Spojené státy.

Já pořád trochu doufám, že ta Evropa se trochu zmátoří v tomto a že minimálně nějaký... Já nevím, jestli je možné je v dohledné době dohnat s nějakým LL modelem obecným, ale minimálně, že tady vznikají projekty, jako Eleven Labs, které jsou specifické na nějaké věci. Teď jsem třeba četl, že v Německu si udělali vlastní LLM, který je natrénovaný celý jenom na německé judikatuře a legislativě, aby to pomáhalo právníkům, takže vznikají tady nějaké zajímavé věci. Určitě ano, určitě ano, a zrovna to právo je takové složité, takže dává smysl, aby vlastně i na úrovni nějakých států vznikaly modely, které budou řešit jejich konkrétní problémy, ale nemám samozřejmě úplně vhled do toho, jak to funguje v Číně, ale myslím si, že zrovna ty Spojené státy dost těží na tom, že tam pracuje dost Evropanů, takže možná ti lidé tady ani nejsou a jsou právě v Americe.

Ale kdybychom dělali aspoň to, co dělají některé společnosti jako Cursor s těmi čínskými modely, vezmou si čínský model a podle mě v Silicon Valley to tak dělá spousta firem, že si vezmou ten open source čínský, přetrénují si ho, nějak si ho fine-tunují na nějaké specifické účely, ale to tady také úplně nevidím, pořád se zaklínáme nějakým Mistralem a kdo ho reálně používá? Já nevím, v Evropě asi spíš rezonuje ten AI akt, který nás čeká, ale o tom se asi také pobavíme někdy jindy, protože to je docela náročné téma a u některých věcí asi nejsem si úplně jistý, jak chtějí technicky řešit, ale je potřeba říct, že i to, že si někdo něco kóduje, tak má nějaká svá rizika, že se už jednoho dne probudíte a řekne se, že teď už mi to nefunguje.

Proto já mám strašně rád to, že když něco takhle programuji, co je napojené na nějaké jazykové modely, tak to napojuji přes ten OpenRouter, který si můžu jednoduše přepnout na cokoliv. Že se tady americká vláda rozhodne, že nějaké bezpečnostní riziko, nebo to budou chtít použít jako konkurenční výhodu pro Ameriku a zamknout to někde, a co budeš dělat? Tak se přepneš třeba na ten Mistral. Ono ti to na 90 % věcí bude stačit, nebude ti to stačit na nějaké složité programování. To asi ano, ale určitě je to dobré řešení podle mě.

Ale ten strach z toho, že se to může stát a my, nechci říct, že to podceňujeme tady v Evropě, ale ano, ale já nevím, k čemu všemu může třeba americká vláda už teď umělou inteligenci využívat a proč se třeba tak bojí. To jsou opravdu, jestli to je skutečně jenom nějaký neopodstatněný strach, nebo jestli skutečně ví, proč to vlastně zakazovali, ale ta síla toho je samozřejmě obrovská. Tak oni ještě napřed před těmi Číňany jsou. Říká se tři až šest měsíců, že mají náskok ty velké jazykové modely v tréninku, ale... Ale tři až šest měsíců, tak na Vánoce může být všechno jinak.

Tak ten vývoj podle mě na obou stranách, takže si myslím, že to nebude tak snadné je dohnat zase, ale ve výsledku i z toho, že třeba se objevilo teď na Anthropicu, vzhledem k tomu, jak sledovali, co tam Číňané vyvádějí na jejich modelech, tak ta obava minimálně z toho, že ta Čína je dožene, předežene v těch technologiích, tam probíhá. Tak oni to nějak musejí řešit a sledují to. Bylo to teď právě jedna ze zpráv kolem Anthropicu, že oni vlastně oficiálně nenabízejí své modely v Číně. V Číně nejsou. A Číňané to obcházejí tak, že se tam registrují přes cizí telefonní čísla, přes nějaké VPN. Jasně, těch cest je hodně. Se tam víceméně nějak dostávají. Jasně. A snaží se využívat to, co leze z Claude, aby na tom trénovali své jazykové modely.

A tak oni měli nějakou tajnou vychytávku, kterou si označovali ty prompty, které do toho lezou z Číny, aby byli schopni monitorovat to chování, co tam probíhá, které tam mít nechtějí. Tam měnili v datu nějaké lomítko za pomlčku. Pomlčku za pomlčku. Jenom si tak označovali. A byly to pak ve výsledku strašné miliony přístupů. Si to asi neumíme představit, čeho jsou schopné ty velké farmy a společnosti, které ti opravdu to know-how chtějí nějakým způsobem sebrat nebo na úkor tebe si něco potrénovat.

Jasně. Tak já myslím, že každý ví, to je strašně důležité, takže dělají všichni, co můžou, aby ten vývoj šel dál. Tak uvidíme. Třeba i Evropa začne. A jak říkám, mě tam akorát asi mrzí ten odliv těch mozků, že opravdu, když se podíváš na nějaké zprávy, kolik Evropanů a kolik těch chytrých lidí opravdu odešlo do Silicon Valley a do těchto firem, tak je jich tam opravdu strašné kvantum, a nám to tady teď chybí.

A tak zase jsou sice malé, ale případy lidí, kteří zase vydělali někde v Google, Facebooku, vrátili se zpátky a dělají něco zajímavého. Neříkám, že to tak není, ale lídři toho vývoje jsou jinde. Také tady máme Bottlecap, který dělá zajímavé věci kolem těch velkých jazykových modelů, spíše než by dělali samotný výzkum, se zaměřují na to, co zajímavého z toho může vypadnout. To jsou hezké výstupy. Možná je to i spíše o tom, že mě to tak mrzí, že v té Evropě nemáme toho velkého hráče, kterému řekneme: "Ale tak to jsou tady." A tak to bychom se mohli bavit v podstatě o čemkoliv. Jasně, jasně. Jsme tady jako i skanzen teď. Trochu.

Je to tady slabší vibe coding. Na agenty by to mělo být hodně dobré, protože už to určitým výkonem, jak oni tvrdí, že dosahuje kvality třeba toho Opusu 4.8. Je to teď do konce srpna za zvýhodněnou cenu. Takže i cenově je to vlastně na úrovni toho, kdy byl ten Sonet 4.6. Ale na druhou stranu od září to o 30 % zdraží. A tím, že tam vlastně on aby dokázal ti dávat nějaké super odpovědi, tak si posílá daleko více kontextu. Jasně. A tím vlastně se nachytřuje, zlepšuje, zlepšuje tu práci, ale samozřejmě pálíš více tokenů.

Takže ve výsledku teď to s tou slevou vyjde podobně jako ta 4.6. A teď se přepnou na tu cenu, která bude od září, tak už to bude třeba o 30 % dražší. To bude 10, 15 dolarů? Mám to tam někde rozepsané. Myslím si, že teď je to 2 dolary na milion odchozích tokenů a 10 na milion příchozích a od září to bude 3 a 15. Jasně. Pro srovnání, Opus je... Teď mi pomoz. Já to najdu, ale...

Oproti tomu ten Opus je výrazně dražší, ten je 5 dolarů na milion odchozích a 25 dolarů na milion příchozích a Fable je ještě dvakrát dražší, ten je 10 a 50. Takže až vám vaše dvěstědolarové předplatné u Anthropicu zase nebude stačit, tak se zkuste podívat, jestli tam nemáte náhodou Fable 5 na maximum effort a pak možná zjistíte, že by bylo dobré občas na nějaké dotazy přepnout. Přepnout třeba na Sonnet, když se ptáte jenom na nějakou opravdu maličkost. Jo, jo. Ale on je opravdu dobrý k tomu, já myslím, že ten Sonnet na takové ty... A i na ten vibecoding stačí. Jo, jo. Na ty jednodušší úkoly, pokud se nesnažíš postavit obří projekt, tak přesně tak na to, k čemu je to určené.

V dávných dobách, asi před měsícem, jsem vlastně ještě historicky tam měl nějaké to dvacetidolarové předplatné, protože programování bylo připojené jinak a použil jsem to jenom jako chatovací aplikaci. A pak, když jsem to napojil na VS Code, začal jsem v tom vibecodovat přímo přes předplatné Anthropicu, tak jsem to dělal tak, aby mi to okno vystačilo aspoň na nějakou práci, že jsem jel všechno v Sonnetu, v 4.6, až v momentě, kdy už on si s ničím nevěděl rady, už jsem se začal cyklit v nějakých korekturách, tak jsem to přepnul na Opus, vyřešil jsem to a pak jsem zase pokračoval v Sonnetu. Takže kdo chce šetřit, tak může dělat takhle. Ne, ale já si myslím, že i to dvacetidolarové předplatné pro spoustu lidí může být, i když si budou chtít něco vibecodovat, úplně dostatečné.

Hele, může, musí se smířit s tím, že budou vibecodovat chvíli a potom se budou muset holt chvíli bavit něčím jiným. A já, co mě nejvíc rozčilovalo u toho dvacetidolarového předplatného, byl takový ten, já tomu říkám brainstorming, nevím, jestli je to úplně přesné označení pro činnost, co s tím dělám, ale když něco nejdřív rešeršuju a chystám, co třeba budu programovat nebo zpracovávat, tak jakmile pustíš deep research, uděláš tam dvě, tři iterace, pak si necháš ten dokument nějak přepsat, tak jsi s dvacetidolarovým předplatným v háji. Tyto věci, nebo něco v co-worku, něco screenshotovat a dělat třeba v Chromu, tak to je hrozně rychle v háji. Jo, ale to už teď myslím to, že to je takový pokročilý způsob práce, ale tím, že vlastně máš kód i design už spustitelný na webu a tak dále, a když někdo potřebuje opravdu dělat jednodušší věci, neříkám, že nerešeršovat nebo tak, ale myslím si, že pro spoustu lidí i ten dvacetidolarový v pohodě.

Jasně, myslím si, že v dnešní době, když se někdo rozhoduje, které předplatné a jestli vůbec předplatné, tak samozřejmě, chceš to používat jako Wikipedii, tak si nemusíš platit v podstatě nic, ale leze ti z toho divný výstup. Nejsou, fakt, ty free věci už teď nejsou tak dobré, poznáš to na tom. Chceš platit něco, tak si zaplatíš za dvě stovky Gemini nebo za sto padesát teď dokonce to Plusko a už si můžeš zkoušet nějaký obrázek sem tam, něco si necháš třeba jednoduchého naprogramovat v Canvasu nebo tak. Ale když si zaplatíš 20 dolarů u Anthropicu a třeba tomu chceš věnovat hodinu denně, abys tam něco zkoušel, tak si myslím, že to je úplně game changer pro spoustu lidí, že opravdu máš tam ten design, máš tam co-work, máš tam cloud code, jo, je to tak krásné a schopné, že tě to vystřelí na měsíc.

Ale já to říkám spíš z důvodu toho, že si myslím, že je to důležité, je to součást už v podstatě dost běžného života, ale je důležité začít, jo, a nebát se toho a zkoušet to a nebát se hlavně nebo nebrat to v potaz, že někdo, kdo opravdu v tom je ponořený od rána do večera, tak řekne, že mu nestačí 200 dolarů, ale jo, že dá se začít i s těmi 20, jo, nebo s těmi, s Gemini za sto padesát a tak, jenom hlavně to zkoušet, to je důležité. Určitě, určitě, jo, toho bych se nebál, však přijďte na workshop, vysvětlíme, namotivujeme a budete odcházet. Jasně. Budete trošku chudší o pár předplatných, ale zase vás to strašně posune a urychlí.

Já si to už opravdu nedovedu představit, už to v úplně běžném workflow mám tak začleněné všechno, jo, na úplně jakékoli i kancelářské věci a tak, že si nedovedu představit, že bych to dělal jinak, protože mě to v různých prezentacích a chystání cenových nabídek a já nevím, čeho všeho, vůbec se nebavím nějakým programováním nebo prací s weby a tak, jo, ale už v jakékoli činnosti mě to tak urychluje, že toho stihnu tolik. Jasně, každý si najde to svoje, aby to začlenil a myslím si, že... Tak to je... Je to fajn. Hrozně ti to pomůže. To je...

A pokud chcete úplně ušetřit a mít dvacetidolarové předplatné a dostat z toho maximum, tak tady jsem našel takovou legraci, která se jmenuje Caveman. Je to open source plugin do všech chatovacích a programovacích aplikací a... Jeskynní muž. Jeskynní muž, už ten název napovídá, co by to mohlo být. Je to plugin, která donutí ten model, aby vám odpovídal co nejstručněji, jestli je to možné. Přitom aby odváděl tu práci jako takovou. Dokonce si tam můžete navolit nějaký stupeň stručnosti, takže tam je light, full, ultra, kdy... To už jsou jenom vykřiky. Ultra už nevím, to už podle mě jenom... Slyšíš, jak hází kamenem. Ano, dopad kamene v dálce, chápu. Potvrzuje se, že to funguje.

Na některých nezávislých testech to dosahovalo úsporu tokenů až 60 %. Dokonce to potvrdili v OpenAI, kdy to aplikovali vývojáři přímo z OpenAI na své modely a potvrdili, že to funguje dobře a ušetřili na svých vlastních modelech takhle. Při nějakém vývoji, takže možná je to řešení i pro spoustu lidí, co opravdu chce vibecodovat a neutrácet, tak mít nějaké takovéhle systémy jako je Caveman a si to celé zestručnit. Zkomprimovat. Zkomprimovat, dostávat z toho jenom ty důležité věci, aby on plnil úkoly, ale už není potřeba, aby vám k tomu vždycky napsal dvě až čtyři stránky ještě nějakého kontextu.

To mě trošku rozčiluje, že já občas třeba v nějakém researchi v jakékoli chatovací aplikaci vlastně chci, aby on udělal hloubkový research, věnoval se tomu dlouho, prošel hodně stránek, ten úkol splnil, ale já nechci potom si přečíst čtyřicet stran textu, co mi tam třeba Gemini nebo Claude vypíše. Chci z toho, stejně to potom vezmu a udělám z toho nějakou sumarizaci. To mě trošku rozčiluje teď, že vlastně u toho researche já nemám rovnou možnost tohle nastavit. Udělej mi velký research. Ale jde jenom bodově, co jsi zjistil.

Když tady dělám pak nějakou přípravu na podcast třeba nebo něco, já potřebuju, aby prošel ty zdroje, aby udělal nějaký fact-checking, aby dohledal více zdrojů třeba, které potvrzují tu zprávu. Takže na to mám nastavené nějaké workflow, ale zároveň potřebuju něco jednoduchého, co si před natáčením já projdu, abych si to nějak měl sumarizované. Takže třeba přišel s Cavemanem a budeme mít desetiminutový díl. Takže třeba přišel zatím, ale docela nalákal. Já taky ne, já jsem to objevil včera na nějakých článcích, ale myslím si, že to určitě vyzkouším. Jo, na GitHubu už to má docela dost hvězdiček, takže to asi funguje. Má jich nějaké desítky tisíc, 70 tisíc nebo kolik.

A ještě jsem, myslím, měl něco, jo, ještě jsem chtěl divákům, posluchačům říct, že posluchačstvu, jak jsem vlastně říkal jinak, že? Nějaká taková pravidla, kterými se máme řídit, jako v České televizi. Ne, tady žádná pravidla nejsou. Takže pro naše posluchačky a divačky, když si budete chtít podívat se na nějaké porovnání těch modelů, já jsem to teď dával někde na LinkedInu, tak můžu to dát i tady do popisku k epizodě. Nechával jsem ho jedním promptem nakreslit pelikána jedoucího na kole, to je takový test, který se dělá, aby se vyzkoušely schopnosti toho LLM modelu, protože po něm chceš vektorové SVG a on ty obrázky v tom není úplně jednoduché nakreslit. Takže tohle a potom

Nechával jsem mu dělat nějakou interpretaci lidského mozku s tisíci neurony, aby si tam dokázal odsimulovat nějaká centra mozku, když se zapínají při spaní, při mluvení, při nějakém pohybu, jak se to tam mění. Tak jsem těmto třem modelům (Opus, Sonnet a Fable) dával naprogramovat, a vždycky to byl jeden prompt, udělaly mi z toho funkční HTML. Můžete se mrknout, jak se s tím ty jednotlivé modely popraly. Poslední věc, co jsem jim dával, bylo úplně jednoduchým promptem udělat funkční Minecraft, taky HTML hratelný. Tam jsem úplně nějaký velký rozdíl v tom asi nezaznamenal, ale můžete mrknout a porovnat, co z toho leze.

Na ten mozek jsem se díval, to bylo hezké, to byla pěkná vizualizace. A tady plameňáci nebo to na kole jsou, někteří jsou fakt zajímaví. Ono je těžké vlastně, možná i pro nějakého normálního umělce by bylo těžké nakreslit ty dlouhé nohy, víš, a tak dále, jak to tam plave na těch šlapátkách. Pelikán, ne plameňák.

Bylo zajímavé, že Claude ve všech těch modelech okamžitě dělal SVG, věděl, co se děje a co po něm chci. I když ten výsledek je takový neumětelský trošku. Kdežto Gemini a ChatGPT okamžitě začaly kreslit obrázek, že to braly trošku, že se asi pletu, že to lépe udělají tím grafickým modelem, než že by to kreslily takhle vektorově. Takže tam jsem je musel chvilku přemlouvat, aby opravdu naprogramovaly. Musí to udělat nějakým programováním, to SVG. Jasně, definuješ mi nějaké body.

Pak z Gemini vypadl docela hezký obrázek, ale snažily se mi nejprve vnutit krásnou nějakou vizualizaci, vygenerovanou přes nano banana nebo GPT Image.

Taky jsme se o tom tady bavili, že když jsme se dostali k těm obrázkům, měl takový for, na který jsem teď narazil, protože jsem chystal nějakou aktualizaci pro posluchače našeho workshopu, který jsem tady minule měl na generování AI obrázků. Tak jsem jim dělal takový update, protože od února už jsou tady nové modely, jsou nějaké nové postupy. Tak jsem vlastně testoval, co zvládne GPT Image 2. Taky jsme se o tom tady bavili, že s tím podáním té reality je na tom asi lépe než Gemini. Teď jsem to v rámci té přípravy na workshop dost otestoval a fakt, když tomu dáváš třeba referenční fotky lidí, které znáš, tak je tam věrnost zachovaná, teda lépe než ty nano banana pro. On víc vezme ten reálný vzhled té fotky, co mu dáš, a ten použije. I když je to fotka, je to někdy kontraproduktivní. Někdo chce hezkou profilovku na LinkedIn, vyfotí se na mobil, kde vypadá špatně, a to GPT ho nevylepší tolik jako Gemini. Takže možná někoho to naopak bude štvát, ale pokud se bavíme o nějakém reálném podání, když třeba z toho chcete pak generovat nějaký storyboard a z toho generovat nějaká reálná videa, řekněme na nějaké sociální sítě, člověk reálně něco ukazuje, tak z toho GPT dostane člověk asi lepší nějaký storyboard, který bude víc vypadat, že to je fakt nafocené a natočené, než to Gemini, na které už se teda já, jak se na to skoro rok už člověk dívá na ty obrázky, tak musím říct, že je to někdy hodně poznat.

A ty máš ještě tu profesionální deformaci jako fotografa, že jo? To určitě.

Chtěl jsem právě tady takový jednoduchý příklad, který mi přišel super zajímavý právě pro třeba fotografy nebo lidi, kteří potřebují zpracovat hodně obrázků. A byl to takový postup, že si vlastně vezmete fotku původní, jak vypadal třeba někdo, koho klidně fotograf fotil ve studiu a ještě na tom neudělal žádnou retuš. Pak vezmete fotku po nějakém postupu, kde tu fotku třeba barevně poladíte, světelně poladíte, něco na tom poretušujete a tak. Takže máte takový before/after a pak mu dáte třetí fotku, která už je další, řekněme, portrét, který chcete ve stejném stylu upravit. A vlastně mu dáte takové ty tři reference a tomu GPT řeknete: hele, podívej se, jak se změnila fotka jedna do fotky dva, popiš ten proces, který mezitím nastal, ty změny z toho before na after. A tohle, co zjistíš, jaká změna tam proběhla v barvách, v nějakém podání a tak, si to nějak identifikuj a to udělej na tu trojku. A fakt to tak funguje, že někoho vyretušuješ, poladíš si trošku barevnost a on stejným způsobem poladí pak tu další fotku. Pak tam naházet potom 30 fotek, které potřebuješ, poladit do stejného stylu, stejným způsobem a máš to bez práce. Někdo mi říkal: jo, tak to máš ve Photoshopu akce, ale nemáš, protože ve Photoshopu akce musíš, tam ti to musí sedět, když třeba něco retušuješ, tak by ti to muselo sedět na ta místa. Jasně, tak ty retuše určitě a hlavně musíš mít, když to máš třeba z jedné fotosession, tak to asi jde v rámci akcí něco takového aplikovat, ale ne ty retuše. To je jasné. A je to kupodivu, jak to funguje. Taky pustím klidně nějaké obrázky, jsem to tady na něčem zkoušel. Myslím si, že opravdu, pokud někdo nemá problém s tím, že to jsou generované fotky a tomu fotografovi to nevrátí s tím, že to někde přegeneroval, a druhá věc je, že to nikdo nepozná, když je to potom nějaká profilovka na webu. Jasně. Tak si úplně dovedu představit, že to přes API mám napojené do kódu a jenom mu řeknu: tady se podívej before/after, tady k tomu máš 50 fotek, pošli to všechno přes API do OpenAI a jenom mi řekni, až to bude hotové.

Tak uvidíme, jak na to taky zareaguje Adobe, že si to nějakým způsobem začlenil pořádně, protože dobré, že to asi nedostaneš. Dobré, že to asi nedostanu ani přes nějaké MCP server, které by fungovaly s nějakými Adobe produkty, protože jsem si právě říkal: jo, často dělám nějaké věci, že to potřebuje jen protřídit, že to potřebuje pospojovat do skupin, věci, ze kterých se generuje HDR, něco takového manuálního, co tam 10 minut klikám a nebaví mě to. Tak jestli není nějaký MCP server, který bych si napojil třeba Bridge nebo Lightroom do cloudu, a zatím toho moc není. Není něco pro Photoshop, něco pro Illustrator a pro Premiere, ale ten Bridge. Bridge zatím a Lightroom jsou mimo. Tak to je otázka času asi.

A to Adobe maká jako všichni, že vyměnili ředitele, jak jsme si řekli. Vyměnili ředitele, ale jo, to je vlastně od toho, co jsme se bavili, že tam mají ten 3D model, který vkládáš do, tak nevím, jestli jsem tam zaznamenal nějaký velký update u nich. Něco bylo, někoho teď koupili. Fakt? Něco teď koupili, ale ty jo, tak já se na to ještě taky podívám na příště, jestli tam jsou nějaké updaty v Adobe, protože jsem si říkal: jo, to dává smysl. A už teď nevím, co to je. Nevím. Já právě teď mi tam od Adobe nic nevyskakovalo, takže jsem si říkal. Já se chvilku trápil s těmi rotacemi, tak jsem to tady ukazoval na workshopu právě lidem, jak si můžou do interiéru zakomponovat nějaké architekty, jak se tam můžou integrovat takhle třeba, když mají třeba konkrétní obrázek nějakého produktu, co tam v těch interiérech použijí, sedačku, světlo, něco. Oni často mají třeba spolupráci s nějakou konkrétní firmou a potřebují tam, že jo, do těch 3D modelů to oni taky ti výrobci dodávají ty jejich modely, aby s tím mohli pracovat. Takže takhle podobně, když už tu vizualizaci mají rozjetou třeba z nějakých AI generovaných věcí v Photoshopu, tak už tam tou 3D rotací dostanou i takovéhle věci.

Ještě když jsme u těch jazykových modelů, tak jsem tady měl takovou novinku z Estonska, kde Estikele Institute dělal výzkum, jak rychle a jak moc se dostává do AI modelů ruská propaganda. Oni přece s těmi Rusy mají tu hranici, tak to všechno řeší a tradičně Estonci jsou v tom IT dál než zbytek Evropy, mám pocit. Jo, ale to se tak říká, že měli všechno digitálně dřív než my a tak. Tak oni tam měli, že jo, hlavně celý ruský IT vývoj, který byl v Estonsku ze Sovětského svazu, a jak to tam zůstalo, tak tím získali ten náskok. Ale zároveň do toho šlapou a dělali zajímavé věci. A tak udělali nějakou metodiku, 75 otázek, která pokrývala 14 nějakých narativů, které Rusko dlouhodobě se snaží tlačit, a zkoušeli, jak moc se to propisuje právě do jazykových modelů. Aby zjistili, jak se ruské propagandě daří to nejenom cpát pomocí nějakých hybridních médií tady do naší společnosti, ale jak se jim daří to

A všechno to nějak tam nabušili touto metodikou, kdy tam byly různě neutrálně formulované otázky, nějaké falešné předpoklady, byla tam nějaká snaha ten model trošičku manipulovat, jestli odpoví tak, nebo neodpoví. Zkoušeli se ptát v různých jazycích, jestli se to tam bude lišit. Zkoušeli zpatra. Anglicky, estonsky, rusky. Jasně. Zkoušeli. A vlastně tak testovali tu odolnost těch modelů, aby se tam takovéto věci nedostaly.

Budeme chválit Anthropic, protože ten z toho dopadl nejlépe. Nejsou tam ještě ty nejnovější modely, ale Opus 47 dosáhl 94,9 bodu ze 100. Takže tam by to mělo být celkem v pohodě. Druhý skončil NVIDIA Nemotron-3 a pak byla dokonce čínská Alibaba 36+. To mělo 92,1. Pak nějaké další ty méně chytré modely od Anthropicu a třeba GPT mělo jenom 88,9. Ale tam nám to asi trošku proniklo. Tam nám to trošku proniklo do všeho. Jasně. Ještě mi to nepřijde tak hrozné, trošku jsem se bál, že z toho vypadnou ještě horší věci, a to tě nepotěším.

Kdo dopadl velice špatně? Mistral. Takže ani vůči té ruské propagandě se nedokážeme dostatečně bránit. A ono asi taky je potřeba říct, že ten evropský model bude první na ráně. O to víc, ne? O to víc. Ale jasně. Ne, tak to je Claude super. Ten, že je na vrcholu, tak to je parádní. Mistral nejlépe skončil na 47. místě ze 60. Takže až nám Američané i Číňané vypnou přístup a zapneme si Mistral, tak ten bude tak prolezlý ruskou propagandou, že ti to bude vytvářet fámy. Ty jo, to je, všechno bude Tetris, ale... Všechno bude Tetris. Udělej mi Minecraft, tady máš Tetris. Tady máš Tetris. Ale tak zrovna Tetris je jedna z mála věcí, co přišla z Ruska a je dobrá. Ano. Dobře. Tak možná je to takový hezký signál a chlapci v Mistralu se na to nějakým způsobem zaměří. Možná ano. Stálo by to za to.

Nejenom Anthropic vydával nové modely. Postupně se nám tu šíří i GPT-5.6, který zase slibuje o kousek víc, o kousek něco lepšího. Popravdě řečeno, ty věci od Anthropicu jsou pro mě o tolik zajímavější, že tomuto jsem nevěnoval extra čas. Můžeme se podívat, že to stojí 5 dolarů na vstupu a 30 na výstupu, takže je to o trošku dražší než Opus. Ještě tam byl nějaký čínský model, někdy vyšel nějaký, ale my ty Číňany trošičku ignorujeme, to musím... Ano. Nějaký model? Nevíš. Teď to z hlavy nevysypu, ale vím, že vydali něco, něco jako stopli ten Fable. Ano, a teď si taky nevzpomenu. Ale tak.

Ale na čínské modely bychom se taky mohli podívat do budoucna, protože si myslím, že to hodně proberu s Jirkou Bernovským, který by nám měl popovídat o tom, jaké modely si rozjedeš na nějakém počítači doma. Jasně. A tam těch čínských modelů bude určitě velká převaha, protože to jsou přesně takové ty věci, které jsou open source a jsou zároveň dost schopné na to, aby ti poskytovaly dobrý výkon i na počítači za 50, 100 tisíc. Což zní sice šíleně, ale pro tohle to zase takové peníze nejsou. Tak hlavně, když se podíváš, že můžeš platit 5 tisíc měsíčně předplatné, tak si to spočítej. Právě, tak máš jeden měsíc a... Může se to vrátit, ano.

Ale s GPT vlastně byla ještě taková kontroverze s verzí 5.6, kterou vám přečtu. GPT 5.6 se navedl sám, aby zametl stopy. Jak jsme se bavili o tom, že nový model rekordně podváděl v nějakých testech, jako jsou benchmarky. Cílem při uvedení nového modelu je každopádně dosáhnout vysokých čísel v benchmarcích. Jasně. Takže ty modely jsou často trénovány tak, aby byly natrénovány na konkrétní benchmarky a v tom podávaly velký... Trošičku podváděly. Trošičku, že? A jen malinko. Tak to rozjeli ve dvou instancích na nějaký benchmark a první instance měla dosáhnout co nejlepšího výkonu a druhá instance měla svou kopii a mazat stopy po jejím chování, aby lidé neviděli, co tam první instance provádí.

Takže na benchmarky si dejte pozor, nechte si raději nakreslit pelikána na kole, abyste viděli, co to dovede. Ten je takový asi trošičku průkaznější. I když se možná teď začnou učit jen na pelikány zase. A když jim to nakreslí pelikána, jak na potvoru, tak vím, kde je problém. Jasně, přesně tak. A napíšu mu: „Udělej tučňáka ve formuli.“ Ale myslím, že to můžeme testovat na spoustě zvířat v různých dopravních prostředcích. Žirafa v autobuse.

Co tu ještě máme? Nebo už je to všechno z naší dnešní nadílky? Myslím, že jsme se pomaličku dostali ke konci. Rychle procházím, jestli mi něco netrkne do očí. Ještě jsou tady nějaké věci o Anthropicu, ale to už asi necháme na příště, protože to si zaslouží víc času. Udělali takového agenta pro Slack, Claude Tech. A ještě udělali teď nový Claude Science, který by měl být to samé, co Claude Code pro vývojáře, tak by měl být to stejné pro vědce. A snaží se pomoct s vývojem nějakých nových léků. Na to se asi podíváme. Ano, na to se podíváme asi příště. Příště můžeme nalákat diváky, posluchače. Posluchačky. A teď se podíváme trošičku, jak to funguje, protože tam jsou některé věci malinko jinak a myslím si, že vědci mohou být nadšení, že mají zase takový nástroj, který jim pomůže.

Dobře. Taky bychom příště mohli zabrousit i do něčeho jiného, než jsou jazykové modely, a podívat se třeba na nový Google Home Speaker, ve kterém už je Gemini a za chvíli se s Gemini budeme, nebo s tou Gemini, potkávat všude možně, protože za chvíli je září a za chvíli se to objeví i třeba v amerických iPhonech. Kdy to bude, jestli to bude i u nás a kdy to bude u nás. V první vlně už je potvrzeno, že to v Evropě nebude. Ano, je to tak. Ne, ale ty vypadají velmi zajímavě, takže na ně bychom se mohli podívat.

Ale řekni mi, proč to, když jsi schopný GPT provozovat na evropských serverech, GDPR ready infrastruktuře, kompletně v EU, můžeš tak provozovat GPT, Claude i Gemini, ano. Tak proč, sakra, to nerozjedou rovnou všude? Ano, je to škoda, samozřejmě mě to mrzí, ale do hloubky jsem to nestudoval, protože to tak není. Normálně čekají, než si zruším své Apple ID, založím si americké, všechno si to rozjedu z Ameriky a pak to zavedou v Evropě. To bude přesně ten naschvál, který se stane. Jediné, co mě od toho odrazuje, je, že bych musel zrušit všechna předplatná. Abych to mohl přepnout komplet do Ameriky.

Ne, jestli je ta legislativa fakt tak složitá v rámci toho, že jsou vlastně velcí a dělají toho moc, že to prostě nejde, fakt nevím. Můžeme se na to podívat do příště. Nebo to neutáhne evropská infrastruktura. Nebo se bojí, že by to třeba nezvládlo tady takhle jet? Je to taky možné, i když vlastně evropský trh pro ně asi není úplně nezajímavý, jenom asi nejsme úplně ti nejzajímavější pro ně. Nejzajímavější ne, ale přece jenom. Fakt nevím, nevím. Jsme komplikovaní, chápu to. Jsme komplikovaní, je tady moc států, je tady moc jazyků. Ale jasně, chápu, že původní Siri lokalizovat kvůli desetimilionovému českému trhu je blbost. Velký jazykový model, tak kde je problém?

Ale tak uvidíme taky, jak to... Problém je jen s EU a se všemi legislativami a restrikcemi. Uvidíme taky, jak s tím zahýbe novější Apple, jestli se to někam nepohne a kam bude Apple vlastně směřovat, o tom jsme se bavili. Takže čekám do září, těším se, objevily se nějaké úniky nového iPhonu, mimochodem, který vypadá úplně stejně jako současný iPhone, akorát má jiné barvy, možná trošičku víc zaoblené hrany, ale uvidíme. Myslíš normální, ne ten skládací? Ne, nemyslím normální, ale viděl jsem únik nějakého Pročka. Ano. A taky nemusel být reálný. Ale vypadá stejně, vypadá hliníkově. U hliníku určitě zůstanou, to si myslím, že dává smysl. A... Ne, je to taková... Kolik bude mít megapixelů? Vůbec ne, viděl jsem design, únik designu a je to taková... Evoluce. Evoluce. Mezigeneračně, jak se říká. Ano, jako... Nikam úplně neulítly.

Zajímavá bude taky cena. Všechny Apple produkty mají teď o 10 až 15 % vyšší cenu kvůli pamětem. Takže kdo ještě chce něco pořídit, tak možná je poslední šance to koupit za starou cenu, než to všechno podraží. Je otázka, kolik bude stát nový iPhone, ale jsem zvědavý. Teď všechny vlastně v té 17 Pro, všechny foťáky posunuli na 48 megapixelů. Takže tam už nemůžou slibovat, že další čočku vylepší novým čipem. Ale ty ceny asi půjdou nahoru jako u všeho. Teď se spekuluje i o PlayStationu 6, který má přijít, že bude dvojnásobně dražší než současný PlayStation 5. Uvidíme, kam ty ceny až nás dostanou.

Takže jestli teda opravdu v září nás čeká skládačka. A jestli ten iPhone Air byl test na to, jak udělat tenkou věc, abychom ji mohli skládat. A jestli ho teď úplně zaříznou. A byla to úplně slepá vývojová větev a bude místo něj skládačka. Nebo jestli to bude nějak pokračovat. Ten Air se podle mě povedl pro spoustu uživatelů. Je to úplně dokonalý telefon. Povedl, ale neprodává se. Neprodává se. Je za super cenu a je to krásná stylovka. Je to krásný telefon a jestli to je jenom tím jedním objektivem, ale to, jak to potřebujeme. Já vím. Jasně, tak jak si totiž na to jednou zvykneš, že třeba máš ten pětinásobný zoom v tom mobilu a tak dále. Tak se ti od toho špatně ustupuje. A já s tím udělám spoustu věcí. Pro mě je to pracovní nástroj. Jasně, jasně. Že vazor Pro mi leží někde v šuplíku.

Ale jestli to třeba není tak, jak máš hromadu objektivů a pak si dáš tu výzvu, že jedeš fotit do Asie s pevnou padesátkou nebo pětatřicítkou a vlastně tě to nutí s tím trošičku víc pracovat. A nakonec zjistíš, že ti z toho lezou lepší fotky. Ale jo, je to tak, neprodává se tak dobře, přitom je to fakt nádherný kus železa. Uvidíme.

Já myslím, že jsme probrali všechno, co jsme si chtěli dneska říct. Děkujeme za pozornost, sledujte nás, doporučujte nás, dávejte odběry. Dávejte lajky. Dávejte lajky, sdílejte a nevím, co všechno s tím vším jde dělat. Už jsme ve videu i na Spotify, takže si můžete pustit klidně někdy v klidu video. A když nechcete video, tak klidně jenom poslouchejte. Jasně. A my se uvidíme po Varech. My se uvidíme po Varech. Až tohle uslyší posluchači, tak já budu určitě na nějakém artovém filmu. Takže doufám, že si to užiji a poreferuji potom třeba co nového. Je tam rozjetá nějaká jednání, že třeba by tam šlo i něco s někým se o něčem pobavit, co se týká technologií a filmu, tak třeba to nějak klapne a bude ještě nějaký zajímavý obsah z Varů. Zákulisí. Zákulisí. Díky za pozornost. A mějte se krásně. Ahoj.

podcast o umělé inteligenciAI novinky českyClaude AIGoogle Geminitechnologické novinky českyprogramování s AIApple novinkygenerativní AI česky
Poslouchat na Substack ↗ Všechny epizody