← Zpět na hlavní stránku

AI novinky česky: Google Veo 3, Tencent a Copilot pro vládu USA

·16:07
Shrnutí epizody

Tato epizoda rozebírá nejnovější AI novinky česky, konkrétně široké zpřístupnění nástroje Google Veo 3 pro generování videa. Představuje také inovaci od Tencentu v podobě automatického generování zvukových efektů a strategický krok Microsoftu, který nabízí Copilot zdarma pro vládní sektor USA. Celkově se zaměřuje na to, jak generativní AI česky i globálně mění kreativní průmysl i veřejnou správu.

Hlavní body

Přepis epizody

Toto je podcast, kde skončí zítřek. Vítejte, společně prozkoumáme, jak umělá inteligence a technologie přetváří práci, kreativitu i volný čas. Tento podcast vzniká s pomocí umělé inteligence, která asistuje při přípravě obsahu i hlasové syntéze. Navzdory snaze o dokonalost může epizoda obsahovat drobné nepřesnosti. Tak vítejte, dnes se podíváme na pár čerstvých novinek ze světa umělé inteligence. Od velkých hráčů, Microsoftu, Googlu, a také něco z Číny, od Tencentu. A také se dotkneme toho, jak AI vstupuje do specifické oblasti Web3. Ano, jsou to vlastně všechno docela aktuální zprávy, které popisují tyto inovace. A cíl pro dnešek. Chceme prozkoumat, jak tyto nové věci posouvají hranice AI. A to v různých oblastech. Dobře, tak pojďme na to.

Začneme u Microsoftu. Ten totiž udělal docela, řekl bych, výrazný krok. Myslíte ten Copilot pro americkou vládu? Ano, nabízí své AI služby Copilot, a to zdarma, pracovníkům federální vlády USA, což je potenciálně obrovský zásah. Mluví se o milionech uživatelů. Miliony, to je dost. A jde konkrétně o Copilot pro Microsoft 365. Tedy ten nástroj, který funguje přímo v Officech. Word, Excel, Teams. Jasně, ten integrovaný asistent. Cílem má být prý zvýšení produktivity. Pomoc se shrnutím, psaním konceptů, analýzou dat a tak podobně. Je to hodně zajímavý tah, nasadit takto komplexní nástroj a zdarma? Pro tak obrovský aparát? Počkat, zdarma pro miliony úředníků? To zní skoro až podezřele velkoryse. Není v tom nějaký háček? To asi nebude. Je to spíše, řekla bych, velmi chytrý strategický krok. Jak to myslíte? Představte si to. Microsoft tím získá obrovskou referenci. Etabluje se na velmi lukrativním trhu vládních zakázek. Zaměstnanci si na ten Copilot zvyknou, začlení ho do práce. A až to bezplatné období skončí. Tak bude pro vládu snazší zaplatit Microsoftu, než hledat něco jiného, na co nejsou zvyklí. Ano, ano. To je jedna věc. A druhá, neméně důležitá, je získávání poznatků. Samozřejmě, všechno musí být v rámci přísných pravidel ochrany soukromí a bezpečnosti. To doufám. Ale i anonymizovaná data o tom, jak miliony úředníků reálně používají AI nástroje. Jaké funkce jsou top, kde to drhne, co se automatizuje. To jsou pro Microsoft nesmírně cenné informace pro další vývoj. Takže testování a sběr dat ve velkém, i když anonymizovaně. A tak je to obrovská živá demonstrace hodnoty. Ukázat na tak masivním vzorku, jak AI může reálně usnadnit práci. Lepší reklamu si asi přát nemohou.

Dobře. A co ta bezpečnost? Přece jen vládní data jsou často citlivá. Je to vůbec bezpečné? To je naprosto klíčová otázka. A určitě ta největší výzva. Microsoft musel bezpochyby projít extrémně přísnými bezpečnostními audity a certifikacemi. Těmi specifickými pro americkou vládu. Nabízejí různé úrovně zabezpečení, že? Přesně tak.

Dobře. Pojďme teď od úředníků ke kreativitě. Google totiž oznámil širší dostupnost svého nástroje pro generování videa pomocí AI. Jmenuje se Veo. Ano, Veo. A zdá se, že v této oblasti začíná být docela plno, že? OpenAI má Soru. Nedávno se mluvilo o Kling od Kuaishu. Je to tak? Ten závod v generování videa AI teď akceleruje neuvěřitelným tempem. Google s Veo slibuje schopnost generování videa ve vysokém rozlišení 1080p. A prý mají být koherentní i přes minutu délky. Ano, to tvrdí. Že jsou vizuálně i příběhově koherentní. Což je velký posun oproti dřívějším pokusům. A zajímavé je, že jako vstup může sloužit nejen text, ale i obrázek, nebo dokonce i jiné video. Google také hodně mluví o té kontrole nad stylem, tónem a hlavně o schopnosti udržet konzistenci postav a objektů napříč scénami. To byl často problém, že? Určitě. U starších modelů se postava v každém záběru trochu měnila, bylo to vidět. Pokud tohle Veo zvládá lépe, je to velké plus. Co je na tom vlastně fascinující, je ta rychlost. Ještě před rokem, už snad dvěma. Právě. AI generované klipy byly spíše takové krátké, trhané experimenty plné divných chyb. A teď tu máme nástroje, které aspirují na produkci minutových, relativně kvalitních a souvislých videí. Demokratizaci tvorby videa, jak se říká. Rozhodně. Vytvořit krátký spot, vizualizaci, animaci. Dříve to bylo náročné na vybavení, lidi, čas. Teď se ta bariéra skutečně snižuje. Zmiňovali také, že Veo rozumí filmovým pojmům jako časosběr nebo letecké záběry. To je také docela silné. Není to už trochu děsivé, jak moc ta AI chápe vizuální jazyk? Nejen rozpoznávat objekty, ale i chápat kontext, kompozici, vizuální techniky. Z toho obrovského množství dat, na kterých trénovali? Ale není to lidské chápání? Určitě ne. A stále jsou tu velké technické výzvy. Udržet perfektní koherenci a logiku děje po celou minutu, to je extrémně těžké. Stejně tak zajistit fyzikální realismus, jak se věci hýbou, jak reagují na světlo, gravitaci. V tom AI pořád dělá chyby. Přesně. Porozumět komplexním a nuancovaným pokynům je klíčové. Aplikace jsou asi jasné. Marketing, vzdělávání, možná i film.

Ale co ty stinné stránky? Deepfakes, dezinformace. Není právě generování videa ta nejnebezpečnější oblast AI? Je to určitě oblast s vysokým rizikem. O tom žádná. Technologie jako Veo nepochybně usnadňují tvorbu velmi realistických falešných videí. Zneužití, šíření dezinformací, podvodům? Bohužel ano. Google a další se snaží implementovat ochranné mechanismy. Třeba vodoznaky, ale je to neustálý boj kočky s myší. A co autorská práva? To je další velká otázka. Na jakých datech se model učil? Komu patří práva k výslednému videu? To jsou věci, které se teprve řeší. Právně i eticky. Google to integruje do YouTube Shorts a platformy VideoFX. Takže chtějí, aby to tvůrci začali rychle používat. Pro tvůrce to může být revoluce, ale i velká zodpovědnost. Musí se s tím naučit zacházet eticky.

Dobře. Takže máme obraz, teď zvuk. K dokonalému videu patří i dokonalý zvuk. A tady vstupuje na scénu čínský Tencent se svým AI modelem Hunyuan. Ano, Hunyuan. Ten teď umí něco, čemu říkají videofóly. Což znamená, že AI dokáže automaticky vygenerovat a přidat realistické zvukové efekty k němému videu. Kroky, šustění oblečení, déšť. Přesně. Je to naprosto klíčové pro atmosféru a uvěřitelnost. Vtahuje nás to do děje. A tradičně je to velmi pracná disciplína. Vyžaduje speciální studia, rekvizity a hlavně velmi zkušené lidi, ty foley umělce. Jak to technicky funguje? Velmi zjednodušeně řečeno, ano. Technologicky je to ale mimořádně komplexní. Ten AI model musí nejdříve pomocí pokročilého počítačového vidění velmi detailně analyzovat, co se ve videu děje. Jaké objekty, jak se hýbou materiály. Ano, ano. A také celková scéna. Kontext. A na základě této analýzy pak generativní audio model syntetizuje odpovídající zvuky. Musí rozumět fyzice zvuku, akustice prostředí a hlavně dokázat ten zvuk perfektně časově synchronizovat s obrazem. Často na milisekundy přesně. To zní jako kombinace několika špičkových AI technologií. Přesně tak. Je to rozpoznávání obrazů plus generování audia na velmi vysoké úrovni.

A myslíte, že tohle může opravdu nahradit ty lidi, kteří dělají ruchy ve filmech? Ty foley umělce? Myslím, že v dohledné době spíše ne. Ale alespoň ne u velkých kvalitních produkcích. Ta lidská kreativita, cit pro nuanci, schopnost vytvořit opravdu unikátní a emotivní zvukovou stopu, to je podle mě pořád nenahraditelné. Ale jako nástroj. Ano, jako nástroj pro rychlé ozvučení videí pro sociální sítě, pro menší produkce s omezeným rozpočtem, nebo jako pomocník pro profesionály, který zvládne ty rutinnější zvuky. Tam to může být obrovský přínos. Určitě. Je to další důkaz, jak AI postupně proniká do všech aspektů tvorby obsahu. Od scénáře přes obraz až po zvuk.

Dobře, od kreativních nástrojů teď k něčemu výrazně techničtějšímu. K vývoji softwaru, a to ve specifické oblasti Web3. Naše podklady zmiňují vznik specializovaných AI platforem určených přímo pro kódování v tomto prostředí. Ano, to je také zajímavý trend. Co přesně dělají tyto platformy? V podstatě fungují jako takoví inteligentní asistenti pro vývojáře, pro ty, kteří tvoří aplikace a systémy pro ten decentralizovaný svět Web3, pro blockchain, kryptoměny a podobně. Takže pomáhají s tvorbou, nasazováním, správou těch dApps a chytrých kontraktů. Ano, přesně. Těch decentralizovaných aplikací dApps a chytrých kontraktů jsou vlastně programy běžící na blockchainu. A jak konkrétně pomáhají? Umí třeba generovat kód? Ano, to je jedna z funkcí. Mohou navrhnout kostru chytrého kontraktu podle zadání v přirozeném jazyce, což je docela užitečné. Ale umí toho víc? Předpokládám. Určitě. Pomáhají s hledáním a opravováním chyb v kódu, s debuggingem, což je v prostředí blockchainu extrémně důležité, protože chyby tam mohou vést k nevratným finančním ztrátám. To je pravda. Vývoj pro Web3 má svá specifika. Programovací jazyky jako Solidity jsou relativně nové, celý ekosystém se velmi rychle vyvíjí. A jak jsem říkala, ta bezpečnost je naprosto kritická. Jasně. Chytré kontrakty často spravují reálné peníze. Přesně. A jakákoliv chyba může být fatální. Takže tyto AI platformy mohou výrazně snížit bariéru vstupu pro vývojáře, kteří chtějí do Web3 proniknout. Nemusí se učit všechno od nuly. Tak nějak. AI jim poskytne základ, upozorní na rizika, pomůže s optimalizací. Zajímavá synergie.

Myslíte, že AI může pomoci Web3 technologiím k většímu rozšíření a přijetí? Myslím, že ano. Tím, že zjednodušuje a zabezpečuje vývoj, může AI přispět k rychlejšímu vzniku kvalitnějších a bezpečnějších decentralizovaných aplikací. A naopak. Může blockchain pomoci AI? Někteří vizionáři o tom uvažují. Že by blockchain v budoucnu mohl poskytnout transparentní a

decentralizovanou infrastrukturu pro trénování a provoz AI modelů. To je spíš hudba budoucnosti. Každopádně vznik těch specializovaných AI nástrojů pro web 3 ukazuje dvě věci. Jednak, že ten web 3 ekosystém dospívá a stává se komplexnějším. A jednak to potvrzuje obecný trend, že AI se stává nepostradatelným pomocníkem pro vývojáře napříč všemi technologiemi.

Dobře. Když se tedy na tyto různé kousky skládačky podíváme zblízka. Pro zvuk? AI pro web 3 kódování. Co nám to říká o tom, kam obecně AI směřuje? Jaké společné jmenovatele tam vidíme? Vidíme několik jasných trendů. Za prvé, to naprosto zběsilé tempo inovací. Co bylo před rokem sci-fi, je dnes v beta verzi nebo dokonce široce dostupné. To je pravda. Je to tak rychlé? Za druhé vidíme hlubokou integraci. Velcí hráči jako Microsoft, Google, Tencent nezavádějí AI jako něco samostatného. Do Office, do YouTube, do cloudu? Přesně. Do kancelářských balíků, videoplatforem, cloudových služeb, vývojářských nástrojů. A tím se AI velmi rychle a přirozeně dostává k milionům, možná miliardám uživatelů.

Takže AI se stává součástí všeho. Podobně jako se kdysi stal internet nebo mobily? Dá se to tak říct, ano. Jako zesilovač, který nám umožní dělat věci rychleji a lépe. Jsem s tím. Dobrá otázka.

Díky, že posloucháte podcast Kde skončí zítřek. Nové díly vycházejí každé pondělí, středu a pátek. Tak nás následujte, ať vám nic neuteče. A sledovat nás lze na Substacku, na všech sociálních sítích i na webu www.apokalypsa.cz.

AI novinky českygenerativní AI českytechnologické novinky českybudoucnost technologiíautomatizace s AItech podcast českypodcast o umělé inteligenciAI brief česky
Poslouchat na Substack ↗ Všechny epizody