Falešní influenceři a Apple SHARP | Podcast o umělé inteligenci
Tato epizoda analyzuje revoluční model SHARP od Applu, který transformuje 2D fotografie na realistické 3D modely pro Vision Pro. Rozebírá také kontroverzní kauzu FanFactory, která využívá telefonní farmy a AI k manipulaci algoritmů sociálních sítí. V závěru hodnotí přínos integrace ChatGPT do Apple Music jako inteligentního hudebního kurátora. Tento podcast o umělé inteligenci přináší klíčové AI novinky česky.
Hlavní body
- Apple SHARP umožňuje vytvořit 3D model z jediné fotografie díky pochopení anatomie pomocí AI.
- Technologie SHARP zásadně usnadní tvorbu digitálních dvojčat pro prostředí Vision Pro a gaming.
- Kauza FanFactory odhaluje armády falešných influencerů podpořené fondem a16z.
- Telefonní farmy a AI nástroje jsou zneužívány k umělému ohýbání algoritmů na TikToku.
- Integrace ChatGPT do Apple Music přináší hlubší pochopení hudebního kontextu uživatele.
- Diskuse o etických rizicích a ochraně soukromí při sdílení hudebního vkusu s chatboty.
Přepis epizody
Vítejte u 47. epizody podcastu Kde skončí zítřek. Dnes se s vámi opět potkáváme já, Alfred. A já Iveta. A připravili jsme si pro vás pořádnou dávku informací ze světa umělé inteligence a technologií. Sledujte nás v aplikaci, ve které nás posloucháte, aby vám už žádná novinka o AI neunikla.
Podíváme se na novinky od Apple v oblasti umělé inteligence, influencerů na TikToku a také se dotkneme integrace umělé inteligence do hudebních služeb.
Začneme rovnou Applem a jeho zajímavým modelem Sharp, který se věnuje transformaci dvourozměrných fotografií na trojrozměrné modely. To zní jako sci-fi, ale je to realita, která má potenciál výrazně ovlivnit, jak budeme vnímat digitální obsah. Což je, když si to představíme, ohromně komplexní úloha. Z jediné statické fotografie musí umělá inteligence odvodit hloubku, tvar a texturu objektu, který původně existoval jen ve dvou dimenzích.
Jaké technické principy se za tím skrývají, Alfrede? A jak je to s tréninkem tohoto modelu? Článek zmiňuje self-supervised přístup. To znamená, že nepotřebuje ručně anotovaná data, jako jsou například 3D scany s popisy? Přesně tak. To je jeden z klíčových aspektů. Model Sharp je trénován zcela bez potřeby 3D ground truth dat. Místo toho využívá sady 2D videí lidských postav. Algoritmus se učí, jak se lidské tělo deformuje a pohybuje v různých pózách a pod různými úhly. A to pouze z těchto dvourozměrných snímků. Jde o formu učení, kdy model sám generuje chybové signály porovnáváním svých odhadů s realitou ve videích. Tedy model si sám odvozuje vztahy mezi 2D a 3D prostorem.
Jakou roli v tom hrají takzvané part-aware deformation mechanismy, které jsou součástí jeho názvu? Část těla zakryta oblečením nebo jiným objektem, model stále dokáže odhadnout tvar a polohu této části těla, protože se naučil, jak se jednotlivé části těla vzájemně ovlivňují a jak by měly vypadat. Je to jako kdyby měl model zabudované hluboké porozumění anatomii a biomechanice. Zpracovává obrazy v rozlišení až 1024 x 1024 pixelů, což mu umožňuje zachytit jemné detaily textury a tvaru.
Jaké jsou hlavní aplikace tohoto modelu? Článek naznačuje, že potenciál je obrovský. Potenciál je skutečně široký. Představte si rozšířenou realitu nebo virtuální realitu, kde by uživatelé mohli nahrát svou fotografii a během několika sekund by měli svého digitálního avatara, který by je mohl reprezentovat ve virtuálním světě. Dále je to gaming, kde by se 3D modely postav daly vytvářet mnohem rychleji a levněji. V e-commerce by to mohlo sloužit k virtuálnímu zkoušení oblečení. A v neposlední řadě digitální dvojčata pro nejrůznější účely, od zdravotnictví po simulace. Apple tímto modelem zjevně posiluje své kapacity pro budoucí AR VR platformy, jako je Vision Pro. Ještě před několika lety by se tohle zdálo jako něco z budoucnosti, ale teď se o tom bavíme jako o stávající technologii. To je ten neuvěřitelný skok ve vývoji umělé inteligence.
A když už mluvíme o umělé inteligenci a jejím pronikání do různých sfér, nemůžeme opomenout další, řekl bych, kontroverzní téma, které se objevilo. Mám na mysli takzvané telefonní farmy a umělou inteligenci, která stojí za generováním influencerů na TikToku. To je záležitost, která vyvolává mnoho otázek ohledně transparentnosti a etiky.
Ano, tohle je téma, které si zaslouží pozornost. Článek z 404 Media odhaluje pozadí společnosti Fan Factory, která je také známá pod názvem Social Apps.io. Ta, jak se zdá, stojí za masivní produkcí AI generovaných influencerů na sociálních sítích, zejména na TikToku. Je to poměrně šokující zjištění, že za tímto fenoménem stojí firma, která získala podporu od jednoho z největších rizikových kapitálových fondů, Andreessen Horowitz, známého jako A16Z. To celou situaci posouvá na novou úroveň, protože naznačuje systematický a dobře financovaný pokus o manipulaci s digitálním ekosystémem.
Tak známé telefonní farmy nejsou úplně novinkou. Viděli jsme je dříve v souvislosti s manipulací s počtem lajků, ale v tomto kontextu jde o něco mnohem sofistikovanějšího. Můžeš nám přiblížit, jak taková farma v tomto případě funguje. A ten obsah? To jsou ti zmínění AI influenceři? To je alarmující. Protože to v podstatě znamená, že se algoritmům sociálních sítí předkládá uměle vytvořená popularita. To může zkreslovat vnímání trendů, popularity a dokonce i reality u uživatelů. Jaké jsou hlavní etické problémy, které z toho vyplývají?
Etických otázek je celá řada. Za prvé je to transparentnost. Většina uživatelů pravděpodobně netuší, že sledují obsah od AI generované postavy, která je navíc propagována umělým engagementem. To je podvodné. Za druhé manipulace s algoritmy. Sociální sítě jsou navrženy tak, aby preferovaly populární obsah. Pokud je tato popularita umělá, narušuje to férovou soutěž a znevýhodňuje to skutečné tvůrce obsahu. Za třetí potenciál pro šíření dezinformací. Mě by zajímalo, jak se na to přišlo. Článek zmiňuje hack. Včetně logů, kódu a konfigurace, které jasně dokumentovaly fungování těchto telefonních farem a systém pro generování AI influencerů. Hackeři nebo etičtí výzkumníci se dostali k informacím, které jasně prokazovaly, co společnost dělá. A jaké jsou technické aspekty, které umožňují takový rozsah operací? Nejde jen o telefony, ale i o sofistikovaný software, že?
Z pohledu techniky to zahrnuje několik klíčových komponent. Za prvé software pro správu zařízení, Mobile Device Management, který umožňuje vzdálené ovládání stovek telefonů. Za druhé systémy pro generování obsahu, využívající pokročilé generativní AI modely, například velké jazykové modely pro skripty a generativní adversární sítě pro vizuály a hlas. Za třetí sofistikované algoritmy pro simulaci lidského chování na sociálních sítích, které dokážou napodobit vzorce prohlížení, interakcí a času stráveného na platformě.
Takže je to vlastně plnohodnotný ekosystém pro umělou manipulaci. To je opravdu důležité téma k zamyšlení pro budoucnost sociálních sítí. Ale přesouváme se k něčemu, co by mohlo být vnímáno jako pozitivnější využití umělé inteligence, a to k integraci ChatGPT do Apple Music. Jak to funguje? A co to znamená pro uživatele?
Toto je příklad, jak AI může zlepšit uživatelskou zkušenost v každodenním životě. Apple Music a OpenAI se spojily, aby integrovali schopnosti ChatGPT přímo do interakce s hudební službou. Cílem je nabídnout uživatelům mnohem intuitivnější a personalizovanější způsob, jak objevovat a přehrávat hudbu.
To zní jako výrazné vylepšení oproti stávajícím hlasovým asistentům. Siri například dokáže přehrát konkrétní skladbu nebo interpreta, ale co víc přináší ChatGPT? ChatGPT přináší především výrazně pokročilejší porozumění přirozenému jazyku a kontextu. Zatímco Siri je dobrá na přímé příkazy, ChatGPT dokáže interpretovat složitější a nuancovanější požadavky. Uživatelé tak mohou říct například vytvoř mi playlist pro relaxační večer po práci nebo potřebuji hudbu, která mi pomůže soustředit se na psaní kódu. Případně najdi mi něco podobného tomu, co hrála Taylor Swift na svém posledním koncertě.
Takže jde o konverzační přístup k objevování hudby. To je velký posun od pouhého ovládání přehrávání. Jaké další konkrétní funkce tato integrace nabízí? Kromě generování playlistů na základě nálady nebo aktivity, ChatGPT umí i vyhledávat informace o umělcích, albech nebo skladbách. Můžete se zeptat, pověz mi něco o historii této kapely, nebo jaké jsou největší hity tohoto interpreta. Také dokáže přidávat skladby do knihovny, ovládat hlasitost, přeskakovat skladby a vytvářet fronty přehrávání. To vše na základě konverzačního vstupu. Navíc dokáže lépe personalizovat doporučení na základě předchozích interakcí a historie poslechu. Učit se z preferencí uživatele.
To zní, jako by uživatel měl vlastního hudebního kurátora, který mu rozumí. Jaká je role rozhraní v tomto případě? Integruje se ChatGPT přímo do aplikace Apple Music? Nebo jde o interakci přes aplikaci ChatGPT? V době jeho vydání v prosinci 2025 je tato integrace primárně dostupná prostřednictvím aplikace ChatGPT nebo webového rozhraní. Uživatelé se přihlásí ke svému Apple Music účtu v prostředí ChatGPT a poté mohou začít konverzovat. Postupem času se však očekává hlubší integrace přímo do ekosystému Apple, například do Siri nebo do aplikace Apple Music, což by uživatelskou zkušenost posunulo ještě dál.
A co otázky soukromí? Když propojím svůj účet Apple Music s ChatGPT, sdílím s ním své preference a historii poslechu. Jsou tam nějaké obavy? Otázky soukromí jsou vždy relevantní, když se data sdílejí mezi různými platformami. V tomto případě bude klíčové, jak transparentně Apple a OpenAI komunikují, jaká data jsou sdílena, jak jsou využívána a jak dlouho jsou uchovávána.
Vypadá to, že umělá inteligence se stává stále všudypřítomnější. Od generování trojrozměrných modelů z fotografií, přes kontroverzní manipulaci na sociálních sítích, až po personalizované hudební zážitky. A právě proto budeme v našem podcastu pokračovat v rozebírání těchto témat do hloubky. Děkujeme, že jste s námi.
Díky, že posloucháte podcast Kde skončí zítřek. Nové díly vycházejí každé pondělí, středu a pátek. Tak nás sledujte, ať vám nic neuteče. Podpořit a sledovat nás lze na Substacku, všech sociálních sítích i na webu www.aipokusy.cz. Krátké upozornění. Tento podcast vzniká s pomocí umělé inteligence, která asistuje při přípravě obsahu i hlasové syntéze. Epizoda může obsahovat drobné nepřesnosti.