Blog Nástroje Za hranice inovací
AI-Update týdne: Šest skoků, které (zase) pohnuly světem tvorby obsahu
Jaroslav Urbánek, zakladatel TECHNOMATONu 3. srpna 2025 2 min čtení
Text vyšel a popisuje stav k tomuto dni.
TL;DR
Šest novinek, které během jediného týdne posouvají hranice: od věrných klonů a „přemýšlejícího“ LLM přes tutora v kapse až po filmové video a celé virtuální světy. Zkrátka AI vlak zrychluje a už ani nezastavuje ve větších stanicích.
1. „Jediná fotka, nekonečno klonů“
Ideogram spustil Character model: nahrajete portrét a během pár vteřin máte desítky verzí téže postavy v libovolném stylu či scéně. Jako když máte oblíbenou LEGO figurku a stavíte jí nové kulisy, aniž byste kupovali další sadu. Šlape to jako hodinky a do 5. srpna je to navíc zdarma.
2. Gemini 2.5 zapíná „Deep Think“
Google rozšiřuje Ultra tarif o režim, který nechá model dum-at delší čas a paralelně testovat víc hypotéz. Výsledkem je vyšší skóre na soutěžních benchmarcích a schopnost lámat matematické oříšky bez externích nástrojů. Představte si šachistu, který počítá několik variant dopředu, zatímco soupeř teprve tahá pěšcem.
3. ChatGPT v roli osobního tutora
Study Mode mění chatbota na průvodce: místo hotového řešení klade otázky, podstrčí hint a rychlý kvíz, aby člověk došel k odpovědi sám. Funguje i ve free verzi – takže výmluva „nevím, jak se to učí“ právě padla. Je to asi jako mít učitele, který raději mrkne a napoví, než aby psal výsledky na tabuli.
4. Full-HD video z textu na jediné RTX 4090
Alibaba zveřejnila Wan 2.2: otevřený generátor, jenž vytvoří pětisekundový 1080p klip pod devět minut. Přihodili MoE architekturu, LoRA posuvník pro styl a efekty typu filmový kouř. Přirovnal bych to k instantní kameře, která místo fotky vyplivne celý mini film.
5. FLUX.1 Krea: fotky bez „AI-looku“
Black Forest Labs a Krea nabízejí váhy modelu, který eliminuje voskovou pleť i přežehlené barvy. Výsledek? Snímky, nad nimiž vám spadne čelist, protože vypadají, jako by je fotil profík se středním formátem.
6. HunyuanWorld: prompt → prozkoumatelný 3D svět
Tencent ukázal pipeline, která z textu (nebo jedné fotky) vygeneruje kompletní 3D scénu včetně mesh exportu. Je to podobné, jako kdybyste namalovali mapu pokladu a během chvilky se ocitli uvnitř té krajiny. Kdo chvíli stál, už stojí opodál – VR studia by měla zbystřit.