Blog Nástroje Za hranice inovací

ChatGPT Agent: Revoluce v digitální asistenci – od konverzace k akci

Jaroslav Urbánek, zakladatel TECHNOMATONu 18. července 2025 13 min čtení

Text vyšel a popisuje stav k tomuto dni.

Představte si AI asistenta, který nejen povídá, ale umí za vás procházet web, plánovat schůzky nebo sestavit prezentaci. Přesně to přináší novinka od OpenAI jménem ChatGPT Agent. Tato vylepšená verze ChatGPT dokáže samostatně plnit komplexní úkoly od začátku do konce s využitím vlastního „virtuálního počítače“. Znamená to, že ChatGPT nyní nejen radí, ale i koná – umí inteligentně prohledávat internet, vyplňovat formuláře, bezpečně se přihlásit na webové stránky, spouštět kód, analyzovat data a dokonce generovat celé dokumenty (například editovatelné prezentace či tabulky) na základě vašich pokynů. Z pasivního chatbota se tak stává aktivní virtuální asistent, který pro vás skutečně pracuje.

Jak to funguje pod kapotou? Základem nové schopnosti ChatGPT je sjednocený agentní systém, který v sobě spojuje tři pilíře předchozího vývoje: schopnosti prototypu Operator (ovládání webu), funkce režimu Deep Research (hloubková analýza informací) a samozřejmě inteligenci a plynulou konverzaci samotného ChatGPT. Jinými slovy, model se naučil hladce přecházet mezi „přemýšlením“ a „jednáním“ – podle potřeby buď zpracovává informace, nebo provádí akce, aby úkol splnil. Ačkoliv má agent více autonomie, uživatel nad ním má stále plnou kontrolu. ChatGPT Agent si veškeré kroky, které by mohly mít zásadní dopad (např. utratit peníze nebo odeslat e-mail), nechává nejprve potvrdit vámi. Také můžete kdykoliv proces přerušit, převzít ručně ovládání prohlížeče nebo celý úkol zastavit – asistent se vám podřídí.

Spojení Operatoru a Deep Research dává Agentovi nové možnosti. Původní nástroj Operator uměl ovládat web (scrollovat, klikat, zadávat text), zatímco Deep Research skvěle shrnoval a analyzoval informace do hloubky. Každý zvládal něco jiného – Operator neuměl dělat složité rozbory a psát dlouhé reporty a Deep Research zase neuměl interagovat s webem nebo projít stránky vyžadující přihlášení. Uživatelé často zkoušeli s Operatorem dotazy, na které se více hodil Deep Research, a naopak. Proto OpenAI vzala to nejlepší z obou a integrovala je do jednoho systému. ChatGPT Agent tak umí obojí: aktivně pracovat na webu (klikat, filtrovat informace) a zároveň provádět důkladnou analýzu textů a psát souvislé výsledky. Navíc to vše zvládá v rámci jedné konverzace – můžete začít běžným povídáním s ChatGPT a plynule přejít k zadávání akcí, aniž byste museli měnit nástroj nebo přerušit tok dialogu.

Aby toho dosáhl, vybavila OpenAI ChatGPT Agenta celou sadou nástrojů. K dispozici má vizuální webový prohlížeč (ovládá web přes grafické rozhraní jako člověk), textový prohlížeč (pro rychlé čtení velkých objemů textu), terminál (příkazovou řádku pro spouštění kódu) a také přímý přístup k API. Agent navíc podporuje tzv. ChatGPT Connectors, což je funkce umožňující propojit ChatGPT s vašimi aplikacemi jako je Gmail, Google Kalendář či Github. Tím pádem si asistent může z těchto služeb vyžádat informace relevantní k vašemu úkolu a využít je při řešení. Pokud je potřeba se někam přihlásit (např. do vašeho účtu), agent vás vyzve, abyste převzali ovládání prohlížeče a zadali údaje bezpečně sami – po přihlášení pak pokračuje v práci již uvnitř daného účtu. Díky různým cestám k informacím si ChatGPT Agent vždy zvolí tu nejefektivnější – někdy použije API (třeba aby nahlédl do kalendáře), jindy rychle pročte dlouhý text přes textový prohlížeč, a když je potřeba pracovat s webem určeným pro lidi, prostě ho projde vizuálním prohlížečem. Všechny tyto operace jsou prováděny na izolovaném virtuálním počítači, který si model spouští pro sebe. Díky tomu udrží kontext napříč kroky – může například stáhnout soubor z webu, pak v terminálu spustit skript na jeho zpracování a výsledek si zase otevřít ve vizuálním prohlížeči. Model dynamicky přizpůsobuje svůj postup tak, aby úkol splnil co nejrychleji a nejpřesněji.

Celé řešení je navrženo velmi interaktivně a spolupracuje s vámi. ChatGPT Agent pracuje iterativně – když běží nějaký úkol, vy ho můžete kdykoli přerušit a upřesnit zadání, nasměrovat ho jinam, nebo úplně změnit cíl. Agent na to zareaguje a pokračuje dál, aniž by „zapomněl“ pokrok, kterého už dosáhl, pokud je stále relevantní. Stejně tak sám ChatGPT může proaktivně požádat vás o doplňující informace, pokud si není jistý, že směřuje ke správnému cíli. Když úkol trvá déle, než jste čekali, nebo se zdá, že uvízl, máte možnost ho pozastavit a nechat si od ChatGPT Agenta vysvětlit, co zatím udělal a jak hodlá pokračovat, případně ho můžete zastavit úplně – v takovém případě vám agent odevzdá dílčí výsledky, které stihl připravit. Pokud používáte mobilní aplikaci ChatGPT, dostanete dokonce notifikaci, jakmile agent úkol dokončí. Cílem je, abyste vy měli hlavní slovo a agent byl váš šikovný pomocník na povel, ne nekontrolovatelná černá skříňka.

K čemu je to dobré v praxi? Spojení těchto schopností výrazně rozšiřuje užitečnost ChatGPT v každodenním i pracovním životě. Níže uvádíme několik příkladů, co pro vás ChatGPT Agent zvládne udělat:

  • Kancelářské úkoly: Můžete nechat AI automatizovat nudné opakující se činnosti – například převést výstřižky obrazovek či dashboardů do podoby pěkné prezentace s editovatelnými prvky. Také za vás zvládne přeplánovat schůzky, zařídit rezervaci teambuildingové akce, nebo aktualizovat složité tabulky novými daty, aniž by rozhodil formátování.

  • Osobní asistence: V soukromí vám pomůže naplánovat a zarezervovat celou dovolenou včetně itineráře. Poradí si i s uspořádáním večeře nebo oslavy – navrhne menu, najde a objedná ingredience, klidně i vybere vhodnou dekoraci. Když potřebujete specialistu (lékaře, řemeslníka…), Agent vyhledá nejlepší možnosti a rovnou vám domluví termín návštěvy.

To je jen několik ukázek – škála možných úkolů je široká. ChatGPT Agent umí číst, psát, počítat i jednat na webu, takže zvládne vše od rešerší přes plánování až po vykonávání konkrétních akcí. Je to jako mít virtuálního asistenta, kterému stačí říct, co potřebujete, a on už zařídí jak to udělat.

Jak si ChatGPT Agent stojí ve srovnání s lidmi a dřívějšími modely? Zdá se, že velmi dobře – jeho schopnosti se projevily i v různých testech a benchmarcích. OpenAI uvádí několik pozoruhodných výsledků:

  • Na rozsáhlém testu “Humanity’s Last Exam” (soubor odborných otázek napříč obory na expertní úrovni) dosáhl model pohánějící ChatGPT Agenta úspěšnosti 41,6 %, čímž stanovil nový rekord mezi AI modely; při paralelním spuštění více pokusů najednou a výběru nejjistější odpovědi se skóre dokonce zvýšilo na 44,4 %. (Pro srovnání – běžný GPT-4 v tomto testu zaostával.)

  • V nejtěžším matematickém benchmarku FrontierMath (obsahuje nové, nepublikované úlohy, se kterými zápolí i špičkoví matematici) dosáhl Agent s pomocí nástrojů (např. spuštěním kódu v terminálu) 27,4% úspěšnosti, což výrazně překonalo předchozí modely.

  • V interním testu komplexních úloh simulujících znalostní práci (např. vypracování konkurenční analýzy pro firmu, sestavení podrobného finančního modelu apod.) byly výstupy ChatGPT Agenta hodnoceny experty jako stejně dobré nebo lepší než výstupy lidských odborníků přibližně v polovině případů. Zároveň výrazně předčil starší modely OpenAI (označované jako o3 a o4-mini).

  • V benchmarcích zaměřených na prohledávání webu si Agent také vede skvěle. V testu BrowseComp, kde AI hledá obtížně dohledatelné informace na internetu, dosáhl 68,9% úspěšnosti – o 17 procentních bodů více než předchozí specializovaný model Deep Research.

  • V úloze editace tabulek (SpreadsheetBench) získal Agent skóre 45,5 % (při možnosti tabulky rovnou upravovat), zatímco vestavěný asistent v Excelu (Copilot) dosáhl jen 20,0 %. Jinými slovy, v práci s reálnými daty v tabulkách byl více než dvakrát úspěšnější než konkurenční nástroj od Microsoftu.

Tyto výsledky ukazují, že ChatGPT Agent posouvá laťku schopností AI v praxi. Kombinace přístupu k nástrojům a lepšího plánování mu umožňuje řešit úlohy způsoby, které dřívější modely nezvládaly. Samozřejmě, vždy je co zlepšovat (stále není na úrovni člověka ve všech úlohách), ale v mnoha ohledech už dosahuje či překračuje výkon lidských odborníků.

Jak můžete ChatGPT Agenta vyzkoušet? Pokud patříte mezi platící uživatele ChatGPT (plán Plus, Pro nebo Team), máte k němu přístup jako součást rozhraní ChatGPT. Přímo v prostředí chatbota stačí v rozbalovací nabídce Tools/Nástroje zvolit „Agent mode“ a můžete v kterékoli konverzaci kdykoliv přepnout agentní schopnosti na plno. Poté jednoduše napište, co má agent udělat – ať už „proveď hloubkový průzkum k tématu X a sepiš mi z toho zprávu“, nebo „vytvoř prezentaci z těchto poznámek“, případně „odešli report výdajů za tento měsíc“. Jakmile to zadáte, ChatGPT Agent se pustí do práce. Na obrazovce přitom uvidíte živý komentář toho, co zrovna dělá – systém vypisuje kroky: že třeba otevírá web, čte informace, spouští Python pro výpočet atd. Můžete tedy průběh sledovat a kdykoliv zasáhnout, pokud by se odchyloval od vašeho záměru. Jak už bylo zmíněno, kdykoli můžete převzít kontrolu nad prohlížečem nebo proces pozastavit. ChatGPT Agent lze také integrovat do vašich pracovních nástrojů. Přes zmíněné Connectors mu můžete povolit přístup například ke svému Google kalendáři či e-mailové schránce, aby si mohl sám stáhnout podklady (např. seznam nadcházejících schůzek či nové e-maily). Nemusíte se bát – aby Agent něco provedl (třeba odeslal e-mail nebo zapsal událost do kalendáře), vždy po vás bude chtít potvrzení a často využije již zmíněný bezpečný režim „převzetí prohlížeče“, kdy citlivé údaje (hesla apod.) zadáváte vy, ne model. Skvělou funkcí je také plánování opakovaných úkolů – například můžete nastavit, aby Agent každý týden v pondělí ráno sám spustil a vygeneroval aktualizovaný report s metrikami, aniž byste mu to museli pokaždé připomínat.

Výkonné nástroje bohužel přinášejí i nová rizika, a OpenAI proto zavedla celou řadu bezpečnostních opatření. Je to poprvé, co mohou uživatelé pověřit ChatGPT vykonáváním akcí přímo na webu a s jejich daty, což samozřejmě otevírá nové vektory možného zneužití. Jedním z hlavních rizik je tzv. prompt injection útok. Jde o situaci, kdy by se někdo cizí pokusil podstrčit agentovi škodlivé instrukce – například skryje na webové stránce neviditelný text s příkazem. Kdyby ho agent nekriticky přečetl, mohl by ho třeba oklamat, aby prozradil vaše soukromé informace útočníkovi nebo provedl nějakou nechtěnou akci. Proto ChatGPT Agent prošel speciálním tréninkem a testy, aby takové manipulace rozpoznal a odolal jim. OpenAI nasadila také monitoring – systém sleduje výsledky nástrojů (např. texty z webu), a pokud by detekoval něco podezřelého, okamžitě zasáhne. K nejdůležitějším ochranným mechanismům patří: vždy vyžadovat výslovný souhlas uživatele před akcemi s reálným dopadem (např. než něco objedná nebo utratí peníze), aktivní dohled u citlivých úkolů (tzv. Watch Mode – např. když má poslat e-mail, může vyžadovat, abyste postup schválili krok za krokem) a proaktivní omezování rizik, kdy je model učen některé nebezpečné požadavky rovnou odmítnout (třeba vás bude ignorovat, když byste po něm chtěli provést bankovní převod). OpenAI také zavedla další ochranu soukromí: jedním tlačítkem můžete smazat veškerá data z prohlížení, která agent nasbíral, a odhlásit ho ze všech webů. V tzv. režimu převzetí prohlížeče navíc platí, že údaje, které při interakci se stránkou zadáváte (hesla, osobní informace), zůstávají lokálně a model je nevidí ani neukládá. Agent je navržen tak, aby k bezpečnému dokončení úkolu vaše citlivá data ani nepotřeboval – čím méně jich uvidí, tím menší je riziko.

OpenAI bere velmi vážně i rizika zneužití v citlivých oblastech, jako je například bioinformatika či chemie. Rozhodli se ChatGPT Agenta zařadit do nejvyšší kategorie High Biological and Chemical Risk dle svého rámce Preparedness, což znamená, že aktivovali ty nejpřísnější bezpečnostní pojistky pro případ, že by se někdo pokoušel Agenta využít k nebezpečným účelům. Nemají sice důkazy, že by model dokázal pomoci nezkušenému člověku třeba vytvořit biologickou zbraň (to je hranice pro „High“ podle OpenAI), ale pro jistotu nasadili preventivní opatření hned od začátku. Patří sem důkladné trénování modelu, aby takové požadavky odmítal, neustálé monitorování jeho výstupů algoritmy a týmem odborníků, a spolupráce s externími experty na biologickou bezpečnost. Již během vývoje konzultovali hrozby s výzkumníky, nechali odborníky model „red-teamovat“ (testovat, jak by šel zneužít) a dokonce uspořádali workshop s představiteli vlád, akademie a neziskovek na téma biologické bezpečnosti AI. OpenAI také spustila program odměn (bug bounty), aby jim komunita pomohla odhalit případné problémy v reálném provozu. Je vidět, že otázka bezpečnosti a etiky je u tohoto výkonného nástroje na prvním místě.

Kdo může ChatGPT Agenta využít a za jakých podmínek? OpenAI oznámila dostupnost nové funkce 17. července 2025. Ihned od tohoto data ji mohli začít používat předplatitelé úrovně Pro (přednostně tentýž den) a během několika dnů ji dostali i uživatelé s plánem Plus a Team. V nejbližších týdnech (od oznámení) by se měla dostat i k firemním zákazníkům (Enterprise) a do verze pro školy (Education). Zdarma dostupná verze ChatGPT tuto funkci zatím nemá – je to prémiová vlastnost pro platící uživatele. Pro uživatele Pro platí také štědřejší limity: mohou s Agentem odeslat 400 zpráv za měsíc, zatímco Plus a Team mají 40 zpráv měsíčně, po jejichž vyčerpání je případně možné dokoupit další kapacitu formou flexibilních kreditů. Je tu ale jedna výjimka: Evropa. V době uvedení neměli uživatelé v Evropském hospodářském prostoru a Švýcarsku Agenta k dispozici. OpenAI uvedla, že na zpřístupnění pro EU/EHP teprve pracují – zřejmě z důvodu dodržení tamních regulačních požadavků. Pokud tedy v ČR kliknete v ChatGPT na nabídku nástrojů, možná zatím „Agent mode“ neuvidíte.

Je dobré také vědět, že pokud jste používali zmíněný nástroj Operator v režimu beta, brzy už nebude potřeba – samostatná stránka s testovacím Operatorem poběží jen pár týdnů po spuštění Agenta a pak ji OpenAI vypne. ChatGPT Agent její funkce plně nahrazuje. A jestli jste si oblíbili starší mód Deep Research (hluboké průzkumy), nezmizel – je teď vlastně součástí Agenta. V rozhraní ChatGPT lze v nabídce u vstupu zprávy stále zvolit možnost „deep research“ a model provede důkladnou analýzu dotazu s extra detailní odpovědí (bude mu to trvat déle, ale výsledkem jsou obsáhlé informace). Tato možnost tam zůstala pro případy, kdy chcete výstup opravdu do hloubky, i za cenu času.

Co omezení a plány do budoucna? ChatGPT Agent je teprve na začátku a pořád se učí. Ačkoliv si poradí s celou řadou složitých úkolů, stále dělá chyby a ne vždy vše proběhne dokonale hladce. Například funkce generování prezentací (slideshow) je momentálně v beta verzi. Agent sice dokáže vytvořit PowerPoint se snímky, ale jeho výstupy jsou zatím poměrně základní – formátování a design diapozitivů může působit jednoduchým dojmem, zejména pokud začíná úplně od nuly. OpenAI vysvětluje, že pro začátek se soustředili hlavně na to, aby model uměl informace logicky uspořádat do slidů a používal prvky jako text, grafy, obrázky či tvary tak, aby šly po exportu snadno editovat. Vzhled zatím není oslnivý a dokonce se občas stane, že náhled slidů v ChatGPT nesedí úplně přesně s finálním PPT souborem – na odstranění těchto nedostatků se pracuje. Také momentálně Agent neumí nahrát existující prezentaci a editovat ji (to umí jen s tabulkami), ale do budoucna by měla přibýt i tato schopnost. Dobrou zprávou je, že už nyní probíhá trénování další verze modelu zaměřené na vylepšení tvorby slideshow – měla by produkovat vzhledově propracovanější a formátovanější výstupy a zvládat širší okruh požadavků. Obecně OpenAI očekává rychlé zlepšování Agenta v efektivitě, hloubce a univerzálnosti jeho práce. Postupně bude také interakce plynulejší – cílem je snižovat nutnost neustálého dohledu a zásahů uživatele, aniž by utrpěla bezpečnost. Jinými slovy, Agent by měl být časem ještě samostatnější, ale stále tak, aby ho šlo bezpečně kontrolovat.

Shrnutí: ChatGPT Agent představuje obrovský posun v tom, co dokáže AI asistent. Už to není jen o generování textu na základě dotazu – teď vám AI umí reálně pomoci s prací. Spojením schopnosti zkoumat (číst a analyzovat informace) a jednat (provádět akce) se z ChatGPT stává univerzální digitální pomocník pro profesionální i osobní použití. Samozřejmě je pořád co ladit a člověk musí být obezřetný, když agentovi svěří důležité úkoly. Ale už teď můžete vidět náznak budoucnosti, kde rutinní nebo složité úkoly přenecháme AI a sami se budeme věnovat kreativnější práci. Pokud máte přístup k ChatGPT Agentovi, určitě stojí za to ho vyzkoušet – třeba vás překvapí, jaké věci za vás zvládne udělat.

Více informací naleznete také v oficiálním oznámení OpenAI: Introducing ChatGPT Agent.

Newsletter na LinkedInu

Odebírejte Za hranice inovací

Newsletter Jaroslava Urbánka: rozbory dění v AI a toho, co z něj plyne pro firmy.

Odebírat na LinkedInu

Další krok

Test připravenosti na AI

Osm otázek bez registrace. Z odpovědí vybereme téma, kterým můžete s AI začít. Výsledek je orientační.

Spustit test připravenosti

Další čtení

3 články