Google pustil do sveta novú AI, ktorá ovláda počítač. Kliká, píše a prechádza web ako človek
Google predstavuje nový model Gemini 2.5 Computer Use, ktorý dokáže pracovať s PC ako skutočný užívateľ.
Google opäť posúva hranice toho, čo umelá inteligencia dokáže. Najnovší model Gemini 2.5 Computer Use už nie je len „rozmýšľajúci chatbot“. Tentokrát ide o systém, ktorý dokáže priamo ovládať počítač alebo mobil. Vie kliknúť, napísať text, vyplniť formulár, prihlásiť sa do účtu a dokonca poslať požiadavku na potvrdenie nákupu. Inými slovami, AI, ktorá sa správa ako človek pred obrazovkou.
Model vznikol ako rozšírenie Gemini 2.5 Pro, no špecializuje sa na prácu s používateľským rozhraním (UI). Google tvrdí, že prekonáva všetky konkurenčné riešenia v testoch, ktoré merajú, ako dobre sa AI dokáže pohybovať po webe či aplikáciách. A aby toho nebolo málo, robí to rýchlejšie a s menším oneskorením než ostatné systémy.

Kým väčšina AI systémov doteraz komunikovala so softvérom len cez štruktúrované API, Gemini 2.5 ide ďalej. Vie si poradiť aj s bežnými webmi, ktoré API vôbec nemajú, teda s tým, čo denne používame my všetci. Ak treba niečo vyplniť, kliknúť alebo presunúť, AI to spraví priamo cez vizuálne rozhranie. Funguje v slučke. Model dostane príkaz, pozrie si snímku obrazovky, vyhodnotí situáciu a vykoná akciu. Po nej si opäť „pozrie“, čo sa zmenilo, a pokračuje, kým úloha nie je hotová.
Znie to ako samozrejmosť, ale v skutočnosti ide o prelomové riešenie starého problému automatizácie. Tento problém experti opisujú ako „poslednú míľu“. Doteraz totiž každá automatizácia narážala na okamih, keď sa niečo zmenilo. Mohlo ísť napríklad názov tlačidla alebo rozloženie formulára. Vtedy celé riešenie padlo. Gemini 2.5 tento problém rieši vizuálnym porozumením obrazovky, vďaka čomu sa dokáže prispôsobiť zmenám rovnako ako človek. Google to demonštroval na príklade svojho platobného tímu. AI dokázala opraviť viac ako 60 % zlyhaní v testoch, ktoré by inak trvali dni.
Nový krok k univerzálnym AI agentom
Gemini 2.5 Computer Use nie je len ďalšia vylepšená verzia chatbotu. Predstavuje skutočný krok smerom k všeobecne účelovým AI agentom, ktorí dokážu riešiť viac než len textové úlohy. Doteraz boli AI systémy väčšinou úzko špecializované. Jeden generoval text, iný spracovával tabuľky, ďalší testoval softvér. Gemini 2.5 tieto hranice maže. Vďaka schopnosti ovládať akékoľvek rozhranie, ktoré „vidí“, ruší závislosť od konkrétnych API a protokolov. To znamená, že v budúcnosti môžu vzniknúť asistenti, ktorí dokážu prechádzať medzi desiatkami aplikácií a webov bez obmedzení, od pracovných nástrojov až po e-shopy či databázy.
Neprehliadni
Google ukázal viacero praktických ukážok. V jednej z nich AI prechádzala stránku s informáciami o domácich zvieratách, pridávala ich do databázy salónu a následne rezervovala termín u špecialistu. V druhej upratala chaotickú virtuálnu nástenku, jednoducho presúvala farebné poznámky do správnych kategórií. Všetko automaticky, krok za krokom, bez potreby zásahu človeka.
V testoch ako Online-Mind2Web, WebVoyager a AndroidWorld model porazil konkurenciu s presnosťou nad 70 % a najnižšou latenciou zo všetkých. Práve rýchlosť je v tomto prípade kľúčová. Ak AI vykonáva stovky drobných úkonov (kliknutia, zápisy, overenia), každá sekunda navyše znamená spomalenie celého systému. Nízka latencia Gemini 2.5 preto umožňuje plynulú, reálnu automatizáciu bez zbytočných prestojov, čo je rozhodujúce pri reálnom nasadení v pracovných prostrediach.
AI režim prichádza aj na Slovensko
Aj keď sa o tzv. AI režime hovorí už od začiatku roka, na Slovensko prichádza až teraz. Google ho zatiaľ testoval hlavne v rámci svojich interných projektov, napríklad Project Mariner, Firebase Testing Agent či pri automatizovaní testov v službe Google Payments. Teraz sa však rozširuje aj do bežných používateľských prostredí. To znamená, že sa s ním možno čoskoro stretneš priamo v prehliadači, napríklad pri vypĺňaní formulárov, rezerváciách alebo pri automatickom usporadúvaní online úloh.
Keď AI ovláda tvoju obrazovku, musí byť bezpečná
Systém, ktorý dokáže ovládať tvoju myš a klávesnicu, má obrovskú moc a rovnako veľkú zodpovednosť. Google preto zaviedol viacvrstvovú ochranu. Každý krok, ktorý AI navrhne, prechádza tzv. „per-step“ bezpečnostnou kontrolou ešte pred vykonaním.
Vývojári môžu určiť, ktoré akcie sú zakázané, alebo kedy musí model požiadať o potvrdenie od používateľa, napríklad pri nákupoch, zmenách údajov či finančných transakciách. Google priznáva, že hrozby ako prompt injection (vloženie škodlivého príkazu) sú reálne, preto sa zameriava na prevenciu, nie len reakciu.

Gemini 2.5 Computer Use rieši starý problém automatizácie, učí sa rozmýšľať ako človek a zároveň otvára dvere novej generácii AI agentov. Vie sa prispôsobiť zmenám, konať samostatne a pracovať rýchlo a spoľahlivo.
Ak sa tento systém rozšíri do bežných nástrojov, môžeme očakávať éru, kde AI preberie rutinné úlohy priamo na obrazovke, od formulárov po celý workflow. A v tom momente sa z asistenta stane skutočný spolupracovník.