17. juulil 2025 teatas OpenAI ChatGPT Agendist, mis on järjekordne edasiminek suhtlemisel AI-süsteemidega. See uus tööriist kujutab endast hüpet traditsioonilistest vestlusrobotitest digitaalseteks assistentideks, mis suudavad iseseisvalt täita keerulisi, mitmetasandilisi ülesandeid.
Mis on ChatGPT Agent?
ChatGPT Agent ühendab endas kahte põhivõimekust, mis eristab seda varasematest AI-tööriistadest.
Internetiotsing – suudab otsida ja analüüsida informatsiooni kogu internetist, süvenedes uurimisteemadesse kasutades filtreerimist ja sünteesi.
Iseseisev interaktsioon – suudab aktiivselt toimetada veebiliidestega, navigeerides saitidel, täites vorme, klõpsates nuppe ja täites toiminguid nagu inimkasutaja.
Lühidalt öeldes: 1) agent navigeerib veebisaitidel, 2) töötleb ja filtreerib otsingutulemusi, 3) küsib kasutajapoolset autentimist kaitstud sisu juurde pääsemiseks (nt sisselogimine, pangakaardi andmete sisestamine jne), 4) käivitab koodi andmeanalüüsiks ja 5) esitab leiud organiseeritult.
Virtuaalne arvuti
ChatGPT Agent täidab neid keerulisi ülesandeid, kasutades oma virtuaalse arvuti süsteemi. See virtuaalne keskkond võimaldab AI-l vahetada (I) analüütilise mõtlemise ja (II) otsese tegevuse vahel. See võimaldab agendil hallata keerukaid töövoogusid, mis varem oleksid nõudnud kasutaja poolt sekkumist mitmes etapis.
Virtuaalne keskkond haldab oma failisüsteemi allalaaditud dokumentide, andmefailide ja genereeritud sisu salvestamiseks. See võimaldab agendil püsida kontekstis, mis osutub oluliseks mitme tööriista käsitlemisel—agent võib alustada informatsiooni uurimisega a) tekstipõhise brauseri kaudu, seejärel lülituda b) visuaalsele brauserile detailsemaks kontrollimiseks, c) laadida alla asjakohased failid, d) käivitada terminali käsud failide töötlemiseks ja lõpuks e) kuvada tulemused visuaalse brauseri liidese kaudu.
Kasutaja järelvalve
Vaatamata võimekusele olla iseseisev, on ChatGPT Agent kavandatud nii, et kasutajad säilitaksid täieliku ülevaate agendi operatsioonidest. Süsteem on kavandatud küsima selgesõnalist luba enne oluliste toimingute täitmist, tagades, et kasutajad saavad läbi vaadata ja heaks kiita olulisi otsuseid. Lisaks saavad kasutajad katkestada käimasolevaid ülesandeid, võtta brauseri liidese oma otsese kontrolli alla või peatada tegevused täielikult mis tahes ajal ülesande täitmise käigus.
Kuidas erineb ChatGPT Agent varasematest tööriistadest?
ChatGPT Agent esindab ühtset lähenemist, mis koondab mitu spetsialiseeritud võimekust ühte süsteemi. See integratsioon ühendab (I) liidesele keskenduvate tööriistade veebiinteraktsiooni tugevused (OpenAI varasem Operator tööriist), (II) uurimisele orienteeritud süsteemide analüütilise sügavuse (ChatGPT varasem Deep research funktsioon) ja (III) suurte keelemudelite dialoogi pidamise intellekti (ChatGPT).
Varasemad AI-tööriistad töötasid kindlate piirangute raames—liidese automatiseerimisvahendid ei suutnud teha põhjalikku analüüsi või genereerida detailseid aruandeid, samas kui uurimisele keskenduvad süsteemid ei suutnud suhelda dünaamiliste veebielementidega või juurde pääseda autenditud sisule. OpenAI mõistis, et kasutajate päringud nõudsid sageli võimekusi, mis hõlmasid mitme tööriista kategooriat – mis viis integreeritud lahenduse väljatöötamiseni ChatGPT Agendi näol.



ChatGPT Agendi funktsionaalsus
| Võimekus | Näited |
|---|---|
| Tekstibrauser | Uurimistöö, sisuanalüüs, informatsiooni süntees, võrdlevad uuringud, faktikontroll |
| Visuaalne brauser | Vormide täitmine, liidesel navigeerimine, visuaalne kinnitamine, kasutajaliidese elementide manipuleerimine, multimeedia sisu ülevaatamine |
| Otsene API integratsioon | Google Drive juurdepääs, sotsiaalmeedia haldamine, e-kaubanduse platvormid, broneerimissüsteemid, finantsteenused |
| Koodi käitamine | Andmetöötlus, statistiline analüüs, algoritmide rakendamine, veaotsing, automatiseerimise skriptid |
| Dokumentide koostamine | Arvutustabelite loomine, finantsmudelid, andmete visualiseerimine, aruannete genereerimine, andmebaaside organiseerimine |
| Esitlused (slaidid) | Slaidikomplektide loomine, visuaalne disain, diagrammide genereerimine, mallide kohandamine, multimeedia integratsioon |
| Reaalajas interaktsioon töötlemise ajal | Ülesannete muutmine, prioriteetide korrigeerimine, ulatuse selgitamine, progressi jälgimine, suunamuutmine |
| Mitme platvormiga ühenduvus | Google Drive failide juurdepääs, Gmaili integratsioon, kalender, pilves failide haldamine, muud koostöövahendid |
Agent säilitab läbipaistvuse keeruliste operatsioonide käigus, küsides kinnitust enne kriitiliste etappide lõpetamist. Näiteks enne oluliste ekirjade väljasaatmist esitab see mustandi kasutajale ülevaatamiseks ja heakskiitmiseks. Kasutaja saab paluda Agenti teha muudatusi või võtta üle kontroll käsitsi paranduste tegemiseks.
Päringute esitamine
Erinevalt standardsetest ChatGPT interaktsioonidest, mis keskenduvad vestluslike vastuste andmisele, on ChatGPT Agendi päringud kavandatud iseseisvaks ülesannete täitmiseks, mis võib võtta kaua aega ja hõlmata mitut platvormi.
Näidispäringud OpenAI-lt:
“Vaata üle mu kalender ja anna ülevaateid eelseisvatest klientide kohtumistest, kasutades hiljutisi valdkonna uudiseid ja turuarenguid”
“Uuri ja osta koostisosad autentse Jaapani hommikusöögi jaoks neljale inimesele, arvestades toitumispiiranguid ja kättesaadavust kohalikes poodides”
“Tee konkurentsianalüüs kolme valdkonna liidri kohta ja väljasta põhjalik slaidiesitlus turupositsioneerimise ülevaadete ja analüüsiga”
“Võta ChatGPT agendi jõudlusnäitajad Google Drive’i repositooriumidest ja loo visuaalsed esitlusslaidid, keskendudes andmete visualiseerimisele ilma sissejuhatava sisuta”
“Kavanda ja broneeri täielik marsruut kõigi 30 Major League Baseball’i staadioni külastamiseks 2025. aasta hooajal, alustades homme San Franciscost. Optimeeri minimaalse reisiaja jaoks, anna eelistus päevamängudele ja erireklaamüritustele (eriti Hello Kitty teemalistele õhtutele) ning esita lõplik plaan nii detailse arvutustabelina kui ka interaktiivse kaardi visualiseeringuna”
Riskid
Nagu Sam Altman toote lansseerimisel rõhutas, toovad täiustatud AI agendi võimekused kaasa uusi turvalisuse väljakutseid, mis nõuavad hoolikat kaalutlemist.
Peamised riskikategooriad:
- Päringu sisestamise rünnakud (prompt injection attacks): Pahatahtlikud veebisaidid, mis üritavad manipuleerida agendi käitumist manustatud või peidetud juhiste kaudu
- Andmeturvalisuse haavatavused: Volitamata juurdepääs tundlikule isiklikule või finantsinformatsioonile
- Autentimise ärakasutamine: Sisselogimisandmete või seansi tokenite väärkasutus
- Finantstoimingute riskid: Volitamata ostud või rahaülekanded
- Privaatsuse rikkumised: Konfidentsiaalse teabe tahtmatu jagamine
- Vastuvõtlikkus sotsiaalsele inseneeriale (social engineering susceptibility): Manipuleerimine näiliselt legitiimsete taotluste kaudu
OpenAI on rakendanud kaitsekihte, sealhulgas mudelile spetsiaalset koolitust kahtlaste juhiste äratundmiseks ja ignoreerimiseks, reaalajas seiresüsteemid, mis jälgivad agendi käitumist, ja dünaamilised turvavärskendused.
Praegune kättesaadavus
ChatGPT Agent on praegu kättesaadav tasulistele pakettidele. Pro kasutajad saavad teha 400 päringut kuus, samas kui Plus kasutajatel on juurdepääs 40 päringule kuus. OpenAI plaanib laiendada kättesaadavust Enterprise ja Edu kontode jaoks juuli lõpuks.
Viited
Youtube, OpenAI, 17.07.25, Introduction to ChatGPT agent
https://www.youtube.com/live/1jn_RpbPbEc?si=fv-c6HCwnSPdyfC2&t=85
OpenAI, 17.07.25, Introducing ChatGPT agent: bridging research and action,
https://openai.com/index/introducing-chatgpt-agent/