17. juulil 2025 teatas OpenAI ChatGPT Agendist, mis on järjekordne edasiminek suhtlemisel AI-süsteemidega. See uus tööriist kujutab endast hüpet traditsioonilistest vestlusrobotitest digitaalseteks assistentideks, mis suudavad iseseisvalt täita keerulisi, mitmetasandilisi ülesandeid.

Mis on ChatGPT Agent?

ChatGPT Agent ühendab endas kahte põhivõimekust, mis eristab seda varasematest AI-tööriistadest.

Internetiotsing – suudab otsida ja analüüsida informatsiooni kogu internetist, süvenedes uurimisteemadesse kasutades filtreerimist ja sünteesi.

Iseseisev interaktsioon – suudab aktiivselt toimetada veebiliidestega, navigeerides saitidel, täites vorme, klõpsates nuppe ja täites toiminguid nagu inimkasutaja.

Lühidalt öeldes: 1) agent navigeerib veebisaitidel, 2) töötleb ja filtreerib otsingutulemusi, 3) küsib kasutajapoolset autentimist kaitstud sisu juurde pääsemiseks (nt sisselogimine, pangakaardi andmete sisestamine jne), 4) käivitab koodi andmeanalüüsiks ja 5) esitab leiud organiseeritult.

Virtuaalne arvuti

ChatGPT Agent täidab neid keerulisi ülesandeid, kasutades oma virtuaalse arvuti süsteemi. See virtuaalne keskkond võimaldab AI-l vahetada (I) analüütilise mõtlemise ja (II) otsese tegevuse vahel. See võimaldab agendil hallata keerukaid töövoogusid, mis varem oleksid nõudnud kasutaja poolt sekkumist mitmes etapis.

Virtuaalne keskkond haldab oma failisüsteemi allalaaditud dokumentide, andmefailide ja genereeritud sisu salvestamiseks. See võimaldab agendil püsida kontekstis, mis osutub oluliseks mitme tööriista käsitlemisel—agent võib alustada informatsiooni uurimisega a) tekstipõhise brauseri kaudu, seejärel lülituda b) visuaalsele brauserile detailsemaks kontrollimiseks, c) laadida alla asjakohased failid, d) käivitada terminali käsud failide töötlemiseks ja lõpuks e) kuvada tulemused visuaalse brauseri liidese kaudu.

Kasutaja järelvalve

Vaatamata võimekusele olla iseseisev, on ChatGPT Agent kavandatud nii, et kasutajad säilitaksid täieliku ülevaate agendi operatsioonidest. Süsteem on kavandatud küsima selgesõnalist luba enne oluliste toimingute täitmist, tagades, et kasutajad saavad läbi vaadata ja heaks kiita olulisi otsuseid. Lisaks saavad kasutajad katkestada käimasolevaid ülesandeid, võtta brauseri liidese oma otsese kontrolli alla või peatada tegevused täielikult mis tahes ajal ülesande täitmise käigus.

Kuidas erineb ChatGPT Agent varasematest tööriistadest?

ChatGPT Agent esindab ühtset lähenemist, mis koondab mitu spetsialiseeritud võimekust ühte süsteemi. See integratsioon ühendab (I) liidesele keskenduvate tööriistade veebiinteraktsiooni tugevused (OpenAI varasem Operator tööriist), (II) uurimisele orienteeritud süsteemide analüütilise sügavuse (ChatGPT varasem Deep research funktsioon) ja (III) suurte keelemudelite dialoogi pidamise intellekti (ChatGPT).

Varasemad AI-tööriistad töötasid kindlate piirangute raames—liidese automatiseerimisvahendid ei suutnud teha põhjalikku analüüsi või genereerida detailseid aruandeid, samas kui uurimisele keskenduvad süsteemid ei suutnud suhelda dünaamiliste veebielementidega või juurde pääseda autenditud sisule. OpenAI mõistis, et kasutajate päringud nõudsid sageli võimekusi, mis hõlmasid mitme tööriista kategooriat – mis viis integreeritud lahenduse väljatöötamiseni ChatGPT Agendi näol.

Joonis 1. ChatGPT Agent intelligentsuse võrdlustes. Allikas: OpenAI
Joonis 2. ChatGPT Agent agentsete võrdluste tulemused. Allikas: OpenAI
Joonis 3. ChatGPT Agent reaalsete kasutusstsenaariuste võrdlused. Allikas: OpenAI

ChatGPT Agendi funktsionaalsus

VõimekusNäited
TekstibrauserUurimistöö, sisuanalüüs, informatsiooni süntees, võrdlevad uuringud, faktikontroll
Visuaalne brauserVormide täitmine, liidesel navigeerimine, visuaalne kinnitamine, kasutajaliidese elementide manipuleerimine, multimeedia sisu ülevaatamine
Otsene API integratsioonGoogle Drive juurdepääs, sotsiaalmeedia haldamine, e-kaubanduse platvormid, broneerimissüsteemid, finantsteenused
Koodi käitamineAndmetöötlus, statistiline analüüs, algoritmide rakendamine, veaotsing, automatiseerimise skriptid
Dokumentide koostamineArvutustabelite loomine, finantsmudelid, andmete visualiseerimine, aruannete genereerimine, andmebaaside organiseerimine
Esitlused (slaidid)Slaidikomplektide loomine, visuaalne disain, diagrammide genereerimine, mallide kohandamine, multimeedia integratsioon
Reaalajas interaktsioon töötlemise ajalÜlesannete muutmine, prioriteetide korrigeerimine, ulatuse selgitamine, progressi jälgimine, suunamuutmine
Mitme platvormiga ühenduvusGoogle Drive failide juurdepääs, Gmaili integratsioon, kalender, pilves failide haldamine, muud koostöövahendid

Agent säilitab läbipaistvuse keeruliste operatsioonide käigus, küsides kinnitust enne kriitiliste etappide lõpetamist. Näiteks enne oluliste ekirjade väljasaatmist esitab see mustandi kasutajale ülevaatamiseks ja heakskiitmiseks. Kasutaja saab paluda Agenti teha muudatusi või võtta üle kontroll käsitsi paranduste tegemiseks.

Päringute esitamine

Erinevalt standardsetest ChatGPT interaktsioonidest, mis keskenduvad vestluslike vastuste andmisele, on ChatGPT Agendi päringud kavandatud iseseisvaks ülesannete täitmiseks, mis võib võtta kaua aega ja hõlmata mitut platvormi.

Näidispäringud OpenAI-lt:

“Vaata üle mu kalender ja anna ülevaateid eelseisvatest klientide kohtumistest, kasutades hiljutisi valdkonna uudiseid ja turuarenguid”

“Uuri ja osta koostisosad autentse Jaapani hommikusöögi jaoks neljale inimesele, arvestades toitumispiiranguid ja kättesaadavust kohalikes poodides”

“Tee konkurentsianalüüs kolme valdkonna liidri kohta ja väljasta põhjalik slaidiesitlus turupositsioneerimise ülevaadete ja analüüsiga”

“Võta ChatGPT agendi jõudlusnäitajad Google Drive’i repositooriumidest ja loo visuaalsed esitlusslaidid, keskendudes andmete visualiseerimisele ilma sissejuhatava sisuta”

“Kavanda ja broneeri täielik marsruut kõigi 30 Major League Baseball’i staadioni külastamiseks 2025. aasta hooajal, alustades homme San Franciscost. Optimeeri minimaalse reisiaja jaoks, anna eelistus päevamängudele ja erireklaamüritustele (eriti Hello Kitty teemalistele õhtutele) ning esita lõplik plaan nii detailse arvutustabelina kui ka interaktiivse kaardi visualiseeringuna”

Riskid

Nagu Sam Altman toote lansseerimisel rõhutas, toovad täiustatud AI agendi võimekused kaasa uusi turvalisuse väljakutseid, mis nõuavad hoolikat kaalutlemist.

Peamised riskikategooriad:

  • Päringu sisestamise rünnakud (prompt injection attacks): Pahatahtlikud veebisaidid, mis üritavad manipuleerida agendi käitumist manustatud või peidetud juhiste kaudu
  • Andmeturvalisuse haavatavused: Volitamata juurdepääs tundlikule isiklikule või finantsinformatsioonile
  • Autentimise ärakasutamine: Sisselogimisandmete või seansi tokenite väärkasutus
  • Finantstoimingute riskid: Volitamata ostud või rahaülekanded
  • Privaatsuse rikkumised: Konfidentsiaalse teabe tahtmatu jagamine
  • Vastuvõtlikkus sotsiaalsele inseneeriale (social engineering susceptibility): Manipuleerimine näiliselt legitiimsete taotluste kaudu

OpenAI on rakendanud kaitsekihte, sealhulgas mudelile spetsiaalset koolitust kahtlaste juhiste äratundmiseks ja ignoreerimiseks, reaalajas seiresüsteemid, mis jälgivad agendi käitumist, ja dünaamilised turvavärskendused.

Praegune kättesaadavus

ChatGPT Agent on praegu kättesaadav tasulistele pakettidele. Pro kasutajad saavad teha 400 päringut kuus, samas kui Plus kasutajatel on juurdepääs 40 päringule kuus. OpenAI plaanib laiendada kättesaadavust Enterprise ja Edu kontode jaoks juuli lõpuks.

Viited

Youtube, OpenAI, 17.07.25, Introduction to ChatGPT agent
https://www.youtube.com/live/1jn_RpbPbEc?si=fv-c6HCwnSPdyfC2&t=85

OpenAI, 17.07.25, Introducing ChatGPT agent: bridging research and action,
https://openai.com/index/introducing-chatgpt-agent/