AI agenti
Kako izraditi AI agenta za poslovni proces
Odaberite pravi poslovni proces, postavite jasna pravila i izradite prvog AI agenta koji radi sigurno pod ljudskim nadzorom.
Sadržaj
AI agent nije samo chat sučelje. To je sustav u kojem model, unutar zadanih granica, bira sljedeći korak, poziva alate i provjerava rezultat kako bi ostvario poslovni cilj. Vrijednost ne dolazi iz etikete „agent”, nego iz bolje obavljenog procesa: manje ručnog prepisivanja, brže rješavanje slučaja ili dosljednija priprema odluke.
Dobar prvi projekt zato nije najambicioznija ideja, nego uzak proces koji se može promatrati, izmjeriti i zaustaviti. Prije izrade treba znati što agent smije učiniti, što mora prepustiti čovjeku i po kojim ćemo dokazima zaključiti da pilot radi.
Naš pristup izradi AI agenata za tvrtke zato počinje poslovnim procesom, granicama ovlasti i mjerljivim pilotom.
Kada je agent opravdan
Najprije provjerite treba li vam uopće agent. Ako se svaki korak može unaprijed opisati pravilom, obrascem ili običnom integracijom, predvidljiv radni tijek uglavnom je jednostavniji za testiranje i održavanje. Agent ima više smisla kada se sljedeći korak mijenja ovisno o sadržaju slučaja, kada treba odabrati između više alata ili kada nije moguće unaprijed zapisati cijeli put do rezultata.
Anthropic razlikuje radne tijekove s unaprijed definiranim putanjama od agenata koji dinamički usmjeravaju vlastiti rad te preporučuje povećavati složenost tek kada jednostavniji pristup nije dovoljan. To je korisna početna provjera: za razvrstavanje poznatih tipova zahtjeva možda je dovoljan jedan poziv modelu i provjera izlaza; za istraživanje složenog korisničkog slučaja, rad s nekoliko sustava i prilagodbu prema rezultatima alata agent može biti opravdan.
Odaberite proces koji se može dokazati
Za pilot odaberite jedan čest i jasno omeđen proces s imenovanim vlasnikom. Ulaz i očekivani izlaz trebaju biti poznati, a posljedice pogreške ograničene i popravljive. Dobar kandidat ima dovoljno prošlih primjera za testiranje te ručni način rada koji ostaje dostupan ako agent stane.
Prije automatizacije zapišite sadašnje stanje: koliko slučaj traje, koliko ljudskih koraka traži, gdje nastaju ispravci i kako stručnjak procjenjuje kvalitetu. Zatim mapirajte redovni put, iznimke, potrebne podatke, sustave koji se koriste i trenutke kada odluku mora donijeti odgovorna osoba. Bez te polazne crte pilot može izgledati aktivno, ali ne možemo dokazati da je poboljšao proces.
Složite minimalnu arhitekturu
Prva verzija obično treba samo šest dijelova:
- Okidač ili sučelje prima zahtjev i identitet korisnika.
- Sloj konteksta dohvaća samo podatke potrebne za taj slučaj.
- Model dobiva jasan cilj, granice i uvjete završetka.
- Mali skup alata čita ili mijenja poslovne sustave kroz njihove API-je.
- Pravila provjeravaju poziv i traže ljudsko odobrenje prije osjetljive radnje.
- Zapis izvođenja čuva ulaze, odluke, pozive alata, ishode i verzije konfiguracije potrebne za evaluaciju.
Deterministički kod treba ostati zadužen za izračune, obvezna pravila i provjeru formata. Model neka rješava nejasnoću, odabir dopuštenog alata i formuliranje nacrta. OpenAI-jeva dokumentacija o pozivanju funkcija pokazuje kako model može predložiti strukturirane argumente alata; aplikacija i dalje treba provjeriti argumente, ovlasti i poslovna pravila prije izvršenja. Jasni nazivi, uski parametri i eksplicitni rezultati alata olakšavaju i modelu i ljudima razumjeti što se dogodilo.
Dozvole moraju pratiti posljedice
Agentu ne dajte zajednički administratorski račun. Primijenite načelo najmanjih ovlasti koje definira NIST: svaki alat dobiva samo resurse i radnje potrebne za svoj zadatak. Odvojite alate za čitanje od alata za pisanje, ograničite dopuštene zapise i domene te postavite limite broja poziva i troška. Tajne držite izvan uputa modela i korisnički vidljivih zapisa.
Provjere trebaju biti uz samu radnju, a ne samo na početku ili kraju razgovora. Primjerice, zahtjev za slanje poruke treba ponovno provjeriti primatelja i sadržaj neposredno prije slanja. Dokumentacija OpenAI Agents SDK-a objašnjava ulazne i izlazne provjere te provjere pojedinačnih alata, ali isti obrazac vrijedi neovisno o odabranom okviru.
Ljudsko odobrenje nije ukras
Agent se treba zaustaviti prije isplate, brisanja, slanja vanjske poruke, promjene službenog zapisa ili dodjele novih ovlasti ako se posljedice ne mogu lako poništiti. Zaslon za odobrenje mora prikazati predloženu radnju, izvor podataka, pogođeni zapis, razlog i mogućnost povrata. Osoba mora moći odobriti, odbiti ili urediti prijedlog.
OpenAI-jev vodič za human-in-the-loop opisuje obrazac u kojem se izvođenje pauzira dok čovjek ne odluči o osjetljivom pozivu alata. Ne tražite potvrdu za svaki bezazleni korak: previše upozorenja otežava prepoznavanje onih važnih.
Evaluacije su specifikacija ponašanja
Prije pilota složite skup stvarnih, anonimiziranih primjera: uobičajene slučajeve, rubne slučajeve, neispravne ulaze i pokušaje navođenja agenta izvan dopuštenog procesa. Za svaki primjer zapišite prihvatljiv ishod, očekivane ili zabranjene pozive alata te kada agent mora tražiti pomoć. OpenAI-jev vodič za evaluacije koristi reprezentativne testne podatke i unaprijed zadane kriterije za provjeru ponašanja.
Evaluirajte cijelo izvođenje, ne samo završni tekst. Pregledajte je li agent uzeo pravi izvor, poslao valjane argumente, poštovao odobrenje i završio u dopuštenom stanju. Testove ponovno pokrenite nakon promjene modela, uputa, alata ili pravila. U produkciji uzorkujte tragove rada i nove pogreške vraćajte u evaluacijski skup.
Mjerite pilot prema polaznom stanju
Dogovorite metrike i pragove prije početka. Korisne mjere uključuju udio ispravno završenih slučajeva, stopu ljudskih ispravaka, pogreške alata, vrijeme ciklusa, trošak po završenom slučaju, broj eskalacija te broj nedopuštenih ili štetnih radnji. Nema univerzalnog dobrog postotka: prihvatljivi prag ovisi o procesu i riziku. Usporedite pilot s ručnim načinom na sličnoj skupini slučajeva i posebno pratite kvalitetu, a ne samo brzinu.
Uvodite ovlasti u etapama
Počnite u testnom okruženju, zatim pokrenite agenta u sjeni bez utjecaja na stvarne odluke. Sljedeća etapa može biti samo čitanje, nakon nje ograničene radnje uz odobrenje, a tek potom veći opseg. Svaka etapa treba imati vlasnika incidenta, zapis radnji, ograničenje trajanja i jasan prekidač za povrat na ručni proces.
NIST-ov profil za generativnu umjetnu inteligenciju organizira rad na rizicima kroz organizacijsko upravljanje, mapiranje, mjerenje i postupanje tijekom životnog ciklusa. Za pilot to znači da dokumentiranje namjene, rizika, testova i odluka nije završna administracija, nego dio same izrade.
Ne počinjite s više agenata
Više agenata uvodi dodatne prijenose konteksta, dozvole, kašnjenje, trošak i mjesta na kojima rezultat može poći pogrešno. Počnite s jednim agentom ili determinističkim radnim tijekom. Specijalizirane agente uvedite tek kada evaluacije pokažu da jedan sustav ne može pouzdano obraditi jasno odvojene uloge ili skupove alata te da nova arhitektura mjerljivo poboljšava rezultat.
Pravi završetak pilota nije demonstracija koja izgleda uvjerljivo. To je mali sustav čije granice možemo objasniti, čije radnje možemo rekonstruirati i čiju vrijednost možemo usporediti s procesom koji je zamijenio ili podržao.