Chatt, assistent och agent
En vanlig chatt väntar på nästa fråga. En assistent kan ha dokument eller funktioner kopplade till sig. En agent får ofta ett mål, planerar flera steg, observerar resultat och fortsätter tills den når ett stoppvillkor.
Begreppen används olika av olika produkter. Bedöm därför faktisk åtkomst: kan verktyget bara föreslå ett kommando, eller kan det köra kommandot och skriva filer utan ny bekräftelse?
Agentens fyra delar
- Modell: tolkar mål och väljer nästa åtgärd.
- Verktyg: exempelvis filsystem, webbläsare, terminal eller API.
- Tillstånd: uppgift, tidigare resultat och sparade checkpoints.
- Kontroll: behörigheter, godkännanden, budget och stoppvillkor.
En bättre modell ersätter inte svaga kontroller. Ett felaktigt antagande blir farligare när det omedelbart omsätts i en extern handling.
Uppgifter som passar
Agenter passar repetitiva, observerbara flöden: sortera filer efter tydliga regler, köra en testslinga, samla status från flera källor eller skapa ett utkast som en människa granskar. Resultatet bör kunna kontrolleras automatiskt eller snabbt av en person.
De passar sämre för oåterkalleliga beslut, juridiska bedömningar eller bred åtkomst utan tydligt mål. Att skicka meddelanden, publicera, köpa eller radera ska normalt kräva uttryckligt godkännande.
Ge minsta möjliga behörighet
- Skapa en separat arbetskopia.
- Tillåt bara mappar och kommandon som uppgiften behöver.
- Håll hemligheter utanför agentens kontext.
- Kräv paus före externa eller destruktiva handlingar.
- Sätt tids-, kostnads- och stegbudget.
- Logga åtgärd och resultat utan hemliga värden.
Stoppvillkor och mänsklig kontroll
Ett bra stoppvillkor kan vara ”alla specificerade tester passerar och diffen berör bara dessa filer”. ”Fortsätt tills allt fungerar” är för vagt eftersom agenten kan ändra kraven eller kringgå testet.
Den mänskliga granskaren behöver se mål, ändringar, kommandon, testresultat och kvarvarande osäkerhet. Om en agent inte kan förklara sin leverans är den svår att använda ansvarsfullt.