NYFIR STUDIOS
Nyfir Studios Learn

Vad är en AI-agent och vad kan den göra?

En AI-agent är ett system där en modell inte bara svarar med text utan också kan välja och använda verktyg: läsa filer, söka, köra kommandon eller anropa tjänster. Det gör agenten handlingskraftig – och gör behörighetsgränser avgörande.

Chatt, assistent och agent

En vanlig chatt väntar på nästa fråga. En assistent kan ha dokument eller funktioner kopplade till sig. En agent får ofta ett mål, planerar flera steg, observerar resultat och fortsätter tills den når ett stoppvillkor.

Begreppen används olika av olika produkter. Bedöm därför faktisk åtkomst: kan verktyget bara föreslå ett kommando, eller kan det köra kommandot och skriva filer utan ny bekräftelse?

Agentens fyra delar

  • Modell: tolkar mål och väljer nästa åtgärd.
  • Verktyg: exempelvis filsystem, webbläsare, terminal eller API.
  • Tillstånd: uppgift, tidigare resultat och sparade checkpoints.
  • Kontroll: behörigheter, godkännanden, budget och stoppvillkor.

En bättre modell ersätter inte svaga kontroller. Ett felaktigt antagande blir farligare när det omedelbart omsätts i en extern handling.

Uppgifter som passar

Agenter passar repetitiva, observerbara flöden: sortera filer efter tydliga regler, köra en testslinga, samla status från flera källor eller skapa ett utkast som en människa granskar. Resultatet bör kunna kontrolleras automatiskt eller snabbt av en person.

De passar sämre för oåterkalleliga beslut, juridiska bedömningar eller bred åtkomst utan tydligt mål. Att skicka meddelanden, publicera, köpa eller radera ska normalt kräva uttryckligt godkännande.

Ge minsta möjliga behörighet

  1. Skapa en separat arbetskopia.
  2. Tillåt bara mappar och kommandon som uppgiften behöver.
  3. Håll hemligheter utanför agentens kontext.
  4. Kräv paus före externa eller destruktiva handlingar.
  5. Sätt tids-, kostnads- och stegbudget.
  6. Logga åtgärd och resultat utan hemliga värden.

Stoppvillkor och mänsklig kontroll

Ett bra stoppvillkor kan vara ”alla specificerade tester passerar och diffen berör bara dessa filer”. ”Fortsätt tills allt fungerar” är för vagt eftersom agenten kan ändra kraven eller kringgå testet.

Den mänskliga granskaren behöver se mål, ändringar, kommandon, testresultat och kvarvarande osäkerhet. Om en agent inte kan förklara sin leverans är den svår att använda ansvarsfullt.