DIN FÖRSTA AGENT
Börja med en verifierbar leverans, inte maximal autonomi
Välj ett resultat som kan granskas: ett strukturerat utkast från öppna källor eller helt syntetiska data. Sätt en namngiven ägare, bygg i testmiljö och låt ingen extern handling ske automatiskt.
- Skriv mål, stoppvillkor och förbjudna handlingar.
- Skapa ett litet eval-set med normala fall, kantfall och attacker.
- Bygg fasta steg först; tillåt modellval bara där regler inte räcker.
- Ge ett läsverktyg i taget och validera strukturerad output.
- Lägg på loggning, budget, timeout och mänsklig granskningskö.
Kunskapsassistent över ett kontrollerat dokumentpaket
Ladda ett syntetiskt dokumentpaket eller offentliga instruktioner i en godkänd testmiljö. Assistenten svarar med källa och säger ”saknas i underlaget” när stöd inte finns. Den har inga verktyg och gör inga externa handlingar.
Varför börja här? Du får testdata, källkontroll och ett kvalitetsmått innan du lägger till agency. Mät korrekta hänvisningar, obesvarade frågor och påståenden utan stöd.
Researchagent med två läsverktyg
Ge agenten ett sökverktyg mot en allowlist av öppna domäner och ett verktyg som hämtar den valda sidan. Den ska returnera strukturerad JSON med URL, publiceringsdatum, påstående, stöd och osäkerhet.
Stopp: okänd domän, robots-/åtkomstfel, instruktioner inuti källtexten, fler än sex verktygsanrop, saknad källa eller budgetgräns. Agenten får aldrig publicera resultatet.
Evals: källprecision, fabricerade URL:er, missad motstridig källa, prompt injection och kostnad per godkänt utkast.
Syntetisk triage med säker återkörning
Ett workflow läser ett påhittat supportärende, låter modellen föreslå kategori och svar, validerar resultatet och lägger det i en sandboxkö. En person godkänner innan något skulle kunna skickas.
- Varje ärende får ett körnings-id och en idempotensnyckel.
- Timeout eller tillfälligt API-fel får högst två återförsök.
- Samma nyckel får inte skapa två köposter.
- Misstänkt instruktion i ärendet, låg säkerhet eller känsligt ämne ger manuell eskalering.
- Rollback betyder att testposten kan tas bort; ett skickat mejl är däremot inte säkert återkallningsbart och ligger därför bakom godkännande.
Godkänn inte agenten på tre lyckade demos
- Kör eval-setet efter varje ändring av modell, prompt, tool eller datakälla.
- Kontrollera normalfall, tom input, fel format, dubbletter, lång input, API-fel och prompt injection.
- Sätt acceptanskriterier för kvalitet, farliga anrop, kostnad, latens och manuell eskalering.
- Versionera instruktioner, tool-scheman och eval-resultat tillsammans.
- Lansera till liten volym, granska alla utfall och ha en testad pausknapp.
Ett osäkerhetsvärde som modellen själv skriver är inte en tillförlitlig säkerhetskontroll. Använd verifierbara regler och empiriska evals.
Skribent, källkontroll och begränsning
Skribent och teknisk källgranskare: Christopher Leijon. Funktioner, protokoll och säkerhetsråd har kontrollerats mot länkade primärkällor .
Extern sakgranskning: Ingen extern systemarkitekt, AI-säkerhetsspecialist eller dataskyddsspecialist har granskat sidan. Materialet är ett praktiskt orienteringsstöd och ersätter inte säkerhetsgranskning, hotmodellering, juridisk bedömning eller organisationens förändringsprocess.
Nästa: Verktyg
Välj rätt byggnivå: konversationsyta, API/SDK eller hanterad automation.