DIN FÖRSTA AGENT

BYGG UTAN KOD // TRE KONKRETA EXEMPEL

Senast uppdaterad:

MINSTA SÄKRA SYSTEM

Börja med en verifierbar leverans, inte maximal autonomi

Välj ett resultat som kan granskas: ett strukturerat utkast från öppna källor eller helt syntetiska data. Sätt en namngiven ägare, bygg i testmiljö och låt ingen extern handling ske automatiskt.

  1. Skriv mål, stoppvillkor och förbjudna handlingar.
  2. Skapa ett litet eval-set med normala fall, kantfall och attacker.
  3. Bygg fasta steg först; tillåt modellval bara där regler inte räcker.
  4. Ge ett läsverktyg i taget och validera strukturerad output.
  5. Lägg på loggning, budget, timeout och mänsklig granskningskö.

EXEMPEL 1 — INTE EN AGENT

Kunskapsassistent över ett kontrollerat dokumentpaket

Ladda ett syntetiskt dokumentpaket eller offentliga instruktioner i en godkänd testmiljö. Assistenten svarar med källa och säger ”saknas i underlaget” när stöd inte finns. Den har inga verktyg och gör inga externa handlingar.

Varför börja här? Du får testdata, källkontroll och ett kvalitetsmått innan du lägger till agency. Mät korrekta hänvisningar, obesvarade frågor och påståenden utan stöd.

EXEMPEL 2 — BEGRÄNSAD AGENT

Researchagent med två läsverktyg

Ge agenten ett sökverktyg mot en allowlist av öppna domäner och ett verktyg som hämtar den valda sidan. Den ska returnera strukturerad JSON med URL, publiceringsdatum, påstående, stöd och osäkerhet.

Stopp: okänd domän, robots-/åtkomstfel, instruktioner inuti källtexten, fler än sex verktygsanrop, saknad källa eller budgetgräns. Agenten får aldrig publicera resultatet.

Evals: källprecision, fabricerade URL:er, missad motstridig källa, prompt injection och kostnad per godkänt utkast.

EXEMPEL 3 — KONTROLLERAT WORKFLOW

Syntetisk triage med säker återkörning

Ett workflow läser ett påhittat supportärende, låter modellen föreslå kategori och svar, validerar resultatet och lägger det i en sandboxkö. En person godkänner innan något skulle kunna skickas.

  • Varje ärende får ett körnings-id och en idempotensnyckel.
  • Timeout eller tillfälligt API-fel får högst två återförsök.
  • Samma nyckel får inte skapa två köposter.
  • Misstänkt instruktion i ärendet, låg säkerhet eller känsligt ämne ger manuell eskalering.
  • Rollback betyder att testposten kan tas bort; ett skickat mejl är däremot inte säkert återkallningsbart och ligger därför bakom godkännande.

TEST OCH DRIFT

Godkänn inte agenten på tre lyckade demos

  1. Kör eval-setet efter varje ändring av modell, prompt, tool eller datakälla.
  2. Kontrollera normalfall, tom input, fel format, dubbletter, lång input, API-fel och prompt injection.
  3. Sätt acceptanskriterier för kvalitet, farliga anrop, kostnad, latens och manuell eskalering.
  4. Versionera instruktioner, tool-scheman och eval-resultat tillsammans.
  5. Lansera till liten volym, granska alla utfall och ha en testad pausknapp.

Ett osäkerhetsvärde som modellen själv skriver är inte en tillförlitlig säkerhetskontroll. Använd verifierbara regler och empiriska evals.

AVSÄNDARE OCH GRANSKNING

Skribent, källkontroll och begränsning

Skribent och teknisk källgranskare: Christopher Leijon. Funktioner, protokoll och säkerhetsråd har kontrollerats mot länkade primärkällor .

Extern sakgranskning: Ingen extern systemarkitekt, AI-säkerhetsspecialist eller dataskyddsspecialist har granskat sidan. Materialet är ett praktiskt orienteringsstöd och ersätter inte säkerhetsgranskning, hotmodellering, juridisk bedömning eller organisationens förändringsprocess.

Så tas och uppdateras innehållet på AI på svenska.

GUIDEVÄG // STEG 3 AV 6

Nästa: Verktyg

Välj rätt byggnivå: konversationsyta, API/SDK eller hanterad automation.

Fortsätt till steg 4 →

Till guidens översikt