Skip to content

AI Agent Reliability Audit

Jag granskar dina AI-agenter innan dina kunder gör det.

Sätter du AI-agenter nära pengar, kunder eller produktionssystem? Då finns det en handfull förutsägbara sätt de kan haverera på — en kassa som bekräftar på fel, en injektion som exfiltrerar data, en webhook som körs två gånger. Jag tvingar varje sådant haveri att hända en gång, under kontroll, så att det inte händer hos dina kunder. Samma disciplin som jag kör på min egen agentflotta i produktion.

Den ansvariga människan som håller förtroendegränsen — inte en skanner, inte en byrå.

Vem det är för

För team som gett en AI-agent riktigt ansvar

Agenter nära pengar

Checkout, återbetalningar, utbetalningar, fakturor — allt där en agent kan bekräfta eller flytta värde.

Agenter nära kunder

Support, mejl, meddelanden som går ut i ditt namn — där en injektion eller ett fel blir kundens problem.

Agenter nära produktion

Agenter med verktyg som skriver till databaser, anropar API:er eller kör kommandon i dina system.

Metoden

De 7 linserna

Ett agent-system havererar på ett litet antal förutsägbara sätt. Varje lins tvingar ett av dem att hända — under kontroll, med bevis.

  1. 01

    Ytinventering

    Varje väg in: entrypoints, webhooks, cron-jobb och vilka verktyg varje agent får anropa.

    Så testas det: Härleds ur koden, aldrig ur ett gammalt diagram. Varje oautentiserad ingång och för bred verktygsrättighet flaggas.

  2. 02

    Injektionsvägar

    Varje extern sträng som når en prompt — webhooks, mejl, RAG-chunkar, hämtade webbsidor.

    Så testas det: Adversariella injektioner som försöker exfiltrera data, trigga en ogodkänd åtgärd eller eskalera agentens rättigheter.

  3. 03

    Pengavägar

    Litar servern på ett belopp eller en success-flagga från klienten? Är felen ärliga? Går allt att stämma av?

    Så testas det: Jag tvingar de olyckliga vägarna: nekat kort, bruten koppling, spoofad "betald". Pengavägar måste faila stängt.

  4. 04

    Idempotens & retries

    Varje webhook och jobb körs minst en gång. Finns idempotensnycklar — och backas de av en unik databasindex?

    Så testas det: Jag levererar samma webhook två gånger och kör parallella jobb. Blir det dubbla debiteringar, tryck eller rader?

  5. 05

    Autonomigränser

    Vad får agenten avsluta själv, och vad ska stanna för en människa? Var sitter godkännande-grindarna?

    Så testas det: Jag letar efter den utgående åtgärd som skickas utan grind — och grindar placerade efter det oåterkalleliga steget.

  6. 06

    Gränser

    Kostnadstak, dagliga anropstak, rate-buckets, loop-skydd, timeouts — det som stoppar en skenande agent.

    Så testas det: Jag försöker spränga taket och kontrollerar att runnern vägrar starta — inte bara loggar en varning och fortsätter.

  7. 07

    Observerbarhet

    När en agent gör fel kl 02:00 — kan du se vad den gjorde, varför, och om det hänt förr?

    Så testas det: Jag utlöser ett kontrollerat fel och ber systemet förklara det med enbart sina loggar. Går det inte är det ett fynd.

Vad du får

Bevis, inte åsikter

Ett fynd är aldrig "du borde förbättra X". Det är ett reproducerbart haveriscenario, den minsta fix som stänger grundorsaken, och steget som bevisar att den håller.

Skriftlig rapport

Exec-sammanfattning, en scorecard per lins, och fynd rangordnade efter blast radius — vad som går sönder och hur långt det sprider sig.

Konkreta haveriscenarier

Varje fynd: den exakta inputen, utfallet den gav, grundorsaken, fixen och verifieringssteget.

30-dagars åtgärdsplan

Ordnad efter risk per timme — den största risken per nedlagd insats först.

Omtest

Inom 30 dagar kör jag om varje test som failade. Ett fynd stängs när dess verifieringssteg passerar — inte när någon säger att det är fixat.

Pris

Två sätt att börja

Agent Health Check

En snabb, ärlig temperaturmätning: hur farligt är ditt agent-upplägg just nu?

9 995 krexkl. moms

Cirka 1 dag · fast pris

  • Ytkarta över dina agenters entrypoints, verktyg och webhooks
  • De 5 största riskerna, rangordnade efter blast radius
  • En prioriterad kortlista på vad du bör åtgärda först
  • Avgiften dras av om du uppgraderar till full audit inom 30 dagar

9 995 kr fast pris · exkl. moms

Full granskning

AI Agent Reliability Audit

Hela 7-lins-granskningen av ett agent-system — rapport, åtgärdsplan och omtest.

34 995 krexkl. moms

Cirka 1 vecka · fast pris

  • Full granskning av alla 7 linser, med adversariella tester
  • Skriftlig rapport: scorecard, fynd rangordnade efter blast radius
  • Varje fynd: konkret haveriscenario (input→utfall), fix och verifieringssteg
  • 30-dagars åtgärdsplan, ordnad efter risk per timme
  • Omtest inom 30 dagar: jag kör om varje test som failade

34 995 kr fast pris · exkl. moms

Varför jag

Jag kör den här disciplinen på mitt eget system, varje dag

Jag är inte en skanner och inte en byrå. Jag är en person i Sverige som bygger och driver en agentflotta i produktion — agenter nära pengar, tryck-på-beställning och människa-i-loopen-godkännanden. Det här kvartalet härdade jag den: prompt-injection-försvar, HMAC på webhooks, idempotens hela vägen, kostnadstak per klient, pengavägar som failar stängt. Auditen är den praktiken vänd utåt. Jag gjorde en ärlig självgranskning av min egen plattform med exakt samma mall — den finns att läsa.

Ärlig avgränsning

Vad en audit inte är

Jag säljer bevis, inte trygghet på låtsas. Här är gränserna, uttalade i förväg.

  • Inget certifikat. Det här är inte ISO 27001, SOC 2 eller en formell compliance-stämpel — det är en teknisk granskning av hur dina agenter failar.
  • Ingen garanti att systemet är "säkert". Jag hittar och bevisar de haverier metoden täcker; jag lovar inte att inget annat existerar.
  • Jag pentestar inte dina tredjepartsleverantörer. Jag granskar hur du använder dem, inte deras interna system.
  • Jag skjuter inte skarpa tester mot produktionens pengavägar utan skriftlig scope. Arbetet sker mot staging/testläge.
  • Jag fixar inte allt åt dig i priset. Auditen levererar fynd, fixförslag och ett omtest; själva implementationen kan vi komma överens om separat.

Vanliga frågor

Hur lång tid tar en audit?

En full Reliability Audit tar cirka en fokuserad vecka från kickoff till rapport, plus omtestet inom 30 dagar. Health Check är cirka en dag.

Vad behöver du från oss?

Läsåtkomst till koden för agent-systemet, en staging- eller testmiljö att köra tester mot, och en kontaktperson som kan svara på hur flödena är tänkta att fungera. Ingen produktionsåtkomst krävs för grundarbetet.

Rör ni produktionen eller riktiga pengar?

Nej, inte utan skriftlig scope. Adversariella tester körs mot staging eller testläge. Pengavägar testas med provider-testnycklar, aldrig skarpa debiteringar utan att vi kommit överens om det.

Vilka ramverk bygger metoden på?

De 7 linserna är min egen praktik, härdad på min egen agentflotta, men de överlappar väl med OWASP:s Top 10 för LLM- och agent-appar. Skillnaden är att jag tvingar varje haveri att faktiskt hända — inte bara checkar en lista.

Fixar du det du hittar?

Auditen levererar fynd, en föreslagen fix per fynd och ett omtest. Vill du att jag implementerar fixarna kommer vi överens om det separat — men många team fixar själva med planen i handen.

Är rapporten konfidentiell?

Ja. Rapporten namnger riktiga haverisätt och är en karta över din attackyta om den läcker — den behandlas därefter och delas bara med dig.

Vad är skillnaden mot Health Check?

Health Check är en snabb triage på cirka en dag: ytkarta plus de största riskerna, utan djupa adversariella tester och utan formellt omtest. Den är dörröppnaren — och avgiften dras av om du uppgraderar till en full audit inom 30 dagar.

Har du agenter nära pengar eller kunder?

Boka en audit så går vi igenom ditt agent-system, vad som ligger i scope och vilket paket som passar. Inget säljsnack.

Boka en audit