AI Agent Reliability Audit
Jag granskar dina AI-agenter innan dina kunder gör det.
Sätter du AI-agenter nära pengar, kunder eller produktionssystem? Då finns det en handfull förutsägbara sätt de kan haverera på — en kassa som bekräftar på fel, en injektion som exfiltrerar data, en webhook som körs två gånger. Jag tvingar varje sådant haveri att hända en gång, under kontroll, så att det inte händer hos dina kunder. Samma disciplin som jag kör på min egen agentflotta i produktion.
Den ansvariga människan som håller förtroendegränsen — inte en skanner, inte en byrå.
Vem det är för
För team som gett en AI-agent riktigt ansvar
Agenter nära pengar
Checkout, återbetalningar, utbetalningar, fakturor — allt där en agent kan bekräfta eller flytta värde.
Agenter nära kunder
Support, mejl, meddelanden som går ut i ditt namn — där en injektion eller ett fel blir kundens problem.
Agenter nära produktion
Agenter med verktyg som skriver till databaser, anropar API:er eller kör kommandon i dina system.
Metoden
De 7 linserna
Ett agent-system havererar på ett litet antal förutsägbara sätt. Varje lins tvingar ett av dem att hända — under kontroll, med bevis.
- 01
Ytinventering
Varje väg in: entrypoints, webhooks, cron-jobb och vilka verktyg varje agent får anropa.
Så testas det: Härleds ur koden, aldrig ur ett gammalt diagram. Varje oautentiserad ingång och för bred verktygsrättighet flaggas.
- 02
Injektionsvägar
Varje extern sträng som når en prompt — webhooks, mejl, RAG-chunkar, hämtade webbsidor.
Så testas det: Adversariella injektioner som försöker exfiltrera data, trigga en ogodkänd åtgärd eller eskalera agentens rättigheter.
- 03
Pengavägar
Litar servern på ett belopp eller en success-flagga från klienten? Är felen ärliga? Går allt att stämma av?
Så testas det: Jag tvingar de olyckliga vägarna: nekat kort, bruten koppling, spoofad "betald". Pengavägar måste faila stängt.
- 04
Idempotens & retries
Varje webhook och jobb körs minst en gång. Finns idempotensnycklar — och backas de av en unik databasindex?
Så testas det: Jag levererar samma webhook två gånger och kör parallella jobb. Blir det dubbla debiteringar, tryck eller rader?
- 05
Autonomigränser
Vad får agenten avsluta själv, och vad ska stanna för en människa? Var sitter godkännande-grindarna?
Så testas det: Jag letar efter den utgående åtgärd som skickas utan grind — och grindar placerade efter det oåterkalleliga steget.
- 06
Gränser
Kostnadstak, dagliga anropstak, rate-buckets, loop-skydd, timeouts — det som stoppar en skenande agent.
Så testas det: Jag försöker spränga taket och kontrollerar att runnern vägrar starta — inte bara loggar en varning och fortsätter.
- 07
Observerbarhet
När en agent gör fel kl 02:00 — kan du se vad den gjorde, varför, och om det hänt förr?
Så testas det: Jag utlöser ett kontrollerat fel och ber systemet förklara det med enbart sina loggar. Går det inte är det ett fynd.
Vad du får
Bevis, inte åsikter
Ett fynd är aldrig "du borde förbättra X". Det är ett reproducerbart haveriscenario, den minsta fix som stänger grundorsaken, och steget som bevisar att den håller.
Skriftlig rapport
Exec-sammanfattning, en scorecard per lins, och fynd rangordnade efter blast radius — vad som går sönder och hur långt det sprider sig.
Konkreta haveriscenarier
Varje fynd: den exakta inputen, utfallet den gav, grundorsaken, fixen och verifieringssteget.
30-dagars åtgärdsplan
Ordnad efter risk per timme — den största risken per nedlagd insats först.
Omtest
Inom 30 dagar kör jag om varje test som failade. Ett fynd stängs när dess verifieringssteg passerar — inte när någon säger att det är fixat.
Pris
Två sätt att börja
Agent Health Check
En snabb, ärlig temperaturmätning: hur farligt är ditt agent-upplägg just nu?
Cirka 1 dag · fast pris
- Ytkarta över dina agenters entrypoints, verktyg och webhooks
- De 5 största riskerna, rangordnade efter blast radius
- En prioriterad kortlista på vad du bör åtgärda först
- Avgiften dras av om du uppgraderar till full audit inom 30 dagar
9 995 kr fast pris · exkl. moms
AI Agent Reliability Audit
Hela 7-lins-granskningen av ett agent-system — rapport, åtgärdsplan och omtest.
Cirka 1 vecka · fast pris
- Full granskning av alla 7 linser, med adversariella tester
- Skriftlig rapport: scorecard, fynd rangordnade efter blast radius
- Varje fynd: konkret haveriscenario (input→utfall), fix och verifieringssteg
- 30-dagars åtgärdsplan, ordnad efter risk per timme
- Omtest inom 30 dagar: jag kör om varje test som failade
34 995 kr fast pris · exkl. moms
Varför jag
Jag kör den här disciplinen på mitt eget system, varje dag
Jag är inte en skanner och inte en byrå. Jag är en person i Sverige som bygger och driver en agentflotta i produktion — agenter nära pengar, tryck-på-beställning och människa-i-loopen-godkännanden. Det här kvartalet härdade jag den: prompt-injection-försvar, HMAC på webhooks, idempotens hela vägen, kostnadstak per klient, pengavägar som failar stängt. Auditen är den praktiken vänd utåt. Jag gjorde en ärlig självgranskning av min egen plattform med exakt samma mall — den finns att läsa.
Ärlig avgränsning
Vad en audit inte är
Jag säljer bevis, inte trygghet på låtsas. Här är gränserna, uttalade i förväg.
- Inget certifikat. Det här är inte ISO 27001, SOC 2 eller en formell compliance-stämpel — det är en teknisk granskning av hur dina agenter failar.
- Ingen garanti att systemet är "säkert". Jag hittar och bevisar de haverier metoden täcker; jag lovar inte att inget annat existerar.
- Jag pentestar inte dina tredjepartsleverantörer. Jag granskar hur du använder dem, inte deras interna system.
- Jag skjuter inte skarpa tester mot produktionens pengavägar utan skriftlig scope. Arbetet sker mot staging/testläge.
- Jag fixar inte allt åt dig i priset. Auditen levererar fynd, fixförslag och ett omtest; själva implementationen kan vi komma överens om separat.
Vanliga frågor
Hur lång tid tar en audit?
En full Reliability Audit tar cirka en fokuserad vecka från kickoff till rapport, plus omtestet inom 30 dagar. Health Check är cirka en dag.
Vad behöver du från oss?
Läsåtkomst till koden för agent-systemet, en staging- eller testmiljö att köra tester mot, och en kontaktperson som kan svara på hur flödena är tänkta att fungera. Ingen produktionsåtkomst krävs för grundarbetet.
Rör ni produktionen eller riktiga pengar?
Nej, inte utan skriftlig scope. Adversariella tester körs mot staging eller testläge. Pengavägar testas med provider-testnycklar, aldrig skarpa debiteringar utan att vi kommit överens om det.
Vilka ramverk bygger metoden på?
De 7 linserna är min egen praktik, härdad på min egen agentflotta, men de överlappar väl med OWASP:s Top 10 för LLM- och agent-appar. Skillnaden är att jag tvingar varje haveri att faktiskt hända — inte bara checkar en lista.
Fixar du det du hittar?
Auditen levererar fynd, en föreslagen fix per fynd och ett omtest. Vill du att jag implementerar fixarna kommer vi överens om det separat — men många team fixar själva med planen i handen.
Är rapporten konfidentiell?
Ja. Rapporten namnger riktiga haverisätt och är en karta över din attackyta om den läcker — den behandlas därefter och delas bara med dig.
Vad är skillnaden mot Health Check?
Health Check är en snabb triage på cirka en dag: ytkarta plus de största riskerna, utan djupa adversariella tester och utan formellt omtest. Den är dörröppnaren — och avgiften dras av om du uppgraderar till en full audit inom 30 dagar.
Har du agenter nära pengar eller kunder?
Boka en audit så går vi igenom ditt agent-system, vad som ligger i scope och vilket paket som passar. Inget säljsnack.
Boka en audit