AI-säkerhet
Promptinjektion, läckage, osäker verktygsåtkomst, behörigheter och fellägen i produktion.
19 innehållsposter (12 artiklar · 7 videor)
Börja här
Börja med några rekommenderade innehållsposter innan du går igenom hela flödet.
14 min läsningPromptinjektion och LLM-säkerhet: hotmodeller och djupförsvar
Promptinjektion är en permanent säkerhetsriskklass för LLM-system, inte ett misstag i promptskrivningen. En produktionsguide till hotmodeller, datagränser, verktygsbehörigheter, regressionstester, övervakning och incidenthantering.
Avancerad
10 min läsningRAG för företagskunskap: behörigheter, informationsläckage och källgränser
En kunskapsassistent för företag är säker endast om informationshämtningen respekterar behörigheterna. Så utformas källgränser för RAG, ACL-filtrering, dokumentägarskap, loggning, hantering av inaktuella källor och säkra avböjanden.
Avancerad
11 min läsningSäker dokumentinläsning för RAG: PDF-filer, OCR, metadata och lagringstid
Kvaliteten på RAG börjar före hämtningen. En säker guide till inläsning av PDF-filer, OCR, metadata, behörigheter, källors aktualitet, radering, risk för skadlig kod och operativt ansvar.
AvanceradMer i detta ämne
7 min läsningWebhooks i Hermes: händelsestyrda AI-agenter utan en enda enorm prompt
Konfigurera Hermes Agent-webhooks med autentisering som passar avsändaren, hälsokontroller på port 8644 och små namngivna rutter, så att händelser blir fokuserade agentkörningar med ett uttryckligt leveransmål.
Mellannivå
10 min läsningNemoClaw på DGX Spark: plan för driftsättning och säkerhet
Planera och utvärdera OpenClaw, Hermes eller Deep Agents Code i NVIDIA OpenShell på DGX Spark: aktuell introduktion, policylager, dirigerad inferens och det acceptansunderlag som krävs.
Avancerad
8 min läsningOpenClaw: tillåtelselistor, parning och säkra gruppomnämnanden
Kanaltillåtelselistor, DM-parning och regler för omnämnanden i grupper är den verkliga säkerhetsgränsen för OpenClaw, eftersom verktygen kan omfatta skal, filer och webbläsare. En praktisk checklista för nedlåsning.
Mellannivå
9 min läsningKonfigurera en personlig OpenClaw-gateway: installation, introduktion och kontrollpanel
Vad OpenClaw är, hur du installerar och konfigurerar flerkanalsgatewayen i egen drift, öppnar Control UI på port 18789 och vilka Node-versioner som stöds utan att hoppa över säkerhetsbaslinjen.
Mellannivå
10 min läsningOpenClaw skills, autonomi med heartbeat och godkännandekontroller
Hur OpenClaw skills läses in, hur periodiska heartbeat-körningar fungerar, hur du styr kommandokörning på värden och hur du håller webbläsarautomatisering bakom en restriktiv policy och granskad bekräftelse i arbetsflödet.
Mellannivå
20 minuterBehörigheter och åtkomstkontroll för RAG – en fördjupad guide
Paragon. Går igenom behörighetsproblemet för RAG i produktion och jämför verktygsanrop, namnrymder, ACL-tabeller och relationsbaserade behörigheter. Det stöder direkt artikelns huvudregel: informationshämtningen får endast returnera källor som den aktuella användaren har rätt att se, och källsystemens behörigheter får inte behandlas som en efterhandsfråga.
Avancerad
69 minuterAgentlandskapet – lärdomar från att driftsätta agenter i produktion
MLOps.community. Prosus AI-chef och en AI-utvecklare berättar vad som faktiskt gick sönder när de driftsatte agenter i koncernens portföljbolag: penetrationstestning av promptinjektion före lansering, en osäker skrivning när en Jira-agent inte kunde tolka mänsklig kortnotation, inaktuell kontext som hanterades genom att agenterna fick redovisa sina antaganden samt reservlösningar som slog samman eller stängde av agenter när dessa började öka den kognitiva belastningen. Det är som att se artikelns register över fellägen spelas upp som en direktsänd incidentanalys.
Avancerad
7 minuterFå bättre RAG och AI-agenter med Docling
IBM Technology. Förklarar inläsningsdelen av RAG och agenter: hur PDF-filer och andra filer förbereds så att dokumentstruktur, tabeller och layout bevaras för efterföljande informationshämtning. Det stöder artikelns varning om att kvaliteten och säkerheten hos RAG börjar före vektoriseringen, särskilt när komplexa affärsdokument ska tolkas.
Avancerad
10 min läsningFellägen för AI i produktion: det som går sönder efter demon
Bygg ett fellägesregister för hallucinationer, inaktuell kontext, promptinjektion, osäker verktygsanvändning, schemadrift, bristfällig felhantering och luckor i observerbarheten.
Avancerad
10 min läsningMönster för privat AI-driftsättning: lokal, VPC, egen drift och hybrid
Privat AI är inte en enda arkitektur. En praktisk jämförelse av lokala modeller, SaaS för företag, drift i VPC, inferens i egen regi och hybridmönster för små och medelstora företag som värdesätter integritet och kontroll.
Avancerad
10 min läsningAnsluta AI till e-post, kalender och CRM säkert
En riskbaserad guide till att ansluta AI till e-post, kalender och CRM med minsta möjliga behörighetsomfång, godkännandespärrar, skyddat revisionsunderlag, negativa tester och återställningsvägar.
Mellannivå
8 min läsningIntegritet och datahygien när du använder AI på jobbet
En praktisk guide till att minska integritets- och sekretessrisker när du använder AI på jobbet. Kontrollera exakt produkt, abonnemang, konfiguration, data och tillämpliga regler innan du klistrar in något.
Nybörjare
25 minuterOWASP:s 10 främsta sätt att angripa LLM:er: AI-sårbarheter avslöjade
IBM Technology. Vidgar perspektivet från promptinjektion till hela OWASP:s topp 10 för LLM:er – osäker hantering av utdata, exponering av känslig information och alltför långtgående handlingsfrihet. Det är precis den katalog över fellägen som du bör ha i åtanke innan du ger något åtkomst till Gmail eller HubSpot.
Mellannivå
11 minuterVad är en promptinjektionsattack?
IBM Technology. Jeff Crumes exempel med att ”köpa en SUV för 1 dollar” är den tydligaste förklaringen på 10 minuter av varför direkt och indirekt promptinjektion är två olika problem och varför filtrering inte kan lösa något av dem fullständigt. Den anknyter direkt till artikelns argument att du behöver behörigheter enligt principen om minsta privilegium, ett särskilt agentkonto och en människa i loopen för allt som inte går att ångra – inte en smartare systemprompt.
Mellannivå
13 minuterAngrepp mot LLM – promptinjektion
LiveOverflow. Beskriver promptinjektion som ett klassiskt injektionsangrepp mot system som blandar instruktioner med data som inte är betrodda – med ett konkret exempel från innehållsmoderering där en angripare får en oskyldig användare att framstå som skyldig. Perspektivskiftet från ”modellen är målet” till ”applikationen är målet” är exakt det grepp som inleder artikeln.
Avancerad
17 minuterFörsvar av LLM – promptinjektion
LiveOverflow. Går igenom den faktiska spelplanen för djupförsvar – taintanalys av LLM-utdata, begränsning av förväntade utdataformat, användarisolering, few-shot-strukturer, finjustering, temperatur 0 för determinism och redundans i kritiska flöden. Den motsvarar artikelns avsnitt om djupförsvaret nästan punkt för punkt.
Avancerad