Ämne

AI-säkerhet

Promptinjektion, läckage, osäker verktygsåtkomst, behörigheter och fellägen i produktion.

19 innehållsposter (12 artiklar · 7 videor)

Börja här

Börja med några rekommenderade innehållsposter innan du går igenom hela flödet.

Mer i detta ämne

7 min läsning
Artikel

Webhooks i Hermes: händelsestyrda AI-agenter utan en enda enorm prompt

Konfigurera Hermes Agent-webhooks med autentisering som passar avsändaren, hälsokontroller på port 8644 och små namngivna rutter, så att händelser blir fokuserade agentkörningar med ett uttryckligt leveransmål.

Mellannivå
10 min läsning
Artikel

NemoClaw på DGX Spark: plan för driftsättning och säkerhet

Planera och utvärdera OpenClaw, Hermes eller Deep Agents Code i NVIDIA OpenShell på DGX Spark: aktuell introduktion, policylager, dirigerad inferens och det acceptansunderlag som krävs.

Avancerad
8 min läsning
Artikel

OpenClaw: tillåtelselistor, parning och säkra gruppomnämnanden

Kanaltillåtelselistor, DM-parning och regler för omnämnanden i grupper är den verkliga säkerhetsgränsen för OpenClaw, eftersom verktygen kan omfatta skal, filer och webbläsare. En praktisk checklista för nedlåsning.

Mellannivå
9 min läsning
Artikel

Konfigurera en personlig OpenClaw-gateway: installation, introduktion och kontrollpanel

Vad OpenClaw är, hur du installerar och konfigurerar flerkanalsgatewayen i egen drift, öppnar Control UI på port 18789 och vilka Node-versioner som stöds utan att hoppa över säkerhetsbaslinjen.

Mellannivå
10 min läsning
Artikel

OpenClaw skills, autonomi med heartbeat och godkännandekontroller

Hur OpenClaw skills läses in, hur periodiska heartbeat-körningar fungerar, hur du styr kommandokörning på värden och hur du håller webbläsarautomatisering bakom en restriktiv policy och granskad bekräftelse i arbetsflödet.

Mellannivå
20 minuter
Video

Behörigheter och åtkomstkontroll för RAG – en fördjupad guide

Paragon. Går igenom behörighetsproblemet för RAG i produktion och jämför verktygsanrop, namnrymder, ACL-tabeller och relationsbaserade behörigheter. Det stöder direkt artikelns huvudregel: informationshämtningen får endast returnera källor som den aktuella användaren har rätt att se, och källsystemens behörigheter får inte behandlas som en efterhandsfråga.

Avancerad
69 minuter
Video

Agentlandskapet – lärdomar från att driftsätta agenter i produktion

MLOps.community. Prosus AI-chef och en AI-utvecklare berättar vad som faktiskt gick sönder när de driftsatte agenter i koncernens portföljbolag: penetrationstestning av promptinjektion före lansering, en osäker skrivning när en Jira-agent inte kunde tolka mänsklig kortnotation, inaktuell kontext som hanterades genom att agenterna fick redovisa sina antaganden samt reservlösningar som slog samman eller stängde av agenter när dessa började öka den kognitiva belastningen. Det är som att se artikelns register över fellägen spelas upp som en direktsänd incidentanalys.

Avancerad
7 minuter
Video

Få bättre RAG och AI-agenter med Docling

IBM Technology. Förklarar inläsningsdelen av RAG och agenter: hur PDF-filer och andra filer förbereds så att dokumentstruktur, tabeller och layout bevaras för efterföljande informationshämtning. Det stöder artikelns varning om att kvaliteten och säkerheten hos RAG börjar före vektoriseringen, särskilt när komplexa affärsdokument ska tolkas.

Avancerad
10 min läsning
Artikel

Fellägen för AI i produktion: det som går sönder efter demon

Bygg ett fellägesregister för hallucinationer, inaktuell kontext, promptinjektion, osäker verktygsanvändning, schemadrift, bristfällig felhantering och luckor i observerbarheten.

Avancerad
10 min läsning
Artikel

Mönster för privat AI-driftsättning: lokal, VPC, egen drift och hybrid

Privat AI är inte en enda arkitektur. En praktisk jämförelse av lokala modeller, SaaS för företag, drift i VPC, inferens i egen regi och hybridmönster för små och medelstora företag som värdesätter integritet och kontroll.

Avancerad
10 min läsning
Artikel

Ansluta AI till e-post, kalender och CRM säkert

En riskbaserad guide till att ansluta AI till e-post, kalender och CRM med minsta möjliga behörighetsomfång, godkännandespärrar, skyddat revisionsunderlag, negativa tester och återställningsvägar.

Mellannivå
8 min läsning
Artikel

Integritet och datahygien när du använder AI på jobbet

En praktisk guide till att minska integritets- och sekretessrisker när du använder AI på jobbet. Kontrollera exakt produkt, abonnemang, konfiguration, data och tillämpliga regler innan du klistrar in något.

Nybörjare
25 minuter
Video

OWASP:s 10 främsta sätt att angripa LLM:er: AI-sårbarheter avslöjade

IBM Technology. Vidgar perspektivet från promptinjektion till hela OWASP:s topp 10 för LLM:er – osäker hantering av utdata, exponering av känslig information och alltför långtgående handlingsfrihet. Det är precis den katalog över fellägen som du bör ha i åtanke innan du ger något åtkomst till Gmail eller HubSpot.

Mellannivå
11 minuter
Video

Vad är en promptinjektionsattack?

IBM Technology. Jeff Crumes exempel med att ”köpa en SUV för 1 dollar” är den tydligaste förklaringen på 10 minuter av varför direkt och indirekt promptinjektion är två olika problem och varför filtrering inte kan lösa något av dem fullständigt. Den anknyter direkt till artikelns argument att du behöver behörigheter enligt principen om minsta privilegium, ett särskilt agentkonto och en människa i loopen för allt som inte går att ångra – inte en smartare systemprompt.

Mellannivå
13 minuter
Video

Angrepp mot LLM – promptinjektion

LiveOverflow. Beskriver promptinjektion som ett klassiskt injektionsangrepp mot system som blandar instruktioner med data som inte är betrodda – med ett konkret exempel från innehållsmoderering där en angripare får en oskyldig användare att framstå som skyldig. Perspektivskiftet från ”modellen är målet” till ”applikationen är målet” är exakt det grepp som inleder artikeln.

Avancerad
17 minuter
Video

Försvar av LLM – promptinjektion

LiveOverflow. Går igenom den faktiska spelplanen för djupförsvar – taintanalys av LLM-utdata, begränsning av förväntade utdataformat, användarisolering, few-shot-strukturer, finjustering, temperatur 0 för determinism och redundans i kritiska flöden. Den motsvarar artikelns avsnitt om djupförsvaret nästan punkt för punkt.

Avancerad