Ämne

Agenter & datoranvändning

Agentarbetsflöden, webbläsarstyrning, minne, loopar, ramverk och kundinriktade röstflöden.

48 innehållsposter (29 artiklar · 19 videor)

Börja här

Börja med några rekommenderade innehållsposter innan du går igenom hela flödet.

Mer i detta ämne

9 min läsning
Artikel

DGX Spark: vad det är, vem det är till för och vad som ändrats för lokala agenter

En saklig genomgång av NVIDIA DGX Spark: Grace Blackwell GB10-specifikationer från NVIDIA, koherent enhetligt minne, ConnectX-7-klustring och när en agentdator för skrivbordet är rätt satsning på privat AI.

Avancerad
7 min läsning
Artikel

Hermes Agent: vad det är, vad det inte är och när du ska använda det

En tydlig översikt över Hermes Agent från Nous Research: beständigt minne, färdigheter, verktyg och meddelandegateways, samt hur du avgör när en chattbot räcker och när en agentkörmiljö är rätt verktyg.

Mellannivå
8 min läsning
Artikel

Hermes Agent under den första veckan: minneshygien, färdigheter och verktygsgodkännanden

En säker första vecka med Hermes Agent: installera och gör ett grundtest, vårda MEMORY.md och USER.md, lägg till en färdighet, begränsa filskrivningar och inaktivera eller isolera åtkomsten till skalet.

Mellannivå
8 min läsning
Artikel

Hermes kontra n8n: välj efter arbetsuppgift (och när du ska använda båda)

Ett beslutsramverk för Hermes Agent och n8n: deterministiska flöden stannar i n8n, medan ett bearer-autentiserat Hermes API-steg eller en separat händelsewebhook hanterar avgränsat agentarbete.

Mellannivå
7 min läsning
Artikel

Webhooks i Hermes: händelsestyrda AI-agenter utan en enda enorm prompt

Konfigurera Hermes Agent-webhooks med autentisering som passar avsändaren, hälsokontroller på port 8644 och små namngivna rutter, så att händelser blir fokuserade agentkörningar med ett uttryckligt leveransmål.

Mellannivå
8 min läsning
Artikel

Idempotens, omförsök och mänskliga kontrollpunkter för n8n AI-noder

AI-noder misslyckas på andra sätt än CRUD-API:er. Utforma omförsök, idempotensnycklar, mänskliga kontrollpunkter och loggning i n8n så att ett instabilt modellanrop inte skickar dubbla mejl eller hoppar över granskningen.

Mellannivå
10 min läsning
Artikel

n8n → Hermes: välj ett API-anrop eller en händelsewebhook

Behåll deterministiskt tillstånd i n8n och välj Hermes API när n8n behöver agentens resultat, eller webhook-adaptern när en händelse ska utlösa en konfigurerad Hermes-leverans.

Mellannivå
10 min läsning
Artikel

NemoClaw på DGX Spark: plan för driftsättning och säkerhet

Planera och utvärdera OpenClaw, Hermes eller Deep Agents Code i NVIDIA OpenShell på DGX Spark: aktuell introduktion, policylager, dirigerad inferens och det acceptansunderlag som krävs.

Avancerad
8 min läsning
Artikel

OpenClaw: tillåtelselistor, parning och säkra gruppomnämnanden

Kanaltillåtelselistor, DM-parning och regler för omnämnanden i grupper är den verkliga säkerhetsgränsen för OpenClaw, eftersom verktygen kan omfatta skal, filer och webbläsare. En praktisk checklista för nedlåsning.

Mellannivå
9 min läsning
Artikel

Konfigurera en personlig OpenClaw-gateway: installation, introduktion och kontrollpanel

Vad OpenClaw är, hur du installerar och konfigurerar flerkanalsgatewayen i egen drift, öppnar Control UI på port 18789 och vilka Node-versioner som stöds utan att hoppa över säkerhetsbaslinjen.

Mellannivå
10 min läsning
Artikel

OpenClaw skills, autonomi med heartbeat och godkännandekontroller

Hur OpenClaw skills läses in, hur periodiska heartbeat-körningar fungerar, hur du styr kommandokörning på värden och hur du håller webbläsarautomatisering bakom en restriktiv policy och granskad bekräftelse i arbetsflödet.

Mellannivå
8 min läsning
Artikel

OpenClaw kontra Hermes: välj efter arbetsuppgift, inte varumärke

OpenClaw och Hermes är överlappande agentsystem i egen drift med olika operativa styrkor. Jämför kanaldirigering, webhooks, verktyg och automatiseringsgränser innan du väljer det ena, det andra eller båda.

Mellannivå
10 min läsning
Artikel

Experimentell stack med två DGX Spark-enheter, DeepSeek-V4-Flash, n8n och Hermes

Så utvärderar du en experimentell väg från användargemenskapen för DeepSeek-V4-Flash på två DGX Spark-enheter, med n8n för den deterministiska delen och Hermes för bedömningsuppgifter.

Avancerad
12 min läsning
Artikel

Få Codex, Claude Code och Cursor att arbeta som ett CLI-team

Använd AGENTS.md, CLAUDE.md, Cursor-regler och CLI-verktygens icke-interaktiva lägen så att Codex designar, Claude granskar och Cursor implementerar, utan en egen orkestreringsplattform.

Avancerad
15 min läsning
Artikel

Projektledning för flera agenter med Linear: Claude, Cursor och Codex i samma backlog

Låt Claude Code, Cursor och Codex arbeta i samma Linear-projekt som ett riktigt ingenjörsteam: reservera arbete, markera framsteg, lämna över till granskning, åtgärda fynd och stäng ärenden utan att trampa på varandra.

Avancerad
6 minuter
Video

AI-röstassistenter: så fungerar de egentligen och därför låter de så mänskliga

CX Foundation. Delar upp röstassistenter i den praktiska kedjan: taligenkänning, språkmodell, API:er till verksamhetssystem, talsyntes och avbrottshantering. Det ger artikelns ramverk för införande en konkret teknisk grund innan läsarna väljer Twilio, Retell, Vapi, LiveKit eller någon annan plattform.

Avancerad
9 min läsning
Artikel

AI-anpassade utvecklingsmiljöer och kodarbetsflöden med kännedom om kodarkivet

Cursor, Copilot, Claude Code och agenter med kännedom om kodarkivet förändrar programvaruutvecklingen först när teamen sätter gränser. Ett praktiskt arbetsflöde för kodbaskontext, planering, tester, granskning, hemligheter och produktionssäkerhet.

Avancerad
9 min läsning
Artikel

Röstagenter för kundflöden: där de fungerar och där de misslyckas

Röstagenter är användbara när flödet är avgränsat, data finns tillgängliga och reservvägen är tydlig. Ett praktiskt beslutsramverk för system i stil med Twilio och Retell, transparens, överlämning, testning och stegvis införande.

Avancerad
11 min läsning
Artikel

Välja agentramverk 2026: en reproducerbar utvärdering

Jämför agentramverk mot ett representativt arbetsflöde, uttalade driftkrav och en genomgång av utträdeskostnaden – i stället för att luta dig mot popularitet och tyckande.

Avancerad
11 min läsning
Artikel

Utforma en AI-supportagent: triage, kunskap, åtgärder och eskalering

En köutvärderad referensdesign för supporttriage, hämtning, svarsutkast, kontrollerade åtgärder och mänsklig eskalering, med de policy- och mätgränser som krävs för en säker pilot.

Mellannivå
10 min läsning
Artikel

Bygg en automatiserad briefing eller ett nyhetsbrev med AI

Bygg en automatiserad daglig eller veckovis briefing med spårbara källor, insamling som tar hänsyn till tillstånd, uttryckliga kvalitetskontroller och återkommande underhåll.

Mellannivå
12 min läsning
Artikel

Datoranvändning och webbläsaragenter i produktion

Datoranvändning och webbläsaragenter ger demonstrationer som blir virala. Produktionsdrift i stor skala ser annorlunda ut – snäv avgränsning, omfattande skyddsräcken och genomtänkt användarupplevelse. Här är mönstren som fungerar, felen vi ser gång på gång och den ärliga ekonomiska kalkylen.

Avancerad
10 min läsning
Artikel

Ansluta AI till e-post, kalender och CRM säkert

En riskbaserad guide till att ansluta AI till e-post, kalender och CRM med minsta möjliga behörighetsomfång, godkännandespärrar, skyddat revisionsunderlag, negativa tester och återställningsvägar.

Mellannivå
10 min läsning
Artikel

MCP för dig som inte är utvecklare: anslut Claude eller Cursor till dina verktyg

En praktisk introduktion till MCP: verifiera klientstödet, installera en officiell lokal server, avgränsa dess åtkomst till filsystemet och testa både tillåtna och nekade åtgärder innan du ansluter verkliga konton.

Mellannivå
12 min läsning
Artikel

Så bygger du minne för långvariga agenter

Långvariga agenter behöver en persistenslösning med tydligt ansvar: proveniens, bekräftelse, isolering mellan kundorganisationer, tester av informationshämtning, lagringstid, korrigering och verifierbar radering.

Avancerad
9 min läsning
Artikel

n8n kontra Zapier kontra Make: välj rätt automatiseringsplattform

En praktisk jämförelse av de tre viktigaste automatiseringsplattformarna för AI-arbetsflöden år 2026. Vad var och en är bra på, var begränsningarna finns och beslutsreglerna för att välja utan att ångra sig.

Mellannivå
12 min läsning
Artikel

RAG bortom textsegment: graf-RAG, agentbaserad RAG och RAG med lång kontext

Klassisk textsegmentsbaserad RAG har begränsningar. Graf-RAG, agentbaserad RAG och RAG med lång kontext bryter igenom dessa begränsningar på olika sätt. När respektive metod är rätt verktyg, hur de faktiskt fungerar och vilka avvägningar i produktion som spelar roll.

Avancerad
190 minuter
Video

Komplett nybörjarkurs i LangGraph – komplexa AI-agenter med Python

freeCodeCamp.org. Ett långt kodprojekt som steg för steg går igenom LangGraphs tillståndsgrafer, noder, kanter, villkorsstyrd dirigering, kontrollpunkter och verktygsanvändning. När du är klar har du fått tillräcklig känsla för modellen med typat tillstånd, där varje övergång är explicit, för att artikelns jämförelse med CrewAI och kod som använder API:er direkt inte längre ska vara abstrakt.

Avancerad
66 minuter
Video

CrewAI-genomgång: komplett intensivkurs för nybörjare

aiwithbrandon. Samma typ av bygge, men enligt CrewAI:s modell med roller, mål och bakgrundsberättelser: agenter som teammedlemmar, uppgifter som leveranser och ett ramverk som döljer exekveringsloopen. Se den direkt efter LangGraph-kursen. Skillnaden i hur mycket ramverket bestämmer åt dig är precis det som artikeln vill att du ska väga in.

Avancerad
15 minuter
Video

Så bygger vi effektiva agenter: Barry Zhang, Anthropic

AI Engineer. Barry Zhang presenterar tre regler: bygg inte en agent när ett arbetsflöde räcker, håll loopen så enkel som möjligt och tänk som din agent, det vill säga placera dig i dess kontextfönster och inse att den fattar beslut i blindo mellan skärmbilder. Argumentet för enkelhet och checklistan för att avgöra om uppgiften ens motiverar en agent uttrycker exakt den disciplin som artikeln efterfrågar.

Avancerad
18 minuter
Video

Tips för att bygga AI-agenter

Anthropic. Tre utvecklare från Anthropic går igenom de vanligaste fallgroparna de ser: agenter som inte vet när de ska stanna, överlastade systemprompter när det egentligen är miljön som behöver åtgärdas och kostnaden för fleragentsystem som ingen faktiskt behövde. Videon passar bra direkt efter Barrys föredrag. Du kommer att känna igen samma mönster ur ett annat perspektiv.

Avancerad
31 minuter
Video

Så bygger du en AI-kundsupportagent med n8n (kostnadsfri mall)

Bart Slodyczka. Arbetsflödet i n8n ansluter till supportsystem, skriver svarsutkast från hämtat material och omvandlar lösta ärenden till kandidatinnehåll för kunskapsbasen. Lägg före användning av inläsningsmönstret till mänskligt godkännande, maskera personuppgifter och hemligheter, bevara källärendet och innehållsversionen som proveniens och kör hämtningsutvärderingar mot en avskild uppsättning ärenden.

Mellannivå
231 minuter
Video

Så bygger och säljer du AI-agenter: den ultimata nybörjarguiden

Liam Ottley. Kursen omfattar RAG-förankrade chattbotar, eskaleringslogik och en kodfri teknikstack med verktyg som Botpress, Voiceflow, Make och n8n. Avsnittet om ”en agents anatomi” ger en konkret implementering att jämföra med artikelns ansvarskedja triage → belägg → föreslagen åtgärd → policykontroll → överlämning.

Mellannivå
24 minuter
Video

Introduktion till Operator och agenter

OpenAI. Den faktiska lanseringsdemonstrationen av Operator, där teamet bokar restauranger, beställer matvaror, köper evenemangsbiljetter och låter Operator köra fast vid en omdirigering eller lämna tillbaka kontrollen när den stöter på en inloggning. Det är den tydligaste bilden du kan hitta av hur det är att använda en webbläsaragent i praktiken – loopen med skärmbilder och klick, bekräftelserna före åtgärder som ändrar tillstånd, skyddsräckena mot promptinjektion – vilket är precis den konkreta känsla som artikeln försöker förmedla för att skapa rätt förväntningar.

Mellannivå
2 minuter
Video

Claude | Datoranvändning för att samordna uppgifter

Anthropic. En två minuter lång demo från Anthropic där Claude planerar en liten uppgift i flera appar – söker på webben, kontrollerar Maps och lägger in en kalenderinbjudan – genom att styra datorn direkt. Den ger en användbar kontrast till modellen med enbart en molnbaserad webbläsare i demonstrationen av Operator nedan och är en bra rimlighetskontroll av artikelns poäng att agenter för datoranvändning fungerar bäst för korta, väl avgränsade sysslor snarare än öppna uppgifter.

Mellannivå
5 minuter
Video

Claude har tagit kontroll över min dator …

Fireship. Den tydligaste korta förklaringen på YouTube av loopen skärmbild–åtgärd–skärmbild, inklusive en ärlig bild av fellägena (Claude ger sig i väg för att titta på Yellowstone, tokenförbrukning och latens per steg). Fireship går avsiktligt inte in på detaljer om produktion – läs artikeln för dem – men videon ger dig rätt intuition för varför systemen är dyra och bräckliga innan du inför ett i din stack.

Avancerad
8 minuter
Video

Anthropics Claude Computer Use förändrar spelplanen | YC Decoded

Y Combinator. Garry Tan går igenom vad datoranvändning faktiskt förändrar för den svåra svansen av programvara som inte går att automatisera – äldre applikationer, interna portaler och allt som saknar API. Inramningen motsvarar precis artikelns argument att ”webbläsaren är det universella gränssnittet” och ger en mer affärsrealistisk bild av var tekniken först lönar sig.

Avancerad
25 minuter
Video

OWASP:s 10 främsta sätt att angripa LLM:er: AI-sårbarheter avslöjade

IBM Technology. Vidgar perspektivet från promptinjektion till hela OWASP:s topp 10 för LLM:er – osäker hantering av utdata, exponering av känslig information och alltför långtgående handlingsfrihet. Det är precis den katalog över fellägen som du bör ha i åtanke innan du ger något åtkomst till Gmail eller HubSpot.

Mellannivå
11 minuter
Video

Vad är en promptinjektionsattack?

IBM Technology. Jeff Crumes exempel med att ”köpa en SUV för 1 dollar” är den tydligaste förklaringen på 10 minuter av varför direkt och indirekt promptinjektion är två olika problem och varför filtrering inte kan lösa något av dem fullständigt. Den anknyter direkt till artikelns argument att du behöver behörigheter enligt principen om minsta privilegium, ett särskilt agentkonto och en människa i loopen för allt som inte går att ångra – inte en smartare systemprompt.

Mellannivå
26 minuter
Video

Från noll till din första AI-agent på 25 minuter (utan programmering)

Futurepedia. En fungerande n8n-agent byggs från grunden i en enda sittning, med pauser för att förklara vad en agent faktiskt är, hur den skiljer sig från ett linjärt arbetsflöde och var skyddsräckena hör hemma. Efteråt kommer du att känna igen varje nod i artikelns diagram och ha en känsla för hur rimliga standardinställningar ser ut.

Mellannivå
92 minuter
Video

Mästarklass i n8n: bygg AI-agenter och automatisera arbetsflöden (från nybörjare till proffs)

Nate Herk | AI Automation. Nate är en av de mest sedda praktikerna med särskilt fokus på n8n, och den här mästarklassen går djupare än Futurepedias introduktion – minne, konfigurationer med flera agenter, felhantering och verkliga arbetsflöden för företag. Ta fram den när din agent för prioritering av potentiella kunder fungerar och du vill bygga vidare på den.

Mellannivå
20 minuter
Video

Model Context Protocol (MCP)

Anthropic. Protokollets skapare – Theo Chu, David Soria Parra och Alex Albert – går igenom varför MCP finns, komponenterna (server, klient och transport), mottagandet sedan lanseringen i november 2024 och vilka servrar de faktiskt använder till vardags. Den fungerar bra som huvudkälla efter Nate Herks översikt.

Mellannivå
16 minuter
Video

Så gör MCP:er agenter smartare (för icke-tekniker)

Nate Herk | AI Automation. En 16 minuter lång förklaring utan jargong av vad en MCP-server är, hur klienter som Claude och n8n använder dem och vad du faktiskt gör annorlunda när du väl har en. Den ligger nästan exakt i linje med artikelns upplägg om att ”ansluta Claude eller Cursor till dina verktyg”.

Mellannivå
7 minuter
Video

Minne för agenter (konceptuell video)

LangChain. En kort genomgång utan kod av uppdelningen mellan korttids- och långtidsminne, de tre former som långtidsminne brukar ta – instruktioner, en profil och en lista med objekt – samt avvägningen mellan att skriva i det direkta arbetsflödet och i bakgrunden. Artikelns avsnitt om minnesarkitektur utgår från exakt den här taxonomin.

Avancerad
44 minuter
Video

Bygg ett hjärnliknande minne för AI | minnessystem för LLM-agenter

Adam Lucek. En längre implementationsgenomgång av de kognitionsvetenskapligt inspirerade kategorierna episodiskt, semantiskt, arbets- och procedurminne, som kopplas till en agent i kod. Den är värd att se efter den konceptuella videon från LangChain om du vill ha en mer uttalad tankemodell och ett fungerande exempel att hämta idéer från.

Avancerad