Emne

Models & Tool Choice

Choose between ChatGPT, Claude, Gemini, Copilot, reasoning models, and hosted or local inference.

27 historier (12 artikler · 15 videoer)

Start her

Et par gode steder at begynde, før du går på opdagelse i hele oversigten.

Flere i dette emne

13 min læsning
Artikel

LLM-stacken i 2026: modeller, inferens, værktøjer og afvejninger

En praktiserende arkitekts blik på LLM-stacken i 2026 — modelniveauer, inferensudbydere, orkestreringslag, evalueringsværktøjer og de afvejninger, der faktisk betyder noget, når AI sættes i produktion.

Avanceret
10 min læsning
Artikel

Chain-of-thought, self-critique og tree-of-thoughts — hvornår du skal bruge hvad

Tre ræsonnementsteknikker, der reelt forbedrer AI-resultater på vanskelige problemer — og beregningen af omkostninger og udbytte ved at bruge dem. Med konkrete prompts, direkte sammenligninger og de faldgruber, som moderne ræsonnerende modeller medfører.

Let øvet
12 min læsning
Artikel

Omkostningsoptimering af inferens: promptcaching, routing og outputkontrol

LLM-inferensomkostninger kan reduceres med 60-90% med de rigtige teknikker. Promptcaching, modelrouting, outputkontrol, batching og nogle mindre kendte mønstre. Her er tallene, mønstrene og den produktionsdisciplin, der adskiller veldrevet inferens fra en løbsk regning.

Avanceret
13 min læsning
Artikel

Finjustering i 2026: Hvornår LoRA slår RAG, og hvordan du gør det uden en klynge

LoRA-finjustering er blevet tilgængelig — du kan køre reelle finjusteringer på en bærbar computer eller leje en GPU i en time. Her er de mønstre, der virker, de tilfælde, hvor finjustering slår RAG, og en praktisk arbejdsgang fra dataklargøring til drift.

Avanceret
6 min læsning
Artikel

Gratis eller betalt ChatGPT: Det får du faktisk med en opgradering

En sammenligning uden jargon mellem gratis ChatGPT, ChatGPT Plus og ChatGPT Pro — hvad der ændres, når du opgraderer, og hvordan du afgør, om du overhovedet har brug for det.

Ny inden for AI
10 min læsning
Artikel

Lokal AI på din Mac: Ollama, LM Studio, og hvad 7B-modeller reelt kan

Lokal AI er blevet moden. Med Ollama eller LM Studio og en moderne Mac kan du køre kompetente modeller offline, gratis og privat. Her er, hvad der virker, hvad der ikke gør, og hvilke anvendelser der reelt har gavn af det.

Let øvet
10 min læsning
Artikel

Udformning af prompts til ræsonnerende modeller (o3, R1 og Claude extended thinking)

Ræsonnerende modeller er ikke hurtige modeller med ekstra trin. De belønner en anden måde at skrive prompts på, ignorerer visse traditionelle mønstre og har deres egne faldgruber. En praktisk vejledning i at bruge dem godt.

Let øvet
12 min læsning
Artikel

Vælg mellem prompting, RAG og finjustering (og hvornår de skal kombineres)

Prompting, RAG og finjustering er de tre store greb til at tilpasse LLM'er til dit problem. De passer hver især til nogle problemer og ikke til andre. Her er en ramme for valget, de realistiske omkostninger og de produktionsmønstre, hvor kombinationen virker bedst.

Avanceret
11 min læsning
Artikel

Selvhostet kontra hostet inferens: vLLM, TGI og break-even-regnestykket

Ved hvilken skala slår selvhosting API-kald? Det faktiske regnestykke, de driftsmæssige realiteter og de mønstre, der adskiller teams, som bør selvhoste, fra teams, som fortsat bør betale for administreret inferens.

Avanceret
Video

Dybdegående gennemgang af LLM'er som ChatGPT

Andrej Karpathy.

Avanceret
Video

Andrej Karpathy: Software Is Changing (Again)

Y Combinator.

Avanceret
Video

Is This the End of RAG? Anthropic's NEW Prompt Caching

Prompt Engineering.

Avanceret
Video

Build Hour: Prompt Caching

OpenAI.

Avanceret
Video

Fine Tuning LLM Models – Generative AI Course

freeCodeCamp.org.

Avanceret
Video

Developing an LLM: Building, Training, Finetuning

Sebastian Raschka.

Avanceret
Video

Er ChatGPT Plus pengene værd? Min opdaterede anmeldelse for 2025

Ryan Doser.

Ny inden for AI
Video

Alle AI-modeller forklaret

Tina Huang.

Let øvet
Video

RouteLLM opnår 90% GPT-4o-kvalitet OG 80% BILLIGERE

Matthew Berman.

Let øvet
Video

RAG vs. Fine Tuning

IBM Technology.

Avanceret
Video

RAG vs Fine-Tuning vs Prompt Engineering: Optimering af AI-modeller

IBM Technology.

Avanceret
Video

Sådan bruger jeg LLM'er

Andrej Karpathy.

Begynder
Video

Den nye, klogeste AI: Claude 3 – testet mod Gemini 1.5 + GPT-4

AI Explained.

Begynder
Video

Fast LLM Serving with vLLM and PagedAttention

Anyscale.

Avanceret
Video

Alle AI-modeller forklaret

Tina Huang.

Ny inden for AI