Aihe

Arviointi, havainnoitavuus ja laatu

Mittaa tekoälyn toimintaa, havaitse regressiot, seuraa kustannuksia ja viivettä sekä kehitä työnkulkuja jatkuvasti.

12 sisältöä (5 artikkelia · 7 videota)

Aloita tästä

Muutama hyvä aloitussisältö ennen koko sisältövirran selaamista.

Lisää tässä aiheessa

Video

The Agent Landscape - Lessons Learned Putting Agents Into Production

The Agent Landscape - Lessons Learned Putting Agents Into Production

Edistynyt
10 min lukemista
Artikkeli

Tuotantotason tekoälyn epäonnistumistavat: mikä rikkoutuu demon jälkeen

Tekoälyjärjestelmät epäonnistuvat yleensä ennustettavilla tavoilla: hallusinaatio, vanhentunut konteksti, mielistely, kehoteinjektio, turvaton työkalujen käyttö, skeeman ajautuminen ja heikot varamenettelyt. Tuotannon epäonnistumisrekisteri tiimeille, jotka julkaisevat oikeita työnkulkuja.

Edistynyt
11 min lukemista
Artikkeli

Pilkkominen, uudelleenjärjestäminen ja hybridihaku: tee RAG:stä toimiva

Useimmat RAG-toteutukset toimivat huonosti, koska niissä tehdään kolme asiaa väärin. Käytännön opas asiakirjojen pilkkomiseen, tulosten uudelleenjärjestämiseen sekä avainsana- ja semanttisen haun yhdistämiseen ilman hakutekniikan asiantuntijuutta.

Keskitaso
Video

Why AI evals are the hottest new skill for product builders | Hamel Husain & Shreya Shankar

Why AI evals are the hottest new skill for product builders | Hamel Husain & Shreya Shankar

Keskitaso
Video

Evaluate prompts in the Anthropic Console

Evaluate prompts in the Anthropic Console

Keskitaso
Video

How to Systematically Setup LLM Evals (Metrics, Unit Tests, LLM-as-a-Judge)

How to Systematically Setup LLM Evals (Metrics, Unit Tests, LLM-as-a-Judge)

Edistynyt
Video

How to Construct Domain Specific LLM Evaluation Systems: Hamel Husain and Emil Sedgh

How to Construct Domain Specific LLM Evaluation Systems: Hamel Husain and Emil Sedgh

Edistynyt
Video

LangSmith in 10 Minutes

LangSmith in 10 Minutes

Edistynyt
Video

Instrumenting & Evaluating LLMs

Instrumenting & Evaluating LLMs

Edistynyt