7:56Chroma
Kelly Hong stellt Chromas Untersuchung von 18 Modellen vor: weshalb Needle-in-a-Haystack-Ergebnisse irreführend sein können, wie die Leistung bei Mehrdeutigkeit und Ablenkungen nachlässt und warum selbst einfache Aufgaben zur Wiederholung von Zeichenketten jenseits von 500 Tokens schlechter werden. Der Vortrag ist kurz, evidenzbasiert und liefert genau den Befund, den Sie ernst nehmen sollten, bevor der Artikel zu technischen Maßnahmen übergeht.
Was Sie aus diesem Video mitnehmen sollten: Verstehen, wie lange Kontexte unter Mehrdeutigkeit und Ablenkungen versagen können, und Tests für dieses Risiko entwerfen.
Das sollten Sie zuerst ansehen oder wissen: Lediglich grundlegendes LLM-Vokabular; dies ist ein kurzer Forschungsvortrag.
Hinweis von AI Expert: Modellnamen, Preise und Fähigkeiten ändern sich schnell. Nutzen Sie das Video für das Entscheidungsmuster und prüfen Sie vor dem Einsatz das aktuelle Modellverhalten.
