7:56Chroma
Келли Хонг проходит по исследованию Chroma на 18 моделях — почему оценки needle-in-haystack обманчивы, как качество деградирует при неоднозначности и отвлекающих факторах, почему даже простые задачи на повторение строк деградируют после 500 токенов. Кратко, доказательно и ровно та позиция, к которой статья хочет, чтобы вы отнеслись всерьёз, прежде чем переходить к инженерным ходам.
Что вынести из этого видео: Понять, как длинный контекст может давать сбои при неоднозначности и отвлекающих факторах, и проектировать тесты с учётом этого риска.
Что посмотреть или знать заранее: Ничего сверх базовой терминологии LLM — это короткий доклад по исследованию.
Заметка AI Expert: Названия моделей, цены и возможности быстро меняются. Используйте видео для понимания принципа выбора, затем проверьте актуальное поведение модели перед внедрением.
