55:02Dave Ebbelaar
Действующий ИИ-инженер проходит по своей реальной лестнице оценок — юнит-тесты в стиле assert, метрики без эталонов, согласование LLM-as-judge с людьми и цикл «анализируй–измеряй–улучшай». Такая структура — самое близкое из доступного на видео к тезису статьи, что оценки — это система для отлова регрессий, а не таблица лидеров.
Что вынести из этого видео: Спроектировать лестницу оценок, которая ловит регрессии до того, как изменения промпта или модели дойдут до пользователей.
Что посмотреть или знать заранее: Полезно понимать API, автоматизации, RAG или базовую архитектуру агентов.
Заметка AI Expert: Концепция остаётся полезной, но проверьте примеры на актуальных инструментах перед применением в реальной работе.
