1:46:33Lenny's Podcast
Хамел Хусейн и Шрея Шанкар проходят весь процесс оценки качества на реальном ИИ-ассистенте для управления недвижимостью: разбирают трассировки, ведут открытое и осевое кодирование ошибок, решают, когда остановиться, строят модель-судью (LLM-as-judge) и сверяют её с человеческим суждением. Это редкий обстоятельный разговор, действительно рассчитанный на продакт-менеджеров и руководителей команд, а не на ML-инженеров, и он выдерживает тот же ритм «30 минут в неделю после настройки», который рекомендует статья.
Что вынести из этого видео: Освойте цикл оценки качества для продакт-менеджеров: разбор трассировок, разметка ошибок, определение критериев, проверка изменений и сравнение с человеческим суждением.
Что посмотреть или знать заранее: Полезно понимать бизнес-процессы, риски и практические сценарии применения ИИ.
Заметка AI Expert: Концепция остаётся полезной, но проверьте примеры на актуальных инструментах перед применением в реальной работе.
