Новость
Лидеры LangChain, Conviva и CoreWeave: идеальный диалог агента может скрывать сломанный продукт
На конференции VB Transform 2026 эксперты LangChain, Conviva и CoreWeave обсудили проблему оценки ИИ-агентов, где успешный диалог не гарантирует качество продукта. Они предложили переходить от оценки отдельных трасс к сравнению когорт пользователей и рассматривать критерии оценки как живое техническое задание. Harrison Chase подчеркнул, что evals теперь определяют, что агент должен и не должен делать, заменяя традиционные спецификации.