Агентный инжиниринг
От убедительного ответа к обоснованному решению: адверсариальная валидация сгенерированных артефактов и агентных контуров
Анна Лучник
Независимый консультант
Тезисы
LLM позволяют создавать исследования, спецификации, архитектуры и продуктовые концепции быстрее, чем человек способен их проверить. Главная опасность — не очевидные галлюцинации, а убедительные конструкции, в которых факты, допущения и рекомендации неявно подтверждают друг друга. Самопроверка модели или согласие нескольких агентов не гарантируют независимой валидации.
В докладе будет представлен метод адверсариальной валидации LLM-артефактов. Он помогает разложить результат на проверяемые утверждения, подобрать для них подходящие способы проверки и понять, когда нужен ещё один рецензент, а когда — первоисточник, расчёт, прототип или реальный пользователь.
Также рассмотрим, как перейти от проверки отдельного ответа к проверке всего агентного контура: его целей, источников, критериев приёмки, правил остановки и обратной связи из реальности.
В методе намеренно нет набора универсальных готовых промтов. Сначала команда должна сама определить собственные гипотезы, риски и признаки ошибки — и только после этого автоматизировать проверку.
Для кого доклад
Доклад будет особенно полезен тем, у кого LLM уже генерируют исследования, спецификации, архитектурные решения, код, продуктовые гипотезы и другие артефакты, но ещё не выстроен отдельный процесс проверки их качества:
разработчики и архитекторы агентных систем;
технические и продуктовые руководители;
исследователи и аналитики, использующие LLM;
руководители AI-native-компаний;
специалисты, принимающие на основании LLM-артефактов архитектурные, продуктовые или управленческие решения.
О докладчике
Изучает, как принимать решения, которые решают первоначальную проблему и не создают новых.
Ментор Сколково, помогает стартапам в разработке стратегии, управлении киберрисками и выстраивании продаж сложных ИТ-решений.
Работала архитектором в консалтинговых подразделениях международных компаний и на руководящих должностях, включая позиции CIO и CISO.
Эта же карточка для AI-агента: /talks/adversarial-validation.md