AQuA: как агент количественных исследований учится на ошибках и делает бэктесты надежными
Особый интерес вызывает история одной ошибки, изменившей дизайн системы. В ранней версии агент мог напрямую писать код признаков. Однажды он создал признак «участие во внутридневном объёме», который, как считалось, использует только прошлые данные, но на деле в знаменателе стоял полный дневной объём, включая будущие значения. Ни автор, ни проверяющий агент этого не заметили, а ложный признак дал подозрительно высокий IC. После разбора инцидента команда отказалась от идеи полагаться на проверки со стороны другого агента и ввела жёсткие ограничения: теперь агенты могут комбинировать только заранее одобренные операторы и компоненты моделей, а доступ к окончательным тестовым данным полностью исключён.
Такая конструкция защищает от двух типов утечек. Первая связана с генерацией гипотез: признаки, метки и нормализации не должны видеть информацию из будущего. Вторая — с отбором: агент видит только валидационные метрики, а финальный тест запускается после фиксации конфигурации, и его результаты не возвращаются в цикл. Именно поэтому в Part II период 2010–2019 годов отведён под обучение, 2020-й — под изоляцию, а 2021–2025 годы использованы только для итоговой проверки. По мнению авторов, подход AQuA применим не только в финансах, но и в других областях, где агенты многократно обращаются к оценочным метрикам, — от автоматической настройки моделей до поиска новых материалов. При этом исследователи честно указывают на ограничения: результаты получены на симуляциях и ограниченных данных, а реальные торги не проводились. Главный вывод: чтобы ИИ-исследователь действительно прогрессировал, нужно не просто разрешить ему учиться на своих ошибках, но и гарантировать, что сами критерии оценки остаются неподкупными.
Источник: www.qbitai.com
Поделиться