ИИ-агенты страдают амнезией: найдено «лекарство» от забывчивости
Исследователь под псевдонимом codila выявил критическую проблему у ИИ-агентов — склонность к амнезии, когда система теряет контекст в ходе длительных операций с данными. Эксперт предложил инновационное решение, основанное на внедрении «памяти с перепроверкой», что позволяет агенту сохранять целостность цепочки рассуждений. Для криптовалютного сектора это открытие особенно важно: такие агенты уже используются для анализа рынка, управления смарт-контрактами и выявления арбитражных возможностей. Устранение амнезии повышает доверие к алгоритмической торговле и децентрализованным приложениям, ускоряя массовое внедрение блокчейн-технологий.
Почему агент все забывает
Корень проблемы codila видит в устройстве одиночного цикла. Цикл — это один круг улучшения: агент пробует, проверяет результат, вносит правку и повторяет.
Такой цикл дает агенту способность думать, но не помнить. Как поясняет исследователь, шаги выстраиваются в линию и ждут друг друга, пока контекстное окно не переполнится — и тогда агент забывает, что вообще делал.
Есть у одиночного цикла и второй изъян. Агент видит только собственную метрику и не замечает, когда сам показатель перестает отражать суть задачи.
Основой мышления агента при этом остаются четыре приема, которые сформулировал Эндрю Ын — американский ученый в области искусственного интеллекта, сооснователь Coursera и основатель образовательной компании DeepLearning.AI. Первый прием — рефлексия: агент пишет ответ, второй запрос его критикует, после чего агент переписывает результат.
Второй прием — использование инструментов: агенту дают поиск, запуск кода и доступ к API. Третий — планирование, когда задачу разбивают на шаги в формате JSON еще до запуска, а при сбое агент перестраивает план. Четвертый — работа команды агентов, где один пишет код, второй проверяет, а третий тестирует.
Силу такого подхода codila подкрепляет цифрами Ына. По его данным, GPT-3.5 в связке с агентным подходом решает тест HumanEval на 95,1%, тогда как более новая GPT-4 без такого подхода — на 67%.
Как графы лечат забывчивость
Лекарством от «амнезии» codila называет переход от цикла к графу. Граф — это сеть циклов, где отдельные циклы проверяют и поправляют друг друга, а не тянутся одной линией.
Память в такой сети устроена принципиально иначе. Агенты делятся общим состоянием через код координации и не пересылают друг другу целые переписки, поэтому промежуточные результаты не переполняют контекст. Как формулирует сам исследователь, агент забывает, а граф — нет.
Внедрить такой подход codila советует в два шага. Сначала стоит добавить один критикующий запрос после каждой генерации, что дает прирост качества на 10–30% за день работы. Затем все четыре приема связывают в единый граф.
Отдельно исследователь предупреждает о ловушке. Если проверяющий узел получает тот же контекст, что и исполнитель, он не проверяет работу, а лишь соглашается сам с собой — поэтому такому узлу нужен чистый контекст и опора на реальный сигнал, например на реально пройденный тест.
Честно называет codila и цену такого подхода. По его словам, граф оправдан не всегда: для мелких и линейных задач он только добавляет расходы и точки отказа, а реальную пользу приносит там, где работу можно распараллелить.
Итог сводится к смене роли. Тот, кто просто задает вопрос, остается на уровне запросов, тогда как тот, кто рисует граф, становится архитектором и запускает уже не одного агента, а целую команду.
Хотите получить доступ к экспертным инсайдам? Подписывайтесь на наш новостной телеграм-канал, а также вступайте в сообщество BeInCrypto! Читайте последние новости и свежую аналитику криптовалют, ИИ и фондовых рынков. Будьте на шаг впереди толпы каждый день!