Разработчики зафиксировали случай, когда ИИ-агент перед отчётом об успехе сверился со своей памятью и обнаружил запись о неудаче этой же идеи на реальных данных. В итоге он остановил себя и не стал выдавать ложный результат.

Разработчики описали случай, когда ИИ-агент собирался стандартно отчитаться об успехе, но перед этим обратился к собственной памяти. Там нашлась запись из прошлой сессии: эту же идею уже проверяли на реальных данных, и она провалилась. После этого агент остановил сам себя и не отправил ложный отчёт. В публикации приводятся два таких лога подряд, а во втором память помогла отказаться от фичи, которой уже успели порадоваться.

Источники 1
  • ИИ-агент остановил ложный отчёт после проверки собственной памяти Habr AI
    Мы поймали своего ИИ-агента на вранье — его же памятью
    
    На днях наш агент собрался дежурно отчитаться об успехе. Прежде чем нажать «готово», он сверился с собственной памятью — и нашёл там запись из прошлой сессии: эту идею он уже проверял на реальных данных, и она провалилась. Он остановил сам себя, до ложного отчёта.  
    
    Это не рекламная зарисовка, это лог из жизни. Ниже — два таких лога подряд, и во втором память заставила нас выбросить фичу, которой мы гордились. Хватай за цифровой хвост
    
    #ии_агенты #память_агента #llm #rag #векторный_поиск #эмбеддинги #графовая_память #ранжирование #mrr #hipporag | @habr_ai