Память агента

Чем память агента отличается от контекста сессии, из каких типов она состоит и почему без управления ею агент каждый раз начинает работу с чистого листа.

Дата составления: 2026-08-29
Статус: 💡 Актуально


Контекст против памяти

Контекстное окно — это все, что модель держит перед глазами в момент ответа: инструкции, приложенные документы, результаты поиска, история переписки. В конце каждого чата или агентной сессии оно полностью исчезает.

Память агента (Agent Memory) — это то, что окончание сессии переживает: файлы, базы, хранилища за пределами модели, которыми управляете вы, а не провайдер LLM или харнесса. Агент читает и пишет ее между шагами внутри задачи и между сессиями.

Разница практическая: контекст живет и умирает вместе с сессией, память накапливается. Все, что агент должен знать в следующий раз, нужно оставить ему снаружи — сам он из сессии ничего не выносит.

Это регулярно всплывает как жалоба на качество: при долгой работе в одном чате по одному спору ответы постепенно портятся, а «сохранить» наработанное внутри чата нельзя. Единственный способ — вынести результат наружу: в файл, в проект или в рабочую папку агента.


Четыре типа памяти

Разделение пришло из когнитивной науки и стало в этой области общепринятым — в этих терминах описывают себя и сервисы памяти, и самодельные сборки.

  • Рабочая (Working) — черновики и промежуточные выводы по текущей задаче: выписки из документов, план проверки, результат последнего поиска. Живет внутри сессии и умирает вместе с ней;

  • Эпизодическая (Episodic) — журнал по делу: что делали, чем закончилось, где ошиблись. Если вы просили модель суммировать длинный чат и переносили резюме в новый — вы вручную вели эпизодическую память;

  • Семантическая (Semantic) — факты и знания, не привязанные к событию: матрица рисков, уполномоченные подписанты, особенности согласования у конкретного контрагента, позиция фирмы по спорному вопросу;

  • Процедурная (Procedural) — как здесь принято работать: методика проверки договора, чек-лист, порядок эскалации к человеку, требования к оформлению документа.

Готовых инструментов именно под процедурную память почти нет. Первые три типа рынок закрывает — проектами, поиском по прошлым чатам, RAG-хранилищами, — а «как здесь принято работать» приходится собирать руками из файлов и инструкций. Отсюда и перекос: много про .md-файлы и мало про коробочные решения.

По способу ведения память делится еще раз: часть ее пишете вы, часть агент дописывает себе сам. В агентных средах это обычно два этажа — постоянный файл проекта, который правит человек, и авто-память, которую агент ведет по ходу работы и куда складывает то, что счел важным. Первый этаж предсказуем, второй нет, и именно поэтому его содержимое полезно время от времени просматривать.


Зачем управлять памятью

Три довода, и все три практические.

Каждая сессия начинается с нуля. Что решили в прошлый раз, какая редакция договора актуальна, что уже проверяли, где лежит правильный шаблон — агент не знает. Не потому, что «забыл», а потому, что помнить ему нечем.

Наличие файлов не равно памяти о них. Даже если все артефакты остались лежать в папке, агент должен еще догадаться туда посмотреть и понять, что из этого важно. Папка без навигации — это склад, а не память.

Отбор непрозрачен. Решая одну и ту же задачу в разных сессиях, агент по-разному наполняет свой контекст: сам решает, что прочитать целиком, а что пролистать. Вы не знаете, что он прочитал, и, что важнее, не знаете, что он отбросил. Ответ, в котором не учтено существенное, выглядит ровно так же уверенно, как полный.

Лечится это структурностью папок и нормализацией данных в них: чем понятнее устроена база, тем меньше у агента пространства для импровизации. Как раскладывать — в статьях Хранение знаний и Рабочее пространство агента.


Куда дальше


Связанные статьи

Дополнительные материалы


Теги: #память #агентный-ии #управление-данными #актуальное