Каждый чат начинается с чистого листа
Ассистент видит только то, что лежит в текущем окне разговора. Закрыли чат, открыли новый, и модель не знает о прошлом ничего. Она не «забыла»: этой информации у неё просто нет на входе. Отсюда и ощущение, что вы каждый раз нанимаете нового сотрудника и заново рассказываете ему про проект.
Встроенная память закрывает не тот вопрос
У ChatGPT и Claude есть своя память, и она правда помогает. Но у неё два ограничения, которые видно сразу, как только работа выходит за рамки одного человека. Она принадлежит одному аккаунту: коллега её не видит, и объяснять проект он всё равно будет с нуля. И она принадлежит одной модели: ушли в другого ассистента, и память с вами не поехала.
Файл правил помнит «как», но не помнит «почему»
Файл с инструкциями для агента нужен, и его никто не отменяет: он задаёт правила работы. Но он статичен и пишется руками, а главное, отвечает на другой вопрос. Правила говорят, как делать. Они не хранят, что уже решили полгода назад и по какой причине отказались от прошлого варианта. Именно эта причина и теряется первой.
Что реально закрывает дыру
Слой памяти снаружи ассистента, к которому агент обращается сам. Три свойства делают его рабочим, а не ещё одним местом, куда надо не забывать заглядывать.
- Хранится отдельно от провайдера, поэтому переживает смену ассистента и доступен не только вам.
- Пишет агент, а не вы: решение сохраняется в момент обсуждения, вместе с причиной.
- Отдаёт сначала список найденного, а целиком читается только нужное, иначе память съест окно контекста быстрее, чем принесёт пользы.
Как проверить это на себе
Возьмите решение, которое принимали месяц назад, и спросите про него новый чат. Не «что мы делали», а «почему мы выбрали этот вариант». Если ответа нет, вы каждый раз восстанавливаете его по памяти или заново. Это и есть та работа, которую делать не нужно.