Гениальный собеседник с амнезией
Первый раз это удивляет, а потом начинает злить. Вчера ты полчаса объяснял ассистенту контекст проекта: кто подрядчик, что решили по срокам, где грабли. Он отвечал умно, по делу, будто понимал всё. А сегодня открываешь новый чат — и перед тобой чистый лист. Он не помнит ни подрядчика, ни сроков, ни того, что ты вообще с ним об этом говорил.
Я веду по несколько созвонов в день уже много лет, и с ИИ-инструментами прошёл этот путь до конца. Ощущение всегда одно: разговариваешь с очень умным человеком, у которого стёрли память между встречами. В моменте — блеск. Через день — как будто вас и не знакомили.
Это не баг конкретного продукта. Так устроено большинство ИИ-инструментов, и понимание, почему ии-ассистент забывает, экономит кучу нервов. Разберём механику, а потом — что с этим реально делать.
Почему ии-ассистент забывает: как устроен контекст в чате с ии
Внутри любой языковой модели нет постоянной памяти о вас. Есть окно контекста — это весь текст, который модель видит прямо сейчас, чтобы сформировать ответ. Ваш вопрос, история текущего чата, служебные инструкции — всё это влезает в одно ограниченное окно. Пока разговор идёт, модель держит его перед глазами и кажется, что она вас помнит.
Но контекст в чате с ии — это оперативная память, а не жёсткий диск. Как только вы закрываете чат или начинаете новый, окно очищается. Модель не откладывает разговор в какое-то досье про вас. Она вообще не хранит прошлые сессии — если продукт специально не добавил такой механизм сверху.
Отсюда два следствия, которые полезно держать в голове:
- Длинный разговор тоже забывается изнутри. Когда чат разрастается, самое старое из окна начинает вытесняться. Даже в рамках одной сессии ассистент может «потерять» то, что вы говорили в начале.
- Новый чат — всегда с нуля. Если ассистент не помнит прошлые разговоры, это не каприз, а поведение по умолчанию. Память надо было где-то сохранить и в нужный момент вернуть обратно в окно — а этого по умолчанию не происходит.
Проще говоря: модель умная, но по природе беспамятная. Всё, что выглядит как «он меня помнит», — это надстройка, которую кто-то построил вокруг модели.
Умный в моменте против помнящего
Вот главное различие, ради которого стоило всё это объяснять. Есть два разных класса инструментов, и их легко перепутать.
Умный в моменте. Отлично решает задачу здесь и сейчас: сформулировать письмо, разобрать кусок кода, накидать план встречи. Внутри одной сессии — незаменим. Но каждый разговор для него первый. Он не накапливает знание о вашей работе, людях и договорённостях. Его ценность обнуляется вместе с окном контекста.
Помнящий. Тоже умный в моменте, но поверх этого у него есть память ии-ассистента — механизм, который сохраняет важное из разговоров и подтягивает нужное обратно, когда вы возвращаетесь к теме. Такой ассистент через месяц знает, что вы обсуждали с подрядчиком в мае, и не заставляет пересказывать всё заново.
Разница чувствуется не на первом разговоре, а на десятом. Умный в моменте требует, чтобы вы каждый раз загружали контекст руками — а это и есть скрытый налог на работу с ИИ. Помнящий этот налог снимает: контекст живёт у него, а не в вашей голове.
Для руководителя разрыв особенно болезненный. Ваша работа во многом и есть память: кто что обещал, что решили три недели назад, какой хвост остался висеть. Ассистент, который всё это забывает к утру, помогает печатать быстрее, но не снимает с вас роль ходячего архива.
Как сделать, чтобы ассистент помнил
Память не берётся из воздуха — её строят. Если разобрать, что должно происходить под капотом «помнящего» ассистента, получается три шага.
- Захват. Из разговора надо выделить, что вообще стоит запомнить: решения, задачи, договорённости, факты о людях и проектах. Не весь поток дословно, а суть.
- Хранение. Это сохраняется в постоянное место — не в улетающее окно контекста, а в базу, файлы, заметки. То, что переживёт закрытие чата.
- Возврат. Когда вы задаёте новый вопрос, система находит в хранилище релевантное и подкладывает обратно в контекст. Модель снова «вспоминает» — потому что ей вернули нужный кусок прошлого.
Пока инструмент не делает все три шага, он останется умным в моменте, каким бы мощным ни был. И наоборот — даже средняя модель с хорошей памятью на практике полезнее блестящей, но беспамятной.
Если не хочется ждать, пока продукт всё это сделает за вас, минимальная ручная версия работает уже сегодня: после каждого важного разговора сохраняйте короткое резюме в одном файле или заметке и в начале следующей сессии подкладывайте его ассистенту сами. Грубо, но это ровно те же три шага руками — и разрыв «умный, но забывает» частично закрывается.
Где память встроена в продукт
В созвонах налог на память самый большой: договорённости живут в живой речи и испаряются, как только все положили трубку. Поэтому логично, чтобы помнил как раз тот инструмент, который был на встрече.
По этому принципу мы и делаем Alfric — ассистента рабочих созвонов. Он слушает встречу и отдаёт протокол с решениями, задачи с ответственными и сроками, саммари, а потом напоминает о хвостах. И, что важно для темы этой статьи, к любой договорённости можно вернуться обычным вопросом — «что решили с подрядчиком в мае?» — и получить ответ, а не чистый лист. Записи и расшифровки при этом лежат на вашем компьютере в обычных markdown-файлах: синхронизация зашифрована, ключ у вас, данные не уезжают в облако вендора. Память — не значит «отдать свою переписку наружу».
Что забрать с собой
Если ассистент не помнит прошлые разговоры — это не поломка, а то, как по умолчанию устроены языковые модели. Память у них оперативная и живёт ровно до конца сессии.
Поэтому при выборе инструмента спрашивайте не «насколько он умный», а «что он помнит завтра». Умный в моменте ускоряет отдельную задачу. Помнящий берёт на себя роль второго мозга — и вот это уже меняет, как вы работаете, а не только как быстро печатаете.