Краткий ответ
Что такое память веб-приложения
Веб-приложение ChatGPT имеет два типа памяти:- Сохранённые воспоминания: факты и предпочтения, которые вы попросили его запомнить, например ваша работа или стиль письма
- Ссылка на историю чатов: информация, которую оно получает из ваших прошлых разговоров
Память агентных инструментов — это просто файлы
В инструментах для coding-агентов память всегда означает чтение и запись клиентом локальных файлов:Claude Code
CLAUDE.md; личные предпочтения и извлеченные уроки сохраняются в локальном каталоге памяти. Оба источника читаются при запуске сессии.Codex
AGENTS.md. С апреля 2026 года Codex также имеет встроенную память, которая извлекает содержимое из прошлых сессий и сохраняет его локально в ~/.codex/memories/.Инструмент памяти Claude API
- Память — это файлы, обычно Markdown, которые вы можете напрямую открывать и редактировать.
- Модель не читает все файлы сразу. Клиент извлекает только то, что относится к текущей задаче.
- Каждый новый разговор читает их снова. Сама модель ничего не помнит; всё, что читает клиент, отправляется в API вместе с вашим вопросом.
Перенос памяти на другой компьютер
Память на уровне проекта переносится вместе с репозиторием
CLAUDE.md и AGENTS.md, находятся в каталоге проекта. Закоммитьте их в git, и они будут доступны сразу после получения кода на другом компьютере. Так ваша команда сможет использовать одинаковые правила проекта.Память на уровне пользователя необходимо копировать или синхронизировать
~/.codex/memories/ Codex или локальный каталог памяти Claude Code), не находится в репозитории. Скопируйте её в то же расположение на новом компьютере либо синхронизируйте с облачным хранилищем или инструментом синхронизации.Убедитесь, что она работает на новом компьютере
Память и стоимость
Память не бесплатна:- Считываемая память тарифицируется как входные tokens. Каждый файл памяти, который клиент считывает в новом разговоре, учитывается во входных данных этого запроса.
- Разговор становится дороже по мере роста. Поскольку API не имеет состояния, каждый ход повторно отправляет весь разговор к текущему моменту, поэтому входные tokens продолжают накапливаться.
- Тарификация кэша снижает стоимость повторяющейся части. Если начало каждого запроса (системный prompt, файлы памяти, предыдущие ходы) остается неизменным, оно может попасть в кэш и тарифицируется значительно ниже обычной цены входных данных.
Серверное состояние диалога — это не память
previous_response_id в OpenAI Responses API: провайдер хранит диалог (по умолчанию 30 дней), а для следующего шага нужен только ID предыдущего ответа.Оно отличается от памяти по двум причинам:- Оно продолжает только одну цепочку диалога. Оно не запоминает ваши предпочтения между сессиями.
- Оно не экономит средства. Всё предыдущее содержимое цепочки по-прежнему тарифицируется как входные tokens на каждом шаге.
Часто задаваемые вопросы
Хранит ли APIYI мои разговоры?
Хранит ли APIYI мои разговоры?
previous_response_id выше), провайдер хранит этот разговор в соответствии со своими правилами.Могу ли я заставить API запоминать мои предпочтения?
Могу ли я заставить API запоминать мои предпочтения?
Всегда ли больше памяти лучше?
Всегда ли больше памяти лучше?
Помимо копирования папки, как еще можно синхронизировать память?
Помимо копирования папки, как еще можно синхронизировать память?
- Фиксируйте память на уровне проекта в git, чтобы она перемещалась вместе с кодом.
- Синхронизируйте память на уровне пользователя с облачным хранилищем или инструментом синхронизации.
- Запустите собственный сервис памяти: некоторые инструменты агентов могут подключаться к внешнему сервису памяти по MCP, и несколько компьютеров могут совместно использовать один сервис.