Skip to main content

Краткий ответ

Нет. API не имеет состояния и не запоминает ничего из предыдущих запросов.Память, которую вы видите в веб-приложении ChatGPT, Claude Code или Codex, — это функция, которую эти продукты реализуют поверх API: они записывают память в файлы и передают эти файлы обратно модели в последующих диалогах. Файлы остаются у вас, а APIYI не хранит содержимое ваших разговоров.

Что такое память веб-приложения

Веб-приложение ChatGPT имеет два типа памяти:
  • Сохранённые воспоминания: факты и предпочтения, которые вы попросили его запомнить, например ваша работа или стиль письма
  • Ссылка на историю чатов: информация, которую оно получает из ваших прошлых разговоров
Оба типа хранятся в вашей учётной записи OpenAI и относятся к веб-продукту. Они не доступны через API. Когда вы вызываете ту же модель через API, она ничего не знает о ваших разговорах в веб-приложении. Подробнее о различиях между веб-приложениями и API см. в разделе Почему официальные веб-приложения и API выдают разные результаты?

Память агентных инструментов — это просто файлы

В инструментах для coding-агентов память всегда означает чтение и запись клиентом локальных файлов:

Claude Code

Правила проекта помещаются в CLAUDE.md; личные предпочтения и извлеченные уроки сохраняются в локальном каталоге памяти. Оба источника читаются при запуске сессии.

Codex

Правила проекта помещаются в AGENTS.md. С апреля 2026 года Codex также имеет встроенную память, которая извлекает содержимое из прошлых сессий и сохраняет его локально в ~/.codex/memories/.

Инструмент памяти Claude API

Модель отправляет запросы на чтение и запись файлов памяти, а ваше приложение выполняет их. Вы определяете, где хранятся файлы: на локальном диске, в базе данных или в облачном хранилище.
Что общего у этих инструментов:
  1. Память — это файлы, обычно Markdown, которые вы можете напрямую открывать и редактировать.
  2. Модель не читает все файлы сразу. Клиент извлекает только то, что относится к текущей задаче.
  3. Каждый новый разговор читает их снова. Сама модель ничего не помнит; всё, что читает клиент, отправляется в API вместе с вашим вопросом.

Перенос памяти на другой компьютер

1

Память на уровне проекта переносится вместе с репозиторием

Файлы, такие как CLAUDE.md и AGENTS.md, находятся в каталоге проекта. Закоммитьте их в git, и они будут доступны сразу после получения кода на другом компьютере. Так ваша команда сможет использовать одинаковые правила проекта.
2

Память на уровне пользователя необходимо копировать или синхронизировать

Память, хранящаяся в вашем пользовательском каталоге (например, ~/.codex/memories/ Codex или локальный каталог памяти Claude Code), не находится в репозитории. Скопируйте её в то же расположение на новом компьютере либо синхронизируйте с облачным хранилищем или инструментом синхронизации.
3

Убедитесь, что она работает на новом компьютере

Откройте тот же проект и задайте вопрос, на который может ответить только память, например о команде запуска тестов проекта. Правильный ответ означает, что память была перенесена.
Не помещайте API-ключи, пароли или другие секреты в файлы памяти. Их содержимое отправляется модели и может быть раскрыто при синхронизации с облачным хранилищем или коммите в репозиторий.

Память и стоимость

Память не бесплатна:
  • Считываемая память тарифицируется как входные tokens. Каждый файл памяти, который клиент считывает в новом разговоре, учитывается во входных данных этого запроса.
  • Разговор становится дороже по мере роста. Поскольку API не имеет состояния, каждый ход повторно отправляет весь разговор к текущему моменту, поэтому входные tokens продолжают накапливаться.
  • Тарификация кэша снижает стоимость повторяющейся части. Если начало каждого запроса (системный prompt, файлы памяти, предыдущие ходы) остается неизменным, оно может попасть в кэш и тарифицируется значительно ниже обычной цены входных данных.
В APIYI попадания в кэш стабильны в основных каналах, таких как Claude, OpenAI, DeepSeek, Qwen и Grok. Неявный кэш Gemini имеет посредственную частоту попаданий, поэтому закладывайте расходы на Gemini по ценам без кэша. Правила для каждого канала см. в разделе Поддерживает ли APIYI тарификацию кэша?
Чтобы получать больше попаданий в кэш, размещайте неизменяемое содержимое (системный prompt, файлы памяти) в начале запроса, а изменяемое содержимое - после него. Не размещайте в начале значения, которые меняются при каждом запросе, например временные метки.

Серверное состояние диалога — это не память

Некоторые API провайдеров предлагают серверное состояние диалога, например previous_response_id в OpenAI Responses API: провайдер хранит диалог (по умолчанию 30 дней), а для следующего шага нужен только ID предыдущего ответа.Оно отличается от памяти по двум причинам:
  • Оно продолжает только одну цепочку диалога. Оно не запоминает ваши предпочтения между сессиями.
  • Оно не экономит средства. Всё предыдущее содержимое цепочки по-прежнему тарифицируется как входные tokens на каждом шаге.
В APIYI мы рекомендуем хранить историю диалога на стороне клиента. Это наиболее надёжный подход, который одинаково работает для всех моделей. Подробнее см. в руководстве по многошаговым диалогам.

Часто задаваемые вопросы

Нет. Будучи релейной платформой, APIYI только пересылает запросы и не хранит содержимое запросов или ответов. См. Как APIYI обеспечивает безопасность данных?Если вы используете серверную функцию разговоров провайдера (например, previous_response_id выше), провайдер хранит этот разговор в соответствии со своими правилами.
Да, но вам нужно реализовать это самостоятельно. Самый простой подход — указать предпочтения в system prompt и отправлять его с каждым запросом. Если предпочтений много, храните их в файлах или базе данных, извлекайте релевантные данные и добавляйте их в запрос. Инструмент памяти Claude API — официальная реализация этого подхода.
Нет. Больше памяти означает более длинный ввод в каждом запросе, более высокую стоимость и больше нерелевантного содержимого, которое может отвлекать модель. Регулярно проверяйте файлы памяти, удаляйте устаревшие записи и оставляйте только правила и факты, которые вы действительно используете.
Несколько вариантов:
  • Фиксируйте память на уровне проекта в git, чтобы она перемещалась вместе с кодом.
  • Синхронизируйте память на уровне пользователя с облачным хранилищем или инструментом синхронизации.
  • Запустите собственный сервис памяти: некоторые инструменты агентов могут подключаться к внешнему сервису памяти по MCP, и несколько компьютеров могут совместно использовать один сервис.
В любом случае память остается там, где вы ее контролируете, а не на стороне API.

Связанная документация

Почему официальные веб-приложения и API дают разные результаты?

Что веб-приложения добавляют поверх API

Руководство по многошаговым диалогам

Как поддерживать историю диалога в каждом формате API

Поддерживает ли APIYI тарификацию кэша?

Правила тарификации кэша и советы по попаданию в кэш для каждого канала

Как APIYI обеспечивает безопасность данных?

Шифрованная передача и отсутствие хранения содержимого запросов