Mem0 (читается «мем-зиро») — слой долговременной памяти для ИИ-агентов и приложений. Он сохраняет полезные факты между сессиями и возвращает их приложению при поиске. Mem0 доступен как управляемая платформа и библиотека с открытым кодом для собственной инфраструктуры.

🆕
Обновлено 2 сентября 2026 года. Mem0 доступен в официальном каталоге коннекторов Anthropic. Его можно подключить через Claude.ai, Claude Desktop или Cowork без локальной установки и командной строки. Подробнее — в официальном блоге Mem0.

Что такое Mem0 и где действует новый алгоритм

Встроенная память Claude остаётся внутри Claude. Mem0 создаёт отдельный переносимый слой: приложение отправляет ему сообщения, сервис извлекает факты, сохраняет их с привязкой к пользователю, агенту или сессии и возвращает подходящие воспоминания при поиске.

В актуальном алгоритме Mem0 Platform новые факты накапливаются по принципу ADD-only, то есть только добавляются. Автоматическое извлечение не перезаписывает и не удаляет прежние записи. Если пользователь переехал, в памяти могут сохраниться и старое, и новое место с временным контекстом. Система учитывает актуальность во время поиска. Существующие воспоминания не переобрабатываются, а новые записи добавляются в граф.

Поиск в платформе стал гибридным. Он объединяет семантическое сходство, ключевые слова, связи между сущностями и временные сигналы. Граф сущностей в новом алгоритме строится автоматически и не требует отдельной Neo4j.

Далее утверждения об ADD-only, гибридном поиске и встроенном графе относятся к Mem0 Platform и новому алгоритму, если не указано иное.

💡
Слой памяти (memory layer) — прослойка между приложением и языковой моделью. Она хранит выбранные факты и передаёт модели релевантный контекст вместо всей истории переписки.

Основные возможности платформы

ВозможностьКак работает
Извлечение фактовПлатформа выделяет сведения из сообщений пользователя и агента и добавляет их в память
Разделение памятиЗаписи можно привязывать к пользователю, агенту или сессии
Гибридный поискРезультаты ранжируются по смыслу, ключевым словам, сущностям и временным сигналам
Граф сущностейПлатформа связывает упоминания людей, мест и других сущностей и использует связи при ранжировании
API и SDKЕсть клиенты для Python и TypeScript, а также REST API
РазвёртываниеМожно использовать облачную платформу или открытую версию на собственной инфраструктуре

Подключение к Claude без кода

Коннектор использует размещённый сервер Model Context Protocol (MCP) Mem0 и предоставляет Claude инструменты для добавления, поиска, просмотра, изменения и удаления воспоминаний.

  1. В Claude нажмите + или введите /, затем откройте Connectors.
  2. Найдите Mem0 в каталоге и нажмите Connect.
  3. Авторизуйте Claude в аккаунте Mem0.
  4. В новом чате явно попросите: «Сохрани в Mem0, что я предпочитаю короткие ответы на русском».
  5. Откройте ещё один чат и спросите: «Проверь мою память Mem0 и скажи, как мне отвечать».

При стандартном режиме Auto модель сама решает, нужен ли вызов инструмента. Расплывчатый вопрос может не запустить поиск. Для надёжной проверки прямо называйте Mem0 или выберите Connectors → Tool access → Always available.

⚠️
Подключение даёт Claude доступ к памяти вашего аккаунта Mem0. Не сохраняйте в ней секреты, пароли, ключи API и другие данные, которые не должны попадать во внешнее облако.

Подключение по Python API V3

Установите пакет и создайте ключ в панели Mem0:

pip install mem0ai

Минимальный пример для актуального API V3:

from mem0 import MemoryClient

client = MemoryClient(api_key="your-api-key")

result = client.add(
    messages=[
        {
            "role": "user",
            "content": "Предпочитаю короткие ответы на русском",
        }
    ],
    user_id="sergey",
)

memories = client.search(
    query="На каком языке и насколько подробно отвечать?",
    filters={"user_id": "sergey"},
)

Операция add() в V3 выполняется асинхронно: ответ содержит event_id и начальный статус PENDING. Перед контрольным поиском дождитесь статуса SUCCEEDED. Статус FAILED означает ошибку обработки, поэтому факт нельзя считать подтверждённо сохранённым.

В V3:

  • идентификатор пользователя при поиске передаётся внутри filters;
  • top_k принимает значения от 1 до 1000, по умолчанию 10;
  • порог релевантности (threshold) по умолчанию равен 0,1;
  • повторное ранжирование (rerank) по умолчанию выключено;
  • get_all() возвращает страницу с полями count, next, previous и results.

V1 и V2 продолжают работать, но новый код лучше сразу строить по контракту V3. Подробности собраны в официальном руководстве по миграции.

Проверка результата

Фактический запуск примеров в рамках этой редакторской проверки не выполнялся. Ниже приведён проверяемый сценарий по официальной документации.

Для Claude сохраните факт в одном чате, откройте новый чат и явно запросите проверку памяти. Успешный результат: Claude находит сохранённое предпочтение и использует его в ответе. Если вызова инструмента нет, назовите Mem0 в запросе или включите Always available.

Для Python API:

  1. Вызовите add() и получите event_id со статусом PENDING.
  2. Проверьте событие через GET /v1/event/{event_id}/ и дождитесь SUCCEEDED.
  3. Выполните search() с тем же user_id внутри filters.
  4. Успешный результат содержит сохранённый факт в массиве results.

Тарифы и лимиты

Тарифы проверены 2 сентября 2026 года по официальной странице Mem0.

ПланЦенаМесячные лимиты и возможности
HobbyБесплатно10 000 add requests, 1 000 retrieval requests, 1 проект, безлимит конечных пользователей
Starter$19/мес50 000 add requests, 5 000 retrieval requests, 1 проект
Pro$249/мес500 000 add requests, 50 000 retrieval requests, безлимит проектов, расширенная аналитика, графовая память и приватная поддержка в Slack
EnterpriseПо запросуБезлимитные запросы и проекты, SLA, on-prem, журналы аудита, пользовательские интеграции и SSO

План Growth за $79, присутствовавший в прежней версии материала, на текущей странице тарифов отсутствует.

📌
Add request — это запрос на обработку, а не обязательно один сохранённый факт. Лимит считает запросы. Один запрос может обрабатывать набор сообщений и приводить к созданию нескольких воспоминаний, поэтому расход нельзя оценивать только по числу записей.

В официальных источниках есть расхождение по графовой памяти. Страница тарифов относит её к Pro и Enterprise, а руководство по новому алгоритму называет её встроенной и автоматически включённой для проектов Mem0 Platform. Если эта возможность влияет на выбор плана, уточните её доступность в своём проекте до оплаты.

Что учитывать при самостоятельном размещении

Открытая версия позволяет держать память в собственной инфраструктуре, но отсутствие платы за код не означает нулевую стоимость эксплуатации. Понадобятся модель для извлечения фактов, эмбеддинги, хранилище, сервер, резервные копии и обновления.

Утверждение о встроенном графе без Neo4j относится к новому алгоритму Mem0 Platform. Его нельзя автоматически переносить на самостоятельную установку: конфигурация открытой версии зависит от выбранного хранилища и версии библиотеки.

⚖️
Облако проще запустить и проверить, а самостоятельное размещение даёт больше контроля над данными. Во втором случае расходы переносятся на модели, инфраструктуру и поддержку.

Полезные сценарии

Личный ассистент между чатами

Условие: у пользователя повторяются устойчивые предпочтения, проекты или рабочий контекст. Ассистент сохраняет выбранные факты и ищет их в новой сессии. Результат проверяется вопросом, для ответа на который нужен ранее сохранённый факт. Сценарий не подходит для секретов и данных, которые нельзя передавать выбранному хостингу.

Поддержка клиентов

Приложение привязывает воспоминания к стабильному user_id и перед поиском передаёт вопрос вместе с фильтром пользователя. Наблюдаемый результат: новый диалог учитывает детали прежнего обращения без загрузки полной переписки. Память не заменяет CRM и журнал операций, если бизнесу нужен строгий аудит исходных сообщений.

Длительная работа ИИ-агента

Агент сохраняет решения, предпочтения и подтверждённые результаты по мере выполнения проекта. При следующем запуске он получает подходящие записи через поиск. Это уменьшает объём истории, передаваемой модели, но требует тестов: неверно извлечённое воспоминание способно повлиять на последующие ответы.

Одна память для нескольких интерфейсов

Один слой можно подключить к Claude, собственному приложению и другим агентам, если они используют согласованные идентификаторы и правила доступа. Проверяемый результат: факт, записанный через один интерфейс, находится через другой. Такое объединение нельзя делать без изоляции пользователей и каналов.

Ограничения и проверка качества

Бенчмарки Mem0 публикует сама компания. На исследовательской странице указан результат 92,5 на LoCoMo, а руководство по миграции приводит 91,6 на LoCoMo и 93,4 на LongMemEval для нового алгоритма. Значения относятся к разным опубликованным конфигурациям, поэтому их нельзя смешивать в одно сравнение без проверки методики и параметров запуска.

Компания сообщает, что полный фреймворк оценки открыт для аудита и повторного запуска. Это повышает проверяемость, но не заменяет испытание на ваших диалогах. Перед внедрением соберите контрольный набор запросов и отдельно проверьте обычное извлечение, временную логику, разграничение пользователей и поведение при устаревших фактах.

Mem0 может быть лишним, если бот живёт в одной короткой сессии, контекст помещается в системный промпт или продукт уже предоставляет подходящую встроенную память. Отдельный слой добавляет стоимость, задержку и ещё одно место, где нужно управлять персональными данными.

Альтернативы

  • Letta (бывший MemGPT) — среда для агентов с управлением долговременным контекстом.
  • Zep — инфраструктура памяти и истории для диалоговых приложений.
  • Собственная связка с pgvector, Pinecone или Qdrant — больше контроля, но извлечение, обновление, временную логику и связи между сущностями придётся проектировать самостоятельно.

Официальные ссылки

Следующий шаг

Mem0 появился в каталоге коннекторов Claude

Mem0 имеет смысл обсуждать, если агенту нужен долгий контекст, переносимая память или единый профиль пользователя в нескольких каналах.

Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov