
Zep AI MemoryCamada de memória de longo prazo para agentes de IA e aplicativos LLM
Visão geral
Funcionalidades principais
- Memória conversacional de longo prazo
- Extração automática de fatos e entidades
- Armazenamento de grafo de conhecimento
- Busca semântica e híbrida
- Integrações LangChain e LlamaIndex
- SDKs multilíngues
Preços
- Modelo
- Freemium
- Categoria
- Desenvolvimento de Agentes
- Avaliação
- 4.8 / 5 (4)
Casos de uso
Memória persistente para chatbots de suporte ao cliente
Dê aos bots de suporte a lembrança de tickets passados, preferências e entidades ao longo de sessões para que os usuários não precisem repetir o contexto, melhorando a qualidade e a continuidade da resolução.
Copilotos com estado e custos de token reduzidos
Substitua o preenchimento de prompt com histórico de bate-papo completo por recuperação semântica direcionada do Zep, mantendo os prompts pequenos e previsíveis enquanto preserva o contexto de longo prazo relevante.
Agentes autônomos com lembrança estruturada
Poder agentes multi-etapas usando o grafo de conhecimento do Zep para lembrar fatos, entidades e relações coletadas ao longo de execuções, permitindo execução de tarefas de horizonte mais coerente.
Back-end de memória LangChain ou LlamaIndex
Incorpora o Zep em pipelines de estrutura LLM existentes como a camada de memória, adicionando extração de fatos e busca híbrida sem construir infraestrutura de recuperação personalizada.
Prós e contras
Prós
- Memória persistente entre sessões
- Reduz o tamanho do prompt e os custos de token
- Grafo de conhecimento para lembrança estruturada
- Funciona com principais estruturas LLM
- SDKs e API amigáveis para desenvolvedores
Contras
- Requer trabalho de integração de engenharia
- Orientado para desenvolvedores, não para usuários finais
- Adiciona outro serviço à pilha
Histórico de batalhas
Em 3 batalhas no Panteão.
Last 3 battles
Avaliações
Média de 4 avaliações.
Entra para deixar uma avaliação.
Does the job
Pretty happy overall. Automatic fact and entity extraction just works and persistent memory across sessions. Geared toward developers, not end users can be annoying, but no dealbreakers — I'd recommend it to a friend without hesitating.
Skeptical, then convinced
I went in skeptical — most tools in this space overpromise. It actually delivers on knowledge graph storage, and reduces prompt size and token costs caught me off guard. still, I'd recommend giving it a real trial.
Compared a few options
Evaluated this against two competitors. Where it wins: langChain and LlamaIndex integrations and persistent memory across sessions. On balance the feature set — especially multi-language SDKs — justifies the 5 stars for our use case.
Does the job
Pretty happy overall. LangChain and LlamaIndex integrations just works and knowledge graph for structured recall. Requires engineering integration work can be annoying, but no dealbreakers — I'd recommend it to a friend without hesitating.
Perguntas e respostas
How credits work
Credits are consumed based on the size of each Episode you send to Zep. Episodes up to 350 bytes use 1 credit; each additional 350 bytes (or part thereof) uses another credit. Where available, webhook invocations consume 1/8 of a credit each. Flex and Flex Plus automatically top up your credits when your balance drops below 20%. Flex adds 10,000 credits ($25); Flex Plus adds 40,000 credits ($75). Flex credits roll over for 30 days; Flex Plus credits roll over for 60 days. Free plan credits do not roll over.
Asked by Yuki Mori · Mar 1, 2026
Are we charged for ingestion or storage?
You are charged for ingestion and processing of Episodes. You are not charged for storage of messages or data.
Asked by Nour Khalil · Feb 17, 2026
What is an Episode?
An Episode is any single data object you send to Zep — a chat message, JSON payload, or block of text. Credit cost scales with Episode size. Episodes up to 350 bytes use 1 credit; each additional 350 bytes (or part thereof) uses another credit. A 640-byte Episode uses 2 credits; a 1,200-byte Episode uses 4 credits.
Asked by Sarai Cohen · Feb 18, 2026
How are rate limits calculated?
Each plan tier has a base rate limit, with Free being the lowest. Free and Flex Plan customers may see rate limits lowered depending on service usage. Enterprise plans have committed, guaranteed rate limits.
Asked by Xander de Vries · Jan 30, 2026
What are the Free plan limits?
10,000 credits per month. No rollover or auto-topup. ·2 projects, 5 custom entity & edge types. ·Variable rate limits, depending on service-wide load. ·Lower priority Episode processing. ·Feature availability and service levels may change over time.
Asked by Fiorella Bianchi · Jan 21, 2026
Faz uma pergunta
Alternativas a Desenvolvimento de Agentes

IDE visual para criar, depurar e inspecionar fluxos de trabalho de agentes LangGraph

Crie agentes de IA personalizados que automatizam tarefas e fluxos de trabalho por meio de linguagem natural.

Uma plataforma de código aberto para construir agentes de IA com estado e memória de longo prazo e raciocínio avançado.

Plataforma de desenvolvimento de dados e IA programática para construir modelos de produção mais rápidos.

Rede econômica modular que combina infraestrutura de blockchain com capacidades de IA.

Protocolo descentralizado para construir e governar sistemas de IA multi-agentes on-chain

Plataforma completa para criar, implantar e gerenciar agentes de IA e chatbots.

Plataforma de observabilidade, avaliação e depuração para aplicações LLM da equipe LangChain
Trending now

API de inteligência de documentos que parseia, divide, reconhece texto e extrai dados estruturados de PDFs complexos, slides e planilhas.

Respostas patrocinadas, pagamento por clique.

Ajuda Precisa nos Deveres de Casa com Explicações Completas

Modelo multimodal de 12B aberto que lida com imagens e texto intercalados com uma janela de contexto de 128K.
