Twilio, ServiceNow, AWS e Google lançaram memória para agentes de IA. Cada uma fica dentro de quem a lançou
Em 2026, a memória para agentes virou produto de plataforma. O que cada lançamento documenta, o que não documenta, e a pergunta que sobra para a empresa que roda agentes de voz, WhatsApp e app em fornecedores diferentes.
Notícias9 min de leitura
Entre dezembro de 2025 e agosto de 2026, quatro plataformas que a sua empresa provavelmente já usa passaram a vender memória para agentes de IA. A Twilio tornou a Conversation Memory disponível a todos em 6 de maio de 2026 (anúncios do SIGNAL 2026). A ServiceNow apresentou o Context Engine em 9 de abril (comunicado). O Memory Bank do Vertex AI, do Google, ficou disponível a todos em 16 de dezembro de 2025 (notas de versão). O AgentCore Memory, da AWS, ganhou em agosto a capacidade de guardar eventos de sistema (notas de versão). Todas as quatro guardam a memória onde a própria plataforma está. Para a empresa que roda o agente de voz num fornecedor, o de WhatsApp em outro e o do app no time interno, a pergunta não é qual memória é melhor. É de quem é a memória do cliente quando os agentes são de vários.
Este post foi escrito para quem decide a arquitetura dos agentes e os contratos dos fornecedores. As fontes foram lidas em 1º de outubro de 2026, e o que cada uma não diz está marcado.
O que cada lançamento documenta
Twilio Conversation Memory. O anúncio diz que o produto "cria um perfil vivo, com identidade resolvida, ligando dados do cliente ao histórico de conversas e aos traços do cliente" e que foi "construído especificamente para LLMs, para reduzir latência e uso de tokens" (SIGNAL 2026). A documentação descreve dois tipos de memória, a conversacional (comportamentos, preferências, humor, pontos da conversa) e a factual (nome, contatos, nível da conta, identificadores), uma API de recall com busca semântica e lexical, e uma resolução de identidade que decide quando criar, acrescentar ou unir perfis. As memórias nascem das conversas que passam pelos canais da Twilio (SMS, WhatsApp, e-mail e voz), depois de passarem pelo Conversation Orchestrator. O preço é por uso: US$ 0,0028 por mil caracteres gerados, US$ 0,007 por recall e US$ 0,005 por perfil usado no dia (preço). O mesmo evento lançou o Agent Connect, um kit de código aberto que "permite conectar agentes construídos em qualquer LLM ou framework diretamente à infraestrutura da Twilio".
ServiceNow Context Engine. O comunicado de 9 de abril diz que o Context Engine "conecta as relações, a política e o histórico de decisões por trás de cada decisão de um agente de IA" e que "dá à IA e aos fluxos da ServiceNow o contexto para perceber o que acontece na empresa"; no lançamento, ele estava "disponível em prévia para clientes selecionados" (comunicado). Em 6 de maio, no Knowledge 2026, a empresa o descreveu como uma camada semântica que integra o CMDB, os dados de fluxo, as análises e sistemas de terceiros (comunicado). A Forrester resumiu a tese do evento numa frase: "o contexto alimenta a inteligência e os agentes de IA movem a ação", com a ServiceNow se posicionando como "a camada operacional autônoma da empresa" (Forrester, 14/05/2026).
Google Vertex AI Memory Bank. As notas de versão de 16 de dezembro de 2025 dizem que "Sessions e Memory Bank do Vertex AI Agent Engine estão disponíveis a todos" e que a cobrança começou em 28 de janeiro de 2026 (notas de versão). A memória é gerada das conversas do usuário com o agente que roda no Agent Engine.
AWS AgentCore Memory. Em abril de 2026, o serviço ganhou filtros por metadados estruturados na memória de longo prazo; em agosto, a API CreateEvent passou a aceitar um payload json para "dados não conversacionais, como eventos de comportamento, logs de atividade e eventos de sistema", extraídos para a memória de longo prazo (notas de versão). É a memória dos agentes que rodam no AgentCore.
Oracle. A Oracle anunciou o AI Database 26ai em 24 de março de 2026, com um "Unified Memory Core" descrito por analistas como "uma memória persistente e com estado para agentes de IA dentro do motor do banco" (Futurum, 25/03/2026). A memória mora no banco da Oracle.
O padrão: a memória fica onde a plataforma está
Lidos juntos, os cinco lançamentos têm o mesmo desenho. A memória nasce do que passa pela plataforma e serve aos agentes que rodam nela:
| Plataforma | De onde a memória nasce | Quem a lê, pela documentação | O que a documentação não diz |
|---|---|---|---|
| Twilio | Conversas nos canais da Twilio | Agentes e atendentes humanos nas conversas da Twilio; agentes de qualquer framework ligados pela infraestrutura da Twilio (Agent Connect) | Se uma ligação atendida fora da Twilio, ou um evento do ERP, entra na memória |
| ServiceNow | CMDB, fluxos, análises, sistemas integrados | A IA e os fluxos da ServiceNow | Se um agente de outro fornecedor consulta o Context Engine; a disponibilidade geral |
| Conversas com agentes no Agent Engine | Agentes no Agent Engine | Entrada de conversas de agentes fora do Google Cloud | |
| AWS | Eventos e conversas enviados ao AgentCore | Agentes no AgentCore | Entrada de conversas de agentes fora da AWS |
| Oracle | Dados e conversas no banco | Agentes que acessam o banco | Quantos frameworks de terceiros a usam (a Futurum sugere observar) |
Nenhuma dessas empresas está errada em fazer isso. A memória dentro da plataforma é o produto natural de quem já tem a conversa ou o dado. O problema aparece do lado de quem compra: a empresa média de atendimento e cobrança não roda tudo numa plataforma só.
O que isso significa para quem tem agentes de vários fornecedores
Pense numa operação comum: voz numa plataforma de voz, WhatsApp pela Twilio, o app com um agente do time interno, o CRM na Salesforce ou na ServiceNow, o ERP de outro fornecedor. Com os lançamentos de 2026, essa empresa pode ter quatro memórias do mesmo cliente, cada uma completa dentro do próprio muro e cega para o resto:
- O agente de voz não lê a memória da Twilio, a menos que a ligação passe pela Twilio. A reclamação feita no WhatsApp às 14h02 não chega à ligação das 14h07 atendida em outro fornecedor.
- O Context Engine conhece o ticket e o fluxo, não a conversa que aconteceu no WhatsApp de outro fornecedor.
- A troca de fornecedor leva a memória junto. Se o contrato de voz muda de plataforma, a memória das ligações fica na plataforma antiga.
- Ninguém mede o conjunto. Cada plataforma mede o próprio agente contra as próprias regras. Nenhuma diz se o agente do concorrente aproveitou o que a outra sabia (como saber se o agente usou o contexto).
O preço por recall mostra o mesmo desenho de outro ângulo. A Twilio cobra US$ 0,007 por recall (preço): numa conversa em que o agente lê a memória a cada troca, dez trocas custam US$ 0,07 só de recall, antes do modelo e da mensagem. É a unidade certa para uma memória que vive dentro do canal cobrado por mensagem. Não é a unidade certa para uma memória que vários agentes, de vários fornecedores, leem na mesma conversa.
O mercado já deu nome ao problema. A a16z escreveu em 10 de março de 2026 que agentes de dados falham por falta de contexto, e que a camada de contexto moderna inclui "entidades canônicas e resolução de identidade", acessível "por API ou MCP", como "um corpo vivo e em constante evolução" (Your Data Agents Need Context). Uma pesquisa da VentureBeat com 101 empresas de mais de cem funcionários, em junho de 2026, achou que 57% atribuíram uma resposta confiante e errada de um agente a contexto de negócio ausente ou inconsistente, 31% mais de uma vez; 25% tinham uma camada de contexto governada em produção, 34% estavam construindo e 41% não tinham começado (VentureBeat, 10/07/2026).
O que conferir antes de assinar
Quatro perguntas para o fornecedor, com a resposta que importa:
- A memória recebe eventos que não passaram por você? Uma ligação de outro fornecedor, um evento do ERP, uma mensagem de um canal que não é seu. Se não recebe, é a memória do seu canal, não a memória do meu cliente.
- Um agente de outro fornecedor lê a memória, com credencial própria e permissão por finalidade? Sem isso, o cliente que muda de canal começa do zero.
- Quando eu sair, a memória sai comigo, em formato aberto? Exportação contínua, não um dump no fim do contrato.
- Quem mede se cada agente usou o que recebeu? Por agente e por fornecedor, com o comprovante de cada entrega.
O que não sabemos
- Se a Twilio vai aceitar conversas de canais fora dela na Conversation Memory. A documentação lida em 1º de outubro de 2026 não descreve essa entrada; não descreve também que a recusa.
- Quando o Context Engine da ServiceNow sai da prévia e se agentes de terceiros poderão consultá-lo. O comunicado de abril diz que "os detalhes de disponibilidade serão compartilhados depois".
- Quanto do Unified Memory Core da Oracle é usado por frameworks de terceiros. A Futurum recomenda acompanhar a adoção; não achamos número público.
- A pesquisa da VentureBeat tem 101 respondentes. É um sinal, não um censo.
Como a Niadra resolve
A Niadra é a camada de memória que fica fora de todas essas plataformas. Ela recebe os eventos de cada canal, plataforma e sistema (a ligação na plataforma de voz, a mensagem pela Twilio ou pela Cloud API, a sessão do app, o ticket, a fatura do ERP), reconhece que falam da mesma pessoa antes de guardar, e entrega a qualquer agente, de qualquer fornecedor, o contexto da tarefa dele antes da primeira palavra. Cada fornecedor entra com a própria credencial e lê só o que a finalidade dele permite; nenhum lê a memória do outro, e a troca de um deles não apaga nada (como agentes de fornecedores diferentes compartilham o histórico).
Os adaptadores de Twilio, WhatsApp Cloud API, LiveKit, Vapi, Retell, ElevenLabs, LangGraph e OpenAI Agents ligam à mesma memória os agentes que você já opera, e os sistemas entram por webhook, lote ou arquivo (Sistemas). No benchmark de 30/09/2026, com o mesmo agente e o mesmo juiz para todo sistema, a Niadra acertou 98,8% dos 338 casos de continuidade entre canais, e nenhum dado sensível foi entregue a uma conversa que não tinha provado quem era. O preço é por conversa ou tarefa, de US$ 2 a 3 a cada mil, com todas as leituras e buscas da conversa incluídas (Preço).
Perguntas frequentes
Se eu já uso a Twilio para WhatsApp, preciso de outra memória?
Depende de onde estão os seus outros agentes. Se toda conversa da sua empresa passa pela Twilio, a Conversation Memory cobre o que ela vê. Se a voz está em outro fornecedor, ou se o ERP e o CRM precisam alimentar o que o agente sabe, a memória precisa ficar fora da Twilio, e a Twilio vira uma das fontes.
A memória da plataforma e uma memória neutra convivem?
Convivem. A memória da plataforma continua servindo aos agentes dela; a camada neutra recebe os eventos de todas e serve ao conjunto. O post sobre memória dentro da plataforma ou memória neutra diz onde termina uma e começa a outra.
O que muda no contrato com o fornecedor de agente?
Duas cláusulas: o agente lê e alimenta a memória da empresa pelo SDK, com credencial própria; e a memória, com o histórico inteiro, fica com a empresa em formato aberto quando o contrato acabar.
Conte o que você está construindo.
E-mail corporativo e duas linhas sobre os seus agentes bastam. Quem responde é quem escreve o código, com uma proposta de acesso antecipado para o seu caso.
Prefere contar mais sobre a sua empresa? Use o formulário completo