Primeira páginaDiário da IA
Para quem programa

AWS publica guia para criar assistente de IA que lembra de conversas anteriores

A Amazon Web Services mostrou como construir um assistente pessoal que acumula contexto entre conversas usando OpenClaw no AgentCore. O exemplo é um assistente de jardinagem, mas a arquitetura serve outros domínios.

AWS publica guia para criar assistente de IA que lembra de conversas anteriores
Imagem: reprodução · AWS

A AWS publicou um guia para construir um assistente de IA que acumula contexto entre conversas usando OpenClaw no runtime do Amazon Bedrock AgentCore. O exemplo é o Sprout, um assistente de jardinagem, mas a arquitetura é genérica: trocando o manifesto de habilidades, o mesmo pipeline serve para suporte, treino físico ou help desk.

Segundo a empresa, o sistema roda em um único template do CloudFormation, sem ferramenta de build, e usa um modelo de cobrança por consumo. Para uso pessoal leve, a estimativa do post é de cerca de US$ 1 a US$ 2 por mês, em vez de cerca de US$ 35 por mês de uma instância EC2 sempre ligada. O guia separa memória de curto prazo, que guarda a conversa atual, e memória de longo prazo, que extrai registros estruturados de forma assíncrona.

O texto também mostra como o assistente busca essas memórias antes de responder e como metadados indexados ajudam a filtrar o que entra no prompt. Em outro trecho, a AWS diz que o mesmo desenho combina memória e visão: uma foto de planta murcha pode ser interpretada junto com o inventário salvo do usuário. O post ainda cita o cache de prompt do Bedrock para reduzir o custo de repetir o prefixo estável.

O que muda para você

Isso serve para quem constrói agentes na AWS e quer um padrão de memória persistente, com roteamento por texto e imagem. O guia mostra como montar a arquitetura e o que a memória já permite fazer. Não é uma entrega pronta para usuário final; é material para desenvolvimento.

Minha leitura

A AWS está vendendo um padrão, não um assistente pronto. O valor está menos no nome das peças e mais na separação entre conversa atual e memória persistente. Isso resolve uma dor real: fazer o sistema lembrar sem recontar tudo a cada turno. O limite também aparece no texto: a memória entra depois, e o desenho só funciona bem para quem consegue montar e operar essa camada.

Thiago FelizolaConsultor de IA, curador do Diário da IA

Primeira páginaArquivo de notícias