Agentes autônomos com memória e contexto — patente depositada no USPTO

Hal-AI Agentic · Orquestração

Squads: agentes orquestradores que trabalham sozinhos

Um Squad não atende ninguém. Ele acorda no horário, lê o próprio contexto, consulta as APIs do seu sistema, decide o que vale fazer e dá a ordem — em linguagem natural — aos agentes que atendem no WhatsApp e no webchat. Depois escreve o relatório, publica o documento e manda por e-mail.

Acordar não é ordem de agir. Verificar e concluir que não havia nada a fazer é uma execução bem-sucedida.

Também pela API pública: disparar uma execução, acompanhar os logs e ler o desfecho declarado pelo Squad.

O que um Squad tem

Um agente-mestre, sem canal próprio, com agenda e ferramentas.

  • Agenda própria — acorda sem ninguém pedir
  • Contexto principal, conhecimento anexado e memória entre execuções
  • As APIs REST do seu sistema, e servidores MCP, como ferramentas
  • Linha direta com os Agentes de Canal, em linguagem natural
  • Documento analítico em HTML e PDF, enviado por e-mail
  • Histórico auditável, modo simulação e botão de parar
Definição

Um agente-mestre que roda a rotina de negócio

Os Agentes de Canal falam com o cliente. O Squad fala com os Agentes de Canal — e com os seus sistemas.

Squad é o agente orquestrador da plataforma. Ele não tem número de WhatsApp, não tem webchat e não recebe mensagem de cliente. O trabalho dele é outro: sustentar uma rotina de negócio inteira, do começo ao fim, sem alguém precisar lembrar de puxar o gatilho.

Você entrega a ele três coisas — o contexto do processo, o conhecimento da operação e as ferramentas (os endpoints do seu ERP, do prontuário, do sistema de pedidos, além de servidores MCP). A partir daí não existe árvore de decisão desenhada: a cada turno o Squad escolhe o que fazer, inclusive concluir que não há nada a fazer.

  • Sem canal próprio. Quando é preciso falar com uma pessoa, quem fala é o Agente de Canal — com a personalidade, a memória e as ferramentas que já estão configuradas nele.
  • Com agenda própria. O Squad tem horários definidos e também agenda tarefas para si mesmo durante a conversa com o gestor.
  • Com memória. A execução de hoje sabe o que aconteceu na de ontem. É a mesma tecnologia de memória e contexto que está na patente depositada no USPTO.

Automação por gatilho

  • Alguém desenha a árvore de decisão antes. O que não estava no desenho não acontece.
  • Dispara para a lista inteira, inclusive para quem já respondeu ontem.
  • O gatilho não sabe se valia a pena agir — ele só sabe que a hora chegou.
  • Mudou a regra do negócio? Alguém precisa redesenhar o fluxo.
  • O que aconteceu fica espalhado em log de sistema, em linguagem de máquina.

Squad orquestrador

  • Recebe contexto, conhecimento e ferramentas, e decide o que fazer a cada turno.
  • Pergunta ao Agente de Canal e aceita “não precisa” como resposta legítima.
  • Lê a situação primeiro. Não agir, quando não há o que fazer, é o resultado certo.
  • Mudou a regra? O gestor conversa com o Squad e o Squad se reconfigura.
  • Cada execução termina com um desfecho declarado por escrito, em português.

É assim que um Squad aparece para quem administra a operação: um cartão por rotina, dizendo quando ele rodou, quando roda de novo e a quantos Agentes de Canal ele pode dar ordem.

Hal-AI · Squads (Orquestradores) Console
Squads (Orquestradores) Agentes-mestre que rodam rotinas em background e delegam aos seus agentes de canal.
Confirmação de Exames
Em ExecuçãoAgenda · seg-sex06:00, 14:00
último hoje 06:00 próximo hoje 14:00 3 agentes alvo multi-agentes
Execução #47 Agenda · 2min14s api_get_agendamentos → 18 disparo(s) · simulação
Simulação
Cobrança Diária
AtivoAgenda · seg-sex08:00, 14:00
Confere o que venceu, avisa quem ainda não foi avisado e publica o fechamento do dia.
último hoje 08:00 próximo hoje 14:00 2 agentes alvo multi-agentes
Teto de disparos/execução · 200
Ronda de Estoque · Rota 12
PausadoManual
Criado ontem pelo gestor. Ainda em ajuste de contexto, sem agenda definida.
último nunca executou próximo sem execução programada 1 agente alvo multi-agentes
Desativado

O que você está vendo

Três Squads na mesma lista. Em Confirmação de Exames, a faixa acesa é a execução #47 acontecendo agora: 2min14s de duração, 18 disparos até o momento, o aviso de modo simulação e o botão de parar sempre à vista. Cobrança Diária está ativo, de segunda a sexta às 08:00 e às 14:00, com teto de 200 disparos por execução; Ronda de Estoque foi criado ontem, nunca executou e segue desativado.

Todo cartão repete a mesma linha: última execução, próxima execução, quantos Agentes de Canal aquele Squad pode acionar e se o leque de subagentes está ligado.

A vantagem

Um relance na lista responde o que hoje se responde perguntando para alguém: qual rotina rodou de madrugada, qual volta a rodar às 14:00, qual está parada e desde quando. Ninguém precisa lembrar de puxar o gatilho, e ninguém precisa abrir uma execução para descobrir que ela existiu.

O teto de disparos e o modo simulação também estão declarados no cartão, antes de qualquer mensagem sair — o limite do que aquela rotina pode fazer é visível sem entrar na configuração.

Só na Hal-AI

O cartão Ronda de Estoque foi criado ontem e ainda está em ajuste de contexto — ajuste que o gestor faz conversando com o próprio Squad, e não desenhando fluxo numa tela. Ele descreve a rotina, pede que o Squad leia a documentação da fonte e implemente os endpoints como ferramentas, combina o horário. O Squad também agenda tarefas para si mesmo.

Uma automação de fluxo só existe depois que alguém souber montar o fluxo. Aqui a rotina nasce de uma conversa em português.

Anatomia

Como uma execução acontece

Nove momentos de uma execução agendada, do despertar ao desfecho declarado.

1

Acorda no horário

A agenda é do próprio Squad. Ninguém abre a plataforma, ninguém clica. No horário definido, a execução começa — de madrugada, de manhã cedo, várias vezes por dia, como o processo exigir.

2

Lê o próprio contexto

Antes de qualquer coisa, ele recupera o contexto principal do processo, o conhecimento anexado e a memória das execuções anteriores. Sabe o que já foi feito, o que ficou pendente e o que não vale repetir.

3

Consulta as APIs do seu sistema

Chama os endpoints REST que você cadastrou — ERP, prontuário, sistema de pedidos — com os cabeçalhos de autenticação da sua operação, e também servidores MCP. O dado vem da fonte, no instante da execução.

4

Decide o que vale fazer

Com o quadro real na mão, ele julga: quais casos merecem ação agora, quais podem esperar, quais já foram resolvidos por outro caminho. Acordar não é ordem de agir.

5

Conversa com os Agentes de Canal

Para o que precisa de contato humano, o Squad escreve uma ordem em linguagem natural ao Agente de Canal — não um payload, não um gatilho. O agente de WhatsApp ou de webchat faz o atendimento 1:1 com a própria personalidade.

6

Recebe a resposta de volta

Não é despachar e esquecer. O Agente de Canal responde o que fez, o que não fez e por quê — e essa resposta volta para o raciocínio do Squad antes do relatório ser escrito.

7

Publica o documento

O Squad escreve um documento analítico com seções, tabelas montadas por referência ao dado da API e gráficos desenhados pelo servidor. Sai em HTML e em PDF, inteiro, sem reticências.

8

Envia por e-mail

O envio vai apenas para destinatários previamente autorizados numa lista fechada, conferida duas vezes antes de sair. O Squad não escolhe para quem manda, e não edita a lista.

9

Declara o desfecho

A execução termina com um desfecho escrito: o que foi verificado, o que foi acionado, o que foi deixado de lado e por quê. Fica no histórico auditável, execução por execução.

Do lado de dentro, uma execução não é uma caixa-preta: é um log carimbado por horário, o leque de subagentes que foi recrutado, o diálogo com cada Agente de Canal e um desfecho declarado no fim.

Hal-AI · Squad · Confirmação de Exames Execuções
Em Execução Execução #47 · via agenda Rodada 3 de 20
06:00:02Contexto carregado — 4 APIs disponíveis 06:00:04api_get_agendamentos(data=amanha) 06:00:0724 agendamentos sem confirmação; 6 já confirmados ontem 06:00:11leque de subagentes aberto — 4 lote(s) em paralelo 06:00:26Relatório publicado 06:00:313 contatos fora da janela de 24h — exigem template aprovado 06:00:33api_post_nota — 502, repetindo 06:00:38Aguardando agentes de canal
18 disparo(s) · 9 enviado(s) · 3 pulado(s) simulação
Subagentes recrutados 4 lote(s) · 4 entregue(s)
Lote 1 · agendamentos de amanhã leitura · esforço alto 3 rodada(s) api_get_agendamento · api_get_preparo entregue Lote 2 · retornos em atraso leitura · esforço médio 2 rodada(s) api_get_historico entregue
Conversa com os agentes de canal 12 alvo(s) · 9 enviado(s) · 3 pulado(s)
Agente Recepção · WhatsApp “confirme com os 12 pacientes agendados para amanhã” 9 conversas iniciadas; 3 já haviam confirmado ontem enviado Agente Retorno · Webchat “avise os 3 que estão fora da janela de 24h” fora da janela — só com template aprovado não disparado
Confirmação de Exames — execução #47 PDF · confirmacao-exames-47.pdf · 214 KB Abrir documento
Histórico de execuções do Squad Confirmação de Exames nos últimos 7 dias
#GatilhoDesfechoDisparosInício
47via agendaEm execução sim.18hoje 06:00
46via botãoAgiu31ontem 14:00
45via agendaVerificou · sem ação0ontem 06:00
44auto-agendadaNada vencia022/08 06:00
43via API Hal-AIFalhou021/08 14:00
Total do período49

O que você está vendo

O console de cima é a execução #47 em andamento, disparada pela agenda das 06:00 e já na terceira rodada. Cada linha traz o horário: a chamada da API de agendamentos, a leitura de que 24 casos estavam sem confirmação, a abertura do leque de subagentes em quatro lotes paralelos, a publicação do relatório, o aviso de que três contatos estão fora da janela de 24 horas e até a falha de uma chamada com repetição automática.

Abaixo, o diálogo aparece nos dois níveis: os quatro subagentes recrutados, com o número de rodadas e as ferramentas de leitura que cada um chamou, e a conversa com os Agentes de Canal — o de WhatsApp iniciou nove conversas e devolveu que três pacientes já haviam confirmado ontem; o de webchat respondeu “não disparado”, porque aqueles contatos só podem ser abordados por template aprovado.

A tabela fecha o argumento. Cinco execuções em sete dias, cada uma com o gatilho que a iniciou e um desfecho escrito: Agiu, Verificou · sem ação, Nada vencia e Falhou são resultados diferentes, e a plataforma não trata uma execução que decidiu não agir como se fosse um erro.

A vantagem

  • Quem supervisiona abre a execução e reconstrói a decisão sozinho, sem pedir log para a TI
  • O desfecho vem escrito em português: quem lê o histórico entende a decisão sem traduzir código de sistema
  • A falha aparece na própria linha do tempo, com a repetição automática, em vez de virar silêncio
  • Os três contatos fora da janela de 24h ficam registrados como pulados, com o motivo — não somem no total de enviados

Só na Hal-AI

Repare na resposta do Agente de Canal: três já haviam confirmado ontem. Ninguém programou essa exceção. O agente lembra da conversa porque a memória é dele — histórico vetorizado, fatos episódicos sobre o cliente e noção de tempo, a mesma tecnologia no WhatsApp, no webchat e no atendimento por voz. É o objeto da patente depositada no USPTO em 2025.

Uma automação de fluxo recomeça do zero toda manhã e reenvia porque não lembra de nada.

A2A

Agente que aciona agente

A ordem vai em português. A resposta volta em português. E a resposta pode ser um “não fiz, e aqui está o motivo”.

Entre o orquestrador e o agente que atende não existe formato rígido de mensagem. O Squad descreve a missão como um gestor descreveria a um funcionário, e o Agente de Canal responde como um funcionário responderia: com o resultado e com as exceções.

Isso muda o comportamento na prática. O agente que atende conhece o histórico daquele cliente — porque a memória é dele — e por isso consegue recusar uma ação que não faz sentido, em vez de executá-la porque a regra mandou.

  • A ordem é uma intenção, não um comando. O agente decide como cumprir dentro das ferramentas que tem.
  • A recusa é informação. “Já confirmou ontem” entra no relatório como fato, não some como erro.
  • A trava de reenvio é ancorada na ocorrência, não no nome do template: a plataforma sabe quem já recebeu aquilo e não insiste.
Squad · Confirmação de agenda falando com o Agente de Canal
Bom dia. Levantei os agendamentos de amanhã que ainda estão sem confirmação. Fale com cada cliente pelo WhatsApp, confirme presença e me devolva quem confirmou, quem remarcou e quem não respondeu.06:02
Entendido. Já iniciei as conversas.06:03
Em três casos eu não disparei nada: o cliente já confirmou ontem por aqui mesmo. Reenviar seria insistir sem motivo.06:04
Certo, deixe esses três como confirmados. Me devolva o consolidado às 09:00 para eu montar o relatório do dia.06:05

Diálogo entre um Squad e um Agente de Canal.

Mockup de conversa no aplicativo Buscar Fretes: o cliente pergunta se tem frete de soja saindo do Pará; o agente responde que está buscando no sistema e retorna em breve; depois o agente volta e diz: Olá, aqui é o Áilton, achei um frete para você.
Do outro lado da ordem do Squad está uma conversa 1:1 como esta — o Agente de Canal consulta o sistema do cliente e volta sozinho quando tem resposta.
Capacidade opcional

O leque de subagentes

Análise caso a caso, em paralelo — em vez de um resumo estatístico do conjunto.

Quando o Squad precisa olhar de perto muitos casos, ele abre um leque: dezenas de leituras simultâneas, uma por caso, cada uma com raciocínio próprio. Paciente por paciente. Pedido por pedido. Contrato por contrato.

Um raciocínio por caso

Cada subagente recebe um caso e só aquele caso. Ele lê a evidência, confere o que está sendo afirmado e conclui sobre aquele registro — sem diluir o caso difícil na média do lote.

Resposta validada contra schema

O formato da resposta é declarado antes como JSON Schema. O que volta é conferido contra ele — e entra direto na tabela do relatório, sem o modelo redigitar nenhum número no meio do caminho.

Só herdam ferramentas de leitura

No universo de um subagente não existe escrever, enviar e-mail ou disparar mensagem. Essas ferramentas simplesmente não estão lá. Analisar é tudo o que ele pode fazer.

Em paralelo, não em fila

As leituras são despachadas ao mesmo tempo. É o que torna viável analisar um lote grande dentro da janela de uma execução agendada, em vez de varrer caso a caso durante horas.

Você liga e desliga por Squad

É uma capacidade opcional, definida em cada Squad. Rotinas de verificação simples não precisam dela; rotinas de análise clínica, fiscal ou de crédito costumam precisar.

É o item mais caro da execução

A plataforma avisa isso na própria tela, antes de você ligar. Dezenas de raciocínios paralelos consomem muito mais que uma leitura única — e o consumo aparece discriminado por agente e por módulo no painel.

Um leque aberto tem esta cara por dentro: dezenas de casos despachados no mesmo instante, um subagente por caso, cada cartão com a conclusão daquele registro — e, ao lado, o contador de lote.

Hal-AI · Squad · Leque de subagentes Execução #47
Leque de subagentes 42 casos analisados em paralelo nesta execução — um raciocínio por caso, nenhum resumo do conjunto.
Leque aberto 42 caso(s) · 4 lote(s) · 38s 31 entregue(s) · 11 em análise · 0 com ferramenta de escrita
Caso 4471 · ressonância
EntregueLote 1
Preparo de jejum não consta como lido. Conclusão: reforçar a orientação no contato.
Caso 4472 · retorno clínico
EntregueLote 1
Confirmado ontem pelo próprio paciente. Conclusão: não precisa de novo contato.
Caso 4473 · exame de sangue
EntregueLote 1ressalva
Pedido médico com 40 dias. Conclusão: exige requisição nova antes de confirmar.
Caso 4474 · ultrassom
Em análiseLote 3
Lendo o histórico de remarcações do registro antes de concluir.
Caso 4475 · tomografia
EntregueLote 4ressalva
Convênio pede autorização prévia e não há guia registrada. Conclusão: segurar o contato.
Caso 4476 · retorno ortopedia
EntregueLote 2
Sem pendência no registro. Conclusão: confirmação simples resolve.
Caso 4477 · endoscopia
Em análiseLote 3
Conferindo preparo e exigência de acompanhante para o procedimento.
Caso 4478 · mamografia
EntregueLote 2ressalva
Último contato fora da janela de 24h. Conclusão: só com template aprovado.
Caso 4479 · consulta de rotina
Em análiseLote 4
Comparando com o que a execução de ontem já havia verificado neste caso.
Mais 33 casos no mesmo leque
Em paraleloLotes 1 a 4
Um subagente por caso, todos despachados no mesmo instante — não em fila.
Resposta validada contra schema JSON Schema declarado antes · 31 conferida(s) · 0 fora do formato campos: caso · conclusão · evidência · precisa_de_contato (booleano)
Ferramentas herdadas pelos subagentes só leitura — escrever, enviar e disparar não existem neste universo

O que você está vendo

Uma única execução com o leque aberto: 42 casos, um cartão por subagente, cada um com o caso que recebeu, o estado — Entregue ou Em análise — e a conclusão daquele registro em uma linha. À esquerda, o contador de lote acompanha lote a lote: 24 de 24, 8 de 8, 6 de 10 e 0 de 4 ainda na fila.

Abaixo da grade estão as duas garantias: as 31 respostas entregues foram conferidas contra o schema declarado antes, e a fila de ferramentas mostra em verde só as de leitura — as de escrever, enviar nota e mandar e-mail aparecem apagadas.

A vantagem

O caso difícil não some na média do lote. O pedido médico vencido, a guia de convênio que falta e o contato fora da janela de 24 horas viram três conclusões separadas, cada uma com o motivo — em vez de um número agregado dizendo que “5 casos exigem atenção”.

Como o formato da resposta é conferido contra schema, cada conclusão entra direto na tabela do relatório, sem ninguém redigitar nada no meio do caminho.

Só na Hal-AI

Repare no que está apagado na fila de ferramentas: no universo de um subagente não existe escrever, enviar mensagem ou mandar e-mail — essas ferramentas simplesmente não foram herdadas. Analisar é tudo o que ele pode fazer.

Quem decide o que fazer com as conclusões é o Squad, e quem fala com uma pessoa continua sendo o Agente de Canal.

Postura

O mesmo Squad, dois modos

Falando com o gestor, ele se reconfigura. Rodando sozinho, ele não aceita ser reconfigurado.

Modo 1

Chat com o gestor

O gestor abre uma conversa com o Squad e ajusta o processo falando. Não há tela de fluxo para desenhar.

  • Define o contexto principal e o conhecimento da rotina
  • Ajusta a própria agenda — inclusive criando tarefas para si mesmo
  • Lê a documentação de uma fonte, lista os endpoints disponíveis e implementa as ferramentas
  • Roda em modo simulação para você ver o que aconteceria

Auto-configuração liberada: aqui quem fala é uma pessoa autenticada da sua empresa.

Modo 2

Execução automática

Na rotina agendada, o Squad opera sobre dados que vieram de fora — respostas de API, mensagens de cliente, conteúdo de documento.

  • Todo dado de entrada é tratado como não confiável
  • Auto-configuração bloqueada: nada do que ele lê pode alterar o que ele é
  • Instrução embutida em conteúdo de terceiro não vira ordem
  • Só as ferramentas previamente autorizadas estão ao alcance

É a diferença entre um agente que aceita instrução do gestor e um agente que aceitaria instrução de qualquer texto que leu.

Entregável

O relatório que o agente escreve

Não é um export de planilha com um texto por cima. É um documento analítico redigido pelo Squad sobre o que ele acabou de apurar.

9 tipos de gráfico desenhados pelo servidor, não pelo modelo
HTML + PDF o mesmo documento na tela e no anexo do e-mail
Lista fechada o envio só alcança destinatários previamente autorizados

Seções, e não um bloco de texto

O documento tem estrutura: contexto do período, o que foi verificado, os casos que exigiram ação, as exceções e a conclusão. Sai inteiro, sem cortes e sem “…” no meio de uma tabela.

Tabela por referência

As linhas apontam para o dado que veio da API. O modelo não redigita número: ele referencia a fonte. É o que impede que um valor mude de forma silenciosa entre a consulta e o relatório.

Gráfico desenhado pelo servidor

Nove tipos de gráfico são renderizados no servidor a partir dos dados — não são imagens inventadas pelo modelo. Se um gráfico tem conta por fazer, o documento é recusado em vez de sair errado.

Entrega por e-mail, com anexo

O PDF é gerado no servidor e enviado à lista fechada de destinatários, conferida duas vezes antes do disparo. Todo número que aparece no corpo do e-mail existe no documento.

Governança

Controles para um agente que age sozinho

Autonomia sem freio não é produto. O que segura um Squad é a mesma coisa que o torna aceitável em produção.

Histórico auditável

Cada execução guarda o que foi consultado, o que foi decidido, o que foi acionado e o desfecho declarado. Dá para abrir a execução de duas semanas atrás e entender a decisão.

Trava anti-reenvio

Ancorada na ocorrência, não no nome do template. Se aquele cliente já recebeu aquilo por aquele motivo, o Squad não insiste — e registra que não insistiu.

Modo simulação

A execução roda inteira e mostra o que teria feito, sem falar com ninguém e sem enviar nada. É como se coloca um Squad novo em produção sem susto.

Botão de parar

Uma execução em andamento pode ser interrompida pelo gestor. Não existe rotina que só termina quando ela quiser.

Consultas curadas

O agente não escreve consulta livre no banco. Ele usa consultas parametrizadas e curadas, com allowlist positiva do que pode ser feito — o que não está liberado não existe para ele.

Recusa em vez de improviso

Documento sem conteúdo, ou com conta por fazer no gráfico, é recusado — não é limpo em silêncio para parecer que deu certo.

Escritório em planta aberta com estações de atendimento
O Squad trabalha ao lado da operação humana: quem supervisiona continua vendo tudo o que ele fez, execução por execução.
Perguntas frequentes

O que costumam perguntar sobre Squads

Um Squad substitui o agente que atende no WhatsApp?

Não. São papéis diferentes e complementares. O Agente de Canal é quem conversa com o cliente, com personalidade, memória e ferramentas próprias. O Squad não tem canal: ele coordena a rotina, consulta os sistemas, decide o que precisa de contato e pede ao Agente de Canal que faça esse contato — depois recolhe a resposta e escreve o relatório.

O Squad acordou, verificou e não fez nada. Deu errado?

Deu certo. Acordar não é ordem de agir. Uma execução que consultou os sistemas, avaliou os casos e concluiu que não havia o que fazer é uma execução bem-sucedida — e termina com esse desfecho declarado por escrito no histórico, para quem supervisiona conferir depois.

Como eu impeço que ele fale com a minha base inteira sem eu saber?

Por camadas. Na execução automática a auto-configuração fica bloqueada e o dado de entrada é tratado como não confiável. O Squad só alcança as ferramentas previamente autorizadas, a trava anti-reenvio é ancarada na ocorrência e o envio de e-mail só chega a uma lista fechada de destinatários. Antes de entrar no ar, você roda em modo simulação; depois de entrar, o botão de parar continua disponível.

Consigo disparar um Squad a partir do meu sistema?

Sim. A API pública Hal-AI é versionada, autenticada por chave, com escopos por recurso e chave de idempotência nos envios. Por ela dá para disparar uma execução de Squad, acompanhar o andamento, ler os logs e recuperar o desfecho declarado. Os detalhes estão em Integrações e API.

Qual rotina da sua empresa depende de alguém lembrar?

Traga o processo. A gente desenha o Squad com você: quais sistemas ele consulta, o que ele decide sozinho, com quais agentes ele fala e quem recebe o relatório.