Microsserviços de IA
Agentes de IA que trabalham dentro da sua empresa.
Texto, voz e documentos. Implantados como microsserviços na sua nuvem ou em seus próprios servidores.
implantação on-prem ou na nuvem · rastreabilidade por resposta · integra com seu ERP
Conversa de exemplo. O usuário pergunta se a fatura FV-4471 da Cimentos do Norte já está paga. O agente consulta o ERP e responde: sim, paga em 12 de março por $4.280.000 COP, comprovante RC-9982. Restam 2 faturas em aberto deste cliente. Fonte: ERP, módulo Contas a Receber, consultado há 1 segundo.
fonte: ERP · módulo Contas a Receber · consultado há 1 s
Capacidades
Quatro capacidades, uma mesma arquitetura de microsserviço.
Cada aba roda com dados e chamadas de ferramentas reais: a fonte que o agente cita, o campo enviado para revisão, o passo que espera aprovação.
- Conecta-se aos seus sistemas por API: ERP, CRM, banco de dados, documentos.
- Cada resposta cita a fonte: sistema, módulo e momento da consulta.
Conversa de exemplo. O usuário pergunta quanto estoque há do SKU AC-2290 e se dá para o pedido de amanhã. O agente consulta o WMS e o ERP: o Depósito Norte tem 96 unidades, o Depósito Sul 18, total 114. O pedido PED-8843, de 90 unidades, despacha amanhã a partir do Depósito Sul e fica com falta de 72 unidades. O agente propõe transferir 75 unidades do Depósito Norte para o Depósito Sul hoje; sem a transferência, o pedido não sai completo amanhã. Fonte: WMS módulo Estoque e ERP módulo Pedidos, consultado há 1 segundo.
fonte: WMS · módulo Estoque + ERP · módulo Pedidos · consultado há 1 s
- Conecta-se aos seus sistemas por API: ERP, CRM, banco de dados, documentos.
- Cada resposta cita a fonte: sistema, módulo e momento da consulta.
Integrações
Conecta-se ao que sua empresa já usa.
Não substitui seus sistemas. Os agentes leem e escrevem diretamente no seu ERP, seu CRM, seus canais e seus documentos.
ERP e contabilidade
- SAP
- Oracle
- Dynamics 365
- Siigo
- World Office
CRM e vendas
- Salesforce
- HubSpot
- Zoho
Canais
- WhatsApp Business
- Slack
- Microsoft Teams
- Telefonia SIP
Dados e documentos
- PostgreSQL
- SQL Server
- Amazon S3
- SharePoint
- Google Drive
Não está na lista? Se tem API, banco de dados ou arquivos, conecta.
Arquitetura
O caminho completo de uma requisição, sem caixa-preta.
É assim que uma solicitação se move da sua aplicação até a resposta — e você decide onde o modelo roda.
Onde o modelo roda
Sua aplicação
Onde nasce a solicitação: seu site, seu app ou WhatsApp.
API gateway
Autentica, limita a taxa e audita cada chamada.
Orquestrador de agentes
Escolhe a ferramenta e aplica suas políticas.
Modelo local
Roda em GPU no seu datacenter; não sai da sua rede.
Conectores
Conversa com seu ERP, CRM e seus documentos.
Observabilidade
Cada solicitação fica rastreada, com custo e qualidade.
Segurança
As perguntas da sua revisão de segurança.
As seis que aparecem em toda avaliação de fornecedor, com a resposta técnica.
Onde o modelo é executado?
Na sua VPC ou nos seus próprios servidores, conforme exigir sua política de residência de dados. Em implantação local, a inferência ocorre dentro do seu perímetro: nem o prompt nem o documento o atravessam.
Como os dados são protegidos em trânsito e em repouso?
Ambos os estados são criptografados. A gestão de chaves permanece do lado do cliente; a Andes AI não guarda cópia do material criptográfico.
Uma resposta individual é auditável?
Sim. Cada resposta registra as ferramentas invocadas, os dados consultados e a versão do modelo que a produziu. O exemplo de trace está abaixo.
Nossos dados são usados para treinar modelos?
Não. Nem as conversas nem os documentos de um cliente alimentam o treinamento de modelos base nem de implantações de terceiros.
- request_id
- req_8f3a1c92e01d
- timestamp
- 2026-08-09T14:32:07Z
- user
- usr_4821 · rol: cartera
- tools_called
- erp.facturas.buscar, erp.pagos.consultar
- model
- andes-agent-2.4 · inferencia local
- decision
- answered — source cited
Empresas que já operam com a Andes AI
Como trabalhamos
Do diagnóstico à produção
Três etapas, cada uma com uma condição clara para avançar para a próxima.
Diagnóstico
1 a 2 semanasEntrega: Mapeamento dos seus processos, seus dados e o caso de uso com melhor retorno.
Precisa: Documentação do processo e uma sessão com a equipe que o opera.
Piloto
4 a 6 semanasEntrega: Um agente em produção delimitada, com métricas de sucesso combinadas.
Precisa: Acesso de teste a um sistema e um responsável por validar os resultados.
Produção
Implantação completaEntrega: Implantação completa, SLA, monitoramento e melhoria contínua.
Precisa: Aprovação de segurança e TI, e o canal de operação.
Em produção
PERGUNTAS FREQUENTES
O que se pergunta antes da primeira call.
O que é um microsserviço de IA e como difere de um chatbot?
Um microsserviço de IA é um serviço com API própria, versionada e observável, que executa trabalho dentro dos sistemas de uma empresa. A diferença para um chatbot é que não se limita a responder: consulta o ERP, escreve no CRM, extrai campos de um documento ou dispara um fluxo, e registra cada passo. O chatbot conversa; o microsserviço opera.
Onde o modelo roda e nossos dados saem da rede?
É implantado na VPC do cliente ou nos seus próprios servidores, conforme exigir sua política de residência de dados. Em implantação local, a inferência ocorre dentro do perímetro do cliente: nem o prompt nem o documento o atravessam. No modo nuvem, o modelo roda em infraestrutura gerida pelo provedor e os dados trafegam criptografados.
Com quais sistemas se integra?
ERP e contabilidade (SAP, Oracle, Dynamics 365, Siigo, World Office), CRM (Salesforce, HubSpot, Zoho), canais (WhatsApp Business, Slack, Microsoft Teams, e-mail, telefonia SIP) e fontes de dados e documentos (PostgreSQL, SQL Server, Amazon S3, SharePoint, Google Drive). Se um sistema expõe API, banco de dados ou arquivos, dá para conectar.
Quanto tempo leva ter um agente em produção?
O diagnóstico leva de uma a duas semanas e termina com o mapa de processos e o caso de melhor retorno. O piloto leva de quatro a seis semanas e deixa um agente em produção delimitada, com métricas de sucesso acordadas antes de começar. A produção completa depende do escopo e das aprovações de segurança e TI do cliente.
Nossos dados são usados para treinar modelos?
Não. Nem as conversas nem os documentos de um cliente alimentam o treinamento de modelos base ou de implantações de terceiros. Cada tenant opera em um espaço isolado, com credenciais e armazenamento próprios, e não há rotas de leitura entre tenants.
É possível auditar o que o agente fez em uma resposta específica?
Sim. Cada resposta registra as ferramentas que invocou, os dados que consultou, a versão do modelo que a produziu e a decisão final. O agente opera ainda com as permissões do usuário que faz a consulta: herda o controle de acesso dos sistemas do cliente e não mantém um modelo de acesso paralelo.
Precisa do detalhe técnico de cada capacidade?
Ver serviçosPróximo passo
Agende uma demo com seu caso de uso
Mostramos como um agente resolve um processo real da sua operação em uma chamada de 30 minutos.
30 minutos · videochamada








