Documentação

Como funciona o roteamento

Cada mensagem passa por um classificador que estima intenção e complexidade. Com base nisso, nas regras de roteamento ativas e no plano da organização, o roteador monta uma cadeia de modelos candidatos e escolhe o primeiro disponível. Se o provedor falhar ou estourar o rate limit, ele cai automaticamente para o próximo da cadeia.

Hoje há 61 modelos ativos no catálogo, distribuídos entre 15 provedores conectados: Google / Gemini, Anthropic / Claude, OpenAI / ChatGPT, xAI (Grok), Cerebras, DeepSeek, Groq, Together AI / Meta Llama, ElevenLabs, Mistral AI, OpenRouter, Genesis7.0 (local), Ghost, Apipromax (GPT), Apipromax (Gemini).

Créditos

Um crédito equivale a R$ 0,01 de valor de venda. Antes de executar, a plataforma reserva (hold) uma estimativa; ao final, libera a reserva e cobra o consumo real (settle). Tokens de raciocínio contam — em chamadas reais eles chegaram a 84% do total, e ignorá-los transformaria a margem em prejuízo.

Agentes

Um agente reúne prompt de sistema, cadeia de modelos, ferramentas liberadas, memória e teto de créditos por tarefa. Agentes são versionados: você edita um rascunho, testa e publica. É possível dividir tráfego entre versões para comparar resultados.

Sandbox, navegador e SSH

O código roda em container isolado por gVisor, sem acesso à rede interna da plataforma. O navegador é um Chromium controlado por Playwright dentro do mesmo sandbox. O deploy por SSH usa host-key pinning, bloqueia padrões destrutivos e exige aprovação humana explícita a cada execução.

Servidores MCP

Você pode plugar ferramentas externas pelo Model Context Protocol, por transporte HTTP ou por comando local. As ferramentas expostas ficam disponíveis para os agentes da organização.

Integração de cobrança

Pagamentos por Pix (com QR code) e cartão recorrente tokenizado. Os webhooks confirmam a quitação e disparam a renovação da franquia; faturas vencidas entram no fluxo de dunning com novas tentativas automáticas.