Ninja para empresas

O próximo bilhão de funcionários serão funcionários de IA

Uma força de trabalho de IA com inteligência ilimitada e sem medição, que opera 24 horas por dia, 7 dias por semana, dentro da sua própria nuvem. Ela conclui tarefas de ponta a ponta, cria automações infinitas, evolui de acordo com o seu negócio e colabora com sua equipe em tempo real.

SaaS · VPC · On-prem · Air-gapped · Palo Alto, CA

Por que o Ninja Enterprise

Sua nuvem. Seus modelos. Sem limites.

Totalmente implantado em sua VPC, em qualquer nuvem

O Ninja é executado inteiramente dentro da sua própria nuvem privada virtual no Azure, AWS ou GCP, ou localmente, ou em ambiente totalmente isolado (air-gapped). Seus dados, ferramentas e modelos permanecem atrás do seu firewall. Execute modelos de código aberto em suas próprias GPUs e nada sai do seu perímetro; escolha um modelo de fronteira e a única chamada de saída é para o endpoint que você definir, sob seus termos — nunca compartilhado, nunca usado para treinamento.

Inteligência sem limites em suas próprias GPUs

Execute modelos de código aberto em GPUs dedicadas e torne o Ninja ilimitado. Sem taxas por assento, sem cobrança por token. Você paga o custo da GPU por hora mais nossa licença de software por nó de GPU: um item de custo fixo que conta para seus compromissos de nuvem existentes. Custo de 5 a 10 vezes menor do que assentos de modelos de fronteira com cobrança variável em escala.

A economia

Um item de custo fixo, sem cobranças variáveis que saem do controle.

A precificação por assento e por token penaliza o uso intensivo de IA. A implantação em GPU dedicada tem custo fixo: quanto mais sua força de trabalho de IA produz, mais você economiza por unidade de trabalho.

Orçamento previsível.

Um custo fixo por nó de GPU, previsível até o último centavo.

Financiado por compromissos de nuvem.

Conta para Azure MACC, AWS EDP e GCP CUD — sem necessidade de novo orçamento.

Escala sem penalidades.

Adicione trabalho, não faturas. O uso é limitado pelo hardware, não por um medidor.

Arquitetura

Uma stack autônoma, no seu ambiente.

O Ninja é implantado como uma stack autônoma dentro da sua nuvem ou on-prem — não como uma constelação de chamadas SaaS externas. Tudo o que um agente precisa é executado no ambiente que você controla.

LiteLLM é o plano de controle

Cada modelo, ferramenta MCP, guardrail e log de gastos é registrado e governado em um só lugar — assim, a segurança analisa uma única superfície, não cinquenta.

Caddy é o ponto de entrada único

Um gateway de integração mapeia o MCP para seus aplicativos; cada agente é executado em seu próprio sandbox isolado com um navegador real (Phantoms).

Identidade via single sign-on OIDC

Tokens criptografados em repouso (Fernet); um servidor git integrado (Gitea) para que o código e os aprendizados nunca saiam do ambiente. Serviços de suporte — Postgres, Redis, fila de mensagens, Prometheus + Grafana para auditoria — permanecem todos internamente.

A única chamada de saída é para o modelo que você escolher

Execute modelos de pesos abertos (Kimi K2/K3, GLM 5.2) em suas próprias GPUs NVIDIA sem qualquer saída de dados; aponte para um modelo de fronteira e esse endpoint será a única saída auditável.

Segurança

Governado no gateway. Isolado por workspace

O Ninja foi projetado para ambientes regulamentados e de alta confiança, implantado onde sua equipe de segurança pode monitorá-lo e controlá-lo.

Dentro do seu perímetro

VPC, on-prem ou totalmente isolado (air-gapped). Uma VM dedicada e isolada por agente e thread.

Seus controles

SSO/SCIM, RBAC e trilhas de auditoria completas. Criptografado em trânsito e em repouso. Como o Ninja é executado dentro do seu próprio perímetro, seus controles SOC 2 e HIPAA existentes se aplicam a ele. SOC 2 Tipo II em andamento; implementações compatíveis com HIPAA dentro do seu ambiente coberto por BAA.

Seus dados, para sempre

Seus dados nunca treinam o modelo de ninguém. Informações de saúde protegidas (PHI) e dados confidenciais permanecem dentro do seu perímetro de conformidade.

Verificado por humanos

Uma pessoa confirma ações de alto impacto, com uma trilha de auditoria completa e visualização em tempo real do navegador do agente. Mostramos os controles; não prometemos zero alucinação. Para uso regulamentado, a saída do agente ainda requer verificação humana.
Compatível com HIPAA
SSO/SCIM
RBAC
Trilhas de auditoria
SOC 2 Tipo II, em andamento

Caminho de implementação

Comprove em um piloto. Tenha controle total na sua nuvem.

Comece com uma solução gerenciada, comprove o valor em um fluxo de trabalho real e, em seguida, mova tudo para trás do seu firewall.

Fase 1

Comprove
Gerenciar Piloto SaaS

Sua força de trabalho de IA estará ativa no seu Slack em uma semana. Baseado em créditos, totalmente gerenciado e pronto para uso imediato. Comprove o valor em um fluxo de trabalho real primeiro.
Fase 2

Gerencie você mesmo
Implantado em sua VPC

Migre para uma implementação própria em GPUs dedicadas. Modelos de código aberto sem limites, sem créditos, sem taxas por usuário. Licença de software por nó de GPU: um valor fixo único.

Modelos

Os melhores modelos. Qualquer nuvem. IA que você controla.

Execute os melhores modelos de fronteira e de código aberto, troque a qualquer momento e atualize conforme novos modelos forem lançados. Ninguém mais permite que você escolha entre todos eles, dentro da sua própria nuvem.

Frontier

via gateway
Claude Opus 5
Claude Fable 5
GPT-5.6

Open-weight

auto-hospedado em suas GPUs
Kimi K3
GLM 5.2
Troque a qualquer momento

Traga seu revisor mais rigoroso

Nós implementamos atrás do seu firewall, provamos no seu fluxo de trabalho mais difícil e depois você escala. Vamos encontrar o primeiro.