Ninja per le aziende

Il prossimo miliardo di dipendenti saranno dipendenti AI

Una forza lavoro AI illimitata e senza vincoli di utilizzo, operativa 24/7 all'interno del tuo cloud. Completa il lavoro dall'inizio alla fine, crea automazioni infinite, si evolve in base alla tua attività e collabora con il tuo team in tempo reale.

SaaS · VPC · On-prem · Air-gapped · Palo Alto, CA

Perché Ninja Enterprise

Il tuo cloud. I tuoi modelli. Senza limiti.

Completamente distribuito nel tuo VPC, su qualsiasi cloud

Ninja viene eseguito interamente all'interno del tuo cloud privato virtuale su Azure, AWS o GCP, oppure on-premise o in ambienti completamente isolati (air-gapped). I tuoi dati, strumenti e modelli rimangono dietro il tuo firewall. Esegui modelli open source sulle tue GPU senza che nulla esca dal tuo perimetro; se scegli un modello frontier, l'unica chiamata in uscita è verso l'endpoint che hai selezionato, alle tue condizioni: nessun dato viene condiviso o utilizzato per l'addestramento.

Intelligenza senza limiti sulle tue GPU

Esegui modelli open source su GPU dedicate e rendi Ninja illimitato. Nessun costo per utente, nessun contatore per token. Paghi il costo orario della GPU più la nostra licenza software per nodo GPU: una voce di costo fissa che rientra nei tuoi impegni cloud esistenti. Costi inferiori di 5-10 volte rispetto alle soluzioni a consumo su larga scala.

L'aspetto economico

Una voce di costo fissa, non un contatore fuori controllo.

I prezzi basati su licenze per utente e consumo di token penalizzano l'utilizzo dell'IA. Il deployment su GPU dedicata ha un costo fisso: più la tua forza lavoro IA è attiva, più risparmi per singola unità di lavoro.

Budget prevedibile.

Un costo fisso per nodo GPU, prevedibile al centesimo.

Finanziato tramite cloud commit.

Conteggiato ai fini di Azure MACC, AWS EDP e GCP CUD: nessun nuovo budget richiesto.

Scala senza costi aggiuntivi.

Aggiungi lavoro, non fatture. L'utilizzo è limitato dall'hardware, non da un contatore.

Architettura

Uno stack autonomo, nel tuo ambiente.

Ninja si distribuisce come uno stack autonomo all'interno del tuo cloud o on-prem, non come una costellazione di chiamate SaaS in uscita. Tutto ciò di cui un agente ha bisogno viene eseguito nel sistema che controlli.

LiteLLM è il piano di controllo

Ogni modello, strumento MCP, guardrail e registro di spesa è registrato e gestito in un unico posto: così la sicurezza revisiona una sola superficie, non cinquanta.

Caddy è l'unico punto di ingresso

Un gateway di integrazione mappa MCP alle tue app; ogni agente viene eseguito nel proprio sandbox isolato con un browser reale (Phantoms).

Identità tramite single sign-on OIDC

Token crittografati a riposo (Fernet); un server git integrato (Gitea) affinché codice e apprendimenti non lascino mai il sistema. I servizi di supporto — Postgres, Redis, la coda dei messaggi, Prometheus + Grafana per l'audit — rimangono tutti all'interno.

L'unica chiamata in uscita è verso il modello scelto

Esegui modelli open-weight (Kimi K2/K3, GLM 5.2) sulle tue GPU NVIDIA senza alcun traffico in uscita; punta a un modello frontier e quell'endpoint sarà l'unica uscita verificabile.

Sicurezza

Gestito dal gateway. Isolato per area di lavoro

Ninja è progettato per ambienti regolamentati ad alta affidabilità, distribuito dove il tuo team di sicurezza può monitorarlo e controllarlo.

All'interno del tuo perimetro

VPC, on-prem o completamente air-gapped. Una VM dedicata e isolata per ogni agente e thread.

I tuoi controlli

SSO/SCIM, RBAC e audit trail completi. Crittografia in transito e a riposo. Poiché Ninja viene eseguito all'interno del tuo perimetro, si applicano i tuoi controlli SOC 2 e HIPAA esistenti. SOC 2 Type II in corso; implementazioni conformi a HIPAA all'interno del tuo ambiente coperto da BAA.

I tuoi dati, per sempre

I tuoi dati non addestrano mai il modello di nessuno. I dati PHI e sensibili rimangono all'interno del tuo perimetro di conformità.

Verificato dall'uomo

Una persona conferma le azioni ad alto impatto, con un audit trail completo e una visualizzazione in tempo reale del browser dell'agente. Mostriamo i controlli; non promettiamo l'assenza di allucinazioni. Per utilizzi regolamentati, l'output dell'agente richiede sempre una verifica umana.
Conforme a HIPAA
SSO/SCIM
RBAC
Audit trail
SOC 2 Type II, in corso

Percorso di implementazione

Dimostralo con un progetto pilota. Gestiscilo nel tuo cloud.

Inizia con la versione gestita, dimostra il valore su un flusso di lavoro reale e poi sposta tutto dietro il tuo firewall.

Fase 1

Mettilo alla prova
Gestisci il progetto pilota SaaS

La tua forza lavoro AI sarà operativa su Slack entro una settimana. Basata su crediti, completamente gestita, pronta fin dal primo giorno. Dimostra il valore su un flusso di lavoro reale.
Fase 2

Gestiscilo
Distribuito nel tuo VPC

Passa a un'implementazione di proprietà su GPU dedicate. Modelli open source senza limiti, niente crediti, nessuna tariffa per utente. Licenza software per nodo GPU: un unico costo fisso.

Modelli

I migliori modelli. Qualsiasi cloud. L'IA che possiedi.

Utilizza i migliori modelli frontier e open source, cambia quando vuoi ed effettua l'upgrade non appena ne escono di nuovi. Nessun altro ti permette di scegliere tra tutti questi, all'interno del tuo cloud.

Frontier

tramite il gateway
Claude Opus 5
Claude Fable 5
GPT-5.6

Open-weight

self-hosted sulle tue GPU
Kimi K3
GLM 5.2
Cambia quando vuoi

Coinvolgi il tuo revisore più rigoroso

Implementiamo dietro il tuo firewall, lo dimostriamo sul tuo flusso di lavoro più complesso e poi procediamo con la scalabilità. Troviamo il primo.