Ninja pour les entreprises

Le prochain milliard d'employés sera composé d'employés IA

Une main-d'œuvre IA illimitée et sans compteur, opérationnelle 24h/24 et 7j/7 au sein de votre propre cloud. Elle exécute vos tâches de bout en bout, crée des automatisations infinies, s'adapte à votre entreprise et collabore avec votre équipe en temps réel.

SaaS · VPC · Sur site · Air-gapped · Palo Alto, Californie

Pourquoi choisir Ninja Enterprise

Votre cloud. Vos modèles. Sans compteur.

Déploiement complet dans votre VPC, sur n'importe quel cloud

Ninja s'exécute entièrement au sein de votre propre cloud privé virtuel sur Azure, AWS ou GCP, sur site, ou dans un environnement totalement isolé (air-gapped). Vos données, outils et modèles restent derrière votre pare-feu. Exécutez des modèles open source sur vos propres GPU sans qu'aucune donnée ne quitte votre périmètre ; si vous choisissez un modèle de pointe, le seul appel sortant est dirigé vers le point de terminaison de votre choix, selon vos conditions — jamais mutualisé, jamais utilisé pour l'entraînement.

Une intelligence illimitée sur vos propres GPU

Exécutez des modèles open source sur des GPU dédiés et offrez Ninja à tout le monde. Pas de frais par utilisateur, pas de compteur par jeton. Vous payez le coût horaire du GPU ainsi que notre licence logicielle par nœud GPU : un poste de dépense fixe qui s'impute sur vos engagements cloud existants. Un coût 5 à 10 fois inférieur aux solutions à la demande à grande échelle.

Le modèle économique

Un poste de dépense fixe, pas un compteur qui s'emballe.

La tarification à l'utilisateur ou au jeton vous pénalise à mesure que vous utilisez l'IA. Le déploiement sur GPU dédié est à coût fixe : plus votre main-d'œuvre IA est productive, plus vous économisez par unité de travail.

Un budget prévisible.

Un coût fixe par nœud GPU, prévisible au dollar près.

Financé par vos engagements cloud.

Éligible aux programmes Azure MACC, AWS EDP et GCP CUD — aucun budget supplémentaire requis.

Évolutivité sans pénalité.

Ajoutez du travail, pas des factures. L'utilisation est limitée par le matériel, pas par un compteur.

Architecture

Une pile autonome, dans votre environnement.

Ninja se déploie sous forme de pile autonome au sein de votre cloud ou sur site — et non comme une constellation d'appels SaaS sortants. Tout ce dont un agent a besoin s'exécute dans le système que vous contrôlez.

LiteLLM est le plan de contrôle

Chaque modèle, outil MCP, garde-fou et journal de dépenses est enregistré et gouverné en un seul endroit — ainsi, la sécurité n'a qu'une seule surface à examiner, et non cinquante.

Caddy est le point d'entrée unique

Une passerelle d'intégration relie MCP à vos applications ; chaque agent s'exécute dans son propre bac à sable isolé avec un véritable navigateur (Phantoms).

Identité via authentification unique OIDC

Jetons chiffrés au repos (Fernet) ; un serveur git intégré (Gitea) pour que le code et les apprentissages ne quittent jamais le système. Les services de support — Postgres, Redis, la file d'attente de messages, Prometheus + Grafana pour l'audit — restent tous en interne.

Le seul appel sortant est celui vers le modèle de votre choix

Exécutez des modèles à poids ouverts (Kimi K2/K3, GLM 5.2) sur vos propres GPU NVIDIA sans aucune sortie de données ; connectez-vous à un modèle de pointe et ce point de terminaison devient l'unique sortie auditable.

Sécurité

Gouverné à la passerelle. Isolé par espace de travail

Ninja est conçu pour les environnements hautement réglementés et sécurisés, déployé là où votre équipe de sécurité peut le superviser et le contrôler.

Au sein de votre périmètre

VPC, sur site ou totalement isolé (air-gapped). Une machine virtuelle dédiée et isolée par agent et par thread.

Vos contrôles

SSO/SCIM, RBAC et pistes d'audit complètes. Chiffrement en transit et au repos. Comme Ninja s'exécute au sein de votre propre périmètre, vos contrôles SOC 2 et HIPAA existants s'y appliquent. SOC 2 Type II en cours ; déploiements éligibles HIPAA au sein de votre environnement couvert par un BAA.

Vos données, pour toujours

Vos données ne servent jamais à entraîner le modèle de quiconque. Les informations de santé protégées (PHI) et les données sensibles restent dans votre périmètre de conformité.

Vérifié par l'humain

Une personne confirme les actions à fort impact, avec une piste d'audit complète et une vue en direct du navigateur de l'agent. Nous montrons les contrôles ; nous ne prétendons pas à une absence totale d'hallucinations. Pour un usage réglementé, les résultats de l'agent nécessitent toujours une vérification humaine.
Éligible HIPAA
SSO/SCIM
RBAC
Pistes d'audit
SOC 2 Type II, en cours

Parcours de déploiement

Prouvez-le lors d'un projet pilote. Maîtrisez-le dans votre cloud.

Commencez avec une solution gérée, prouvez sa valeur sur un flux de travail réel, puis déplacez le tout derrière votre pare-feu.

Phase 1

Prouvez-le
Gérer le projet pilote SaaS

Votre main-d'œuvre IA est opérationnelle dans votre Slack en une semaine. Basée sur des crédits, entièrement gérée et prête dès le premier jour. Prouvez d'abord sa valeur sur un flux de travail réel.
Phase 2

Gérez-le
Déployé dans votre VPC

Passez à un déploiement en pleine propriété sur des GPU dédiés. Modèles open source illimités, sans crédits ni frais par utilisateur. Licence logicielle par nœud GPU : un tarif forfaitaire unique.

Modèles

Les meilleurs modèles. N'importe quel cloud. Une IA qui vous appartient.

Utilisez les meilleurs modèles propriétaires et open source, changez à tout moment et mettez à niveau dès la sortie de nouvelles versions. Personne d'autre ne vous permet de choisir parmi tous ces modèles, au sein de votre propre cloud.

Frontier

via la passerelle
Claude Opus 5
Claude Fable 5
GPT-5.6

Poids ouverts

auto-hébergé sur vos GPU
Kimi K3
GLM 5.2
Changez à tout moment

Invitez votre critique le plus exigeant

Nous déployons derrière votre pare-feu, nous faisons nos preuves sur votre flux de travail le plus complexe, puis vous passez à l'échelle. Identifions le premier.