Ninja für Unternehmen

Die nächste Milliarde Mitarbeiter werden KI-Mitarbeiter sein

Eine unbegrenzte KI-Belegschaft ohne Volumeneinschränkung, die rund um die Uhr in Ihrer eigenen Cloud arbeitet. Sie erledigt Aufgaben von Anfang bis Ende, baut endlose Automatisierungen auf, entwickelt sich mit Ihrem Unternehmen weiter und arbeitet in Echtzeit mit Ihrem Team zusammen.

SaaS · VPC · On-Premise · Air-Gapped · Palo Alto, CA

Warum Ninja Enterprise

Ihre Cloud. Ihre Modelle. Unbegrenzt.

Vollständig in Ihrer VPC bereitgestellt, auf jeder Cloud

Ninja läuft vollständig in Ihrer eigenen Virtual Private Cloud auf Azure, AWS oder GCP, lokal oder komplett isoliert (Air-Gapped). Ihre Daten, Tools und Modelle bleiben hinter Ihrer Firewall. Betreiben Sie Open-Source-Modelle auf Ihren eigenen GPUs, ohne dass Informationen Ihre Umgebung verlassen. Wenn Sie ein Frontier-Modell wählen, erfolgt der einzige ausgehende Aufruf an den von Ihnen gewählten Endpunkt zu Ihren Bedingungen – niemals in einem gemeinsamen Pool und niemals zum Training verwendet.

Unbegrenzte Intelligenz auf Ihren eigenen GPUs

Betreiben Sie Open-Source-Modelle auf dedizierten GPUs und machen Sie Ninja unbegrenzt nutzbar. Keine Gebühren pro Nutzer, keine Abrechnung pro Token. Sie zahlen die stündlichen GPU-Kosten zuzüglich unserer Softwarelizenz pro GPU-Knoten: ein fester Posten, der auf Ihre bestehenden Cloud-Verpflichtungen angerechnet wird. Bei entsprechender Skalierung 5- bis 10-mal günstiger als nutzungsbasierte Frontier-Modelle.

Die Wirtschaftlichkeit

Ein fester Posten statt unkontrollierbarer Abrechnungen.

Preismodelle pro Nutzer oder Token bestrafen Sie für eine intensivere KI-Nutzung. Die Bereitstellung auf dedizierten GPUs bietet Fixkosten: Je mehr Ihre KI-Belegschaft leistet, desto mehr sparen Sie pro Arbeitseinheit.

Planbares Budget.

Ein Pauschalpreis pro GPU-Knoten, auf den Dollar genau kalkulierbar.

Finanziert durch Cloud-Commitments.

Anrechenbar auf Azure MACC, AWS EDP und GCP CUD – kein zusätzliches Budget erforderlich.

Skaliert ohne Zusatzkosten.

Konzentrieren Sie sich auf die Arbeit, nicht auf Rechnungen. Die Nutzung wird durch Ihre Hardware begrenzt, nicht durch einen Zähler.

Architektur

Ein in sich geschlossener Stack in Ihrer Umgebung.

Ninja wird als in sich geschlossener Stack in Ihrer Cloud oder On-Premise bereitgestellt – ohne eine Vielzahl ausgehender SaaS-Aufrufe. Alles, was ein Agent benötigt, läuft in der von Ihnen kontrollierten Umgebung.

LiteLLM fungiert als Steuerungsebene

Jedes Modell, jedes MCP-Tool, jede Sicherheitsrichtlinie und jedes Nutzungsprotokoll wird zentral registriert und verwaltet – so muss die Sicherheit nur eine Oberfläche prüfen, nicht fünfzig.

Caddy dient als zentraler Einstiegspunkt

Ein Integrations-Gateway verbindet MCP mit Ihren Anwendungen; jeder Agent läuft in einer eigenen isolierten Sandbox mit einem echten Browser (Phantoms).

Identitätsverwaltung via OIDC Single Sign-On

Tokens sind im Ruhezustand verschlüsselt (Fernet); ein integrierter Git-Server (Gitea) sorgt dafür, dass Code und Erkenntnisse das System nie verlassen. Unterstützende Dienste – Postgres, Redis, Message Queue sowie Prometheus und Grafana für Audits – bleiben vollständig intern.

Die einzige ausgehende Verbindung führt direkt zum Modell Ihrer Wahl

Betreiben Sie Open-Weight-Modelle (Kimi K2/K3, GLM 5.2) auf Ihren eigenen NVIDIA-GPUs – ganz ohne Datenausgang. Bei Nutzung eines Frontier-Modells ist dieser Endpunkt der einzige, prüfbare Ausgangspunkt.

Sicherheit

Gesteuert am Gateway. Isoliert nach Arbeitsbereich.

Ninja wurde für regulierte Umgebungen mit hohen Sicherheitsanforderungen entwickelt und dort bereitgestellt, wo Ihr Sicherheitsteam den vollen Überblick und die Kontrolle behält.

Innerhalb Ihres Perimeters

VPC, On-Premise oder vollständig isoliert (Air-Gapped). Eine dedizierte, isolierte VM pro Agent und Thread.

Ihre Kontrollen

SSO/SCIM, RBAC und vollständige Audit-Protokolle. Verschlüsselt bei Übertragung und Speicherung. Da Ninja innerhalb Ihres eigenen Perimeters läuft, gelten Ihre bestehenden SOC 2- und HIPAA-Kontrollen. SOC 2 Typ II in Bearbeitung; HIPAA-konforme Bereitstellungen innerhalb Ihrer BAA-abgedeckten Umgebung.

Ihre Daten, für immer

Ihre Daten werden niemals zum Training von Modellen Dritter verwendet. PHI und sensible Daten verbleiben innerhalb Ihrer Compliance-Grenzen.

Menschlich verifiziert

Eine Person bestätigt Aktionen mit hoher Tragweite, unterstützt durch ein vollständiges Audit-Protokoll und eine Live-Ansicht des Browser-Fensters des Agenten. Wir bieten die Kontrollmechanismen; wir behaupten nicht, dass Halluzinationen ausgeschlossen sind. Für regulierte Anwendungsbereiche erfordern die Ergebnisse des Agenten weiterhin eine menschliche Überprüfung.
HIPAA-konform
SSO/SCIM
RBAC
Audit-Protokolle
SOC 2 Typ II, in Bearbeitung

Bereitstellungspfad

Beweisen Sie es in einem Pilotprojekt. Betreiben Sie es in Ihrer eigenen Cloud.

Starten Sie mit einer verwalteten Lösung, beweisen Sie den Mehrwert an einem echten Workflow und verlagern Sie dann alles hinter Ihre Firewall.

Phase 1

Beweisen Sie es
SaaS-Pilot verwalten

Ihre KI-Belegschaft ist innerhalb einer Woche in Ihrem Slack einsatzbereit. Credit-basiert, vollständig verwaltet, sofort startklar. Beweisen Sie den Mehrwert zuerst an einem echten Workflow.
Phase 2

Selbst verwalten
Bereitstellung in Ihrer VPC

Wechseln Sie zu einer vollständig eigenen Bereitstellung auf dedizierten GPUs. Unbegrenzte Open-Source-Modelle, keine Credits, keine nutzerbasierten Gebühren. Softwarelizenz pro GPU-Knoten: ein pauschaler Posten.

Modelle

Die besten Modelle. Jede Cloud. KI, die Ihnen gehört.

Nutzen Sie die besten Frontier- und Open-Source-Modelle, wechseln Sie jederzeit und führen Sie Upgrades durch, sobald neue Versionen erscheinen. Niemand sonst bietet Ihnen diese Auswahl innerhalb Ihrer eigenen Cloud.

Frontier

über das Gateway
Claude Opus 5
Claude Fable 5
GPT-5.6

Open-Weight

selbst gehostet auf Ihren GPUs
Kimi K3
GLM 5.2
Jederzeit wechseln

Bringen Sie Ihre kritischsten Prüfer mit

Wir implementieren die Lösung hinter Ihrer Firewall, testen sie an Ihrem anspruchsvollsten Workflow und Sie skalieren anschließend. Lassen Sie uns den ersten Schritt machen.