KI:KUBE

Produkt

Eine Box. Strom. LAN. Browser. Läuft.

Die KI:KUBE ist keine Softwarelizenz und kein Cloud-Account, sondern eine vorkonfigurierte Hardware-Appliance. Was drin ist, wie sie arbeitet, was Sie an Tag 1 und Tag 2 erleben.

Spezifikationen

Hardware in Zahlen

Compute
4× DGX Spark
GPU-Memory (gesamt)
512 GB Unified
Inference-Leistung (theoretisch)
~4 PFLOPS FP4 (Sparse) / ~1 PFLOP INT8 dense
Inference-Leistung (gemessen)
438 tok/s n=8 @ Qwen3.6-35B-A3B-NVFP4 (4-Node, 2026-05-22) · 426 tok/s @ FP8-Variante
Internes Netz
MikroTik 400GbE-Switch (QSFP56-DD), je Spark 200 GbE
Formfaktor
19-Zoll-Rack, 18 HE (einheitlich für KI:KUBE 2 / 4 / 6 / 8)*
Leistungsaufnahme
~0,6 kW unter Inferenz-Volllast (KI:KUBE 4, gemessen); im Leerlauf deutlich darunter
Schnittstelle nach außen
1× / 2× 10 GbE LAN
Stromanschluss
1× Schuko 16A genügt (alle Stufen); optional 2× Schuko für Redundanz

Konkrete Werte abhängig von Konfiguration und Lieferzeitpunkt, verbindlich im Angebot.

* Gilt für KI:KUBE 2 / 4 / 6 / 8 im einheitlichen 18-HE-Rack. Die KI:KUBE 2-slim (2 Sparks) ist als kompakte 10-Zoll-Variante erhältlich: abweichender Formfaktor, ohne 400GbE-Inference-Switch.

Neu · Optional Zusatzmodul zu jeder KI:KUBE

KI:KUBE Companion

Die KI:KUBE denkt, der Companion handelt.

Der KI:KUBE Companion bringt die agentische Schicht auf die KI:KUBE: einen persönlichen KI-Agenten je Nutzer, der Aufgaben ausführt, statt nur zu chatten, Mails triagieren, Briefings schreiben, recherchieren, Routine abarbeiten. Er läuft auf einem eigenen, stromsparenden Gerät und richtet seine Inferenz auf die KI:KUBE: kein Token muß das Haus verlassen.

Der Wirt des Agenten, nicht sein Rechenwerk

Der Companion ist der Wirt des Agenten, die eigentliche Rechenarbeit macht weiterhin die KI:KUBE. Die Inferenz läuft auf der eigenen KI:KUBE, kein Token in der Cloud. Der Companion ersetzt die KI:KUBE nicht, er setzt auf ihr auf.

Warum ein eigenes Gerät

Ein dedizierter, dauerhaft erreichbarer Host: geplante Aufgaben und eingehende Nachrichten laufen, auch wenn der Arbeits-PC aus ist. Je Nutzer sauber getrennt, sehr geringe Angriffsfläche, statt einer Installation auf dem Arbeitsrechner.

Zwei Aufstellformen zur Wahl

Am Arbeitsplatz

Verteilt am Schreibtisch

Je Nutzer ein kompaktes Gerät (Mini-Rechner mit NVMe im Gehäuse) direkt auf dem Schreibtisch.

Zentral im Rack

Companion Rack-Rail (19″)

Ein Einschub direkt im KI:KUBE-Rack mit mehreren Agenten-Knoten: kein Hardware am Arbeitsplatz, zentral verwaltet, Strom, Kühlung/Ventilation und Netz im Rack. Ideal für KI:KUBE 4/6.

Optional · auf Anfrage

Agent-Server

Ein x86-Rechner, der viele Agenten auf einer Maschine konsolidiert, für hohe Nutzerzahlen.

Zwei Bedien-Modi

WebUI

Standard · verfügbar

Bedienung über eine Weboberfläche im Browser: klick-bedienbar, kein Extra-Client nötig, auch vom Handy.

Full-Desktop

Premium · auf Anfrage

Ein echter grafischer Linux-Desktop je Nutzer (im Browser aufrufbar), für alle, die einen vollen Arbeitsplatz-Desktop mit sichtbarer Automatisierung wollen. In Entwicklung, daher auf Anfrage.

Technisch schlüsselfertig inklusive

  • Gerät fertig aufgesetzt, KI-Agent (Hermes) installiert und gepflegt, Update-Kanal.
  • Inferenz auf die eigene KI:KUBE verdrahtet, lokal, kein Cloud-Token.
  • Zugriff eingerichtet (WebUI / Fernzugriff), Dauerbetrieb als Dienst, sichere Grundkonfiguration.

Im Org-Setup (einmalig, gemeinsam)

  • Anbindung an die eigenen Konten (Mail / Kalender / Drive / Wiki) inkl. Rechte-Scopes, sobald die Konten hängen.
  • Interne Messaging-Kanäle, Lese- und Schreib-Freigaben je Quelle („erst lesen, dann schreiben").
  • Darauf aufbauend automatische Briefings eingerichtet.

Selbst gestaltbar

  • Persönlichkeit und Ton des Agenten.
  • Sein Gedächtnis, das aus der Nutzung wächst.
  • Eigene Abläufe und Automationen. Persönlichkeit, Gedächtnis und Automationen entstehen im Betrieb bzw. werden im Onboarding gemeinsam eingerichtet.

Erlebnis

Tag 1 vs. Tag 2 und danach

Vom Auspacken bis zum eingespielten Routine-Werkzeug.

Tag 1

  • Box wird angeliefert (Spedition, palettiert)
  • 19-Zoll-Einbau im Rack oder als Standgerät
  • Strom + LAN anschließen: Display zeigt IP
  • Erste Logins per SSO oder lokalem Admin
  • Vorgesehene Modelle bereits ladebereit

Tag 2+

  • Eigene Dokumente in RAG-Pipeline einspeisen
  • Modellauswahl nach Use Case (Validated Profiles)
  • User im WebUI (Open WebUI / Hermes WebUI) bzw. am Hermes-Agent-Postfach per Gruppen / Rollen anlegen
  • Optional: IDE-Anbindung für Coding-Workflows
  • Monitoring im Grafana-Dashboard verfolgen

Ehrlich gesagt

Was nicht drin ist.

Wir liefern keine eigenen Modell-Weights. Wir kuratieren Open-Source-Modelle (Qwen, Llama, DeepSeek, Mistral, Codestral …) und stellen Validated Profiles zur Verfügung: Modell × Engine × Quantisierung × Hardware-Topologie, alles getestet und benchmarked.

Wir sind kein OpenAI-Konkurrent. KI:KUBE ist die On-Prem-Alternative, wo Cloud-KI strukturell nicht passt. Für unkritische Anwendungen kann die Cloud weiterhin sinnvoll sein, und für Frontier-Spielraum gibt es Hybrid-Strategien (siehe Pressestimmen).

Wir sind kein KIS-, ERP- oder DATEV-Hersteller. KI:KUBE arbeitet auf Daten, die diese Systeme exportieren. Wir liefern stabile API-Schnittstellen, keine Tiefenintegration in Fremdsysteme.

Sehen Sie KI:KUBE an einem Ihrer eigenen Dokumente.

Demo anfragen

KI:KUBE · Render

KI-generierte Visualisierung der KI:KUBE-Appliance.