Lokale KI

Private KI, auf eigener Hardware.

Cloud-KI überträgt Ihre Daten an die Server eines Drittanbieters. Lokale KI läuft auf Infrastruktur, die Ihnen gehört, in Ihren eigenen Räumen. Nichts verlässt das Gebäude. Wir wählen das Modell aus, spezifizieren die Hardware, übernehmen die Installation und schulen Ihr Team.

An die Schweigepflicht gebunden

Wenn Sie es nicht
in ChatGPT einfügen dürfen.

Vermögensverwalter, Treuhänder, Anwälte, Ärztinnen und Ärzte — alle, die dem Berufsgeheimnis unterliegen (Art. 321 StGB) — dürfen Kundendaten nicht an ein im Ausland gehostetes Cloud-Modell senden. Ein Modell, das in Ihren eigenen Räumen läuft, verschafft Ihnen denselben KI-Vorteil, während die vertraulichen Daten das Gebäude nie verlassen.

Gebaut für regulierte Schweizer Branchen: Vermögensverwalter · Treuhänder · Recht · Gesundheitswesen · Finanzen
001 Lokal vs. Cloud

Gleiche Antworten.
Unterschiedliches Vertrauen.

Cloud-KI wird von einem Drittanbieter auf Infrastruktur betrieben, die Sie nicht kontrollieren. Lokale KI läuft auf Infrastruktur, die Ihnen gehört. Für Organisationen, die mit sensiblen, regulierten oder vertraulichen Daten arbeiten, ist entscheidend, wo das Modell läuft.

Dimension
Lokal · On-Premise
Cloud · API
Wo die Daten liegen
In Ihrem Gebäude. Immer.Nie übertragen
Auf den Servern eines Anbieters, oft im Ausland.Grenzüberschreitende Übermittlung
Kostenmodell
Einmalige Hardware + Einrichtung.Keine Abrechnung pro Token
Zahlung pro Token, bei jeder Anfrage, für immer.Skaliert mit der Nutzung
Compliance
Air-Gap-fähig. Audit-freundlich.Gesundheit · Recht · Finanzen
Hängt von den Bedingungen & der Region des Anbieters ab.Geteilte Verantwortung
Konnektivität
Läuft vollständig offline.Kein Internet nötig
Erfordert eine aktive Verbindung bei jeder Anfrage.Abhängig von der Verfügbarkeit des Anbieters
Kontrolle
Ihnen gehören das Modell & die Maschine.Keine stillen Änderungen
Das Modell kann ohne Vorankündigung geändert oder abgeschaltet werden.Roadmap des Anbieters
Am besten geeignet für
Datenschutz und planbare Kosten.Konstante, sensible Workloads
Zugang zum absoluten Spitzenmodell.Variable, unkritische Aufgaben
Unsere Empfehlung: Führende Cloud-Modelle bleiben insgesamt am leistungsfähigsten. · Bei vertraulichen Daten schlägt ein leistungsfähiges Modell, das Ihnen gehört, ein stärkeres, das Sie nur mieten.
002 Modelle für On-Premise

Ein Standard,
die volle Bandbreite.

Für die meisten Kundinnen und Kunden ist unsere erste Wahl Qwen 3.6 — Qualität auf Spitzenniveau auf einem einzigen Server. Brauchen Sie etwas Leichteres? Wir skalieren auf Gemma herunter. Brauchen Sie das absolute Maximum? Wir skalieren auf DeepSeek oder Kimi hoch. Alles Open-Weight, alles Ihnen gehörend, mit echten 4-Bit-Speicherwerten.

Unsere erste Wahl
Qwen 3.6 Alibaba
Apache 2.0 · uneingeschränkte kommerzielle Nutzung

Das ausgewogene Flaggschiff und der stärkste offene Allrounder. Reasoning, Coding und 100+ Sprachen auf Spitzenniveau, auf einem einzigen Server mit viel Arbeitsspeicher statt auf einem Cluster. Unser Standard, sofern Ihr Bedarf nicht kleiner oder grösser verlangt.

235B-A22B · 4-bit Server · 120 GB
235B-A22B · FP16 Server · 470 GB
↓ Kleiner skalieren
Gemma 3 Google
Gemma-Lizenz · kommerzielle Nutzung OK

Wenn ein ganzer Server des Guten zu viel ist. Googles effiziente, multimodale offene Modellfamilie läuft auf einem Laptop oder einem einzelnen Beschleuniger — leistungsfähig genug für die meisten Alltagsaufgaben, auf Hardware, die Sie wahrscheinlich bereits besitzen.

  • 12B Leichter Assistent, 4-Bit Laptop · 8 GB
  • 27B Bester kleiner Fussabdruck, 4-Bit Workstation · 14 GB
↑ Grösser skalieren
DeepSeek · Kimi Schwergewichte
MIT · uneingeschränkte kommerzielle Nutzung

Wenn Sie das absolute Maximum wollen. Modelle der Billionen-Parameter-Klasse für Reasoning mit den höchsten Anforderungen — Kimi K2.5 führt derzeit das unabhängige Leaderboard an. Diese benötigen dedizierte Serverhardware.

  • DeepSeek V3.2 685B, Spitzen-Reasoning, 4-Bit Server · 351 GB
  • Kimi K2.5 1T, Leaderboard #1, 4-Bit Server · 542 GB
Grössenordnung & Ranking: 4-Bit-VRAM und Benchmarks gemäss dem Onyx Self-Hosted LLM Leaderboard · Die endgültige Modellwahl ist Teil des Audits.
003 Private Installation · Preise

Installiert,
nicht gemietet.

Festpreis-Projekte, um ein privates Modell in Ihren eigenen Räumen produktiv zu setzen. Die Hardware wird von Ihnen nach unserer Spezifikation beschafft, sodass sie von Tag eins an Ihnen gehört. Wählen Sie den Umfang, den Sie brauchen.

Stufe 01

Setup

Einsatzbereit

CHF 3'500
  • Wir spezifizieren die Hardware, Sie beschaffen sie
  • Modell installiert & abgestimmt auf Ihrer Maschine
  • Private Chat-Oberfläche für Ihr Team
  • Läuft vollständig On-Premise, offline-fähig
  • Workflow-Audit
  • Team-Schulung
  • Erster Agent gebaut
Stufe 03

Automate

Adopt + erster Agent live

CHF 7'500
  • Alles aus Adopt, plus:
  • Ein Agent für Ihren Workflow gebaut, live im Einsatz
Jedes Engagement: Läuft On-Premise · Open-Weight-Modelle, die Ihnen gehören · Hardware nach unserer Spezifikation, von Ihnen beschafft · Keine Gebühren pro Token
[ Nächster Schritt ]

Nehmen Sie jetzt Kontakt auf.

Kontakt aufnehmen