IA locale

IA privée, sur votre propre matériel.

L'IA cloud transmet vos données aux serveurs d'un tiers. L'IA locale tourne sur une infrastructure que vous possédez, dans vos locaux. Rien ne quitte le bâtiment. Nous sélectionnons le modèle, spécifions le matériel, gérons l'installation et formons votre équipe.

Soumis au secret professionnel

Si vous ne pouvez pas le coller
dans ChatGPT.

Gérants de fortune, fiduciaires, avocats, médecins — quiconque est soumis au secret professionnel (Art. 321 CP) — ne peut pas envoyer de données clients à un modèle cloud hébergé à l'étranger. Un modèle qui tourne dans vos propres locaux vous donne le même levier IA, tandis que les données confidentielles ne quittent jamais le bâtiment.

Conçu pour les activités suisses réglementées : Gérants de fortune · Fiduciaires · Juridique · Santé · Finance
001 Local contre cloud

Mêmes réponses.
Confiance différente.

L'IA cloud est exploitée par un tiers sur une infrastructure que vous ne contrôlez pas. L'IA locale tourne sur une infrastructure que vous possédez. Pour les organisations qui traitent des données sensibles, réglementées ou confidentielles, l'endroit où tourne le modèle est le facteur décisif.

Dimension
Local · sur site
Cloud · API
Où résident les données
Dans vos locaux. Toujours.Jamais transmises
Sur les serveurs d'un fournisseur, souvent à l'étranger.Transfert transfrontalier
Modèle de coût
Matériel + installation, coût unique.Pas de facturation au token
Payez par token, à chaque requête, indéfiniment.Évolue avec l'usage
Conformité
Isolable du réseau. Facile à auditer.Santé · juridique · finance
Dépend des conditions et de la région du fournisseur.Responsabilité partagée
Connectivité
Fonctionne entièrement hors ligne.Aucune connexion internet requise
Nécessite une connexion active à chaque requête.Dépend de la disponibilité du fournisseur
Contrôle
Vous possédez le modèle et la machine.Aucun changement silencieux
Le modèle peut changer ou être retiré sans préavis.Feuille de route du fournisseur
Le plus adapté à
Confidentialité et coût prévisible.Charges de travail stables et sensibles
Accès au modèle le plus avancé qui soit.Tâches variables et non sensibles
Notre recommandation : Les modèles cloud de pointe restent globalement les plus performants. · Pour des données confidentielles, un modèle performant que vous possédez surpasse un modèle plus puissant que vous louez.
002 Modèles pour installation sur site

Un choix par défaut,
toute une gamme.

Pour la plupart des clients, notre choix par défaut est Qwen 3.6 — une qualité de pointe sur un seul serveur. Besoin de plus léger ? Nous descendons vers Gemma. Besoin du maximum absolu ? Nous montons vers DeepSeek ou Kimi. Tous à poids ouverts, tous à vous, avec de vrais chiffres de mémoire en 4 bits.

Notre choix par défaut
Qwen 3.6 Alibaba
Apache 2.0 · usage commercial sans restriction

Le modèle phare équilibré, le meilleur généraliste ouvert du marché. Raisonnement, code et plus de 100 langues de niveau state of the art, tournant sur un seul serveur à forte mémoire plutôt qu'un cluster. Notre choix par défaut, sauf si vos besoins imposent plus petit ou plus grand.

235B-A22B · 4-bit serveur · 120 Go
235B-A22B · FP16 serveur · 470 Go
↓ Réduire · plus petit
Gemma 3 Google
Conditions Gemma · usage commercial autorisé

Quand un serveur complet est superflu. La famille de modèles ouverts, efficace et multimodale de Google tourne sur un ordinateur portable ou un seul accélérateur — suffisamment performante pour la plupart des tâches quotidiennes, sur du matériel que vous possédez probablement déjà.

  • 12B Assistant léger, 4 bits portable · 8 Go
  • 27B Meilleure empreinte réduite, 4 bits station de travail · 14 Go
↑ Augmenter · plus grand
DeepSeek · Kimi Poids lourds
MIT · usage commercial sans restriction

Quand vous voulez le maximum absolu. Des modèles de la classe du trillion de paramètres pour le raisonnement le plus exigeant — Kimi K2.5 domine actuellement le classement indépendant. Ils nécessitent un serveur dédié.

  • DeepSeek V3.2 685 Md, raisonnement de pointe, 4 bits serveur · 351 Go
  • Kimi K2.5 1 T, n°1 du classement, 4 bits serveur · 542 Go
Dimensionnement & classements : VRAM en 4 bits et benchmarks selon le Onyx Self-Hosted LLM Leaderboard · le choix final du modèle fait partie de l'audit.
003 Installation privée · tarifs

Installé,
pas loué.

Des missions à prix fixe pour mettre un modèle privé en production dans vos locaux. Le matériel est acheté par vous selon nos spécifications, il est donc à vous dès le premier jour. Choisissez le niveau d'engagement dont vous avez besoin.

Palier 01

Installation

Opérationnel

CHF 3'500
  • Nous spécifions le matériel, vous l'achetez
  • Modèle installé et ajusté sur votre machine
  • Interface de chat privée pour votre équipe
  • Fonctionne entièrement sur site, prêt pour le hors ligne
  • Audit des processus
  • Formation de l'équipe
  • Premier agent construit
Palier 03

Automatisation

Adoption + premier agent en production

CHF 7'500
  • Tout ce qui est inclus dans Adoption, plus :
  • Un agent construit pour votre processus, en production
Chaque mission : Fonctionne sur site · Modèles à poids ouverts que vous possédez · Matériel selon nos spécifications, acheté par vous · Aucun frais par token
[ Étape suivante ]

Contactez-nous maintenant.

Nous contacter