AI Locale

AI privata, sul tuo hardware.

L'AI cloud trasmette i vostri dati ai server di terzi. L'AI locale gira su un'infrastruttura di vostra proprietà, nella vostra sede. Niente esce dall'edificio. Selezioniamo il modello, specifichiamo l'hardware, gestiamo l'installazione e formiamo il vostro team.

Vincolati dal segreto professionale

Se non potete incollarlo
in ChatGPT.

Gestori patrimoniali, fiduciari, avvocati, medici — chiunque sia vincolato dal segreto professionale (art. 321 CP) — non può inviare dati dei clienti a un modello cloud ospitato all'estero. Un modello che gira nella vostra sede vi offre la stessa leva dell'AI, mentre i dati riservati non escono mai dall'edificio.

Pensato per il lavoro regolamentato svizzero: Gestori patrimoniali · Fiduciari · Legale · Sanità · Finanza
001 Locale vs cloud

Stesse risposte.
Fiducia diversa.

L'AI cloud è gestita da terzi su un'infrastruttura che non controllate. L'AI locale gira su un'infrastruttura di vostra proprietà. Per le organizzazioni che trattano dati sensibili, regolamentati o riservati, dove gira il modello è il fattore decisivo.

Criterio
Locale · on-prem
Cloud · API
Dove risiedono i dati
Nella vostra sede. Sempre.Mai trasmessi
Sui server di un fornitore, spesso all'estero.Trasferimento transfrontaliero
Modello di costo
Hardware + setup una tantum.Nessuna fattura per token
Pagate per token, a ogni richiesta, per sempre.Scala con l'utilizzo
Compliance
Air-gap possibile. Pronto per l'audit.Sanità · legale · finanza
Dipende dai termini e dalla regione del fornitore.Responsabilità condivisa
Connettività
Funziona interamente offline.Nessuna connessione richiesta
Richiede una connessione attiva a ogni richiesta.Dipendente dall'uptime del fornitore
Controllo
Il modello e la macchina sono vostri.Nessun cambiamento a vostra insaputa
Il modello può cambiare o essere ritirato senza preavviso.Roadmap del fornitore
Ideale per
Privacy e costi prevedibili.Carichi di lavoro stabili e sensibili
Accesso al modello più avanzato in assoluto.Compiti variabili e non sensibili
Il nostro consiglio: I modelli cloud di frontiera restano i più capaci in assoluto. · Per i dati riservati, un modello valido di vostra proprietà batte uno più potente preso a noleggio.
002 Modelli per l'on-premise

Una scelta predefinita,
una gamma completa.

Per la maggior parte dei clienti la nostra scelta predefinita è Qwen 3.6 — qualità da frontiera su un singolo server. Serve qualcosa di più leggero? Scaliamo verso Gemma. Serve il massimo possibile? Saliamo fino a DeepSeek o Kimi. Tutti open-weight, tutti vostri, con le reali cifre di memoria a 4-bit indicate.

La nostra scelta predefinita
Qwen 3.6 Alibaba
Apache 2.0 · uso commerciale senza restrizioni

Il flagship bilanciato e il più forte tra i modelli open generalisti. Ragionamento, coding e oltre 100 lingue di livello frontiera, su un singolo server ad alta memoria anziché un cluster. Il default che installiamo, salvo esigenze diverse verso il più piccolo o il più grande.

235B-A22B · 4-bit server · 120 GB
235B-A22B · FP16 server · 470 GB
↓ Scala verso il basso · più piccolo
Gemma 3 Google
Termini Gemma · uso commerciale OK

Quando un server intero è eccessivo. La famiglia open efficiente e multimodale di Google gira su un laptop o un singolo acceleratore — abbastanza capace per la maggior parte dei compiti quotidiani, su hardware che probabilmente avete già.

  • 12B Assistente leggero, 4-bit laptop · 8 GB
  • 27B Miglior ingombro ridotto, 4-bit workstation · 14 GB
↑ Scala verso l'alto · più grande
DeepSeek · Kimi I pesi massimi
MIT · uso commerciale senza restrizioni

Quando volete il massimo possibile. Modelli da un trilione di parametri per il ragionamento più impegnativo — Kimi K2.5 al momento è in cima alla classifica indipendente. Richiedono hardware server dedicato.

  • DeepSeek V3.2 685B, ragionamento di frontiera, 4-bit server · 351 GB
  • Kimi K2.5 1T, #1 in classifica, 4-bit server · 542 GB
Dimensionamento e classifiche: VRAM a 4-bit e benchmark secondo la Onyx Self-Hosted LLM Leaderboard · la selezione finale del modello fa parte dell'audit.
003 Installazione privata · prezzi

Installato,
non noleggiato.

Progetti a prezzo fisso per portare un modello privato in produzione nella vostra sede. L'hardware viene procurato da voi secondo le nostre specifiche, quindi è vostro fin dal primo giorno. Scegliete la profondità di coinvolgimento di cui avete bisogno.

Livello 01

Setup

Operativo da subito

CHF 3'500
  • Specifichiamo l'hardware, voi lo procurate
  • Modello installato e ottimizzato sulla vostra macchina
  • Interfaccia di chat privata per il vostro team
  • Gira interamente on-premise, pronto per l'offline
  • Audit dei workflow
  • Formazione del team
  • Primo agente costruito
Livello 03

Automate

Adopt + primo agente live

CHF 7'500
  • Tutto quello di Adopt, più:
  • Un agente costruito per il vostro workflow, live in produzione
Ogni progetto include: Gira on-premise · Modelli open-weight di vostra proprietà · Hardware secondo le nostre specifiche, procurato da voi · Nessun costo per token
[ Prossimo passo ]

Contattateci ora.

Contattaci