IA Local

IA privada, en tu propio hardware.

La IA en la nube transmite tus datos a los servidores de un tercero. La IA local funciona sobre infraestructura que tú posees, en tus propias instalaciones. Nada sale del edificio. Nosotros seleccionamos el modelo, especificamos el hardware, nos encargamos de la instalación y formamos a tu equipo.

Sujetos al secreto profesional

Si no puedes pegarlo
en ChatGPT.

Gestores de patrimonio, fiduciarios, abogados, médicos: cualquier persona sujeta al secreto profesional (Art. 321 StGB) no puede enviar datos de clientes a un modelo en la nube alojado en el extranjero. Un modelo que funciona en tus propias instalaciones te da la misma capacidad de IA mientras los datos confidenciales nunca salen del edificio.

Diseñado para sectores regulados suizos: Vermögensverwalter · Fiduciarios · Legal · Sanidad · Finanzas
001 Local frente a nube

Las mismas respuestas.
Distinta confianza.

La IA en la nube la opera un tercero sobre una infraestructura que no controlas. La IA local funciona sobre infraestructura que tú posees. Para organizaciones que gestionan datos sensibles, regulados o confidenciales, dónde se ejecuta el modelo es el factor decisivo.

Dimensión
Local · en tus instalaciones
Nube · API
Dónde viven los datos
En tu edificio. Siempre.Nunca se transmiten
En los servidores de un proveedor, a menudo en el extranjero.Transferencia transfronteriza
Modelo de costo
Hardware + configuración, pago único.Sin factura por token
Pagas por token, en cada solicitud, para siempre.Escala con el uso
Cumplimiento
Puede aislarse de la red. Fácil de auditar.Salud · legal · finanzas
Depende de los términos & la región del proveedor.Responsabilidad compartida
Conectividad
Funciona completamente sin conexión.No requiere internet
Requiere una conexión activa en cada solicitud.Depende de la disponibilidad del proveedor
Control
Eres dueño del modelo & del equipo.Sin cambios silenciosos
El modelo puede cambiar o retirarse sin previo aviso.Hoja de ruta del proveedor
Más adecuado para
Privacidad y costo predecible.Cargas de trabajo estables y sensibles
Acceso al modelo más avanzado del momento.Tareas variables y no sensibles
Nuestra recomendación: Los modelos en la nube de vanguardia siguen siendo los más capaces en general. · Para datos confidenciales, un modelo capaz que posees supera a uno más potente que alquilas.
002 Modelos para instalación local

Un modelo por defecto,
toda una gama.

Para la mayoría de clientes, nuestra opción habitual es Qwen 3.6: calidad de vanguardia en un solo servidor. ¿Necesitas algo más ligero? Bajamos a Gemma. ¿Necesitas el máximo nivel? Subimos a DeepSeek o Kimi. Todos de pesos abiertos, todos tuyos, con cifras reales de memoria en 4-bit.

Nuestra opción habitual
Qwen 3.6 Alibaba
Apache 2.0 · uso comercial sin restricciones

El buque insignia equilibrado y el modelo abierto todoterreno más potente. Razonamiento de vanguardia, programación y más de 100 idiomas, funcionando en un único servidor de alta memoria en lugar de un clúster. El que desplegamos por defecto, salvo que tus necesidades pidan algo más pequeño o más grande.

235B-A22B · 4-bit servidor · 120 GB
235B-A22B · FP16 servidor · 470 GB
↓ Reducir · más pequeño
Gemma 3 Google
Términos de Gemma · uso comercial permitido

Cuando un servidor completo es excesivo. La eficiente familia abierta y multimodal de Google funciona en un portátil o en un solo acelerador: suficientemente capaz para la mayoría de tareas cotidianas con el hardware que probablemente ya tienes.

  • 12B Asistente ligero, 4-bit portátil · 8 GB
  • 27B Mejor huella reducida, 4-bit estación de trabajo · 14 GB
↑ Aumentar · más grande
DeepSeek · Kimi Pesos pesados
MIT · uso comercial sin restricciones

Cuando quieres el máximo nivel posible. Modelos de la clase de billones de parámetros para el razonamiento más exigente: Kimi K2.5 encabeza actualmente la clasificación independiente. Estos requieren hardware de servidor dedicado.

  • DeepSeek V3.2 685B, razonamiento de vanguardia, 4-bit servidor · 351 GB
  • Kimi K2.5 1T, n.º 1 en la clasificación, 4-bit servidor · 542 GB
Tamaños & clasificaciones: VRAM en 4-bit y benchmarks según el Onyx Self-Hosted LLM Leaderboard · la selección final del modelo forma parte de la auditoría.
003 Instalación privada · precios

Instalado,
no alquilado.

Proyectos a precio fijo para poner un modelo privado en producción en tus instalaciones. El hardware lo adquieres tú según nuestras especificaciones, así que es tuyo desde el primer día. Elige el nivel de colaboración que necesitas.

Nivel 01

Instalación

En marcha

CHF 3'500
  • Especificamos el hardware, tú lo adquieres
  • Modelo instalado & ajustado en tu equipo
  • Interfaz de chat privada para tu equipo
  • Funciona completamente en local, listo para modo sin conexión
  • Auditoría de flujo de trabajo
  • Formación del equipo
  • Primer agente construido
Nivel 03

Automatización

Adopción + primer agente en producción

CHF 7'500
  • Todo lo de Adopción, más:
  • Un agente construido para tu flujo de trabajo, en producción
En todos los proyectos: Funciona en local · Modelos de pesos abiertos que te pertenecen · Hardware según nuestras especificaciones, adquirido por ti · Sin tarifas por token
[ Próximo paso ]

Ponte en contacto ahora.

Ponte en contacto