NLS

Servicio en desarrollo: todavía no está disponible para contratar. Los precios de esta página son de referencia.

MODELOS IA

Inferencia de modelos IA, con GPU dedicada y API compatible con OpenAI.

Despliega modelos abiertos o ajustados a tu caso de uso, con escalado automático y facturación por hora de uso real. Sin gestionar infraestructura de GPU.

Ver precios de referencia

Características previstas

Lo que está diseñado para incluir el servicio desde su lanzamiento.

Catálogo de modelos abiertos

Despliega modelos open-source populares (Llama, Mistral, Qwen y similares) ya optimizados, sin configurar nada a mano.

API compatible con OpenAI

Cambia el endpoint y la clave, y tu integración actual funciona igual, sin reescribir tu código.

Escalado automático

La capacidad de inferencia sube y baja sola según la demanda real, sin dejar GPU encendida de más.

Aislamiento y privacidad de datos

Tus prompts y datos no se usan para entrenar ni se comparten con otros clientes de la plataforma.

Fine-tuning gestionado

Sube tu dataset y entrena una versión adaptada del modelo, sin gestionar la infraestructura de entrenamiento.

Panel de consumo y coste

Tokens consumidos, latencia y coste por modelo, desglosados en tiempo real desde el mismo panel.

Casos de uso

Los escenarios que más estamos teniendo en cuenta al diseñar el catálogo de modelos inicial.

Chatbots y asistentes virtuales

Atención al cliente, soporte interno o asistentes de producto con respuesta conversacional.

Búsqueda semántica y RAG

Combina modelos de embeddings con tu base de conocimiento para respuestas ancladas en tus datos.

Automatización de agentes

Flujos que encadenan varias llamadas a modelos para completar tareas sin intervención manual.

Generación y clasificación de texto

Resúmenes, extracción de datos, moderación de contenido o categorización a gran volumen.

Precios de referencia

Estimación de precio por hora de GPU dedicada, a falta de confirmación definitiva en el lanzamiento.

IA Starter

Prototipos y cargas ligeras

1× NVIDIA L424 GB VRAMHasta ~40 tokens/s por sesiónHasta 32K tokens de contexto
0,90 €/hora

Facturación por hora de uso real

MÁS POPULAR

IA Professional

Producción con tráfico moderado

1× NVIDIA A100 40GB40 GB VRAMHasta ~120 tokens/s por sesiónHasta 128K tokens de contexto
2,95 €/hora

Facturación por hora de uso real

ENTERPRISE

IA Enterprise

Alto volumen y baja latencia

Clúster 8× NVIDIA H100640 GB VRAM agregadaRendimiento dimensionado según cargaHasta 128K tokens de contexto
A medida

Precio según volumen y SLA requerido

Preguntas frecuentes

¿Quieres ser de los primeros en probarlo?

Cuéntanos qué modelo o caso de uso necesitas y te avisamos en cuanto abramos el acceso anticipado.