Saltar al contenido principal
Tecnología como Servicio

Infraestructura de IA como Servicio (AIaaS) - ASUS Ascent GX10

Infraestructura de IA local y privada como servicio, basada en equipos NVIDIA GB10 Grace Blackwell (ASUS Ascent GX10), alojada en el Data Center de TNS Chile. Ejecuta modelos de lenguaje, RAG y fine-tuning sobre tus datos sin salir del país, con opción futura de instalación en el data center del cliente.

Infraestructura de IA como Servicio (AIaaS) - ASUS Ascent GX10

Sobre el producto

¿Qué es?

Un servicio de infraestructura de Inteligencia Artificial local y privada (AIaaS) que TNS Chile pone a disposición de sus clientes sobre equipos NVIDIA ASUS Ascent GX10, potenciados por el superchip NVIDIA GB10 Grace Blackwell. La solución permite ejecutar modelos de lenguaje, motores RAG y procesos de fine-tuning manteniendo los datos dentro del país y bajo control del cliente.

Modalidad de entrega

En su etapa inicial, el servicio se ofrece con los equipos alojados en el Data Center de TNS Chile, donde garantizamos energía, climatización, conectividad y operación gestionada. Más adelante, si el cliente lo requiere, los equipos pueden instalarse en su propio data center (modalidad on-premise), conservando el mismo stack tecnológico y soporte de TNS.

Especificaciones del nodo GX10

- Superchip NVIDIA GB10 Grace Blackwell: CPU Arm de 20 núcleos + GPU Blackwell (integración 2.5D).

- Hasta 1 PFLOP de rendimiento IA en precisión FP4.

- 128 GB de memoria unificada LPDDR5x (273 GB/s de ancho de banda).

- Almacenamiento NVMe: 4 TB PCIe 5.0 + 1 TB PCIe 4.0.

- Red: NVIDIA ConnectX-7 con 2 puertos QSFP56 de 200 GbE, RJ45 10 GbE, Wi-Fi 7 y Bluetooth 5.4.

- Sistema operativo NVIDIA DGX OS (Ubuntu Linux ARM64); consumo hasta 240 W.

- Stack de IA maduro: CUDA, vLLM, SGLang y TensorRT.

Escalamiento

Un solo nodo ejecuta modelos locales de gran tamaño. Se pueden interconectar 2 unidades en conexión directa (256 GB agregados, 8 TB de almacenamiento y 2 PetaFLOPS FP4, modelos de hasta 400B parámetros). Para 3 o más nodos se incorpora un switch de 200 GbE en el data center.

Casos de uso ideales

- RAG sobre bases de licitación y documentos extensos (prellenado de prompt muy rápido).

- Análisis de expedientes clínicos con contextos largos.

- Fine-tuning y entrenamiento de modelos propios en ecosistema CUDA.

- Prototipos que luego migran a producción sobre servidores NVIDIA.

Ideal para instituciones de salud, sector público y empresas que requieren IA privada, soberanía de datos y cumplimiento normativo.

Lo que incluye

Características

  • Superchip NVIDIA GB10 Grace Blackwell (CPU Arm 20 núcleos + GPU Blackwell)
  • Hasta 1 PFLOP de rendimiento IA en precisión FP4
  • 128 GB de memoria unificada LPDDR5x (273 GB/s)
  • Almacenamiento NVMe: 4 TB PCIe 5.0 + 1 TB PCIe 4.0
  • Red NVIDIA ConnectX-7: 2 puertos QSFP56 de 200 GbE + RJ45 10 GbE
  • Sistema operativo NVIDIA DGX OS (Ubuntu Linux ARM64)
  • Stack CUDA completo: vLLM, SGLang y TensorRT
  • Escalable hasta 2 nodos en directo (256 GB / 400B parámetros)
  • Consumo eficiente de hasta 240 W por nodo

Beneficios

  • Soberanía de datos: la información nunca sale del país ni de tu control
  • IA privada sin dependencia de nubes públicas ni costos variables por token
  • Modelo flexible: inicia alojado en el Data Center de TNS y migra a tu data center cuando lo necesites
  • Operación gestionada por TNS: energía, climatización, conectividad y soporte
  • Ideal para RAG con documentos extensos y contextos largos
  • Cumplimiento normativo para sector salud y público
  • Menor costo total frente a GPUs de datacenter tradicionales
  • Escalabilidad progresiva según la carga real de trabajo

¿Le interesa este producto?

Conversemos sobre cómo podemos implementar esta solución en su organización.

Volver a productos