Contacta con nosotros

Temario del curso

Introducción a EXO y Clustering de IA Local

  • Resumen del marco EXO y el ecosistema exo-explore
  • Comparación entre inferencia centralizada en la nube e inferencia local distribuida
  • Arquitectura: descubrimiento de dispositivos libp2p, backend MLX, dashboard y capas de API
  • Requisitos de hardware: Apple Silicon (M3 Ultra, M4 Pro/Max), Thunderbolt 5, almacenamiento compartido

Instalación de EXO en macOS

  • Configuración de Xcode, Metal ToolChain y prerequisitos de macOS
  • Instalación de uv, Node.js y Rust toolchain nightly
  • Instalación del fork fijado de macmon para la monitorización de Apple Silicon
  • Clonado del repositorio y construcción del dashboard con npm
  • Ejecución de EXO desde el código fuente y verificación del dashboard en localhost:52415

Instalación de EXO en Linux

  • Instalación de dependencias mediante apt o Homebrew en Linux
  • Configuración de uv, Node.js 18+ y Rust nightly
  • Construcción del dashboard y ejecución de EXO en modo solo CPU
  • Estructura de directorios: rutas XDG Base Directory para configuración, datos, caché y registros

Descubrimiento Automático de Dispositivos y Formación del Cluster

  • Comprensión del auto-descubrimiento basado en libp2p a través de redes locales
  • Configuración de espacios de nombres personalizados con EXO_LIBP2P_NAMESPACE para el aislamiento del cluster
  • Verificación de la membresía de nodos en la vista de cluster del dashboard
  • Gestión de fallos de descubrimiento y problemas de segmentación de red

Habilitación de RDMA sobre Thunderbolt 5

  • Arquitectura RDMA y la afirmación de reducción del 99% en latencia
  • Habilitación de RDMA en el modo de recuperación de macOS con rdma_ctl
  • Requisitos de cables y restricciones de topología de puertos en Mac Studio
  • Igualación de las versiones de macOS entre todos los nodos del cluster
  • Resolución de problemas de descubrimiento RDMA y configuración DHCP

Implementación de Modelos de Última Generación

  • Uso del dashboard para cargar y fragmentar modelos DeepSeek v3.1, Qwen3-235B y familia Llama
  • Vista previa de las asignaciones de instancias con el punto de API /instance/previews
  • Creación de instancias de modelo con fragmentación de pipelines o paralelismo tensorial
  • Configuración de tarjetas de modelo personalizadas desde HuggingFace hub

Monitorización y Resolución de Problemas

  • Lectura de los registros EXO y comprensión del rastreo distribuido
  • Interpretación de la salud del cluster en la vista de cluster del dashboard
  • Diagnóstico de fallos de nodos trabajador y comportamiento de reconexión
  • Uso de EXO_TRACING_ENABLED para análisis de cuellos de botella de rendimiento

Mantenimiento y Actualización del Cluster

  • Actualización de los binarios EXO y procedimientos de reconstrucción del dashboard
  • Migración de cachés de modelos y gestión de modelos previamente descargados a través de NFS
  • Eliminación ordenada de nodos y reequilibrio de cargas de trabajo

Requerimientos

  • Comprensión de los fundamentos de redes (IP, segmentación de subredes, firewalls)
  • Experiencia con la administración de la línea de comandos de macOS o Linux
  • Conocimientos sobre gestión de paquetes de Python (pip/uv) y herramientas de Node.js

Público Objetivo

  • Administradores de sistemas
  • Ingenieros de DevOps
  • Arquitectos de infraestructura de IA responsables de la implementación de LLMs on-premise
 21 Horas

Formación Corporativa a Medida

Soluciones de formación diseñadas exclusivamente para empresas.

  • Contenido personalizado: Adaptamos el temario y los ejercicios prácticos a los objetivos y necesidades reales del proyecto.
  • Calendario flexible: Fechas y horarios adaptados a la agenda de su equipo.
  • Modalidad: Online (en directo), In-company (en sus oficinas) o Híbrida.
Inversión

Precio por grupo privado (formación online) desde 4350 € + IVA*

Contáctenos para obtener un presupuesto exacto y conocer nuestras promociones actuales

Próximos cursos

Categorías Relacionadas