Electrosens R&D

vLLM sur DGX Spark : l’inférence locale de LLM entre dans une nouvelle ère

En juin 2026, vLLM a publié un support natif et optimisé pour le NVIDIA DGX Spark, marquant un tournant pour l’inférence locale de LLM open source. Cet article décrypte en profondeur l’architecture du backend vLLM sur la puce GB10 Grace Blackwell, l’exploitation du nouveau format NVFP4, et les gains

Agents IA sur cluster DGX Spark : le guide complet avec Kubernetes

Cet article explore en profondeur l’utilisation de Kubernetes pour orchestrer des agents d’intelligence artificielle sur un cluster de DGX Spark. Alors que la puissance individuelle du DGX Spark est impressionnante, la mise en cluster via Kubernetes ouvre la voie à des applications multi-agents, des