Recent Changes - Search:

Navigation

Plugins

Architecture

Infrastructure

Exploitation

Projet

DGX Spark (PGX) - Serveur GPU

DGX Spark (PGX)

Spécifications

  • Modèle : NVIDIA DGX Spark (Lenovo ThinkStation PGX)
  • GPU : NVIDIA GB10 Blackwell
  • Mémoire : 121 Go unifiée (RAM + VRAM)
  • CPU : ARM 20 coeurs
  • CUDA : 13.0
  • Stockage : 3.6 To NVMe
  • OS : Ubuntu 24.04

Accès

  • SSH : via Tailscale

Utilisateurs

UserUIDGroupes
younes1002users, docker
alain1000-
pgp6671001docker
lucas1003-
selma1004-
rami1005users, docker

Configuration IA actuelle (mai 2026)

Attention : Le PGX est reconfiguré régulièrement par d'autres utilisateurs (alain, pgp667). Les ports et modèles peuvent changer sans préavis.

  • Modèle : nvidia/Gemma-4-26B-A4B-NVFP4
  • Nom servi : hal-chat
  • Port vLLM : 8101 (localhost only)
  • Proxy socat : 0.0.0.0:8200 -> 127.0.0.1:8101

Historique des modèles

#ModèlePortNom serviPériode
1Qwen2.5-32B-AWQ8104generalAvril-Mai
2DeepSeek-R1-Distill-Qwen-32B-AWQ8103reasoning-liteAvril-Mai
3Qwen2.5-VL-7B8105vision-liteAvril-Mai
4Gemma-4-26B-A4B-it8101hal-9001-chatMai
5Qwen2.5-Coder-14B8102hal-9001-codeMai
6Qwen3-Coder-30B-FP88000-Mai
7DeepSeek-R1-Distill-Qwen-32B-AWQ8001hal9001-supremeMai
8Gemma-4-26B-A4B-NVFP48101hal-chatMai (actuel)

Services Docker

ContainerPortRôle
hal-vllm-chat8101 (local)Modèle IA principal
moodle-proxy (socat)8200Proxy pour accès externe
hal-litellm4000Routeur multi-modèles
hal-open-webui3000Interface web
hal-searxng8080Moteur de recherche
hal-qdrant-Base vectorielle

GPU : surveiller la mémoire

Les processus vLLM zombies peuvent occuper la mémoire GPU. Pour vérifier :

nvidia-smi --query-compute-apps=pid,name,used_memory --format=csv,noheader

Pour tuer un processus zombie :

sudo kill -9 <PID>
Edit - History - Print - Recent Changes - Search
Page last modified on 26/05/2026 08:36