| VPS | Rôle | Host | RAM | CPU | Stockage | Coût/mois |
|---|---|---|---|---|---|---|
| s0 | Hal 🧠 | Hostinger KVM4 | 16 Go | 4 vCPU | 200 Go NVMe | ~20 € |
| s1 | QG Rémy 🔒 | OVH VPS | 24 Go | 8 vCPU | 200 Go NVMe | ~22 € |
| s2 | Boss 👔 | Hostinger KVM4 | 16 Go | 4 vCPU | 200 Go NVMe | ~30 € |
| Composant | Spécification |
|---|---|
| CPU | Intel Core Ultra 7 155H — 16c (6P+8E+2LPE), 22 thr, 4.8 GHz |
| RAM | 30 Go |
| GPU | Intel Arc Graphics (Meteor Lake) + NPU |
| Stockage | 92 Go sys + 769 Go data (452 Go libre) |
| Ollama | v0.32.3 — 25 modèles, 218 Go |
| Niveau | Usage | Coût |
|---|---|---|
| 🟢 Local CPU (s0) | Tâches quotidiennes, test, prototypage | 0 €/mois |
| 🟡 API DeepSeek V4 Flash | Cerveau Hermes — réflexion, code, plans | ~0,36 €/mois |
| 🔴 GPU pod Scaleway (L4/L40S/H100) | Vidéo, fine-tuning, gros modèles | 0,79-3 €/h |
| Modèle | Taille | Type | 🇫🇷 | t/s (HP) | Usage |
|---|---|---|---|---|---|
| gemma4:26b | 16.8 Go | MoE 4B actif | ✅ | ~12 | Rédaction, relecture, qualité max |
| gemma3:4b | 3.1 Go | Dense 4B | ⚠️ | ~18 | Chat rapide, léger |
| Mistral Small 3.2 24B | ~15 Go | Dense 24B | ✅ | ~3.5 | Code, raisonnement |
| phi4-mini | 2.3 Go | Dense 4B | ✅ | ~15 | Technique, code |
| qwen2.5-coder:7b | 4.4 Go | Dense 7B | ✅ | ~7 | Code + français |
| glm-4.7-flash | 17.7 Go | Dense | ✅ | ~13 | Code, logs, Docker |
| luciole:23B | 13.5 Go | Dense 23B | ✅ | ~3.2 | Français natif |
| llama3.2:3b | 1.9 Go | Dense 3B | ✅ | ~20 | Ultra-rapide |
| Fournisseur | Usage | Datacenter France | GPU |
|---|---|---|---|
| OVHcloud | s1 (QG) | ✅ Oui | ❌ |
| Hostinger | s0 (Hal), s2 (Boss) | ✅ Paris | ❌ |
| Scaleway | GPU pods, API LLM | ✅ Paris | ✅ L4/L40S/H100 |
| Hetzner | Alternative | ❌ Allemagne | ❌ |
think: false au niveau RACINE du payload Ollama (pas dans options)num_predict pour les modèles à raisonnementnum_thread=8 sur Ultra 7 155H (règle: P_cores × 1.3)keep_alive=0 entre modèles, pas entre tests d'un même modèle~/.hermes/profiles/<name>/© 2026 Syngulia · v1.0