← OPS M4 · LLM local
🌙
M4 · LLM local
M4 Max · Ollama
GPU
RAM
CPU
24 h
Ollama —
Appels par heure
par modèle · l'heure rouge porte une anomalie
générationtraductionembeddings
Latence médiane de génération
secondes par appel · par heure
générationtraduction
Puissance GPU
watts · un point toutes les 10 min
RAM unifiée
Go utilisés
Anomalies · 24 h
détectées par le proxy sur chaque appel
Réglages serveur
lus à chaque sonde
Appelants
par script, sur 24 h
Base jarvis_rag
Postgres 17 · pgvector · lue à chaque sonde
Bibliothèque constructeurs
triée par le modèle du M4, un cycle par semaine