À propos des ADR
Ce que sont les Architecture Decision Records, comment ils sont organisés ici, et la convention MADR utilisée.
0000 — Gabarit MADR
Gabarit vierge MADR 3.0 à copier pour chaque nouvel ADR.
0001 — Choix du générateur de site : Docusaurus
Décision de retenir Docusaurus plutôt que Starlight ou MkDocs, motivée par l'intégration de CALM, LikeC4 et Slidev.
0002 — Choix du VMM : Cloud Hypervisor
Décision de retenir Cloud Hypervisor comme moniteur de machine virtuelle pour l'isolation Kata, motivée par sa gouvernance neutre sous la Linux Foundation et le support de virtio-fs.
0003 — Runtime de conteneurs : Kata par défaut, runc pour le GPU
Choix du runtime OCI pour le sandboxing des agents (Kata Containers par défaut) et échappatoire runc par charge pour l'inférence de modèles IA locaux accélérée par GPU, orchestrés par containerd/nerdctl.
0004 — Exécuteur de modèles locaux : vLLM
Choix de vLLM comme moteur d'inférence de modèles IA locaux, motivé par la vitesse (PagedAttention, continuous batching) et la gouvernance open source sous la PyTorch Foundation / Linux Foundation.
0005 — Dérogation : vLLM en conteneurisation classique (contrainte GPU)
Décision de faire tourner vLLM en conteneurisation classique (docker/runc) plutôt que dans le sandbox Kata par défaut, parce que l'accès GPU n'est pas disponible sous le VMM Cloud Hypervisor.