Un fichier plus petit garantit-il une latence plus basse ?
Afficher la réponse
Non. Kernels, déquantification, charge et matériel peuvent inverser le résultat.
Quantifier les poids réduit-il automatiquement le cache KV ?
Afficher la réponse
Non. La précision des poids et celle du cache sont deux choix distincts.
Quelle preuve clôt cette leçon ?
Afficher la réponse
Un résultat mesuré avec hypothèses, révisions exactes et contrôle qualité.