Les modèles sont exécutés localement via llama.cpp.
Aucune donnée n'est transmise à un serveur externe — la confidentialité des inspections
est totalement préservée.
La performance dépend du matériel disponible. Un GPU dédié avec Vulkan ou CUDA
accélère significativement le traitement de l'IA Vision (Qwen2-VL). Le fonctionnement
sur CPU seul reste possible pour Gemma 2B, mais avec un temps de réponse plus long.
Pour vérifier l'intégrité d'un fichier téléchargé, utilisez la commande suivante dans PowerShell :
Get-FileHash .\gemma-2b-q8_0.gguf -Algorithm SHA256
Comparez le hash obtenu avec le SHA-256 affiché sur cette page.