Testé, pas prétendu
Les pages marketing affirment ; cette page prouve. Chaque chiffre ci-dessous est soit calculé en direct depuis le registre de modèles au build, soit adossé à une mesure datée décrite dans le code. Quand un chiffre vieillit, la page vieillit avec lui — rien ici n'est un texte marketing codé en dur.
Compteurs en direct
Ce que le catalogue contient réellement
Ces compteurs sont calculés depuis le registre de modèles au moment du build — changez le registre, les chiffres changent. Aucune synchronisation manuelle, aucun chiffre périmé.
27
modèles de chat en ligne
14
sur infrastructure souveraine UE
15/27
portent une checklist Frontière Verified
10
familles de modèles suivies en benchmark
Détail des vérifications
Chaque modèle vérifié, son fournisseur, son score
Modèles portant au moins un critère vérifié. Un score 6/6 signifie que tous les contrôles sont passés ; un score partiel montre exactement quel critère reste ouvert.
| Modèle | Fournisseur effectif | Checklist |
|---|---|---|
| qwen3.5-397b | scaleway | 6/6 |
| glm-5.2 | scaleway | 6/6 |
| deepseek-v4-flash-0731 | scaleway | 6/6 |
| llama-3.3-70b | ovhcloud | 5/6 |
| qwen3.6-27b | ovhcloud | 6/6 |
| qwen3.5-9b | ovhcloud | 6/6 |
| qwen3-32b | ovhcloud | 6/6 |
| qwen3-coder-30b | ovhcloud | 6/6 |
| qwen2.5-vl-72b | ovhcloud | 5/6 |
| gpt-oss-120b | ovhcloud | 6/6 |
| gpt-oss-20b | ovhcloud | 6/6 |
| mistral-small-3.2-24b | ovhcloud | 6/6 |
| kimi-k3 | modal | 5/6 |
| qwen3.8-27b | ovhcloud | 5/6 |
| deepseek-v4.1-flash | modal | 6/6 |
Preuves datées
Chaque affirmation, sa preuve, sa date
Le function calling fonctionne sur le catalogue
2026-08-06Mesuré, jamais déduit : un appel API réel par entrée avec un outil get_weather, plus un aller-retour complet role:"tool". Résultat : 12 des 13 modèles live au moment du test renvoient un tool_call aux arguments JSON valides. Le refus unique (qwen2.5-vl-72b, OVHcloud répond HTTP 400 « tool calls non supportés ») est documenté sur sa fiche.
Voir la doc du champ toolCalling →Zéro rétention des prompts / réponses
2026-07-29Par conception, pas seulement par politique : la gateway ne stocke ni les prompts ni les réponses des appels API — uniquement les compteurs de tokens nécessaires à la facturation. Le traitement est assez simple pour tenir dans une DPA courte (art. 28 RGPD).
Comment nous déterminons la souveraineté →Les modèles souverains tournent chez des fournisseurs contrôlés UE
2026-07-29OVHcloud et Scaleway — sociétés françaises sans contrôle capitalistique non-UE — plus nos propres serveurs UE dédiés (FLEECE AI SASU, société française). Les faits fournisseurs sont transcrits d'audits consignés dans le registre ; le fournisseur effectif par modèle est la route de priorité 1.
Méthodologie de souveraineté →Les prix publiés = prix fournisseurs + marge annoncée
2026-08-13Prix fournisseurs re-confirmés par vérifications directes (page pricing Scaleway, endpoint /v1/models OVHcloud, /v1/models OpenRouter) et convertis aux taux documentés en référence BCE. Les limites maxCompletionTokens mesurées par de vraies requêtes surdimensionnées par fournisseur.
Commentaires sources du registre →Les scores de benchmark sont des chiffres publics réels
2026-08-26Les scores MMLU, GPQA Diamond, LiveCodeBench et Arena Elo sont les meilleures valeurs publiquement rapportées par modèle, sourcées depuis les model cards Hugging Face, les rapports techniques officiels et LMSYS — pas notre propre exécution, et présentés comme tels.
Fichier de données benchmark →Le score
Sovereignty Score — déterministe, recalculable
Le Sovereignty Score affiché sur chaque fiche modèle est une agrégation déterministe sur 100 de cinq facteurs pondérés calculés depuis les faits du registre. Vous pouvez recalculer vous-même n'importe quel score à partir de la formule publiée — pas de boîte noire.
Lire la méthodologie complète →La source
Un registre, tous les faits
Tout ce qui est sur ce site — prix, juridictions, checklists de vérification, résultats de tool calling, fenêtres de contexte — vient d'un registre de modèles typé dont les commentaires documentent chaque vérification : quoi a été testé, quand, comment. C'est l'inverse d'une couche marketing : le code est la source de vérité.