Frontière Verified

Benchmarks independants de qualite des modeles

Frontière AI applique une verification en 6 criteres a chaque modele de notre catalogue. Chaque modele est verifie independamment pour la conformite de la licence, la provenance, la securite, l'alignement RGPD, la qualite des benchmarks et la disponibilite API. Un modele est Frontière Verified quand il passe les six verifications.

27

Modeles live

11

Frontière Verified

14

UE souverain

13

Acces rapide

Modeles live — statut de verification

ModeleScoreJuridictionlpsgba
DeepSeek V4 Flash 0731 (1M contexte)Frontière VerifiedUE souverain
DeepSeek V4.1 Flash (552B MoE, 1M contexte)Frontière VerifiedAcces rapide
GLM-5.2 (Zhipu/Z.ai)Frontière VerifiedUE souverain
GPT-OSS 120B (OpenAI)Frontière VerifiedUE souverain
GPT-OSS 20B (OpenAI)Frontière VerifiedUE souverain
Mistral Small 3.2 24BFrontière VerifiedUE souverain
Qwen3 32BFrontière VerifiedUE souverain
Qwen3 Coder 30BFrontière VerifiedUE souverain
Qwen3.5 397B (multimodal)Frontière VerifiedUE souverain
Qwen3.5 9B (rapide, économique)Frontière VerifiedUE souverain
Qwen3.6 27B (multimodal)Frontière VerifiedUE souverain
Kimi K3 (2,8T paramètres, 1M contexte)5/6 criteres passesAcces rapide
Llama 3.3 70B5/6 criteres passesUE souverain
Qwen2.5-VL 72B (vision)5/6 criteres passesUE souverain
Qwen3.8 27B (multimodal)5/6 criteres passesUE souverain
DeepSeek R1 (671B MoE)0/6 criteres passesAcces rapide
DeepSeek R1 (Distill Qwen 14B)0/6 criteres passesAcces rapide
DeepSeek R1 (Distill Qwen 32B)0/6 criteres passesAcces rapide
DeepSeek V4 Pro (345B MoE)0/6 criteres passesAcces rapide
Gemma 3 27B (Google)0/6 criteres passesAcces rapide
GLM-5.3 (Zhipu/Z.ai)0/6 criteres passesAcces rapide
GLM-5.3 Flash (Zhipu/Z.ai)0/6 criteres passesAcces rapide
Muse Spark 1.1 (1M contexte)0/6 criteres passesAcces rapide
Muse Spark 1.2 (1M contexte)0/6 criteres passesAcces rapide
Qwen3 235B (instruct)0/6 criteres passesUE souverain
Qwen3.8 Flash (Qwen)0/6 criteres passesAcces rapide
Qwen3.8 Max (2,4T, 1M contexte)0/6 criteres passesAcces rapide

Methodologie du classement

Les modeles sont tries par : 1) score Frontière Verified (6 criteres : licence, provenance, securite, RGPD, benchmarks, API), 2) niveau de juridiction (providers souverains UE au-dessus des non-souverains), 3) efficacite prix (prix par token plus bas classe plus haut). Contrairement aux tableaux de popularite, notre classement mesure qualite et conformite.

Questions frequentes

Qu'est-ce que Frontière Verified ?
Frontière Verified est le programme de verification independant de Frontière AI. Chaque modele de notre catalogue est evalue selon 6 criteres : licence verifiee, provenance verifiee, securite analysee, RGPD evalue, benchmarks effectues, et API disponible. Un modele recoit le badge Frontière Verified quand il passe les six tests.
Comment les modeles sont-ils benchmarkes ?
Les modeles benchmarkes passent notre test de qualite (25 questions QCM sur les connaissances generales, les maths, le raisonnement et la langue), le test de latence (temps au premier token et tokens par seconde via streaming) et le test de debit (tokens/s soutenus sur une generation de 500+ mots). Un modele passe quand la qualite >= 72 %, le FTT <= 5s, le debit >= 20 tok/s.
Que signifie provenance verifiee ?
Provenance verifiee signifie que nous avons confirme que les poids du modele existent sur Hugging Face, l'editeur est confirme, et ce n'est pas un fork douteux. Nous verifions l'ID exact du modele contre le catalogue du provider.
Que signifie RGPD evalue ?
RGPD evalue signifie que nous avons evalue la politique de retention des donnees du provider, les sous-traitants et les accords de traitement des donnees. Les providers souverains UE (OVHcloud, Scaleway, self-hosted) sont automatiquement evalues conformes aux exigences de residence des donnees UE.
Pourquoi certains modeles ont-ils moins de criteres verifies ?
Quand un modele est ajoute a notre catalogue, nous priorisons la verification de la provenance, du RGPD et de la disponibilite API. La licence, l'analyse securite et les benchmarks suivent car ils prennent plus de temps. Nous publions le score partiel plutot que de cacher le modele.

Pret a tester les modeles verifies ?

Créer un compte