Tarifs
Ce que coûte Frontière AI : au token, prépayé, marge comprise
Frontière AI facture au token, marge déjà comprise, et sans abonnement. Vous rechargez un solde prépayé dès 10 € et chaque appel réussi le décrémente ; quand le solde atteint zéro, les appels s'arrêtent. Les prix ci-dessous sont ceux que vous payez réellement, affichés par tranche de 100 000 tokens — le montant débité de votre solde quand vos prompts en consomment autant.
Tous les prix sont par tranche de 100 000 tokens, en euros, marge comprise.
Prépayé, sans abonnement
Pas de forfait mensuel, pas de carte enregistrée. Vous rechargez une fois (dès 10 €) et vous consommez le solde jusqu'à épuisement — pas de facture en fin de mois, pas de surprise quand l'attention retombe. Si le solde atteint zéro, les appels renvoient HTTP 402 et rien d'autre ne se passe.
Modèles de chat & de raisonnement
Chaque modèle de chat est facturé en tokens d'entrée et de sortie à son propre tarif. Les modèles de raisonnement consomment des tokens de sortie (au tarif de sortie) pendant qu'ils réfléchissent, avant tout texte visible.
| Modèle | Hébergé via | Prix /100k entrée | Prix /100k sortie |
|---|---|---|---|
| Qwen3 235B (instruct)qwen3-235b | EU sovereign · scaleway | 0,105 € | 0,315 € |
| Qwen3.5 397B (multimodal)qwen3.5-397b | EU sovereign · scaleway | 0,084 € | 0,504 € |
| GLM-5.2 (Zhipu/Z.ai)glm-5.2 | EU sovereign · scaleway | 0,252 € | 0,77 € |
| DeepSeek V4 Flash 0731 (1M contexte)deepseek-v4-flash-0731 | EU sovereign · scaleway | 0,056 € | 0,112 € |
| Llama 3.3 70Bllama-3.3-70b | EU sovereign · ovhcloud | 0,0898 € | 0,0898 € |
| Qwen3.6 27B (multimodal)qwen3.6-27b | EU sovereign · ovhcloud | 0,0574 € | 0,3878 € |
| Qwen3.5 9B (rapide, économique)qwen3.5-9b | EU sovereign · ovhcloud | 0,014 € | 0,0224 € |
| Qwen3 32Bqwen3-32b | EU sovereign · ovhcloud | 0,0112 € | 0,0308 € |
| Qwen3 Coder 30Bqwen3-coder-30b | EU sovereign · ovhcloud | 0,0084 € | 0,0322 € |
| Qwen2.5-VL 72B (vision)qwen2.5-vl-72b | EU sovereign · ovhcloud | 0,1232 € | 0,1232 € |
| GPT-OSS 120B (OpenAI)gpt-oss-120b | EU sovereign · ovhcloud | 0,0112 € | 0,0574 € |
| GPT-OSS 20B (OpenAI)gpt-oss-20b | EU sovereign · ovhcloud | 0,0056 € | 0,0224 € |
| Mistral Small 3.2 24Bmistral-small-3.2-24b | EU sovereign · ovhcloud | 0,0126 € | 0,0378 € |
| Kimi K3 (2,8T paramètres, 1M contexte)kimi-k3 | fast access · modal | 0,3654 € | 1,8242 € |
| Muse Spark 1.1 (1M contexte)muse-spark-1.1 | fast access · openrouter | 0,1512 € | 0,5138 € |
| Muse Spark 1.2 (1M contexte)muse-spark-1.2 | fast access · openrouter | 0,1512 € | 0,5138 € |
| GLM-5.3 Flash (Zhipu/Z.ai)glm-5.3-flash | fast access · openrouter | 0,0098 € | 0,0308 € |
| Qwen3.8 Max (2,4T, 1M contexte)qwen3.8-max | fast access · openrouter | 0,2422 € | 0,7252 € |
| Qwen3.8 27B (multimodal)qwen3.8-27b | EU sovereign · ovhcloud | 0,056 € | 0,378 € |
| Qwen3.8 Flash (Qwen)qwen3.8-flash | fast access · openrouter | 0,0182 € | 0,0574 € |
| DeepSeek R1 (671B MoE)deepseek-r1 | fast access · openrouter | 0,0854 € | 0,3024 € |
| DeepSeek V4 Pro (345B MoE)deepseek-v4-pro | fast access · openrouter | 0,1064 € | 0,21 € |
| DeepSeek R1 (Distill Qwen 32B)deepseek-r1-distill-qwen-32b | fast access · openrouter | 0,0154 € | 0,0616 € |
| DeepSeek R1 (Distill Qwen 14B)deepseek-r1-distill-qwen-14b | fast access · openrouter | 0,0098 € | 0,0252 € |
| GLM-5.3 (Zhipu/Z.ai)glm-5.3 | fast access · openrouter | 0,1694 € | 0,532 € |
| Gemma 3 27B (Google)gemma-3-27b | fast access · openrouter | 0,0098 € | 0,0546 € |
| DeepSeek V4.1 Flash (552B MoE, 1M contexte)deepseek-v4.1-flash | fast access · modal | 0,0182 € | 0,0728 € |
Modèles d'embedding
Les embeddings sont facturés sur les tokens d'entrée uniquement — un embedding ne produit aucun token de sortie, il n'y a donc pas de tarif de sortie.
| Modèle | Dimensions | Contexte | Prix /100k entrée |
|---|---|---|---|
| BGE-M3 (multilingue)bge-m3 | 1024 | 8k | 0,0013 €pas de tarif de sortie |
| BGE Multilingual Gemma2bge-multilingual-gemma2 | 3584 | 8k | 0,0013 €pas de tarif de sortie |
| Qwen3 Embedding 8Bqwen3-embedding-8b | 4096 | 41k | 0,014 €pas de tarif de sortie |
Chaque chiffre ci-dessus est le prix client — le coût provider augmenté de la marge Frontière AI — à l'unité d'affichage de 100k tokens. C'est le montant exact débité de votre solde.
Une sélection curée, tarifée depuis des coûts vérifiés
Chaque modèle n'est entré au catalogue qu'une fois vérifié qui le sert et à quel coût réel, via l'API du fournisseur lui-même. Le prix que vous payez est toujours ce coût vérifié plus la marge — la même fonction que celle du moteur de facturation, jamais un chiffre retapé à la main sur une page.
FAQ
Y a-t-il un palier gratuit ou une période d'essai ?
Non. Frontière AI est uniquement prépayé — pas de palier gratuit, pas de période d'essai. Vous rechargez dès 10 € et payez au token depuis votre solde.
Comment un appel est-il facturé exactement ?
Au token près, depuis l'objet usage que le provider rapporte pour votre appel : les prompt tokens au tarif input du modèle, les completion tokens (raisonnement inclus) au tarif output. Quand un provider sert une partie de votre prompt depuis son cache et le rapporte, ces tokens sont facturés au tarif cache du modèle, moins cher.
Puis-je recharger n'importe quel montant ?
Dès 10 €. Pas d'abonnement, pas de carte gardée en mémoire — vous décidez du montant prépayé et vous arrêtez quand vous voulez.
Pourquoi je paie plus que le prix catalogue du provider ?
Frontière AI route vers OVHcloud, Scaleway ou nos propres serveurs UE et applique une marge sur chaque appel — c'est ainsi que le service est financé. Le prix affiché sur chaque page la comprend déjà, il n'y a donc pas de surcoût caché ensuite.
Où sont les prix en euros par tranche de 100k tokens ?
C'est l'unité d'affichage de chaque page destinée aux humains. Le catalogue lisible par machine (GET /api/v1/models) et le JSON-LD restent au million de tokens — le même tarif exprimé à la quantité de référence du marché.
Sachez ce que vous paierez avant de construire
Rechargez 10 €, changez deux lignes dans votre client existant, et appelez n'importe quel modèle en ligne en quelques minutes.