Statut des services
Cette application n'utilise que des paliers gratuits. Les catalogues changent, des modèles disparaissent sans préavis, et les quotas se comptent en dizaines de requêtes par minute. La chaîne de bascule est conçue autour de ce fait plutôt que contre lui.
Aucun relevé en cache. Les états ci-dessous reflètent la configuration, pas la disponibilité.
Fournisseurs
Google AI Studio
configuréGOOGLE_GENERATIVE_AI_API_KEY
Groq
clé absenteGROQ_API_KEY
Cerebras
clé absenteCEREBRAS_API_KEY
OpenRouter
clé absenteOPENROUTER_API_KEY
Modèles et quotas gratuits connus
Chiffres relevés dans la documentation publique de chaque fournisseur. Ils bougent : traitez-les comme indicatifs.
| Modèle | Rôle | Contexte | Req/min | Req/jour | État |
|---|---|---|---|---|---|
| Gemini 3.5 Flashgemini-3.5-flash | chat, vision | 1049 k | 10 | 250 | inconnu |
| Gemini 3.5 Flash Litegemini-3.5-flash-lite | fast, utility, rerank, vision | 1049 k | 15 | 1000 | inconnu |
| Gemini Flash (alias courant)gemini-flash-latest | chat, fast, vision, rerank, utility | 1049 k | 10 | 250 | inconnu |
| GPT-OSS 120B (Groq)openai/gpt-oss-120b | chat, fast, rerank | 131 k | 30 | 1000 | inactif |
| Llama 3.1 8B Instant (Groq)llama-3.1-8b-instant | fast, utility | 131 k | 30 | 14400 | inactif |
| GPT-OSS 120B (Cerebras)gpt-oss-120b | chat, fast | 131 k | 30 | 14400 | inactif |
| Llama 3.1 8B (Cerebras)llama3.1-8b | fast, utility | 33 k | 30 | 14400 | inactif |
| Llama 3.3 70B (OpenRouter, gratuit)meta-llama/llama-3.3-70b-instruct:free | chat, fast, utility | 66 k | — | 50 | inactif |
| DeepSeek V3 (OpenRouter, gratuit)deepseek/deepseek-chat-v3-0324:free | chat | 164 k | — | 50 | inactif |