Modèles, fournisseurs et coûts
ARDS n'héberge pas ses propres modèles. Vous apportez les clés d'API et ARDS route le travail vers ces fournisseurs. Cette page couvre la liste des modèles, à quoi chacun sert, et comment se passe la facturation.
Familles de fournisseurs
- Anthropic Claude — la valeur par défaut recommandée. Facturation au token via votre compte Anthropic. Quatre niveaux de modèle (Fable / Opus / Sonnet / Haiku) qui arbitrent intelligence contre coût.
- OpenAI et compatibles — pris en charge via le même format de clé
sk-…. Utilisez-le pour OpenAI directement ou pour tout fournisseur qui expose une API au format OpenAI (Azure OpenAI, OpenRouter, etc.). - Synthetic.new — abonnement à forfait, pas au token. Héberge un catalogue trié de bons modèles open-weight (Qwen, Kimi, GLM, MiniMax et d'autres). Bon pour du gros volume où les coûts au token finiraient par grimper. Les modèles portent le préfixe
hf:dans leur ID. - JetBrains — sélectionnable aussi dans le dialogue d'ajout de fournisseur de la page LLM Config.
- Ollama (local) — pris en charge mais uniquement quand vous faites tourner de l'infrastructure ARDS-adjacente vous-même ; pas pertinent pour les testeurs hébergés.
Vous croiserez peut-être aussi une entrée fournisseur GitHub Copilot : un mode « apportez votre clé », adossé à un PAT GitHub fine-grained avec le scope Copilot Requests.
Vous pouvez connecter plusieurs fournisseurs. ARDS utilise des chaînes de fallback pour qu'un appel Claude qui échoue sur les crédits, par exemple, soit silencieusement retenté sur Synthetic. Les chaînes se configurent sur la page LLM Config.
Choisir un modèle
Pour votre première session, ne touchez pas aux valeurs par défaut. Le modèle de conversation par défaut est Opus ; les tâches de coder suivent les presets de la plateforme, qui choisissent un modèle par type de travail.
Quand vous êtes à l'aise, les règles grossières :
- Planification / décomposition → Sonnet. Rapide et bon pour structurer.
- Tâches d'implémentation → Opus pour les tâches difficiles, Sonnet pour la routine.
- Échafaudage de tests / boilerplate → Haiku. Un cinquième du prix d'Opus au token et parfaitement capable pour le travail répétitif.
- Gros volume sous contrôle de coût → Synthetic.new (par ex. Qwen3 Coder 480B). Forfait, donc vous pouvez laisser tourner.
Coûts visibles
Le tableau de bord Costs suit chaque dollar dépensé. Ses deux panneaux principaux sont Coûts par source (quelle partie de la plateforme a dépensé) et Coûts par modèle (où votre dépense se concentre). Au-dessus, des filtres découpent par fournisseur et par plage de dates, et basculent la base de coût entre Facturé, Équivalent API (ce que l'usage couvert par l'abonnement aurait coûté au token) et Les deux. La page montre aussi les fenêtres d'utilisation de l'abonnement, les événements de limite de débit, et un tableau des enregistrements récents.
Les tarifs Anthropic sont fixés par famille de modèles (par million de tokens, actuels en v1) :
| Famille | Entrée | Sortie | Contexte |
|---|---|---|---|
| Claude Fable | 10 $ | 50 $ | 1M tokens |
| Claude Opus | 5 $ | 25 $ | 200K tokens |
| Claude Sonnet | 3 $ | 15 $ | 200K tokens |
| Claude Haiku | 1 $ | 5 $ | 200K tokens |
Les versions nouvellement découvertes héritent des chiffres de leur famille — Opus 4.8 et Opus 4.7 se facturent toutes deux au tarif Opus. Fable est le niveau du haut, avec une fenêtre de contexte d'un million de tokens pour le travail qui demande une très grande vue d'ensemble. La liste complète et à jour est dans la référence des modèles.
Synthetic.new est au forfait par abonnement — pas de maths au token ; vous prenez un plan et vous y faites couler autant de travail que vous voulez.
Attente honnête : une tâche « répare ce bug » coûte des centimes sur Sonnet. Une mission « construire un nouveau microservice de bout en bout » couvrant plusieurs tâches Opus peut tourner à plusieurs dollars. La page Costs vous dit en temps réel.
Que se passe-t-il quand une clé manque de crédit
- Plus de crédit → vous voyez une erreur dans la mission, et (si une chaîne de fallback est configurée) ARDS retente sur le fournisseur suivant.
- Rate-limit → ARDS recule et retente. Les rate-limits longs remontent en demande d'attention.
- Clé révoquée ou invalide → la mission échoue. Ré-ajoutez la clé sur la page LLM Config.
Voir Dépannage pour les formes d'erreur précises.