Suivre les coûts

Le tableau de bord Costs est la source de vérité pour « combien me coûte ARDS ? ». Il tire ses chiffres de la comptabilité de tokens vivante générée par chaque appel LLM.

Facturé vs. équivalent API

L'idée maîtresse du tableau : tout l'usage n'est pas facturé. Un appel passé sur un identifiant à forfait (un abonnement Anthropic, Synthetic.new) ne vous coûte rien de plus — mais le tableau calcule quand même ce qu'il aurait coûté au prix public de l'API, pour que vous voyiez le poids réel de votre usage.

Le sélecteur Base de coût en haut de page a trois positions :

  • Facturé — seulement les dollars réellement comptés (usage par clé d'API).
  • Équivalent API — la valeur ≈$ de tout, comme si tout avait été compté à l'API.
  • Les deux — le défaut : la dépense facturée et l'usage couvert par abonnement côte à côte.

Le panneau Aperçu des coûts reflète la base choisie, avec le nombre total d'enregistrements et les compteurs de tokens entrée/sortie. Une carte dédiée, Équivalent API (couvert par l'abonnement), porte la note « Non facturé — cet usage est couvert par l'abonnement forfaitaire ».

Quand des identifiants d'abonnement sont actifs, une carte Utilisation de l'abonnement montre aussi les fenêtres de quota du fournisseur — session (5 h) et semaine (7 j) — avec le pourcentage utilisé et l'heure de réinitialisation de chaque fenêtre.

Ce que vous voyez par défaut

La vue d'accueil affiche les 30 derniers jours. La barre de filtres propose :

  • Période — les onglets 24 h / 7 j / 30 j / Tout, ou une plage personnalisée Du / Au.
  • Fournisseur — tout filtrer sur un fournisseur.

Sous l'aperçu, deux panneaux découpent la dépense :

  • Coûts par source — par ce qui a généré l'appel : coding_task, research, dialogue, mission_agent, workflow, email_content, search_synthesis, etc. C'est là que vous repérez les schémas du genre « la recherche fait 30 % de mon total ».
  • Coûts par modèle — par modèle, tous fournisseurs confondus.

Descendre dans le détail

Cliquez une ligne de Coûts par source ou de Coûts par modèle pour ouvrir un tiroir de répartition : la dépense d'une source ventilée par modèle (Répartition par modèle), ou celle d'un modèle ventilée par source (Répartition par source).

Il n'y a pas de rapport de coût par mission. À la place, la table Enregistrements récents en bas de page liste les enregistrements individuels — horodatage, source, modèle, tokens, coût estimé — et chaque ligne renvoie vers la page qui la possède : la tâche de code, la mission, la conversation. Pour le détail par appel (la configuration exacte et la provenance d'un appel LLM), utilisez la page LLM Snapshots.

Gratuit vs. compté

  • Identifiants d'abonnement (abonnement Anthropic, forfait Synthetic.new) — pas de facturation à l'appel. Leur usage apparaît en valeurs ≈$ équivalent API et s'impute sur les fenêtres de quota de l'abonnement.
  • Identifiants par clé d'API — comptés au token. Chaque token entrée et sortie compte, au prix public du fournisseur.

Le tableau affiche les prix publics. Si votre relation contractuelle vous donne une remise, votre facture réelle sera plus petite que ce que la page indique.

Quotas et limites

Deux surfaces vous gardent en avance sur les ennuis de quota :

  • La table Événements de limite de débit sur la page Costs liste les limites de débit récemment atteintes — horodatage, la tâche qui a touché le mur, fournisseur, modèle, et l'heure de réinitialisation.
  • La page Quotas montre les fenêtres de quota d'abonnement de chaque compte avec un verdict Ouvert / Fermé jusqu'à par compte. Quand le quota d'un compte est épuisé, ARDS arrête d'y lancer du nouveau travail d'agent jusqu'à la réinitialisation de la fenêtre.

Il n'y a pas de plafond de dépense dur : ARDS ne met pas le travail en pause parce que la dépense comptée aurait franchi un seuil en dollars. Si vous voulez un garde-fou, tournez sur des identifiants d'abonnement (forfait, pas de surprise possible) ou configurez un plafond mensuel chez votre fournisseur (la console Anthropic en a un) — et surveillez la page Costs après de gros changements de configuration.