S’exécute surWrit Cloud
Sur cette page
Facturation & usage
Chaque palier inclut un pool mensuel d’utilisation incluse — le prix du plan exprimé en crédits, à raison de 1 crédit = 0,001 $. Le calcul cloud, la sortie résidentielle et l’IA puisent tous dans ce même pool, pool d’abord ; le portefeuille ne contient que du crédit acheté, et n’est touché qu’une fois le pool épuisé. Les exécutions sur votre propre agent local sont gratuites, sur chaque palier.
pool ▸ le prix du plan, en crédits
Un pool, trois compteurs
Il n’y a pas d’allocations séparées à prévoir — pas de réserve « minutes cloud » à côté d’une réserve « tokens IA ». Le pool du mois finance le mélange dont le mois a réellement besoin, et se réinitialise à chaque cycle de facturation :
| Palier | Pool mensuel | En bref |
|---|---|---|
| Free | 1 000 crédits · $1 | Essayez-le sur votre propre machine. |
| Starter | 15 000 crédits · $15 | Pour les particuliers qui livrent leurs premières intégrations. |
| Pro | 49 000 crédits · $49 | Pour des API de niveau client sur des sites authentifiés. |
| Growth | 199 000 crédits · $199 | Pour les équipes qui exécutent des automatisations en production. |
| Scale | 499 000 crédits · $499 | Pour les opérations à fort volume, multi-équipes. |
| Enterprise | 800 000 crédits · $800 | Sur contact : des conditions sur mesure, même modèle à pool unique. |
La dépense est pool d’abord : tant que le pool a du crédit, l’usage consomme le pool et le portefeuille reste intact.
tarifs ▸ ce qui y puise
Les tarifs
| Ressource | Tarif | Notes |
|---|---|---|
| Calcul cloud — mutualisé | $0.002/min (2 crédits/min) | Facturé pour le temps réellement utilisé, succès ou échec. |
| Calcul cloud — isolé | $0.003/min (3 crédits/min) | 1,5× le mutualisé : l’exécution reçoit un bac à sable privé, à usage unique. |
| Sortie résidentielle | $7/Go | À l’usage, au gigaoctet réellement transféré. |
| IA | $3.20 par 1M de tokens | Un tarif unique pour tous les modèles, sans frais par appel. |
| Agent local / auto-hébergé | Gratuit sur chaque palier — aucun frais de calcul, aucun comptage (détails ci-dessous). | |
L’IA n’est pas une bande gratuite. Le volume de tokens IA par palier que vous pouvez voir dans les relevés d’usage est de la télémétrie — il décrit ce que vous avez utilisé, pas une allocation. L’IA puise dans le pool comme tout le reste, au tarif unique ci-dessus. Avec vos propres clés fournisseur sur votre propre agent, aucune IA gérée n’est facturée.
portefeuille ▸ dépassement uniquement
Le portefeuille
Le portefeuille ne contient que du crédit acheté — le pool inclus n’y transite jamais. Une fois le pool épuisé, l’usage compté continue depuis le portefeuille aux mêmes tarifs, exactement : ajouter des fonds achète plus d’usage, jamais un autre prix. Ajoutez entre 5 $ et 1000 $ à la fois (préréglages $10 · $25 · $50 · $100). Le crédit acheté n’expire jamais.
Exemple chiffré
Une exécution cloud de 30 secondes, et le même workflow sur votre propre machine :
cloud 30 s = 0,5 min × $0.002/min = $0.001
+ IA, au token, à $3.20/1M
+ résidentiel, au Go, seulement si l’exécution en a utilisé
─────────────────────────────────────────
local même workflow, votre propre agent = $0.00 à sec ▸ à quoi ressemble un 402
Quand pool et portefeuille sont vides
Le travail cloud s’arrête au lieu de vous facturer. La requête répond un 402
structuré dont le corps porte un code lisible par machine, votre usage
current, la limit atteinte et un upgrade_hint — votre
logiciel peut donc bifurquer dessus. Le message propose les trois sorties :
- ajouter des fonds au portefeuille,
- exécuter sur votre propre agent local — illimité et gratuit,
- ou monter de palier.
Deux événements de notification suivent la jauge avant le mur : billing.low_balance
et billing.credits_exhausted — ce dernier le dit sans détour : « Local agent runs
are unaffected. »
local ▸ gratuit par contrat
Le local est gratuit — structurellement
Une exécution avec execution_target=local n’est ni contrôlée, ni comptée,
ni facturée. Ce n’est pas une remise : les contrôles de facturation ne s’appliquent tout
simplement pas aux exécutions locales, sur aucun palier, Free compris. Le parallélisme est borné
par votre machine, pas par le plan. Seules les exécutions cloud — et les exécutions
auto qui atterrissent sur le cloud — sont comptées.
Ce qui dépend du palier, c’est le nombre d’agents locaux que vous pouvez garder liés à la plateforme en même temps :
| Palier | Agents locaux liés |
|---|---|
| Free | 1 |
| Starter | 1 |
| Pro | 1 |
| Growth | 5 |
| Scale | 20 |
| Enterprise | Illimité |
plafonds ▸ par palier
Plafonds de durée cloud
Les exécutions cloud et les sessions de streaming en direct portent des plafonds de durée par palier. Les exécutions locales n’en ont aucun — les limites ci-dessous sont des limites cloud :
| Palier | Exécution cloud max | Session streaming max |
|---|---|---|
| Free | 2 min | 5 min |
| Starter | 4 min | 10 min |
| Pro | 5 min | 15 min |
| Growth | 10 min | 30 min |
| Scale | 15 min | 60 min |
| Enterprise | 15 min | 60 min |
Voir les tarifs pour la matrice complète des paliers.
L’usage, la dépense par catégorie et les factures vivent sur la page de facturation dans l’app. La facturation est une surface de compte, pas une partie de l’API développeur — une clé API porte une autorisation, jamais la capacité de lire ou de déplacer de l’argent.
Et ensuite
- Où ça s’exécute : cloud, local et auto-hébergé, côte à côte.
- Sessions IA : à quoi le compteur de tokens est rattaché.
- Tarifs : paliers et limites en une seule table.