Tarifs Vellum AI 2026 : forfaits, crédits et le coût mensuel réel

Alicia Kirana Utomo
Écrit par

Alicia Kirana Utomo

Katelin Teen
Relu par

Katelin Teen

Dernière modification August 18, 2026

Vérifié par un expert
Bannière illustrée pour une analyse détaillée des tarifs de Vellum AI

À quoi ressemblent les tarifs de Vellum AI en 2026

Je veux commencer par ce qui trompe le plus de monde, car cela colore tout ce qui suit : Vellum n'est pas l'entreprise que la plupart des gens croient.

Jusqu'en 2026, vellum.ai était une plateforme LLMOps pour le prompt engineering, les évaluations et l'orchestration de workflows, le genre d'outillage qui se situe sous une build d'IA personnalisée. L'entreprise a pivoté. Le produit qu'elle vend aujourd'hui est un assistant IA personnel toujours actif, et les anciennes pages produit redirigent vers la page d'accueil. Le sous-domaine de documentation porte encore l'intégralité de la documentation de l'ancienne plateforme, ce qui explique pourquoi une recherche sur « Vellum pricing » peut faire apparaître deux entreprises portant le même nom. Un praticien a clairement exprimé cette confusion sur X :

"vellum is a dev/eval platform, different category entirely"

@physicsbyelena, X - 15 August 2026

Tout dans cet article porte sur l'assistant, qui est ce que tarife vellum.ai/pricing aujourd'hui.

La page tarifaire de Vellum, qui démarre sur le forfait Mighty sans aucune carte d'offre gratuite en vue

Voici la grille tarifaire complète réunie en un seul endroit, tirée de la page tarifaire et de la documentation tarifaire.

ForfaitPrixMachineStockageCrédits inclusFrais de plateformeE-mail + sous-domaine
Base (gratuit à vie)0 $Small, 1 vCPU / 2 Gio6 GioAucun, à la consommationNon inclusNon
Mighty30 $/moisSmall, 1 vCPU / 2 Gio10 Gio25 $Non inclusNon
Super100 $/moisMedium, 2.5 vCPU / 5 Gio30 Gio45 $InclusOui
Ultra200 $/moisLarge, 4 vCPU / 8 Gio60 Gio115 $InclusOui
CustomÀ partir de 50 $/moisMedium, Large ou XL10 à 120 GioOptionnel, 10 $ à 200 $InclusOui
Auto-hébergé0 $ pour VellumVotre matérielLe vôtreApportez vos propres clésAucunLe vôtre

Deux choses méritent d'être remarquées avant d'aller plus loin. Il n'y a aucun siège nulle part dans ce tableau, et il n'y a aucune remise annuelle. Vellum tarife un seul forfait d'assistant, facturé mensuellement, et c'est tout le modèle.

L'offre gratuite qui n'apparaît pas sur la page tarifaire

J'ai réextrait vellum.ai/pricing en écrivant cet article, à deux reprises, sur deux variantes d'URL, et le résultat était identique les deux fois : la page commence par la carte Mighty. Il n'y a aucune carte Base, aucune colonne à 0 $, et aucun hero « commencer gratuitement ». Ce que la page fait, en revanche, c'est mentionner Base à deux reprises dans sa propre FAQ, dans les réponses à d'autres questions. La réponse sur les tailles de machine sur la page tarifaire dit « Base includes Small (fixed) ». La réponse sur les crédits dit qu'ils sont « pay-as-you-go on both Base and Pro ».

La page suppose donc que vous connaissez déjà une offre qu'elle ne vous montre jamais.

La documentation tarifaire de Vellum, où le forfait Base gratuit est réellement documenté

La documentation est sans ambiguïté là où la page marketing reste silencieuse. La documentation tarifaire qualifie Base de « free, forever », et elle inclut une machine Small, 6 Gio de stockage persistant, des crédits à la consommation sans minimum mensuel, et des identifiants LLM gérés, ce qui signifie que Vellum prend en charge les clés API des modèles plutôt que de vous demander d'apporter les vôtres. Pour une catégorie où l'offre gratuite habituelle consiste à « cloner le dépôt et aller trouver un VPS », ce dernier point est une chose concrète à offrir, et cela vous évite de créer un compte API OpenAI juste pour démarrer.

Ce qui rend cette omission étrange plutôt que malveillante. Mon interprétation est qu'il s'agit d'une page reconstruite autour des forfaits payants, qui n'a jamais retrouvé son offre d'entrée. Mais l'effet concret, c'est que beaucoup de gens vont tomber sur un prix de départ de 30 $ pour un produit qu'ils auraient pu essayer gratuitement.

Et une fois que l'on met Base à côté de Mighty, le palier à 30 $ devient plus difficile à justifier :

Comparaison entre le forfait Base gratuit et le forfait Mighty à 30 $, où la seule différence produit est quatre Gio de stockage supplémentaires valant cinq dollars
Comparaison entre le forfait Base gratuit et le forfait Mighty à 30 $, où la seule différence produit est quatre Gio de stockage supplémentaires valant cinq dollars

Même machine. Quatre Gio de disque supplémentaires, que la propre grille tarifaire de Vellum facture 5 $. Et 25 $ de crédits, qui représentent de l'argent que vous alliez dépenser en tokens de toute façon. Mighty est une amélioration produit de 5 $ à laquelle est agrafée une carte-cadeau de 25 $. Si vous êtes sur Base et que vous consommez plus de 25 $ de crédits par mois, passer à Mighty vous coûte 5 $ et vous achète du disque. Si ce n'est pas le cas, cela vous coûte 30 $ pour prépayer quelque chose que vous n'utiliserez pas.

Les forfaits ne comportent aucune remise, et voici les calculs

C'est la partie que je n'attendais pas. Vellum publie une grille tarifaire à la carte dans sa documentation : des frais de plateforme de 10 $/mois, des paliers de machine à 35 $, 60 $ et 125 $, des paliers de stockage de 5 $ à 30 $, et des packs de crédits optionnels de 10 $ à 200 $. Normalement, un fournisseur publie à la fois un forfait groupé et ses composants pour que l'on puisse voir que le forfait groupé est moins cher.

Faites les calculs, et les forfaits groupés ne sont pas moins chers. Ils sont identiques.

ForfaitFrais de plateformeMachineStockagePack de créditsSommePrix affiché
Mighty0 $Small, inclus10 Gio, 5 $25 $30 $30 $
Super10 $Medium, 35 $30 Gio, 10 $45 $100 $100 $
Ultra10 $Large, 60 $60 Gio, 15 $115 $200 $200 $

Trois sur trois, au dollar près. Les forfaits sont des préréglages, pas des bonnes affaires. La documentation de Vellum reconnaît ouvertement que c'est voulu, décrivant chaque forfait comme « a starting point » que l'on peut ajuster, moment auquel votre plan se convertit silencieusement en configuration Custom. Il n'y a aucune pénalité à quitter un forfait et aucune récompense à y rester.

Je pense en réalité que c'est la manière honnête de faire les choses, et je préfère cela à une fausse « économie de 20 % » calculée par rapport à un prix catalogue que personne ne paie. Mais cela change la façon dont vous devriez faire vos achats. Il n'y a pas de forfait à choisir. Il y a une machine, un disque et un solde prépayé, et la seule question est de savoir combien de chacun vous voulez.

Ce qui nous amène à ce que les prix affichés cachent :

Décomposition du forfait Ultra à deux cents dollars montrant que cent quinze dollars sont des crédits prépayés plutôt que du produit
Décomposition du forfait Ultra à deux cents dollars montrant que cent quinze dollars sont des crédits prépayés plutôt que du produit

Sur Ultra, 115 $ des 200 $ sont votre propre argent de dépense conservé en dépôt. L'infrastructure que vous louez coûte 85 $. Sur Super, c'est 55 $ de produit contre 45 $ de crédits. Sur Mighty, c'est 5 $ contre 25 $. Les paliers ne sont donc pas vraiment « petit, moyen, grand assistant ». Ce sont « petit, moyen, grand prépaiement », avec un peu de calcul supplémentaire attaché à mesure que l'on monte en gamme.

Ce recadrage compte pour la comparaison des offres. Quand vous mettez les 200 $ d'Ultra à côté d'un concurrent à 200 $, vous comparez 85 $ de calcul à 200 $ de produit, sauf si ce concurrent facture lui aussi votre consommation de tokens à l'avance. La plupart ne le font pas. C'est le même piège qui rend les tarifs de Manus difficiles à mettre côte à côte avec autre chose. Les tarifs de Viktor ont la même structure. Faites la soustraction avant de conclure quoi que ce soit.

Composez votre propre offre : la grille tarifaire à la carte complète

Si les forfaits ne sont que des sommes, les composants sont la véritable liste de prix. Voici chaque ligne publiée.

Frais de plateforme, 10 $/mois. Achète un sous-domaine personnalisé, une adresse IP statique et un support prioritaire. Inclus sur Super et Ultra, absent sur Mighty et Base, et obligatoire sur toute configuration Custom.

Paliers de machine :

PalierCPURAMPrix
Small1 vCPU2 GioInclus sur Base et Mighty
Medium2.5 vCPU5 Gio+35 $/mois
Large4 vCPU8 Gio+60 $/mois
XL4 vCPU16 Gio+125 $/mois

Paliers de stockage :

TaillePrix
6 GioInclus sur Base
10 Gio+5 $/mois
30 Gio+10 $/mois
60 Gio+15 $/mois
120 Gio+30 $/mois

Les paliers de 250 Gio et 500 Gio existent toujours mais sont fermés aux nouveaux abonnements, maintenus pour les personnes qui les possèdent déjà.

Les packs de crédits coûtent 10 $, 25 $, 50 $, 100 $ ou 200 $ par mois, facturés comme une ligne récurrente, et ils achètent exactement leur valeur nominale en crédits. Un pack à 50 $ coûte 50 $ et vous donne 50 $ de crédits.

Il y a un piège dans le configurateur Custom qui mérite d'être signalé. Le forfait Custom minimum est de 50 $/mois, car Custom impose les frais de plateforme de 10 $ et sa machine la moins chère est Medium à 35 $, plus 5 $ de stockage. Small n'est pas proposé sur Custom. Donc si ce que vous vouliez était la machine Small de l'offre gratuite plus un sous-domaine personnalisé et une IP statique, cette combinaison ne peut pas être achetée. Votre chemin le moins cher vers les frais de plateforme coûte 50 $ par mois, dont 40 $ de calcul que vous n'avez pas demandé.

Voici un calculateur qui applique la grille tarifaire publiée par Vellum, pour que vous puissiez voir ce que coûte n'importe quelle configuration, et quelle part est du produit par rapport à du prépaiement :

Crédits : ce qu'ils sont, et les 15 choses qui les consomment

Un crédit est un dollar. La FAQ tarifaire de Vellum le dit directement : « $1 = 1 credit, and you only pay for what you use ». Les crédits sont dépensés en inférence, recherche web, génération d'images, et API tierces payantes accessibles via l'OAuth géré de Vellum. Comme les modèles sous-jacents sont les habituels, ce sont les tarifs que vous verriez sur les tarifs de Claude qui atterrissent sur votre solde.

La philosophie affichée de Vellum sur ce point mérite d'être saluée, et je le dis sans réserve. La documentation tarifaire affirme que l'entreprise « passes through model provider costs at cost », sans marge ni majoration sur l'usage de tokens, donc un dollar de crédits est un dollar pour le fournisseur de modèle. C'est une chose véritablement inhabituelle à publier, et cela signifie que la ligne de crédits n'est pas un centre de profit. Cela explique aussi la forme de tout ce qui précède : si les tokens sont vendus au prix coûtant, c'est la ligne d'infrastructure qui fait vivre l'entreprise, ce qui explique pourquoi les paliers de machine et de stockage sont tarifés comme ils le sont.

Voici maintenant la partie qui détermine votre facture réelle. La documentation de Vellum énumère les actions qui consomment des crédits, et il y en a 15 :

GroupeActionsS'exécute quand
ConversationMain agent, InferenceMain agent, c'est vous qui discutez ; Inference, ce sont les compétences et utilitaires
MémoireMemory consolidation, Memory extraction, Memory retrieval, RecallSurtout en arrière-plan
Peaufinage de conversationConversation summarization, Conversation title, Conversation starters, Empty-state greeting, Context compactorArrière-plan
AutonomieHeartbeat agent, Filing agent, Notification decisionArrière-plan
AutreUnknown TaskAppels non étiquetés que Vellum est encore en train d'attribuer

Relisez ce tableau et comptez ce qui est réellement déclenché par vous. Une seule ligne. Tout le reste, c'est l'assistant qui s'entretient lui-même.

Diagramme montrant que sur quinze actions consommant des crédits, une seule correspond à l'utilisateur qui discute tandis que douze s'exécutent seules
Diagramme montrant que sur quinze actions consommant des crédits, une seule correspond à l'utilisateur qui discute tandis que douze s'exécutent seules

Certaines sont peu coûteuses. Générer un titre de conversation, c'est un petit appel. Mais d'autres ne le sont pas : le heartbeat agent est décrit comme des « periodic check-ins where your assistant reflects, plans, and decides whether anything needs your attention », et le compacteur de contexte se déclenche sur les longues conversations, qui sont précisément celles qui portent déjà le plus de tokens. La consolidation et l'extraction de mémoire s'exécutent sur tout votre historique plutôt que sur votre dernier message, ce qui est le même type de travail de récupération qu'effectue une base de connaissances IA, sauf que c'est facturé en continu.

La communauté tourne autour de cette même structure de coût depuis un moment, dans la catégorie plus large des assistants toujours actifs :

Reddit

"OpenClaw's heartbeat burns tokens 48 times a day asking 'anything new?' on your most expensive model. Hermes has no heartbeat at all and its cron system is so locked down it breaks on the first two attempts. One approach wastes money. The other wastes time. Neither just works."

u/ShabzSparq, Reddit - r/better_claw, 30 May 2026

Et côté mémoire plus précisément :

Reddit

"Unlimited memory sounds like the obvious win until the context bloat means you're sending 15,000 tokens of stale conversation with every new message and paying frontier model rates for it."

u/Lower_Assistance8196, Reddit - r/better_claw, 2 June 2026

À la décharge de Vellum, la documentation ne cache rien de tout cela, et elle indique que le travail en arrière-plan est ajustable : vous pouvez demander à l'assistant de réduire la fréquence des heartbeats ou la compaction de mémoire, ou de les exécuter sur un modèle moins cher. La documentation admet aussi ouvertement que l'entreprise « actively working on making background spend more visible and easier to control », ce qui est une chose honnête à écrire sur sa propre page tarifaire.

Mais « ajustable en demandant poliment à l'assistant » n'est pas la même chose qu'un budget que vous fixez vous-même. Et ce qui est ajusté, c'est précisément ce pour quoi vous avez acheté le produit. Réduire le heartbeat d'un assistant toujours actif, c'est réduire la partie toujours active.

Auto-Reload, et là où la facture de crédits vous échappe

Les crédits sont prépayés. Lorsqu'ils s'épuisent, l'application affiche un message « You've run out of credits » et les actions payantes se mettent en pause jusqu'à la recharge. Cet arrêt net est la meilleure protection budgétaire de tout le modèle, et je la préfère à n'importe quel dépassement silencieux facturé après coup.

Auto-Reload est la fonctionnalité qui le supprime. Elle repose sur trois paramètres :

ParamètrePlagePar défaut
Recharger quand le solde descend sous1 $ à 100 $100 $
Montant ajouté par recharge10 $ à 500 $10 $
Plafond de dépenses mensuel25 $ à 10 000 $Optionnel, vide par défaut

Regardez l'interaction entre ces trois paramètres. Le déclencheur par défaut est un solde de 100 $ et la recharge par défaut est de 10 $, donc dès la sortie de la boîte, Auto-Reload se déclenche au moment où vous descendez sous 100 $ et ajoute un dixième de cette somme. Il continuera de se déclencher. Pendant ce temps, le seul paramètre qui borne réellement votre mois, le plafond de dépenses, est celui qui est livré vide, et vide signifie illimité.

Rien de tout cela n'est caché, et tout est ajustable dans les paramètres. Mais la configuration sûre n'est pas celle par défaut, et sur un produit où 12 des 15 actions facturables s'exécutent sans vous, le paramètre par défaut compte plus que d'habitude. Si vous activez Auto-Reload, fixez le plafond mensuel dans la même séance.

Ce n'est pas un défaut propre à Vellum, pour ce que ça vaut. J'ai vu des acheteurs mal juger un compteur d'usage en une seule après-midi. Un de nos clients, une entreprise de sécurité e-mail évaluant la solution sur Freshdesk, a consommé 200 interactions dès son premier jour de test et a immédiatement appelé pour demander ce que cela signifiait à leur volume réel d'environ 9 000 par mois. Ils avaient raison de demander. L'usage du premier jour de test, sur n'importe quel outil IA, est un très mauvais indicateur du régime de croisière, dans les deux sens, et la réponse honnête est que l'on ne peut pas le savoir avant d'avoir tourné un mois. C'est le même piège que rencontrent les équipes lorsqu'elles modélisent pour la première fois les coûts du support IA. Ce que vous pouvez faire, c'est vous assurer que le plafond existe avant de le découvrir.

Ce que Vellum coûte en pratique

Trois exemples concrets, à partir des composants publiés par Vellum. La consommation de crédits est véritablement impossible à connaître à l'avance, car Vellum ne publie aucun tarif par action, donc j'ai signalé les cas où le chiffre est un total de configuration plutôt qu'une facture.

La personne curieuse. Vous voulez voir de quoi il s'agit. Forfait Base, 0 $/mois, et vous rechargez 10 $ de crédits pour tester. Vous obtenez une machine Small, 6 Gio, et les propres clés de modèle de Vellum. Coût réel : 10 $, une seule fois. C'est le bon point de départ pour presque tout le monde, et c'est celui que la page tarifaire ne vous propose pas.

L'utilisateur quotidien. Vous l'utilisez depuis un mois, vous l'aimez, et vous consommez environ 40 $ de crédits. Mighty vous en donne 25 $ plus 10 Gio pour 30 $, et vous rechargez les 15 $ restants, donc vous êtes à 45 $/mois. Ou vous ignorez le forfait, restez sur Base, et payez 40 $ en crédits à la consommation avec 6 Gio de disque. Le forfait ne vous fait rien économiser et vous coûte 5 $ pour quatre Gio supplémentaires. Choisissez-le si vous voulez le disque ; ignorez-le sinon.

L'utilisateur avancé. Vous voulez la machine XL et 120 Gio, car vous conservez un large stockage de documents sur la machine. Cela fait les frais de plateforme de 10 $ plus 125 $ plus 30 $, donc 165 $/mois d'infrastructure avant le moindre crédit. Ajoutez un pack de crédits à 200 $ et votre ligne d'abonnement est de 365 $/mois, ce qui est le plafond pratique de la tarification publiée par Vellum. Au-delà, ce sont des recharges à la consommation à 100 $ par transaction.

Pour donner un ordre d'idée, 165 $/mois d'infrastructure représentent une somme réelle pour un outil personnel, et cela s'approche du prix d'un siège d'un outil pensé pour les équipes comme un système de tickets IA.

Si vous évaluez cela pour le travail plutôt que pour vous-même, les tarifs de Sierra constituent la comparaison la plus pertinente. Si vous restez sur un usage personnel, comparez plutôt avec les tarifs d'OpenClaw.

Ce que disent réellement les acheteurs à propos du coût

Je vais être direct sur la base de preuves ici, car elle est mince. L'assistant de Vellum a été lancé autour du 17 mars 2026 et a une empreinte communautaire organique quasi nulle : aucun Show HN, aucune fiche G2 ou Capterra pour l'assistant, et plusieurs des fils Reddit « Vellum vs » les mieux classés semblent orchestrés par le fournisseur, l'un d'eux ayant reçu la réponse « Nice ad 👌 saw your launch video on Twitter. » Il existe un profil G2 à 4,8/5, que je ne cite pas, car son avis le plus récent précède le lancement de l'assistant et au moins un avis concerne clairement une application de mise en forme de livres sans rapport, portant le même nom.

Ce qui reste est mince mais réel. La phrase la plus incisive est aussi la plus pertinente :

Reddit

"I think cost is the downside for vellum, it has everything else going for it"

u/ImagineAbimanyu, Reddit - r/AI_Agents, 16 July 2026

C'est un compliment enveloppé autour d'une plainte, et cela correspond à ma lecture du produit. L'utilisateur le plus ancien que j'ai pu trouver, après environ un mois, se montrait positif sur ce que le compteur de crédits finance en majeure partie :

Reddit

"I've been using it for about a month now. I think it's easy but it has its own headaches. I connect to a lot of web services via Composio and that connection breaks easily and has to be reset. Training it on my own data has been pretty easy and it seems to have excellent memory."

u/Cooperman411, Reddit - r/AI_Agents, 17 June 2026

« Excellent memory » mérite qu'on s'y arrête, car la mémoire est précisément ce que quatre des quinze actions consommant des crédits existent pour produire. La fonctionnalité la mieux notée par les utilisateurs est celle qui dépense discrètement le plus en arrière-plan. Ce n'est pas tant une critique que le compromis que fait le produit.

Le seul commentaire substantiel sur Hacker News concernant l'assistant en 2026 est une comparaison apparue dans un fil sans rapport :

Hacker News

"I didn't have good experience with Hermes. Vellum.ai was better, but unfortunately it had a bug where opencode go providers failed to work for a time, so I instead starting writing my own. (Now it is working)"

gf000, Hacker News - 1 August 2026

Meilleur que Hermes, suffisamment bon pour qu'on le regrette quand il a cassé, pas assez fidélisant pour survivre à un bug de fournisseur. C'est à peu près là où devrait se situer un produit âgé de cinq mois.

Ce que la grille tarifaire ne vous achète pas

Tout article tarifaire honnête a besoin de cette section, et les lacunes de Vellum sont étonnamment simples à lister, car ce sont des lacunes liées à la jeunesse du produit plutôt qu'à sa conception.

  • Aucun siège, et rien de collectif. Vellum tarife un seul forfait d'assistant. Il n'y a aucune ligne par utilisateur, aucun espace de travail partagé, aucune console d'administration dans la tarification. Cinq personnes signifient cinq abonnements et cinq mémoires distinctes qui ne se rencontrent jamais, ce qui est précisément le vide structurel que les coéquipiers IA existent pour combler.
  • Aucune conformité publiée. Aucune mention de SOC 2, ISO 27001, RGPD ou HIPAA n'apparaît sur la page tarifaire ni dans la documentation tarifaire. Si votre processus d'achat comporte un questionnaire de sécurité, prévoyez du temps pour cela.
  • Aucun SLA de disponibilité hébergée. Le mot SLA apparaît exactement une fois dans le contenu tarifaire de Vellum, dans la section sur l'auto-hébergement, où il est dit que vous contrôlez le vôtre. Les forfaits hébergés n'en publient aucun.
  • Aucune remise annuelle. Chaque prix est affiché comme un chiffre mensuel fixe. Si une option annuelle existe, elle n'est pas publiée, ce qui est inhabituel comparé aux tarifs de Decagon et à la plupart des paliers entreprise.
  • Aucun tarif par crédit publié. Vous savez qu'un crédit est un dollar. Vous ne savez pas ce que coûte un heartbeat, donc vous ne pouvez pas modéliser un mois avant de l'avoir vécu. Comparez cela à une grille de tokens publiée comme les tarifs de ChatGPT.
  • macOS et iPhone uniquement. Windows et Android sont sur la feuille de route, pas encore livrés. Si le multiplateforme compte pour vous, les tarifs de Claude Cowork constituent le substitut le plus proche.

En contrepartie, ce que Vellum donne bien à 0 $ n'est pas rien : des identifiants de modèle gérés, une base de code sous licence MIT, une voie d'auto-hébergement, et un arrêt net quand les crédits s'épuisent. Pour un outil personnel, c'est un ensemble défendable. Pour tout ce qui implique une équipe d'achat, la liste ci-dessus est la conversation à avoir.

Auto-hébergement : le palier à 0 $ avec une facture différente

L'assistant Vellum est open source, et la page tarifaire se termine par cette offre : déployez-le sur votre propre matériel, un VPS, ou un cloud privé, avec « no platform fee, no computer tier charges », selon la page tarifaire. Vous apportez vos propres clés de modèle, donc le compteur de crédits disparaît entièrement et vous payez directement OpenAI ou Anthropic.

Si vous comptez le faire tourner vous-même, chiffrez honnêtement l'ensemble. La machine Small hébergée de Vellum, c'est 1 vCPU et 2 Gio, ce qui correspond à un VPS bon marché. Leur Large, c'est 4 vCPU et 8 Gio, ce qui n'est pas gratuit mais reste bien en dessous des 60 $/mois que Vellum facture pour cela. Sur l'infrastructure brute, l'auto-hébergement gagne confortablement.

La ligne qui n'apparaît sur aucune facture, c'est votre temps. Quand j'ai rédigé la liste des alternatives à Vellum, le chiffre le plus frappant de tout l'article venait du propre calculateur de coût d'un écosystème concurrent : il affichait 535 $/mois pour une installation auto-hébergée, dont 455 $ correspondaient au temps de l'opérateur à un curseur de 30 $/heure. Retirez le travail, et la même machine coûtait environ 80 $. Même logiciel, un écart d'environ cent fois, et tout l'écart tenait à une personne.

Une comparaison mesurée de deux semaines sur r/better_claw a chiffré cela en heures concrètes, trouvant des temps de mise en place de 4 heures pour un runtime auto-hébergé et 2 heures pour un autre, contre 8 minutes pour une option gérée, avec un entretien sur les mêmes deux semaines allant de 3 à 4 heures contre 15 minutes. Le résumé de l'auteur était sans détour :

Reddit

"The ugly: I was spending 30-40 minutes a week on maintenance. Checking logs. Pruning memory files. Restarting the gateway after DNS blips killed the Telegram listener. My agent was useful but I was slowly becoming its sysadmin."

u/ShabzSparq, Reddit - r/better_claw, 18 June 2026

Le cadrage honnête est donc celui-ci. L'auto-hébergement ne supprime pas la facture, il la déplace de votre carte à votre agenda. Si vos soirées valent moins pour vous que 85 $ par mois, auto-hébergez. Si ce n'est pas le cas, la ligne d'infrastructure d'Ultra est tarifée équitablement.

Ce même calcul se retrouve plus largement dans les agents IA open source. C'est la raison pour laquelle un runtime comme ZeroClaw rivalise sur l'empreinte plutôt que sur les fonctionnalités.

Comment se comparent les tarifs de Vellum AI

Vellum est tarifé comme une location d'ordinateur. La plupart des produits auxquels on le compare sont tarifés comme des logiciels, et quelques-uns comme du travail. Ce sont trois compteurs différents, et les aligner demande de la prudence.

OutilCe qui est facturéPrix d'entréeOffre gratuitePlafond de dépense
VellumMachine, stockage et crédits0 $ (Base), 30 $ (Mighty)Oui, non documentée sur la page tarifairePlafond Auto-Reload optionnel
OpenClawAuto-hébergé, vous fournissez tout0 $ plus votre infrastructureOpen sourceVos propres limites de fournisseur
Claude CoworkIntégré à un abonnement AnthropicInclus avec un forfait payantNonLimites d'usage au niveau du forfait
LindyTâches gérées et créditsPaliers payantsLimitéeAu niveau du forfait
ManusCrédits par tâchePaliers payantsLimitéeAu niveau du forfait
eeselTickets et chats traités0,40 $ par tâche traitée50 $ d'usage gratuitPlafond mensuel strict

La distinction qui compte n'est pas le chiffre, c'est ce à quoi le chiffre est attaché. Le compteur de Vellum suit à quel point votre assistant est occupé. Un compteur basé sur le travail suit ce qui a réellement été accompli. L'un des deux, vous pouvez le prévoir à partir de vos propres données opérationnelles ; l'autre, vous ne pouvez l'observer qu'après coup.

Ce n'est pas une critique de Vellum, car un assistant personnel n'a aucune unité de travail sur laquelle facturer. C'est simplement pourquoi les deux structures sont difficiles à comparer, et pourquoi un abonnement personnel à 200 $ et une facture d'équipe à 200 $ signifient des choses complètement différentes. Le même décalage se retrouve face aux tarifs de Chatbase, qui mesurent les conversations plutôt que le calcul.

Si vous évaluez cela pour une équipe plutôt que pour vous-même, notre article sur les alternatives à Vellum est la lecture la plus pertinente, aux côtés du comparatif plus large des meilleurs employés IA.

Essayer eesel

J'ai passé les dernières années à construire et faire tourner de l'IA sur des files de support en production, ce qui est un problème très différent de faire tourner un assistant sur son ordinateur portable. Ce qui revient sans cesse dans ces déploiements, c'est qu'un compteur d'usage n'est utile que si vous pouvez le prévoir, et vous ne pouvez le prévoir que si l'unité est un travail que vous comptez déjà.

C'est toute la base de la tarification d'eesel. Vous payez 0,40 $ par ticket ou chat traité, et une conversation ne compte qu'une fois, quel que soit le nombre de réponses nécessaires. Les consultations du tableau de bord sont gratuites. Contrairement aux tarifs de Zendesk, il n'y a aucun frais de plateforme, aucun frais par siège, et aucun minimum mensuel, donc votre facture correspond à votre volume de tickets multiplié par quarante cents, un chiffre que vous pouvez extraire de votre helpdesk dès maintenant.

La page tarifaire d'eesel montrant une tarification à l'usage à quarante cents par ticket traité

L'autre moitié, c'est tester avant de s'engager. La simulation rejoue vos propres tickets passés et évalue ce que l'IA aurait répondu par rapport à ce que votre équipe a réellement envoyé, afin que vous voyiez les écarts avant qu'un client ne les voie. C'est l'étape que la plupart des déploiements d'automatisation des tickets de support sautent. Cela compte plus qu'il n'y paraît : j'ai vu un bot au ton assuré donner discrètement de mauvaises réponses, ce qui est exactement la raison pour laquelle nous testons d'abord sur l'historique plutôt que d'activer un interrupteur et de regarder la file d'attente.

Nous avons réalisé une analyse de coût pour un prospect traitant environ 1 000 tickets par mois, qui comparait des fournisseurs facturant à la résolution. À un taux de résolution de 80 %, sa facture aurait été de 792 $/mois, et un pic du Black Friday à 4 000 tickets l'aurait portée à 3 168 $. Ce qui est inconfortable dans la tarification à la résolution, c'est qu'elle vous facture davantage quand vous travaillez mieux, et encore davantage pour un mois que vous n'avez pas choisi. La tarification forfaitaire par tâche fait ressembler novembre à mars.

C'est gratuit pour démarrer, avec 50 $ d'usage et sans carte, et il existe un plafond de dépenses mensuel strict si vous le souhaitez. Cela se connecte à Freshdesk et sept autres helpdesks. Si vous évaluez un assistant IA pour une file partagée plutôt que personnelle, essayez eesel et pointez-le vers un mois de vos tickets réels.

Questions fréquentes

Combien coûte Vellum AI ?
Vellum propose un forfait Base gratuit et trois forfaits Pro payants : Mighty à 30 $/mois, Super à 100 $/mois et Ultra à 200 $/mois. Une configuration Custom démarre à 50 $/mois. En plus de l'un de ces forfaits, vous payez des crédits pour ce que l'assistant fait réellement, à raison de 1 $ = 1 crédit. Pour une vue d'ensemble de ce que facturent ces outils, consultez nos comparatifs sur les tarifs d'OpenClaw et les tarifs de Claude Cowork.
Vellum AI propose-t-il un forfait gratuit ?
Oui, même si la page tarifaire ne le montre jamais. Le forfait Base est gratuit pour toujours et inclut une machine Small, 6 Gio de stockage, des crédits à la consommation, et des identifiants LLM gérés. Il n'est documenté que dans la documentation tarifaire de Vellum. Si c'est une offre gratuite que vous recherchez, notre liste des agents IA open source couvre les autres solutions sans coût.
Qu'est-ce qu'un crédit Vellum et à quoi sert-il ?
Un crédit Vellum équivaut à un dollar américain, et les crédits couvrent l'inférence, la recherche web, la génération d'images et les API tierces payantes accessibles via l'OAuth géré de Vellum. La documentation de Vellum recense 15 actions distinctes qui consomment des crédits, dont 12 s'exécutent en arrière-plan. Les coûts des modèles sont répercutés sans marge, si bien que le compteur de crédits suit la consommation brute de tokens, comme le font les tarifs de l'API Anthropic et les tarifs de l'API OpenAI.
Les tarifs de Vellum AI sont-ils avantageux par rapport aux alternatives ?
Cela dépend si vous voulez un assistant personnel ou un assistant partagé. Les forfaits de Vellum ne comportent aucune remise groupée, donc vous payez le prix catalogue du calcul dans tous les cas. Pour un usage en équipe, il faudrait comparer avec les tarifs de Sierra, les tarifs de Decagon, ou un agent IA de helpdesk facturé au ticket. Notre article sur les alternatives à Vellum passe en revue la liste complète.
Quel est le tarif de Vellum pour une petite équipe ?
Il n'existe pas de tarif d'équipe. Vellum ne publie aucun nombre de sièges ni aucune ligne par utilisateur, car chaque abonnement achète un forfait d'assistant lié aux comptes d'une seule personne. Une équipe de cinq personnes signifie cinq abonnements et cinq mémoires distinctes. Le travail partagé est mieux servi par des coéquipiers IA ou un système de tickets IA qui gère une file unique.
Puis-je plafonner ce que Vellum dépense chaque mois ?
Partiellement. Auto-Reload dispose d'un plafond de dépenses mensuel optionnel compris entre 25 $ et 10 000 $ qui met en pause les recharges automatiques une fois atteint, mais le champ est optionnel et vide signifie aucune limite. Les recharges manuelles sont plafonnées à 100 $ par transaction. Si un plafond strict compte pour vous, comparez comment les coûts du support IA sont plafonnés ailleurs.
Que se passe-t-il si je n'ai plus de crédits Vellum ?
L'application affiche un message « Vous n'avez plus de crédits » avec une action Ajouter des crédits, et tout travail de l'assistant nécessitant une utilisation payante se met en pause jusqu'à la recharge. C'est un arrêt net plutôt qu'un dépassement surprise, ce qui est plus indulgent que la plupart des compteurs d'usage. Pour la même question sur d'autres outils, voir les tarifs de Chatbase et les tarifs de Botpress.

Share this article

Alicia Kirana Utomo

Article by

Alicia Kirana Utomo

Kira is a writer at eesel AI with a Computer Science background and over a year of hands-on experience evaluating AI-powered customer service tools. She focuses on breaking down how helpdesk platforms and AI agents actually work so that support teams can make better buying decisions.

Related Posts

All posts →
Illustration dessinée à la main de deux personnes examinant un graphique de répartition tarifaire à côté du logo Flamingo
Guides

Tarifs Flamingo AI 2026 : ce que coûte vraiment $1 par appareil

Flamingo AI facture $1 par appareil et par mois avec 10 M de tokens IA inclus. Voici ce que l'étiquette de prix ne dit pas : le compteur de tokens, l'escalade des générations, et le comptage des appareils.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 18, 2026
Illustration des cartes de plans Fleece AI et d'un compteur de crédits
Guides

Tarifs de Fleece AI en 2026 : ce qu'un crédit achète vraiment

Les tarifs de Fleece AI vont de 49 à 199 EUR par mois, facturés en crédits. Voici ce qu'est vraiment un crédit, le multiplicateur de modèle x10 et le coût total réel.

Rama Adi NugrahaRama Adi NugrahaAug 17, 2026
Logos de Cassidy AI et n8n côte à côte sur une bannière de comparaison face à face
Guides

Cassidy AI vs n8n : lequel convient vraiment à votre équipe ?

Une comparaison concrète entre Cassidy AI et n8n : ce que chacun automatise vraiment, ce que vous devez câbler vous-même, et pourquoi un seul des deux publie un prix.

Alicia Kirana UtomoAlicia Kirana UtomoJul 27, 2026
Illustration de la plateforme Cassidy d'agents IA et d'automatisation de workflows
Guides

Avis Cassidy AI 2026 : ce qui fonctionne bien, et où ça s'arrête

Un avis honnête sur Cassidy AI pour 2026 : comment fonctionnent réellement les agents, les workflows et la base de connaissances, ce que cache le tarif au crédit, et qui devrait passer son chemin.

Rama Adi NugrahaRama Adi NugrahaJul 27, 2026
Bannière illustrant la répartition des tarifs eGain
Guides

Tarifs eGain 2026 : tous les forfaits et le vrai coût d'une résolution

eGain est l'un des rares fournisseurs à publier une vraie grille tarifaire IA : 25 $ par utilisateur pour AI Knowledge Hub, 0,50 $ par résolution pour AI Agent, 249 $ par mois pour Connectors. Voici ce que compte chaque compteur, comment les blocs prépayés changent le calcul, et ce que la facture donne réellement à votre volume.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 31, 2026
Illustration of a Claude Opus 5 pricing breakdown showing cost per million tokens
Guides

Tarifs Claude Opus 5 en 2026 : coûts API, forfaits, factures réelles

Anthropic a maintenu Opus 5 aux tarifs d'Opus 4.8, mais le thinking est désormais activé par défaut. Voici ce que coûte réellement une exécution de Claude Opus 5 une fois l'effort et le cache pris en compte.

Rama Adi NugrahaRama Adi NugrahaJul 27, 2026
Un guide complet des crédits Salesforce Flex en 2025
Guides

Un guide complet des crédits Salesforce Flex en 2025

Le nouveau modèle de crédits Salesforce Flex est-il adapté à votre équipe ? Ce guide détaille la nouvelle tarification, son fonctionnement et les défis que vous pourriez rencontrer.

Kenneth PanganKenneth PanganNov 24, 2025
Tarification Apollo 2025 : Un guide complet des plans et des coûts cachés
Guides

Tarifs Apollo 2026 : Forfaits à partir de 59 $/mois et ce qu'ils incluent

Décomposez les plans tarifaires d'Apollo pour comprendre les fonctionnalités, les coûts et quel niveau d'abonnement convient à votre équipe de vente ou à votre stratégie commerciale.

Stevia PutriStevia PutriAug 22, 2025
Illustration de deux tarifs affichés sur un mur, l'un montrant un tarif à l'unité et l'autre un forfait mensuel fixe, avec une équipe en train de les lire
Guides

Tarifs Crescendo AI en 2026 : ce que $1.25 par solve coûte vraiment

La page tarifaire de Crescendo AI affiche $1.25. Le plancher est de $34,800 par an avant même de résoudre un seul solve. Une analyse complète du compteur, du forfait, et de la FAQ disparue.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 17, 2026

Prêt à recruter votre collègue IA ?

Configuration en quelques minutes. Pas de carte bancaire requise.

Commencer gratuitement