Blog
Conseils, guides et analyses sur les collègues IA, un support plus intelligent et la construction de meilleures équipes.

Inkling-Small expliqué : un modèle de 276B dont 12B font le travail
Ce qu'est vraiment Inkling-Small : un MoE à poids ouverts de 276B/12B signé Thinking Machines, la fenêtre de contexte sur laquelle la documentation et les fournisseurs ne s'accordent pas, ce que coûte réellement un million de tokens, et sa place dans une pile de support.

Grok Voice Think Fast 2.0 : ce qui change et le prix
Grok Voice Think Fast 2.0 obtient 82,9% sur l'indice speech-to-speech d'Artificial Analysis et répond en 0,70s. Il coûte aussi 60% de plus par minute, et l'alias par défaut y bascule le 5 août.

Test de FLUX 3 : des preuves solides, rien à acheter pour l'instant
Un test de FLUX 3 sur la seule chose réellement évaluable aujourd'hui : les preuves. La recherche tient mieux la route que l'annonce de lancement. Le produit, lui, n'existe pas encore.

Inkling-Small à l'essai : un quart de la taille, presque aussi malin
Un test concret d'Inkling-Small : il surpasse son propre modèle parent de 975B en code, avec un quart de la taille et un quart du prix, avant de s'effondrer sur la factualité. Voici ce que ce compromis coûte réellement.

FLUX 3 : ce que Black Forest Labs a réellement livré
FLUX 3 est un seul modèle pour l'image, la vidéo, l'audio et les actions robotiques. Il n'a pourtant ni API, ni prix, ni poids ouverts pour l'instant. Voici ce que vous pouvez obtenir et ce que vous ne pouvez pas.

Pangram 4 : comment il lit un document et comment lire le résultat
Pangram 4 expliqué à partir de sa propre fiche modèle : les quatre têtes de classification exécutées en une seule passe, les champs de sortie les plus mal interprétés, et là où il cesse de fonctionner.

Tarifs de Qwen 3.7 Flash : ce que vous payez vraiment en 2026
Le tarif de $0.03 est réel, et ce n'est qu'un des quatre compteurs sur votre facture. Voici comment le palier de prompt, le cache, la région de batch et le taux de retentatives se combinent pour former le montant qui vous est réellement facturé.

Qwen 3.7 Flash : spécifications, tarifs et ce qu'il fait vraiment
Qwen 3.7 Flash a été lancé sans article de blog, sans benchmarks et sans poids ouverts. Voici la fiche technique complète, la tarification par paliers, et ce que Qwen n'a jamais prétendu.

Test de Qwen 3.7 Flash : un modèle de vision à 0,03 $ avec un piège
Qwen 3.7 Flash est le modèle de vision le moins cher du marché. J'ai creusé les paliers tarifaires, l'unique benchmark indépendant, et ce que personne ne vous dit.
Prêt à recruter votre collègue IA ?
Configuration en quelques minutes. Pas de carte bancaire requise.