Blog
Tipps, Anleitungen und Einblicke zu KI-Teamkollegen, smarterem Support und dem Aufbau besserer Teams.

Inkling-Small erklärt: ein 276B-Modell, bei dem 12B die Arbeit machen
Was Inkling-Small wirklich ist: ein 276B/12B Open-Weights-MoE-Modell von Thinking Machines, das Kontextfenster, bei dem sich Dokumentation und Anbieter widersprechen, was eine Million Tokens tatsächlich kostet und wo es in einem Support-Stack seinen Platz hat.

Grok Voice Think Fast 2.0: was sich ändert und was es kostet
Grok Voice Think Fast 2.0 erreicht 82,9% im Speech-to-Speech-Index von Artificial Analysis und antwortet in 0,70s. Es kostet aber auch 60% mehr pro Minute, und der Standard-Alias wechselt am 5. August dorthin.

FLUX 3 im Test: starke Belege, aber nichts, was man kaufen kann
Ein FLUX 3 Test des einzigen Dings, das man aktuell wirklich bewerten kann: die Belege. Die Forschung hält mehr Substanz als der Launch-Post. Das Produkt selbst existiert noch nicht.

Inkling-Small im Test: ein Viertel der Größe, fast genauso schlau
Ein Praxistest von Inkling-Small: Es schlägt sein eigenes 975B-Elternmodell im Coding bei einem Viertel der Größe und einem Viertel des Preises, stürzt dann aber bei der Faktentreue ab. Das kostet dieser Tausch tatsächlich.

FLUX 3: was Black Forest Labs wirklich veröffentlicht hat
FLUX 3 ist ein einziges Modell für Bild, Video, Audio und Roboteraktionen. Es hat aber auch noch keine API, keinen Preis und keine offenen Gewichte. Hier ist, was du bekommst und was nicht.

Pangram 4: wie es ein Dokument liest und wie man das Ergebnis liest
Pangram 4 erklärt anhand der eigenen Model Card: die vier Klassifizierungsköpfe, die in einem Durchgang laufen, die Ausgabefelder, die am häufigsten falsch gelesen werden, und wo das Modell an seine Grenzen stößt.

Qwen 3.7 Flash Preise: Was Sie 2026 tatsächlich zahlen
Der Kurs von $0.03 ist real, und er ist nur einer von vier Zählern auf Ihrer Rechnung. Hier sehen Sie, wie sich die Prompt-Staffel, der Cache, die Batch-Region und die Retry-Rate zu der Zahl summieren, die am Ende tatsächlich berechnet wird.

Qwen 3.7 Flash: Spezifikationen, Preise und was es wirklich kann
Qwen 3.7 Flash kam ohne Blogbeitrag, ohne Benchmarks und ohne Gewichte auf den Markt. Hier ist das vollständige Datenblatt, die gestufte Preisstruktur und das, was Qwen nie behauptet hat.

Qwen 3.7 Flash im Test: ein 0,03-Dollar-Vision-Modell mit Haken
Qwen 3.7 Flash ist das günstigste Vision-Modell, das man kaufen kann. Ich habe mir die Preisstufen, den einzigen unabhängigen Benchmark und das angeschaut, worüber niemand spricht.
Bereit, Ihren KI-Teamkollegen einzustellen?
In Minuten eingerichtet. Keine Kreditkarte erforderlich.