Inklingレビュー:Thinking Machinesのオープンモデルは購入する価値があるか?

Kurnia Kharisma Agung Samiadjie
執筆者

Kurnia Kharisma Agung Samiadjie

Katelin Teen
レビュー者

Katelin Teen

最終更新 July 20, 2026

専門家による検証済み
レビュー対象であるThinking Machines Labのオープンウェイト AI モデル「Inkling」のイラスト

Inklingはあなたにとって価値があるか?(30秒チェック)

詳しい内容に入る前に、あなたにとって一番大事なことを選んで、率直な答えを得てください。これは実際のプロジェクトで私自身が下すのと同じ判断です。

Inklingとは実際どんなモデルか

本編のレビューに入る前に、簡単に整理しておきます。Inklingは、Thinking Machines Labによる最初の公開モデルで、同ラボはリーダーボードを追いかけているわけではないと、清々しいほど率直に語っています。売りは、同ラボのTinkerプラットフォーム上で自社用途にファインチューニングする、幅広くバランスの取れたオープンな基盤です。それはあなたが形作る出発点であり、契約して使うチャットボットではありません。

モデルカードによる、重要なスペックは次のとおりです。

  • アーキテクチャ: Mixture-of-Expertsトランスフォーマーで、総計975Bのパラメータのうち、トークンごとに41Bがアクティブ(256のエキスパートのうち6つがルーティングされ、さらに共有エキスパートが2つ)です。これにより、ほぼ1兆パラメータに近いモデルでも、まともな速度で提供できます。
  • 入力: テキスト、画像、そして音声(16 kHz WAV、約20分未満が最適)。出力はテキストのみです。
  • コンテキストウィンドウ: 最大100万トークン
  • ライセンス: Apache 2.0であり、商用利用も問題なく、ウェイトはHugging Faceで公開されています。
  • リリース日: 2026年7月15日。

音声機能は最大の特徴です。ローンチスレッドの最も支持されたコメントが表現したように、これは"largest open weight model that supports audio"(音声に対応する最大のオープンウェイトモデル)であり、サポート通話の文字起こしを読むのではなく、モデル自身に聞かせたいと思う瞬間にこそ意味を持ちます。

Inklingの相対アテンション経路の図:隠れ状態がQ、K、V、Rに射影され、K/Vにはキャッシュへの短い畳み込みが適用され、アテンションのロジットには相対位置バイアスが加算される様子を、Thinking MachinesがHugging Faceのローンチブログで図解したもの
Inklingの相対アテンション経路の図:隠れ状態がQ、K、V、Rに射影され、K/Vにはキャッシュへの短い畳み込みが適用され、アテンションのロジットには相対位置バイアスが加算される様子を、Thinking MachinesがHugging Faceのローンチブログで図解したもの

ベンチマーク:賢いが、尖った弱点もある

ここで、ベンダー自身の売り文句と独立した評価とを切り分けます。Thinking Machines自身の表は、最大努力時の見栄えの良い数字を示していますが、より純粋なシグナルはArtificial Analysisから得られます。同社はすべてのモデルを同じ方法で評価しています。

その評決:InklingはAA Intelligence Indexで41点97機種中10位を獲得し、同サイズのオープンウェイトモデルの平均である約25を大きく上回っています。つまり賢いモデルです。しかしフロンティアのリーダーたちよりはに位置し、DeepSeek V4 Flashのような競合と同じクラスターに収まります。より広いコミュニティのトラッカーでは順位を41位付近に置いており、そこから"『競争力がある』と呼ぶのは妥当か"という議論が生まれました。

評価項目(Artificial Analysis)Inkling測定内容
GPQA Diamond87%科学的推論
AA-LCR63%長文コンテキスト推論
Terminal-Bench v2.155%エージェント的コーディング + ターミナル操作
SciCode46%コーディング
AA-Omniscience (accuracy)40%知識
GDPval-AA v237%実務タスク
Humanity's Last Exam30%推論 + 知識
CritPt5%物理推論

これを素直に読むと、Inklingには明確な個性があることが分かります。科学的推論と長文コンテキスト推論に強く、物理と素の知識の信頼性では顕著に弱いのです(AA-Omniscienceの知識信頼性インデックスは-100から100のスケールでわずか2)。尖った特徴があり、まんべんなく優れたオールラウンダーではありません。

スコアの裏には、本当に役立つ効率性に関する主張もあります。Inklingは制御可能な思考努力度のダイヤル(Hugging Face統合ではnoneからmaxまで)を公開しており、ラボによればNemotron 3 Ultraと同じTerminal-Benchスコアを、およそ3分の1のトークン数で達成できるとしています。トークン単位で支払う人やGPUをレンタルする人にとって、「同じ答えをより少ないトークンで」は、ベンチマークでのわずかな勝ちよりも価値があります。

ローンチスレッドも、私と同じ複雑な印象を捉えていました。

Hacker News

"I just looked at the benchmarks and was kinda disappointed that it seems to be between KimiK2.6 and KimiK2.7 on most of the benchmarks."

価格:唯一の本当の弱点

これはこのレビューの中で私が最も驚いた点です。Inklingはオープンウェイトでありながら、Thinking Machines自身のAPIではプロプライエタリなフロンティアモデルと同じような価格が付けられています。Artificial Analysisによれば、価格面で97機種中81位となっており、同クラスの中でも最も高価な部類に入ります。

アクセス方法支払う金額備考
Thinking Machines API — 入力1.87ドル / 100万トークンクラス平均は約0.43ドル;高価
Thinking Machines API — 出力4.68ドル / 100万トークンクラス平均は約1.25ドル
ブレンドレート約1.10ドル / 100万トークンキャッシュ:入力:出力が7:2:1の比率の場合
キャッシュの読み書き0.374ドル / 100万トークンキャッシュヒットは入力に対して−80%
ウェイトを自己ホストモデル自体は0ドルApache 2.0;ハードウェア費用を負担
Tinkerのファインチューニング有料サービスラボの実質的なビジネスモデル

際立つ点が2つあります。まず、現時点でAPIプロバイダーは1社のみで、それがThinking Machines自身であるため、より安価なサードパーティのホストがまだ価格を下回っていません。次に、「オープンウェイト」は自分で実行する意志がある場合に限って無料になるということです。これは付け足しではなく、実際の判断事項です。したがって価格に関する結論はシンプルです。Inklingをレンタルするのは正当化しづらく、所有することはお買い得になり得ます。

Inklingの1ビットGGUFビルドがUnsloth のスタジオでローカル実行され、321秒間考えた末に自己完結型の数独HTMLゲームを書いている様子。12.6k / 1,048.6kトークンのコンテキストメーターとともに、Hugging Faceのローンチブログで示されているもの
Inklingの1ビットGGUFビルドがUnsloth のスタジオでローカル実行され、321秒間考えた末に自己完結型の数独HTMLゲームを書いている様子。12.6k / 1,048.6kトークンのコンテキストメーターとともに、Hugging Faceのローンチブログで示されているもの

自分で実行する:本当のセールスポイント

ウェイトがオープンであるため、コミュニティは初日からInklingをローカルで動かしていました。Hugging Faceのローンチブログは3つの階層を示しています。フルサイズのBF16チェックポイントには約2TBのVRAMが必要(データセンター級)で、NVFP4量子化ではBlackwellハードウェア上で約600GBまで下がり、コミュニティ製の1ビットGGUFビルドはそれを約95%削減し、高性能なワークステーションで十分な水準になります。

ツール対応も素早く進みました。transformers 5.14、SGLang、vLLM、llama.cpp/Unsloth へのゼロデイ統合に加え、無損失な高速化のための投機的デコーディング用ドラフター層もあります。この「自分で実行する」というストーリーこそが、本当に注目すべき理由です。トレードオフはコントロールと利便性の間にあります。ウェイトを所有し、データはインフラの外に出ることがなく、誰にもモデルを勝手に廃止されることはありませんが、その代わりGPUの責任はあなたが負うことになります。

クラスターの面倒を見ずにそのコントロールを求めるチームのために、Inklingは初日からDatabricksに登場し、ガバナンスが組み込まれ、トークン単位の課金がないUnity AI Gateway経由で利用できます。

メリットとデメリット

ここでは、このレビューの収支を包み隠さずお伝えします。

Inklingが優れている点

  • 本当にオープン — Apache 2.0のウェイト、商用利用可、1ビットビルドまで自己ホスト可能。
  • ネイティブ音声入力 — 読むだけでなく聞くことができる、最大のオープンウェイトモデル。
  • 100万トークンのコンテキスト — 長さの面で最上位ティアと肩を並べる。
  • トークン効率の良い推論 — 努力度ダイヤルは、単なるマーケティング文句ではなく実際の節約をもたらす。
  • 強力な科学的推論 + 長文コンテキスト推論 — GPQA Diamond 87%、AA-LCR 63%。

不足している点

  • レンタルには高価 — API価格で97機種中81位、オープンウェイトとしては不思議な位置。
  • リーダーボードの勝者ではない — フロンティアのリーダーたちより下、オープンモデルの中でも中位。
  • 知識の信頼性が弱い — AA-Omniscienceインデックスが2、加えて物理推論も低い5%。
  • APIプロバイダーが1社のみ — 価格面でのサードパーティ競争はまだない。
  • 自己ホストには本格的なハードウェアが必要 — 「無料」モデルなのに、フルビルドには約2TBのVRAMが必要。

コミュニティは実際どう考えているか

Hacker Newsのローンチスレッド(1,214ポイント、約292件のコメント)は、受け止められ方を最もはっきりと示しています。雰囲気は熱狂的だが冷静なもので、盛り上がりはスコアよりも誰がそれを出したかに関するものでした。

Hacker News

"Not to mention - it is American. This is the first competitive non-Chinese open weights model since what, Llama 3?"

この見方には反論もありました(Mistral、CohereのNorth、Gemmaといった名前が挙がりました)が、「信頼できる西側のオープンウェイトの選択肢はもっと早く出てくるべきだった」という根底にある感情はスレッド全体に流れていました。「モデルを無償公開する会社はどうやって生き残るのか」という健全な疑問もあり、その答えはホスト型ファインチューニング事業であるTinkerに行き着きました。ただ、自分自身でレビューをする人にとって最も役立つ一文は、公開ベンチマークだけが本当のテストではない、という戒めでした。

Hacker News

"want to know how good a model is? Run it with your own non-public benchmark, basically the only way to get proper answers you can somewhat rely on, everything else is manipulated, misunderstood or over-relied on."

その直感を大切にしてください。モデルを自社のサポートキューに向けた瞬間に、まさにそれが重要になるからです。

Inklingクラスのモデルがサポートにとって意味すること

私がここ数年取り組んできた領域なので、率直に言わせてください。私はInklingのようなモデルの上に乗るエージェント層を作っていますが、実際の導入事例を見て学んだことはこうです。より優れたベースモデルが、実際にサポートキューに投入されるものを変えることはめったにありません。

生のモデルは、どれほど賢くても、あなたの返金ポリシーを知らず、チームがすでに解決した直近4万件のチケットを見ることもできず、いつ黙って人間に引き継ぐべきかも分かりません。顧客に直接向けさせれば、自信満々に間違った答えを返すでしょう。それは答えないことよりも悪い結果です。この失敗パターンこそが、サポートにおけるAIハルシネーションがチームを痛めつける正確な理由であり、モデルが常にエンジンに過ぎない理由です。

車とは、その周りを取り巻く層のことです。それがeeselの役割です。eeselはあなたの解決済みチケットやヘルプドキュメント(単なるマーケティングページではなく)から学習し、確信度に応じてルーティングすることで、確信度の低い回答は送信ではなく下書きになります。そして、私が最も大切にしている部分ですが、顧客が一人でも見る前に、エージェントをシミュレーションして、あなた自身の過去のチケットで試すことができます。このシミュレーションこそが、Hacker Newsの「自分のベンチマークで試せ」というアドバイスを、プロダクトのステップに落とし込んだものです。

オープンウェイトモデルをエンジンとして示し、解決済みチケットから学習し確信度に応じてルーティングし過去のチケットでシミュレーションするeesel層、そしてその結果生まれる機能するサポートの仲間を表したフロー図
オープンウェイトモデルをエンジンとして示し、解決済みチケットから学習し確信度に応じてルーティングし過去のチケットでシミュレーションするeesel層、そしてその結果生まれる機能するサポートの仲間を表したフロー図

つまり、サポートスタックを単一のモデルに賭ける必要がないということです。最良のモデルは数週間おきに入れ替わります(今日はInkling、来月には別のもの)。そのためeeselはモデルに依存しない設計を保ち、その時点で最も強いモデルを採用します。一方、顧客にとって重要な部分、つまりナレッジ、ガードレール、チケットのトリアージは変わらず維持されます。

結論

Inklingは、計画的に対処すべき価格の癖はあるものの、本当に優れたオープンウェイトモデルです。ウェイトを所有したい、音声や長文コンテキストが必要、そしてハードウェアを運用できるなら、2026年で最も興味深いオープンリリースの1つであり、ダウンロードする価値は十分にあります。もし単に最も安価で実用的なAPIや、単一の最高ベンチマークスコアが欲しいだけなら、それは適した選択ではなく、無理に選ぶべきではありません。

そして、あなたの本当の目標がサポートチケットに回答することであるなら、このレビューが何度も立ち返っている点を思い出してください。モデルカードはサポートエージェントではありません。エンジンは仕事の半分にすぎないのです。

eeselを試す

Inklingは楽しいリリースですが、モデルカードはサポートエージェントではありません。あなたの本当の目標がティア1サポートの自動化であるなら、必要なのは、強力なモデル(オープンでもクローズドでも)を仲間に変える層です。eeselは、既存のヘルプデスク(Zendesk、Freshdesk、Gorgias、HubSpot、Frontなど100以上)に接続し、あなたの履歴から学習し、本番稼働前に実際の過去のチケットでシミュレーションできるため、顧客が悪い返信をつかんでしまう前に、まずカバレッジと精度を確認できます。Gridwiseはまさにこのアプローチを使って、初月でティア1リクエストの73%を解決しました。

価格は利用量に応じた体系で、解決済みチケット1件あたり約0.40ドル、シート単位の料金はかからず、無料で始められます。それは、優れたエンジンを眺めているだけの状態と、実際にどこかへ走り出すこととの違いです。

よくある質問

Inklingは購入する価値がありますか?
それは何のために欲しいかによります。ダウンロードして自己ホストし、ファインチューニングできるオープンモデルとしては、Inklingは強力な選択肢です。特にネイティブ音声入力や100万トークンのコンテキストが必要な場合はなおさらです。最も安価で実用的なAPIとしては割に合いません。入力約1.87ドル/出力約4.68ドルという価格は、プロプライエタリなフロンティアモデルと同水準で、より安いオープンウェイトの競合の方がコスト面で勝ります。私の短いInklingレビューのまとめ:所有するには最高、レンタルするには高すぎる。
InklingはKimiやGLMと比べて優れていますか?
本当に賢いモデルです - Artificial AnalysisのIntelligence Indexで41点、97機種中10位を獲得していますが、オープンウェイト勢のトップには立っていません。Hacker Newsのコミュニティテスターは、ベンチマークではおおよそKimi K2.6とK2.7の間に位置すると指摘しています。真の強みはネイティブ音声と長いコンテキストであり、ランキング首位の座ではありません。
Inklingの料金はいくらですか?
Thinking Machines自身のAPIでは、Inklingの利用料金は入力100万トークンあたり約1.87ドル、出力100万トークンあたり約4.68ドルで、Artificial Analysisによれば価格面で97機種中81位となっており、このサイズのオープンウェイトモデルとしては高価です。ウェイト自体はApache 2.0の下で無料なので、自己ホストするとトークン単位の料金がハードウェア費用に置き換わります。
Inklingは無料でオープンソースですか?
ウェイトはApache 2.0の下で無料でダウンロードでき、Inklingを自己ホストして商用利用することもできます。ただし「無料」は「実行にお金がかからない」という意味ではありません。フルサイズのBF16ビルドには約2TBのVRAMが必要で、大幅に量子化された1ビットGGUFを使って初めてワークステーションレベルまで下がります。ハードウェアを用意したくない場合向けに、有料の公式APIも用意されています。
Inklingをカスタマーサポートに使えますか?
接続すること自体は可能ですが、このInklingレビューの数字がどれだけ良く見えても、生のモデルはサポートエージェントではありません。実際のチケットに安全に回答するには、解決済みチケットから学習し、確信度に応じてルーティングし、本番稼働前にシミュレーションできる層が必要です。それこそがeeselのようなAIカスタマーサービスプラットフォームが加える価値であり、モデルに依存しない設計なので常に最良のモデルを使えます。
Inklingを作っているのは誰で、Tinkerとは何ですか?
Inklingは、元OpenAI CTOのMira Muratiが設立したThinking Machines Labによる最初のオープンウェイトモデルです。同社はモデルを無償公開する一方で、ホスト型ファインチューニングプラットフォームであるTinkerで収益を上げています - これは「ウェイトは無料公開、ツールを販売する」というビジネスモデルで、Hacker Newsではローンチ当日ずっと議論の的になっていました。
Inklingのベンチマークスコアはどうですか?
Artificial Analysisによると:AA Intelligence Index 41点(97機種中10位)、GPQA Diamond 87%、長文コンテキストのAA-LCR 63%、Terminal-Bench 55%、SciCode 46%、Humanity's Last Exam 30%です。物理推論(CritPt 5%)と知識の信頼性(-100から100のスケールでAA-Omniscienceインデックスが2)では弱さが見られます。尖った特徴があり、まんべんなく優れたオールラウンダーではありません。

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Thinking Machines Labのオープンウェイトモデル、Inklingのイラスト
Trending

Inklingとは:Thinking Machinesのオープンウェイトモデルを解説

Inklingが実際に何なのか:Thinking Machines Labによる初のオープンウェイトモデル、その本当のベンチマーク、運用コスト、そしてサポート業務の近くに置いていいものかどうか。

Alicia Kirana UtomoAlicia Kirana UtomoJul 20, 2026
Inklingの代替としてのAIモデル比較を表すエディトリアルイラスト
Trending

2026年版 Inklingの代替8選

Inklingはオープンで興味深いモデルだが、オープンウェイトとしては高価で、実行できる中で最も賢いモデルというわけでもない。実際に試す価値のある8つの代替モデルを、実際の価格とそれぞれの強みとともに紹介する。

Rama Adi NugrahaRama Adi NugrahaJul 20, 2026
並行して動くコーディングエージェントとターミナルウィンドウを描いたエディトリアルイラスト。ZCode代替の全体像を表している
Trending

2026年、ZCodeの代替として最適な8選

ZCodeは印象的であると同時に粗削りでもある。実際の価格、正直なトレードオフ、誰に向いているかを踏まえた、2026年におけるZCodeの代替8選を紹介する。

Rama Adi NugrahaRama Adi NugrahaJul 12, 2026
ベンチマークのリーダーボードで1本だけ高く強調されたバーを描いたエディトリアルイラスト。ZCodeとGLM-5.2モデルを表している
Trending

ZCode:Z.aiの新しいAIコーディングエージェントの正体

GLMチームによる無料のエージェント型コーディングアプリ、ZCodeを実際に使って検証。背後にあるGLM-5.2モデル、リリース週に出たリアルな不満の声、そして誰に向いているアプリなのかを解説する。

Rama Adi NugrahaRama Adi NugrahaJul 12, 2026
Google Gemini 3.5 Proの料金とAPIコストのガイドを紹介するイラスト付きヒーローバナー
Trending

Gemini 3.5 Proの料金:実際のコストと、まだ足りないもの

Gemini 3.5 Proの料金についての率直な答え:まだ提供されていません。現行のProティア、コンシューマープラン、そして実際のAPIコスト計算をまとめました。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 21, 2026
大量のドキュメントを処理しながら推論する大規模言語モデルのエディトリアルイラスト
Trending

Kimi K3レビュー:Moonshotのオープンフロンティアモデルを徹底検証

Kimi K3の実践レビュー:2.8兆パラメータのオープンモデルのアーキテクチャ、ベンチマーク、実際の料金、そしてローンチ週のコミュニティの本音を検証する。

Alicia Kirana UtomoAlicia Kirana UtomoJul 21, 2026
大規模言語モデルKimi K3の代替候補を比較したイラスト
Trending

2026年、Kimi K3の代替として最適な8選

Kimi K3は本物のフロンティアモデルだが、最安ではなく、重みの公開も遅れている。実際のAPI価格とともに、Kimi K3の代替として最適な8つのモデルを紹介する。

Rama Adi NugrahaRama Adi NugrahaJul 17, 2026
Moonshot AIの大規模言語モデルKimi K3を表すイラスト
Trending

Kimi K3とは:Moonshotのオープンフロンティアモデルを解説

Moonshot AIの2.8兆パラメータのオープンモデル、Kimi K3を分かりやすく解説。何ができるのか、性能はどうか、料金はいくらか、乗り換える価値はあるのかをまとめました。

Alicia Kirana UtomoAlicia Kirana UtomoJul 17, 2026
インディゴ背景のPromptQL代替まとめカバー画像
Trending

2026年版 PromptQLの代替8選

2026年に選ぶべきPromptQLの代替8選。Databricks GenieからオープンソースのWren AIまで、実際の料金と強み、それぞれがどんなチームに向いているかをまとめました。

Rama Adi NugrahaRama Adi NugrahaJul 10, 2026

AIチームメイトを採用する準備はできましたか?

数分でセットアップ。クレジットカード不要。

無料で始める