FLUX 3:Black Forest Labsが実際にリリースしたもの

Rama Adi Nugraha
執筆者

Rama Adi Nugraha

Katelin Teen
レビュー者

Katelin Teen

最終更新 August 4, 2026

専門家による検証済み
画像、動画、音声のパネルを1つのモデルが生成する様子を描いたイラスト。Black Forest Labs の FLUX 3 を表現

FLUX 3とは実際どういうものか

Diagram of FLUX 3 as one shared backbone: images, video and audio feed in on the left, and image, video plus audio, robot action and open-weight outputs branch out on the right
Diagram of FLUX 3 as one shared backbone: images, video and audio feed in on the left, and image, video plus audio, robot action and open-weight outputs branch out on the right

FLUX 1とFLUX 2は画像を作るモデルだった。FLUX 3は別種のものであり、その名前はむしろ実態を過小評価している。

これは画像・動画・音声を1つのアーキテクチャの中で同時に学習させたもので、Black Forest LabsがSelf-Flowと呼ぶアプローチの上に構築されている。同社の説明では、それぞれのモダリティは1つの現実の非可逆な投影にすぎず、それらをまとめて学習させることで、単一モダリティのモデルには決して見えない制約が課されるという。発表記事から私が何度も思い返すのはこの一文だ。「音は衝撃と一致しなければならず、動きは質量に従わなければならない」

これは表現に関する主張であって、ピクセルの話ではない。実はこれはGemini Robotics 2にあったのと同じ主張を、逆側から言い換えたものでもある。DeepMindはロボットモデルを作り、それに世界知識を与えた。Black Forest Labsは動画モデルを作り、そこにすでに世界知識が入っていたことを発見した。

具体的には、1回の生成でFLUX 3が行えることは以下の通りだ。

  • テキストから動画、画像から動画への変換(音声付き、最大20秒)
  • 動画から動画への変換。参照クリップのキャラクターを新しいシーンに引き継ぐ
  • 制御された遷移のためのキーフレームから動画への変換
  • リップシンクされた多言語の会話
  • 複数ショットのシーケンスへのクリップのエージェント的な連結
  • 多言語テキストレンダリングを伴う画像の合成と編集
The FLUX 3 capability overview showing one model spanning image, video, audio and action, as published by Black Forest Labs
The FLUX 3 capability overview showing one model spanning image, video, audio and action, as published by Black Forest Labs

静止画にはMidjourney、クリップには別のツール、ナレーションには3つ目のツールと使い分けてきた人にとって、この統合そのものが売り文句になる。1つのモデル、1つの請求書、1つのプロンプト言語。この拡散モデルの系譜は、そもそも静止画で止まるつもりなど最初からなかったのだ。

このプレッシャーはすでに他の場所にも表れている。現状テキストファイルで終わっているAI動画スクリプトのワークフローはどれも、同じプロンプトからクリップとナレーションの両方をレンダリングできるモデルの候補になる。

動画こそが難所であり、計算資源の配分がそれを証明している

Bar showing the FLUX 3 training compute split: video prediction takes over 95%, images a thin slice, audio under 0.5% of tokens
Bar showing the FLUX 3 training compute split: video prediction takes over 95%, images a thin slice, audio under 0.5% of tokens

今回のローンチ全体で最も有用なエンジニアリング上の詳細はコスト内訳であり、それはロボティクスの併載記事に埋もれている。

動画予測がFLUX 3の総学習計算量の95%以上を占める。 音声付き720p動画のトークンのうち、音声は0.5%未満だ。Black Forest Labsは音声を「簡単なモダリティ」と呼んでいる。低次元で、すでに動画が示している内容と密結合しているため、モデルが動画を学習し終えれば、リップシンクや衝撃音はほぼ副産物として身についてしまうという。

動作についても同じ形をしていることがわかった。低次元の信号で、視覚的な観測に密結合している。これがこのリリース全体を支える主張だ。これを受け入れるなら、動画モデルとはたまたまピクセルを出力する世界モデルであり、ロボット制御は単なる別のデコーダーヘッドにすぎないということになる。

彼らはそれを正直なやり方でテストもしている。稼働中の学習ランに動作予測を追加すると、テキストから動画、画像から動画に対する人間の評価が最大10%下がった。しかし3,500ステップ後、動画品質は元の水準に戻り、その上に動作予測が乗った。一時的な落ち込みであって、恒久的な代償ではない。 彼らは反証可能な予測を立て、その結果を公表した。これはほとんどのローンチがわざわざやらないことだ。

Black Forest Labsが公表した数字

Chart of how often human raters preferred FLUX 3 over rival video models, from 52% against Gemini Omni Flash to 93% against Luma Ray 3.2, as taken from Black Forest Labs
Chart of how often human raters preferred FLUX 3 over rival video models, from 52% against Gemini Omni Flash to 93% against Luma Ray 3.2, as taken from Black Forest Labs

これらは10秒、720p、音声付きのテキストから動画へのクリップにおける選好率だ。ベンダー自身が付けている注意書きとあわせて読んでほしい。モデルもテスト基盤もまだ開発途上であり、50%は票が均等に割れたことを意味する。

比較対象FLUX 3を選んだ割合読み方
Luma Ray 3.293%大差
Runway Gen-4.577%明確
Grok Imagine Video69%明確
Kling v3 Pro60%実質的だが小差
Happy Horse v159%実質的だが小差
Happy Horse 1.157%わずか
Seedance 2.052%コイントス
Gemini Omni Flash52%コイントス

このばらつきこそが、見出しの数字よりもこの表を読む価値があると言える理由だ。現行最強クラスの2モデルに対しては、FLUX 3はコイントスにすぎない。 Luma Ray 3.2に対しては圧勝だ。プレスリリースが「最大93%の比較で選好された」と真実を語りながら、実はほとんど何も伝えていない、というのは、私自身の業界で単一の統合デフレクション数値が使う手口とまったく同じだ。

Black Forest Labsは、自らの成績の中で負けている側の数字まで公表した点で評価に値する。画像側については比較数値はまだなく、サンプルのみで、同社は複雑なプロンプト処理とテキストレンダリングが以前のFLUXバージョンから「大幅に」改善したとしか述べていない。

Grid of FLUX 3 image samples across illustration, photographic and typographic styles, as published by Black Forest Labs
Grid of FLUX 3 image samples across illustration, photographic and typographic styles, as published by Black Forest Labs

今日の静止画について同条件での比較を知りたいなら、両方のモデルが実際に使える状態にあるGPT Image 2とMidjourneyの比較が参考になる。

生成ではなく編集用途であれば、Qwen Image Editが現時点で最も近い代替だ。安価かつ高速な選択肢としては、多くのチームが代わりに選ぶのがNano Banana 2 Liteだ。

今日実際に手に入るもの

The FLUX 3 model page showing a Coming Soon label and a Request early access button, captured 4 August 2026 from Black Forest Labs
The FLUX 3 model page showing a Coming Soon label and a Request early access button, captured 4 August 2026 from Black Forest Labs

Black Forest Labsが公表した順にアクセスの段階を並べるとこうなる。

Four-rung access ladder: FLUX 3 Video in early access, FLUX 3 Action partners only, FLUX 3 Image coming in weeks, FLUX 3 Dev open weights with no date, all sitting left of the line marking public self-serve access
Four-rung access ladder: FLUX 3 Video in early access, FLUX 3 Action partners only, FLUX 3 Image coming in weeks, FLUX 3 Dev open weights with no date, all sitting left of the line marking public self-serve access
機能入手方法2026年8月4日時点のステータス
FLUX 3 VideoAPIおよびプライベートウェイトアクセスアーリーアクセス、申請フォーム
FLUX-mimicとFLUX 3 Action選定された研究・商業パートナー限定非公開、mimic roboticsが最初
FLUX 3 ImageAPIおよびプライベートウェイトアクセス「今後数週間」
FLUX 3 Devオープンウェイトのマルチモーダルバックボーン発表済み、日付未定

次は料金ページだ。ここに話の着地点がある。

The Black Forest Labs pricing page showing tabs for FLUX.2, FLUX Tools and FLUX.1 only, with no FLUX 3 row, as taken from Black Forest Labs
The Black Forest Labs pricing page showing tabs for FLUX.2, FLUX Tools and FLUX.1 only, with no FLUX 3 row, as taken from Black Forest Labs

FLUX 3はそこに載っていない。 タブは3つあり、そのどれもFLUX 3ではない。ドキュメントはさらに踏み込んで、FLUX.2が「あらゆるユースケースにおける推奨モデルファミリー」だとはっきり述べている。つまり今月中に何かを出荷する必要があるなら、実際の選択肢は料金表があるものに限られる。

モデル1MP目追加MPあたり参照画像適した用途
FLUX.2 [max]$0.07$0.03$0.03/MP最高忠実度、最大4MP
FLUX.2 [pro]$0.03$0.015$0.015/MP品質と速度のバランス
FLUX.2 [flex]$0.05$0.05$0.05/MP純粋なメガピクセル単位課金
FLUX.2 [klein] 9B$0.015$0.002$0.002/MP高スループット・低遅延
FLUX.2 [klein] 4B$0.014$0.001$0.001/MP画像あたり最安

解像度は出力とそれぞれの参照画像ごとに、次のメガピクセル単位に切り上げられ、1メガピクセルは1024×1024だ。4MPを超える分はリサイズされて縮小される。つまり、参照画像を渡し始めた途端に、掲示価格と実際の請求額が急速に乖離していくということだ。以下がその計算式だ。

1080pの[pro]ジョブに参照画像を2枚使うだけで、請求額の3分の1が入力側に消える。これは2か月目になって初めて気づく類の詳細であり、私が費用計算してきたあらゆるLLMの料金表と同じ教訓だ。見出しの単価は、実際に自分が買っている単位であることはめったにない。

ロボットの部分は余談ではない

Chart of autonomous success rates on a soft-body kitting task, with FLUX-mimic at a 95% median against 55% for the pi-0.5 baseline, as taken from Black Forest Labs
Chart of autonomous success rates on a soft-body kitting task, with FLUX-mimic at a 95% median against 55% for the pi-0.5 baseline, as taken from Black Forest Labs

画像生成企業がロボティクスモデルを出すのは方向転換のように見える。Black Forest Labsの主張はその逆だ。コンテンツ生成と物理的な制御が同じ世界モデルの上で動くのなら、ロボティクスはすでに投資済みの成果に取り付けられた2つ目のデコーダーにすぎない。

その証拠が、FLUX 3の動画パスの中間特徴量で学習された軽量なアクションデコーダーであり、mimic roboticsと共同でFLUX-mimicとして構築された。柔軟物体のキッティングタスクにおいて、それぞれ自律試行20回で結果は以下の通りだった。

モデル成功率(中央値)
FLUX-mimic95%
シングルタスクのフローマッチング70%
FLUX-mimic(バックボーン凍結)65%
π0.555%
π0.5(バックボーン凍結)0%

重要なのはバックボーン凍結の行だ。 FLUX 3全体を凍結し、デコーダーだけを学習させても、なお65%が出る。π0.5ベースラインで同じことをするとゼロになる。世界知識はただ存在しているだけでなく、特徴量からそのまま動作を読み取れるほど判読可能な形になっているということだ。これを裏付けるもう2つの数字がある。バックボーンは単体のRTX 5090上で入力から表現への変換を80ミリ秒未満でこなし、mimicのロボット全体のループの反応速度は101ミリ秒だ。

この導入は実験室のデモではなく本物だ。Audiは、従来の自動化では手が届かなかったシールやケーブルのような本番・物流タスクでこれを稼働させ続けている。

"We have seen these robots solve complex soft-body manipulation work that would have been simply impossible with conventional robotics."

Christoph Schneider, Audi Production Lab, quoted in Black Forest Labs' announcement

戦略的に興味深いのはサンプル効率に関する主張だ。Black Forest Labsは、より優れた表現によって特定の成功率に到達するのに必要な学習ステップ数が半分になったと報告し、動画アクションモデルにおいてmimic-video論文が示す最大10倍のサンプル効率にも言及している。ロボットに新しいタスクを教えることがデータ収集プロジェクトでなくなるなら、工場自動化の経済性そのものが変わる。これはどんな20秒のクリップよりも大きな意味を持つ話であり、DeepMindがロボティクスの側から検証しているのと同じ仮説だ。

Hacker Newsの反応

ローンチスレッドは571ポイント、133コメントを集め、反応はきれいに二分された。技術系オーディエンスが求めているものは1つで、それは動画の長さではない。

Hacker News

"Flux 2 Dev Klein has practically been the best you could use on most commercial hardware so I really hope Flux 3 has a comparable updated open-weights model to it. if not it'd be a great loss to most hobbyists."

オープンウェイトの話は何度もコメントに登場し、たいてい同じ懸念が添えられていた。オープンウェイトの項目はローンチ計画の一番下に、日付も付かずに置かれている。何人かはVRAMが、FLUX 3 Devを自宅で使えるかどうかを決める要因になると指摘していた。

懐疑派の声はローンチの内容に見合わないほど大きかったが、1つの批判は的を射ていた。

Hacker News

"Showed close to zero examples of people. Frivolous use of the term World Model. Claims 20 seconds of video, shows only jumpcuts."

これは、人物や連続性についての主張が最も強気なページに対する公正な読み方だ。反対意見にも票が集まった。

Hacker News

"It's incredible how negative and dismissive the comments in here are while here I am thinking the model actually looks impressively capable."

両方とも同時に真実でありうる。結果は強力に見え、発表文は誇張気味で、実物はフォームの向こう側にある。個人的には、また別のハイライトリールよりも、計算量の内訳とバックボーン凍結のグラフを取る。そしてBlack Forest Labsはその両方を公表している。

AIを仕事で買う立場から見た意味

The eesel AI dashboard showing connected helpdesk activity and resolution reporting
The eesel AI dashboard showing connected helpdesk activity and resolution reporting

私は生業として動画を生成しているわけではない。私が作っているのはサポートチケットに答えるAIエージェントだが、FLUX 3は、自分と同じカテゴリーでの次の3つのローンチをどう読むかを変えてしまった。

デモリールより先にアクセスの段階を読む。 ローンチには機能のリストと利用可能性のリストがあり、この2つが同じであることはめったにない。FLUX 3のページはこの点で異例なほど正直で、その段階をまさにそこに公開している。ほとんどのAIサポートベンダーはそうしない。だからこそ、有効な問いは常に「これはできますか?」ではなく「これらのうちどれが今、自分のプランに含まれていますか?」だ。これはAIエージェントとチャットボットを比較するときに私が指摘するのと同じギャップだ。デモは天井を見せ、プランは床を見せる。

見出しの数字より分布を見る。 「最大93%の比較で選好」と「最強2社に対してはコイントス」は、同じ表を語っている。ベンダーがAI品質について1つの数字しか出さないなら、その裏にある分布を求めるべきだ。これは、単一のブレンドされたティア1のデフレクション指標よりもインテント単位の指標のほうが優れているという主張のすべてであり、私は自社の製品についても同じことを言っている。単一の精度スコアよりも信頼度しきい値のほうが優れている理由もここにある。

1つのバックボーンで多くの仕事をこなす、これこそが本当のトレンドだ。 FLUX 3は1つのモデルから画像・動画・音声・動作をこなす。言語の側でも同じ集約が起きていて、それがGPT-5.6DeepSeek V4 Flashが以前なら専門モデル3つを必要とした仕事をこなせるようになった理由だ。Claude Opus 4.6も同じ曲線の上にいる。

内部に1つの狭いモデルしか持たないツールを買うことは、以前よりも寿命の短い意思決定になっている。どのモデルに落ち着くにしても、顧客の目に触れさせる前にハルシネーション対策と照らし合わせて確認すべきだ。

オープンウェイトは本当の分岐点だ。 FLUX 3 Devはいずれ、チームがマルチモーダルバックボーンを自前でホストできるようにするだろう。それは魅力的だが、ファインチューニングやGPU、オンコール体制を自分たちで抱え込むまでの話だ。社内に構築できるスキルをすべて備えていた当社の顧客は、それを端的にこう表現した。

"We could try to write our own LLM application but we didn't want to invest our time into that. We wanted something that we would not have to maintain."

Karel, GENERAL BYTES

これは、私よりもうまく言い表されたトレードオフだ。トレーニングカスタムモデルの作業こそが、誰もデモで見せない部分だ。

待機リストではなく、本当にチケットに答えるAIが欲しいですか? eeselは数分でヘルプデスクに接続し、過去のチケットとヘルプセンターから学習し、実際の履歴に対してシミュレーションを実行するので、顧客の目に触れる前に解決率がわかる。フォームも、アーリーアクセスの順番待ちもない。eeselを試す、無料で。

eesel AI drafting and resolving tickets inside Zendesk

FLUX 3の現在地

FLUX 3はこの夏でもっとも興味深いモデルのローンチであり、同時にもっとも購入できないローンチでもある。 技術的な主張は強い。4つのモダリティにまたがる1つのバックボーン、公表された計算量の内訳、負けを含めた正直な選好レンジ、そして偽装が難しいバックボーン凍結のロボティクス結果。Audiでの導入は、多くのフィジカルAIの発表にはない現実の裏付けを与えている。

一方で持っていないのは、価格、エンドポイント、日付だ。FLUX.2はBlack Forest Labs自身が現行のあらゆるユースケースに推奨しているものであり、最初の1メガピクセルあたり$0.014から$0.07という料金表がある版だ。FLUX 3がロードマップに入っているなら、アーリーアクセスを申請しつつ、当面はFLUX.2を前提に計画を立てるとよい。

より広くジェネレーティブツールを選ぶ立場にあるなら、私の生成AIツールまとめが今日買えるものを網羅している。同じ仕事の執筆側については、ブログ向けAIモデルから読み始めるとよい。

コンテンツの側では、AIブログ自動化がこうした画像モデルが実際に日々使われる場所だ。AI記事ライターはそれらを呼び出す部分であり、生成AI SEOツールはその出力の行き先だ。

サポートの側では、サポートチーム向け生成AIがより良い出発点になる。さらに手前の段階なら、カスタマーサービス向け生成AIがこのカテゴリー全体をカバーし、サポートにどのLLMが向くかがモデル選び自体に踏み込んでいる。

Sources

よくある質問

FLUX 3とは何ですか?
FLUX 3はBlack Forest Labsのマルチモーダル基盤モデルで、2026年7月24日に発表された。画像生成のみだったFLUX.1やFLUX.2と違い、FLUX 3は画像・動画・音声を1つのアーキテクチャで同時に学習し、同じバックボーンがロボットの動作予測も行う。1回の生成で最大20秒のネイティブ音声付き動画を出力する。仕組みに興味があれば、この系譜のもとになった拡散モデルの解説記事も参照してほしい。
FLUX 3の料金はいくらですか?
FLUX 3の価格はまだ公開されていない。Black Forest Labsの料金ページに載っているのはFLUX.2、FLUX Tools、FLUX.1のみで、FLUX 3の行は存在しない。最も近い実数値はFLUX.2の料金で、[max]が最初の1メガピクセルで$0.07、[pro]が$0.03、[klein] 4Bが$0.014だ。単位ではなく成果に対してAI予算を組みたい人には、解決あたりのコストという捉え方のほうが役に立つはずだ。
FLUX 3はもう使えますか?
一部だけだ。FLUX 3 Videoは申請フォームの先にあるアーリーアクセス段階で、FLUX 3のモデルページも2026年8月4日時点で「Coming Soon」のままだ。FLUX 3 Imageは「今後数週間」で登場するとされ、動作予測は選ばれたパートナーに限定され、オープンウェイト版のFLUX 3 Devには日付すら発表されていない。今日すぐに使える自セルフサーブの選択肢は依然としてFLUX.2で、それはNano Banana 2GPT Image 2が今すぐ使えるのと同じことだ。
FLUX 3はKling、Runway、Grok Imagineより優れていますか?
Black Forest Labs自身の予備的な数値によれば、人間の評価者はLuma Ray 3.2に対して93%、Runway Gen-4.5に対して77%、Grok Imagine Videoに対して69%、Kling v3 Proに対して60%の割合でFLUX 3を選んだ。Seedance 2.0とGemini Omni Flashに対しては52%で、これはほぼコイントスに近い。これらはまだ学習中のモデルに対するベンダー自身の初期評価であり、第三者によるベンチマークではない点は、AIパフォーマンス指標全般に対して私が持っているのと同じ警戒感を向けるべきだ。
FLUX 3はオープンウェイトになりますか?
Black Forest Labsは「いずれは」なると答えている。「FLUX 3 Dev」は、コンテンツ生成と動作予測の両方に使えるマルチモーダルバックボーンへのオープンウェイトアクセスとして案内されている。日付も、パラメータ数も、ライセンス条件も、まだ何も添えられていない。既存のパターンは参考になる。FLUX.2 [klein]はApache 2.0で提供され、オープンウェイト展開向けの有料ライセンス階層は月1万画像から始まる。自前ホスティングとAPI利用を天秤にかけているチームは、まず私のカスタムAIモデルに関する記事を読んでほしい。
FLUX 3とロボットにはどんな関係がありますか?
同じバックボーンが動作予測も行う。Black Forest Labsとmimic roboticsは、FLUX 3の動画パスを読み取る軽量なアクションデコーダーを持つ動画アクションモデル「FLUX-mimic」を共同開発し、Audiが柔軟物体の組み立て作業でこれを本番運用でテストしている。柔軟物体のキッティングタスクにおける自律成功率は20試行の中央値で95%、比較対象のπ0.5ベースラインは55%だった。これは生成の側から語られたGemini Robotics 2と同じアーキテクチャ上の物語だ。
FLUX 3をブログ画像やサポートコンテンツに使えますか?
まだ使えず、実用上の答えは今日のところFLUX.2だ。FLUX 3が示しているのは、イラスト・短い解説動画・そのナレーションを1つのモデルがまとめて担うようになる、つまり3つのツールと3つの請求書が1つに集約されるということだ。これは画像付きAIブログライターを運用している人や、ビジュアル付きのヘルプセンターコンテンツを作っている人にとって重要な話で、ブログに最適なAIモデルと合わせて読む価値がある。
FLUX 3のローンチからサポートチームは何を学ぶべきですか?
デモリールではなくアクセスの段階を読むことだ。FLUX 3は、印象的な部分と実際に購入できる部分が別物であるローンチであり、それはほとんどのAIサポート製品の売り込みにもそのまま当てはまる形だ。どの機能が今日、どのプランで、いくらで使えるのかを確認し、契約する前に自分たちの過去のデータでテストすること。それがまさにエージェント型カスタマーサービスソフトウェアを事前にシミュレーションできることの意味であり、ローンチ後ではなく前に敵対的テストを行うことの意味でもある。

Share this article

Rama Adi Nugraha

Article by

Rama Adi Nugraha

Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.

Related Posts

All posts →
2人のレビュアーが天秤で生成画像パネルを比較しているイラスト、FLUX 3レビューを表している
Trending

FLUX 3レビュー:根拠は強いが、まだ買えるものはない

FLUX 3について今実際にレビューできるものだけをレビューする、それは根拠だ。研究内容はローンチ投稿よりも説得力がある。だが製品自体はまだ存在しない。

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026
ヒューマノイドロボットの制御モデルを描いたイラスト、Gemini Robotics 2を表現
Trending

Gemini Robotics 2:DeepMind自身の数字が示すもの

Gemini Robotics 2は3つのモデルを同時に出し、タスク別成功率の表ではほとんどのスコアが80%を下回る。この表こそ、今回のリリースで最も役に立つ部分だ。

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026
多数の暗い経路の中から2つの光るエキスパート経路へトークンを振り分ける小型モデルチップのイラスト。Inkling-Small の解説用
Trending

Inkling-Small解説:2760億パラメータ、実働は120億

Inkling-Smallが実際に何なのか:Thinking Machines発の2760億/120億のオープンウェイトMoEモデル、ドキュメントとプロバイダーで食い違うコンテキストウィンドウ、100万トークンの実際のコスト、そしてサポートスタックにおける位置づけ。

Rama Adi NugrahaRama Adi NugrahaAug 4, 2026
整然とした小型モデルのコアと、はるかに大きく絡み合ったコアを比較するイラスト。Inkling-Small のレビュー用
Trending

Inkling-Smallレビュー:サイズは4分の1、賢さはほぼそのまま

実際に試したInkling-Smallレビュー:サイズと価格が4分の1でありながら、コーディングでは975Bの親モデルを上回る。ただし事実性は崖から落ちるように急落する。このトレードオフが実際に何を意味するのかを解説する。

Alicia Kirana UtomoAlicia Kirana UtomoAug 4, 2026
画像、動画、文書のパネルがビジョン言語モデルに入力される様子を描いたイラスト、Qwenのロゴ付き
Trending

Qwen 3.7 Flash: スペック、価格、そして実際にできること

Qwen 3.7 Flashはブログ記事もベンチマークも重みの公開もないまま登場した。ここでは完全なスペックシート、段階的な料金、そしてQwenが決して主張しなかったことをまとめる。

Alicia Kirana UtomoAlicia Kirana UtomoJul 31, 2026
Inklingの代替としてのAIモデル比較を表すエディトリアルイラスト
Trending

2026年版 Inklingの代替8選

Inklingはオープンで興味深いモデルだが、オープンウェイトとしては高価で、実行できる中で最も賢いモデルというわけでもない。実際に試す価値のある8つの代替モデルを、実際の価格とそれぞれの強みとともに紹介する。

Rama Adi NugrahaRama Adi NugrahaJul 20, 2026
レビュー対象であるThinking Machines Labのオープンウェイト AI モデル「Inkling」のイラスト
Trending

Inklingレビュー:Thinking Machinesのオープンモデルは購入する価値があるか?

Inklingの本音レビュー:Thinking Machines Labの最初のオープンウェイトモデルが本当に得意なこと、価格とベンチマークでがっかりする点、そして実際に誰が使うべきかを解説します。

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 20, 2026
Thinking Machines Labのオープンウェイトモデル、Inklingのイラスト
Trending

Inklingとは:Thinking Machinesのオープンウェイトモデルを解説

Inklingが実際に何なのか:Thinking Machines Labによる初のオープンウェイトモデル、その本当のベンチマーク、運用コスト、そしてサポート業務の近くに置いていいものかどうか。

Alicia Kirana UtomoAlicia Kirana UtomoJul 20, 2026
Google NotebookLMがドキュメントを短い縦型動画の概要に変換するイラスト
Trending

NotebookLMのShort Video Overviews: 60秒フォーマットを解説

NotebookLMの新機能Short Video Overviewsは、ソース資料を60秒の縦型動画に変換する。このフォーマットが何をするのか、どう作られているのか、どこに限界があるのかを解説する。

Alicia Kirana UtomoAlicia Kirana UtomoJul 11, 2026

AIチームメイトを採用する準備はできましたか?

数分でセットアップ。クレジットカード不要。

無料で始める