Midjourney が Thinking Mode を試験 V8.2 の後は機能追加が4件
Midjourney は2026年10月8日、生成済みの画像を見直して作り直す Thinking Mode の試験を Alpha サイトで始めた。対象は V8.2 のジョブで、料金と使えるプランは示されていない。
Midjourney
画像・動画を生成、編集できるAIモデル群
ドイツの Black Forest Labs が開発する画像生成・編集モデルのシリーズ。2024年8月の FLUX.1 に始まり、現在は画像・動画・音声を扱う FLUX 3 と、画像向けの FLUX.2 が並ぶ。API で使えるほか、FLUX.2 [dev] や [klein] などは重みが公開されている。仮想試着や不要物の削除といった専用ツールも API で提供している。
公式の日本語UIは確認できていない。FLUX 3 Video は日本語の台詞とリップシンクに対応する。料金は米ドル表示のみ。
公式サイト2026年10月10日時点で確認
Timeline
34件の出来事
最大10枚の参照画像、枠指定でのレイアウト制御、局所編集、4K出力に対応する画像モデル。API 料金は1Kで1枚0.048ドル。
公式発表:Release Notesロボット制御向けの7Bパラメータのモデル。カメラ画像と関節の位置から、将来の映像とロボットの動作を同時に予測する。重みは Hugging Face で配布している。
公式発表:Introducing FLUX 3 Action動画を最大4Kまで高解像度化するツール。忠実に拡大するモードと、描き足すモードがある。
公式発表:FLUX Video Upscale: 2K and 4Kテキストや画像から最長20秒の動画を、音声つきで生成する。日本語を含む多言語の台詞とリップシンクに対応し、BFL API で一般提供された。
公式発表:FLUX 3 Video, Part 1: Generation画像・動画・音声をまとめて学習したマルチモーダルの基盤モデル。提供は先行アクセスから始まり、API、重みの提供、重み公開版の FLUX 3 Dev を順に出す計画とされた。
公式発表:FLUX 3 - Real World Models: Towards Multimodal Flow Models as the Backbone of Visual Intelligenceロボット企業の mimic robotics と、FLUX 3 を土台にした映像・動作予測モデルを共同開発した。Audi の工場での部品組み付けなどで試験している。
公式発表:FLUX 3 x mimic: The Next Generation of Video-Action ModelsASUS と NVIDIA との提携で、ProArt ノート PC の MuseTree アプリに FLUX.2 [klein] 4B が搭載される。ネット接続や API なしで動く。
公式発表:FLUX.2 is now on device: ASUS ProArt laptops now support Klein models映画監督のマーティン・スコセッシ氏が Black Forest Labs のアドバイザーに就いた。絵コンテなど映画の準備作業での FLUX 活用を試している。
公式発表:Visual Intelligence for Cinema: Martin Scorsese × Black Forest Labs人物画像に服を着せて見せる仮想試着モデル。4秒未満で生成し、最大4着まで重ねられる。7月17日に v2 が出ている。
公式発表:FLUX VTO: Virtual Try-On at scaleマスクした物や人物、文字を消して背景を復元するツール。プロンプトは不要で、画像とマスクだけを渡す。
公式発表:FLUX Erase: Remove anything, leave no trace画像を枠の外へ広げる専用エンドポイント。出力サイズを指定でき、最大4メガピクセルに対応する。
公式発表:FLUX Outpainting: Extend any image, in any directionClaude や Cursor など MCP 対応のクライアントから FLUX を呼び出せる公式サーバーを公開した。8月11日に動画生成にも対応した。
公式発表:Release NotesFLUX.2 [pro] の生成速度が2倍になった。あわせて flux-2-pro-preview エンドポイントが加わった。
公式発表:Release Notes4Bと9Bの小型モデル。0.5秒未満での生成・編集をうたう。4B は Apache 2.0、9B は非商用ライセンスで配布している。
公式発表:FLUX.2 [klein]: Towards Interactive Visual IntelligenceSalesforce Ventures と Anjney Midha(AMP)の主導で3億ドルを調達した。評価額は32.5億ドル。
公式発表:Laying the Foundations for Visual Intelligence—Our $300M Series B[pro]、[flex]、重み公開の [dev] を出した。最大10枚の参照画像と4メガピクセルの出力に対応する。[dev] は32Bパラメータ。
公式発表:FLUX.2: Frontier Visual IntelligenceFlux Pro 1.0 のエンドポイントと Finetuning API の提供を終了した。10月3日に予告されていた。
公式発表:Release NotesAdobe Photoshop の生成塗りつぶしで FLUX.1 Kontext [pro] が使えるようになった。Photoshop ベータ版のユーザーが対象で、ベータ期間中は追加費用がかからない。
公式発表:FLUX.1 Kontext now in Adobe Photoshop: Powering Every PixelFLUX.1 Kontext [pro] と FLUX1.1 [pro] が Microsoft の Azure AI Foundry で使えるようになった。従量課金とプロビジョンド スループットの両方が選べる。
公式発表:FLUX Models Launch on Azure AI Foundry for Enterprise-Ready Image GenerationKrea AI と共同開発した、テキストから画像を作る重み公開モデル。AI らしい過度な彩度を抑え、写実的な描写を狙っている。
公式発表:FLUX.1 Krea [dev]: An 'Opinionated' Text-to-Image Model画像編集モデル Kontext の重み公開版を出した。12Bパラメータで、ライセンスは FLUX.1 Non-Commercial License。Hugging Face で配布している。
公式発表:FLUX.1 Kontext [dev] - Open Weights for Image Editingテキストと画像を入力して編集できる FLUX.1 Kontext の [pro] と [max] を公開した。ブラウザで試せる BFL Playground も同時に始めた。
公式発表:Introducing FLUX.1 Kontext and the BFL Playground1〜5枚の画像から FLUX.1 [pro] を自社向けに調整できる API を公開した。最大4メガピクセルの出力に対応する。
公式発表:Announcing the FLUX Pro Finetuning API通常の4倍の解像度(最大4メガピクセル)で生成する Ultra モードと、自然な写真風に仕上げる Raw モードを追加した。Ultra の料金は1枚0.06ドル。
公式発表:Introducing FLUX1.1 [pro] Ultra and Raw Modesインペインティング・アウトペインティングの Fill、構図を指定する Depth と Canny、画像の再構成を行う Redux の4つを公開した。Depth と Canny は後に BFL API での提供が終了している。
公式発表:Introducing FLUX.1 ToolsFLUX1.1 [pro] を公開し、BFL API を一般提供した。従来の [pro] より6倍速いとされ、API の料金は1枚あたり [dev] 2.5セント、[pro] 5セント、FLUX1.1 [pro] 4セントだった。
公式発表:Announcing FLUX1.1 [pro] and the BFL APIBlack Forest Labs が FLUX.1 を発表した。API 向けの [pro]、非商用の重み公開版 [dev]、Apache 2.0 で使える高速版 [schnell] の3種類で、テキストから画像を生成する。
公式発表:Announcing Black Forest LabsBlack Forest Labs が a16z 主導で3,100万ドルのシードラウンドを実施したと発表した。General Catalyst と MätchVC も追加で出資した。
公式発表:Announcing Black Forest Labs2024年8月1日に Black Forest Labs が FLUX.1 を発表した。
ドイツの Black Forest Labs。Stable Diffusion の開発者らが2024年に設立した。
2026年10月時点で、画像の FLUX 3 Image と動画の FLUX 3 Video が最新。
作れる。FLUX 3 Video が音声つきで最長20秒の動画を生成する。
FLUX 3 Video は日本語の台詞に対応する。公式の日本語UIは確認できていない。
API は従量課金で、FLUX 3 Image は1Kで1枚$0.048、FLUX 3 Video は HD で1秒$0.17。
公式の料金ページとドキュメントでは、無料プランや無料クレジットは確認できなかった。
API 経由の利用は可能。重み公開モデルはライセンスが種類ごとに異なる(klein 4B は Apache 2.0、9B は非商用)。
Midjourney は2026年10月8日、生成済みの画像を見直して作り直す Thinking Mode の試験を Alpha サイトで始めた。対象は V8.2 のジョブで、料金と使えるプランは示されていない。
MidjourneyAdobe は2026年9月23日、画像と動画の画質を高める AI 技術を持つ Topaz Labs の買収を完了した。同社の技術は Firefly と Photoshop で使える。ブランドと単体製品は残る。買収額は示されていない。
Google は2026年10月6日、画像生成モデル Nano Banana 2.1 を Gemini API で公開した。TRAIL の年表では222日ぶりの節目になる。1K の画像は1枚0.0336ドル相当で、無料枠はない。
Adobe
画像・動画・音声を生成できる Adobe の生成AI

Midjourney, Inc.
文章から高品質な画像を生成するAIツール
文章の指示で画像を作り、写真を編集できるAI