What is Flux 1 AI

Flux 1 AI

最先端の画像生成。トップクラスのプロンプト追随性、視覚品質、画像ディテール、出力の多様性を実現します。


Flux.1モデルファミリー

テキストから画像を生成するFLUX.1スイートをリリースします。これは、画像ディテール、プロンプト順守、スタイルの多様性、シーンの複雑さにおいて、テキストから画像への合成の新たな最先端を定義します。



Transformer駆動のFlow Modelの大規模化

公開されているすべてのFLUX.1モデルは、マルチモーダルおよびパラレル拡散トランスフォーマーブロックのハイブリッドアーキテクチャに基づいており、12Bパラメータにスケールされています。当社は、フローマッチングに基づくことで、以前の最先端の拡散モデルを改善しています。フローマッチングは、生成モデルを訓練するための一般的で概念的にシンプルな方法であり、拡散を特殊なケースとして含みます。さらに、回転位置埋め込みパラレルアテンション層を組み込むことで、モデルのパフォーマンスを向上させ、ハードウェア効率を改善しています。近日中に、より詳細なテクニカルレポートを公開する予定です。

画像合成の新たなベンチマーク

FLUX.1は、画像合成の新たな最先端を定義します。当社のモデルは、それぞれのモデルクラスで新しい標準を打ち立てます。FLUX.1 [pro]と[dev]は、Midjourney v6.0、DALL·E 3 (HD)、SD3-Ultraなどの人気モデルを、視覚品質、プロンプト追随、サイズ/アスペクト比の多様性、タイポグラフィ、出力の多様性の各側面で上回ります。FLUX.1 [schnell]は、これまでで最も高度な数ステップモデルであり、同クラスの競合他社だけでなく、Midjourney v6.0やDALL·E 3 (HD)などの強力な非蒸留モデルも凌駕します。当社のモデルは、事前学習からの出力の多様性を完全に保持するように特別に微調整されています。現在の最先端と比較して、以下に示すように大幅に改善された可能性を提供します。

すべてのFLUX.1モデルバリアントは、以下の例に示すように、0.1メガピクセルから2.0メガピクセルの多様なアスペクト比と解像度をサポートしています。


次のステップ:すべての人のためのSOTAテキストからビデオへ

本日、当社はFLUX.1テキストから画像モデルスイートをリリースします。これらのモデルの強力な創造能力は、当社が計画している競争力のある生成テキストからビデオシステムのスイートの強力な基盤となります。当社のビデオモデルは、高解像度で前例のない速度の正確な作成と編集を可能にします。当社は、生成メディアの未来を切り開き続けることにコミットしています。



Flux 1 AIジェネレーターの例:


プロンプト:リビングルームにある古いピアノ


プロンプト:薄暗い部屋の木製デスクの上に置かれた、ほこりをかぶった古いCRTモニターの詳細なシネマティックな被写界深度レンダリング。周囲にはアイテムが散らかり、汚い部屋。画面には「FLUX」の文字が柔らかく輝いている。高精細なハードサーフェスレンダリング


プロンプト:私の小さな散らかった寝室の壁に現れた神話の森へのポータル

Summary and Review:

「本日、私たちはBlack Forest Labsの立ち上げを発表できることを嬉しく思います。生成AI研究コミュニティに深く根ざした私たちの使命は、画像や動画などのメディア向けの最先端の生成的深層学習モデルを開発・推進し、創造性、効率性、多様性の限界を押し広げることです。私たちは、生成AIが将来のすべてのテクノロジーの基本的な構成要素になると信じています。モデルを広く利用可能にすることで、その利点をすべての人に届け、一般の人々に教育を提供し、これらのモデルの安全性への信頼を高めたいと考えています。私たちは、生成メディアの業界標準を構築することを決意しています。本日、この目標への第一歩として、テキストから画像への合成のフロンティアを押し広げるFLUX.1モデルスイートをリリースします。」



「Black Forest Labsの立ち上げを発表できることを嬉しく思います。私たちの使命は、メディア向けの最先端の生成的深層学習モデルを開発・推進し、創造性、効率性、多様性の限界を押し広げることです。」


2024年8月1日

- Black Forest Labs

AIニュースレターを購読
あなたのデータは私たちと完全に安全です。誰とも共有しません。