APIMart
Black Forest Labs
近日公開

FLUX 3

FLUX 3 API — 画像・動画・音声を統合するAI、APIMartで近日公開

Black Forest LabsのFLUX 3 APIは、画像生成・編集、ネイティブ音声付き動画、アクション予測を1つのマルチモーダル基盤モデルに統合します。APIMartがアクセス詳細を準備している間に、発表済みのFLUX機能をご確認ください。

近日公開マルチモーダルAI動画生成画像生成ネイティブ音声

FLUX 3 APIプレビュー

Black Forest Labsが発表したマルチモーダル機能を先行紹介

近日公開

FLUX 3 APIがAPIMartに近日登場

APIMartはFLUX 3 APIの統合を準備中です。提供開始時には、FLUX 3 APIページで対応モダリティ、リクエスト形式、制限、アクセス詳細を公開します。

  • APIMartの統合プラットフォームからFLUX APIへアクセス
  • 画像、動画、ネイティブ音声を扱うFLUXマルチモーダルワークフロー
  • 統合準備の完了時にFLUXの料金とドキュメントを公開

FLUX 3 APIの特長

Black Forest Labsの早期アクセス発表で確認されたFLUX機能

FLUXマルチモーダル基盤モデル

FLUX 3 APIは、生成タスクを個別に分離するのではなく、画像、動画、音声、アクション予測を1つのアーキテクチャで共同学習するモデルを基盤としています。

ネイティブ音声付き動画

プレビューでは、別途音声を生成する工程を使わずに、台詞、環境音、出来事に連動する音を含む映像と音声の同期生成が示されています。

最長20秒の動画

このモデルについてBFLは、ネイティブ音声付き動画を1回の生成で最長20秒まで作成でき、より長いシーケンスは連結と参照素材で構築できるとしています。

FLUX動画ワークフロー

FLUX 3 APIの機能発表には、テキストから動画、画像から動画、動画から動画、キーフレームガイダンス、動画の延長、動画と音声の延長が含まれます。

FLUX参照ガイド生成

FLUX 3 APIのプレビューでは、テキストと画像または動画の参照を組み合わせ、被写体、ビジュアルアイデンティティ、動き、構図、一貫性をガイドします。

FLUX画像生成・編集

FLUX 3 APIモデルは、動画に使われるマルチモーダル理解を維持しながら、さまざまなスタイル、アスペクト比、解像度で画像を生成または編集できます。

FLUXプロンプト・タイポグラフィ制御

このモデルは複雑な指示への追従性を高め、タイポグラフィやアニメーション動画デザインに対応します。またBFLは、多言語の画像内テキストがより正確になったと報告しています。

FLUXアクション予測

FLUX 3 APIモデルは、視覚的なダイナミクスの理解をアクション予測へ拡張します。APIMartで利用できるかどうかは最終的な統合内容によって決まります。

FLUX 3 APIの想定ワークフロー

複数のメディアを横断する将来のFLUXワークフローとクリエイティブ・制作シーン

FLUXストーリーボード・プリビジュアライゼーション

将来のFLUX 3 APIワークフローでは、脚本、キーフレーム、参照映像を、動きとネイティブ音声を備えたシーケンスへ変換し、制作計画に活用できる可能性があります。

多言語キャンペーンクリエイティブ

チームは将来、FLUX 3 APIを使い、1つのクリエイティブ方針から、多言語の台詞や画面内テキストを含むローカライズ済みのビジュアルと動画コンセプトを制作できる可能性があります。

FLUX商品画像・動画

将来のFLUX 3 APIワークフローでは、商品参照を活用し、被写体の特徴を保ったキャンペーン画像、デモ、短い動画バリエーションを作成できる可能性があります。

FLUX画像生成・編集

クリエイターは将来、FLUX 3 APIを使い、自然言語の指示から素材を生成したり、スタイル、形式、アスペクト比、解像度をまたいで画像を修正したりできる可能性があります。

FLUX動画の延長・スタイル変更

将来のFLUX 3 APIワークフローでは、開始フレーム、キーフレーム、参照動画を基にクリップを延長し、ビジュアルスタイルを変換し、動きをガイドできる可能性があります。

連携するクリエイティブパイプライン

FLUX 3 APIは、1つのモデルファミリーで画像コンセプト、動画、ネイティブ音声をつなぎ、反復制作で個別ツール間の受け渡しを減らせる可能性があります。

FLUX 3 APIのよくある質問

Black Forest Labsが確認したFLUX 3 APIモデルの情報と、APIMartで予定されているアクセスについて

FLUX 3 APIとは何ですか?

FLUX 3 APIは、Black Forest Labsのマルチモーダル基盤モデルに、画像、動画、音声、アクション予測を横断してアクセスするためのAPIです。テキストとビジュアル参照を入力できます。

FLUX 3 APIはいつAPIMartで利用できますか?

FLUX 3 APIはAPIMartで近日提供予定ですが、開始日は発表されていません。対応モダリティ、ドキュメント、制限、料金は、統合準備が整い次第公開します。

FLUX 3 APIは音声付き動画を生成できますか?

BFLは、FLUX 3 APIモデルが、多言語の台詞、環境音、シーン内の出来事に伴う音を含む動画とネイティブ音声を同時生成するものだと説明しています。

FLUX 3 APIの動画は最長何秒ですか?

FLUX 3 APIモデルについてBFLは、ネイティブ音声付き動画を1回の生成で最長20秒まで作成できるとしています。より長いシーケンスには連結と参照素材を使用できますが、APIMartでの制限はまだ確定していません。

発表済みのFLUX 3 API動画ワークフローは?

FLUX 3 APIの機能発表には、テキストから動画、画像から動画、動画から動画、キーフレームから動画、動画の延長、動画と音声の延長、参照ガイダンスが含まれます。

FLUX 3 APIは画像の生成と編集に対応しますか?

BFLによると、FLUX 3 APIモデルはさまざまなスタイル、アスペクト比、解像度で画像を生成・編集でき、複雑なプロンプトと多言語テキストをより適切に処理します。

FLUX 3 APIのアクション予測とは何ですか?

FLUX 3 APIモデルのアクション予測は、学習した視覚的ダイナミクスを使って次に起こり得ることを予測します。APIMartはこの機能へのアクセスをまだ確定していません。

FLUX 3 APIの全モダリティをAPIMartで利用できますか?

FLUX 3 APIの最終的な統合範囲はまだ発表されていません。対応モダリティ、リクエスト形式、出力制限、商用条件、料金は、アクセス提供時に公開されます。