SoranoruNEWS
TOPIC

画像生成AIの最新情報

画像生成・編集モデルとクリエイティブ活用

Soranoru
NEWS FEED

5件のニュース

注目

Black Forest Labsが次世代モデル「FLUX 3」を発表、ロボット制御と連携した動作予測を実現

Black Forest Labsは、画像・動画・音声を統合した基礎モデル「FLUX 3」を発表しました。ロボット企業mimicとの提携により、製造ラインでの動作予測にも対応した「FLUX-mimic」を展開しています。

なぜ注目?

動画生成AIが単なるコンテンツ制作を超え、物理的なロボット制御や産業現場の自動化に応用され始めています。製造業や物流分野でのAI活用を検討する企業にとって、重要な技術的転換点となるでしょう。

このニュースを事業に活かす
IT之家(RSS)元記事へのリンクあり
注目

Black Forest Labsが多模態モデル「FLUX 3」を発表、20秒の動画生成に対応

画像・動画・音声を統合学習した基礎モデル「FLUX 3」が早期アクセスで公開されました。単一の生成プロセスで最大20秒の動画と音声を生成でき、文生成や画像からの動画生成にも対応しています。

なぜ注目?

動画生成AIの進化は、広告やコンテンツ制作のワークフローを劇的に変える可能性があり、最新モデルの表現力はクリエイティブ業務の効率化に直結します。

このニュースを事業に活かす
注目

動画生成AI「SANA-Video 2.0」発表、単一GPUで720p動画を効率的に生成

SANA-Video 2.0は、5Bおよび14Bのパラメータ規模を持つ混合型動画拡散Transformerです。線形とソフトマックスの注意機構を組み合わせることで、単一GPU環境での効率的な動画生成を実現しました。

なぜ注目?

高コストな計算リソースを必要とする動画生成において、単一GPUでの動作は中小規模の制作現場や個人クリエイターにとって導入のハードルを下げる重要な進歩です。

このニュースを事業に活かす
Qwen:Blog Retrieval(API)元記事へのリンクあり
注目

通義千問が画像生成モデル「Qwen-Image-3.0」を発表、実用性とテキスト描画精度を強化

「実」を追求した第3世代の画像生成モデルで、4.5kトークンの指示入力に対応し、複雑な情報を網羅したグリッドレイアウトの生成が可能です。12言語のテキストレンダリングに対応し、実務での活用を想定しています。

なぜ注目?

高精度なテキスト描画と長文指示への対応により、広告や資料作成など、ビジネス現場での画像生成AIの活用範囲がさらに広がる可能性があります。

このニュースを事業に活かす
公众号:昆仑万维(天工)元記事へのリンクあり
注目

昆仑万维が「世界モデル元年」を宣言、リアルタイム生成モデル等を発表

昆仑万维はWAICにて、世界モデル「Matrix-Game 3.5」や音楽生成モデルなどを発表しました。特にMatrix-Game 3.5は、単一GPUで20FPSのリアルタイム生成を実現しています。

なぜ注目?

動画やゲーム生成におけるリアルタイム性の向上は、エンターテインメントやシミュレーション分野でのAI活用を加速させる可能性があります。

このニュースを事業に活かす