SoranoruNEWS
TOPIC

画像生成AIの最新情報

画像生成・編集モデルとクリエイティブ活用

Soranoru
NEWS FEED

15件のニュース

Google Blog:AI(RSS)元記事へのリンクあり
参考

Google Workspaceに画像生成・編集ツール「Google Pics」が登場

GoogleはWorkspace向けに画像生成・編集ツール「Google Pics」を発表しました。今後数週間以内に、Google AI ProおよびUltraのサブスクリプション契約者と、多くのWorkspace法人顧客向けに提供を開始します。

なぜ注目?

日常的に利用するGoogle Workspace内で直接画像生成や編集が可能になることで、資料作成やコンテンツ制作のワークフローが大幅に効率化される可能性があります。

公众号:MiniMax(稀宇科技)元記事へのリンクあり
参考

MiniMaxが動画生成・編集AI「MiniMax Design」を発表

MiniMax Designは、多模態モデル「H3」を基盤とし、タスクの分解から素材処理、最終出力までを自動化するAIエージェントツールです。ComfyUIなどの外部ワークフローとの連携にも対応しています。

なぜ注目?

動画制作の工程をAIが自律的に判断・実行することで、広告やコンテンツ制作における作業効率の大幅な向上が期待されます。

X:Sky Computing Lab (@haoailab)元記事へのリンクあり
参考

Macで動画生成を高速化する「FastMetal」が登場、ローカル環境で5秒動画を30秒で生成

Apple Silicon搭載Mac上で動作する動画生成フレームワーク「FastMetal」が公開されました。CUDAやクラウド環境を必要とせず、最小3.9GBのメモリ消費で効率的な動画生成を実現します。

なぜ注目?

高価なGPUサーバーを介さず、手元のMacで動画生成が可能になることで、クリエイターや小規模事業者の制作コスト削減とワークフローの効率化に寄与する可能性があります。

蚂蚁 inclusionAI:GitHub 新仓库元記事へのリンクあり
参考

Ant GroupのinclusionAIが画像編集データ生成パイプライン「ConceptEdit」をオープンソース公開

ConceptEditは、VLMによる指示生成、FLUXによる編集、VQAによる評価の3段階で大規模な画像編集用データセットを構築するパイプラインです。単一および複数の概念に対応したデータ生成をサポートしています。

なぜ注目?

画像生成AIの微調整やデータセット構築の効率化に寄与する技術であり、独自の画像生成モデルや編集ツールを開発する事業者にとって、高品質な学習データ作成の参考となります。

X:Runway (@runwayml)元記事へのリンクあり
注目

Runwayの動画生成AI「Seedance 2.5」が公開、50種類のキャラクター参照に対応

Runwayの最新モデル「Seedance 2.5」がリリースされ、最大50種類のキャラクター参照が可能になりました。音楽と同期した最大30秒の動画生成をサポートしています。

なぜ注目?

キャラクターの一貫性を保った動画生成が可能になることで、広告制作やコンテンツ制作におけるキャラクター活用の幅が大きく広がります。

X:Elon Musk (@elonmusk, xAI)元記事へのリンクあり
参考

XのAI「Grok Imagine」が画像編集機能を大幅強化、特定エリアの直感的な編集が可能に

XのAIツール「Grok Imagine」において、画像内の特定の領域をマウスオーバーして即座に編集できる機能が追加されました。直感的な操作で生成画像の細部を修正できるようになります。

なぜ注目?

SNS上での画像生成・編集の利便性が向上することで、マーケティング素材の作成や投稿コンテンツの制作フローが効率化される可能性があります。

X:Suno (@suno)元記事へのリンクあり
参考

音楽生成AI「Suno」のモバイルアプリで自分の声を録音・活用できる「Voices」機能が提供開始

SunoのiOSおよびAndroidアプリにて、自身の声を録音して楽曲制作に利用できる「Voices」機能が実装されました。ProおよびPremierプランでは無制限、無料プランでも制限付きで利用可能です。

なぜ注目?

自身の声をAI楽曲に組み込めるようになることで、オリジナリティの高いコンテンツ制作が容易になります。クリエイターやマーケティング担当者にとって、ブランド独自の音源制作の幅が広がる可能性があります。

X:Runway (@runwayml)元記事へのリンクあり
注目

Runwayが「Seedance 2.5」を公開、最大50のキャラクター参照で複雑な映像生成が可能に

Runwayに実装されたSeedance 2.5は、最大50個のキャラクター参照を用いて一貫性のある世界観を構築できます。最大30秒の音響・対話付き動画を生成し、ストーリーに合わせて編集や延長が可能です。

なぜ注目?

キャラクターの一貫性を保った長尺動画の生成が可能になることで、広告制作やコンテンツ制作における映像制作の効率化と表現の幅が大きく広がります。

X:Krea AI (@krea_ai)元記事へのリンクあり
注目

Krea AIが動画生成モデル「Seedance 2.5」を発表、最大30秒の連続生成に対応

Krea AIは、最大30秒の連続動画生成やマルチショット構成、最大50個の参照画像に対応した「Seedance 2.5」を公開しました。複雑なシーンの構築や一貫性のある映像制作を支援します。

なぜ注目?

長尺かつマルチショットの動画生成が可能になることで、広告やSNS向け動画制作の効率化や表現の幅が広がる可能性があります。

公众号:火山引擎元記事へのリンクあり
注目

火山エンジンがSeedance 2.5 APIを提供開始:30秒の長尺生成とマルチモーダル参照に対応

火山エンジン(ByteDance傘下)がSeedance 2.5 APIをリリースし、生成時間を従来の15秒から30秒へ延長しました。最大50個のマルチモーダル素材を参照し、長尺の物語や複数キャラクターの安定した描写が可能です。

なぜ注目?

長尺かつ一貫性のある動画生成能力は、広告やプロモーション動画の制作フローを大きく変える可能性があり、今後の動画マーケティングにおける新たな選択肢として注目されます。

注目

Alibaba Cloudが画像生成モデルQwen-Image-3.0を公開、高精度なテキスト描画を実現

Qwen-Image-3.0は、4.5Kトークンのプロンプトに対応し、ロゴの崩れを防ぐ高いテキスト描画精度を備えた商用利用可能な画像生成モデルです。12言語をネイティブサポートし、高解像度生成を低コストで提供します。

なぜ注目?

テキスト描画の精度向上により、広告クリエイティブや販促資料の作成において、AI生成画像の活用範囲がより実用的なレベルへ拡大することが期待されます。

X:Google AI (@GoogleAI)元記事へのリンクあり
参考

Google EarthがNano Banana 2を統合、テキストから地形や街並みを生成可能に

Google Earthのウェブ版に画像生成モデル「Nano Banana 2」が統合されました。ユーザーはテキストプロンプトを用いて、特定の場所の過去の景観や新しい施設を3D映像として視覚化できます。

なぜ注目?

都市計画や不動産開発、観光プロモーションにおいて、場所の変遷や将来のイメージを直感的に共有するための強力なツールとなる可能性があります。

X:Suno (@suno)元記事へのリンクあり
参考

音楽生成AIのSunoがアップデート、MIDI出力や画像からの楽曲生成に対応

音楽生成AIのSunoがウェブおよびモバイル版で新機能を公開しました。音源分離やMIDIエクスポート、画像からの楽曲生成、車載システムへの対応などが追加されています。

なぜ注目?

MIDI出力や画像生成機能の追加により、AI生成楽曲をDAWで編集するなどのクリエイティブなワークフローへの統合が加速し、制作現場での実用性が向上しています。

X:Runway (@runwayml)元記事へのリンクあり
参考

Runway Agentが自然言語によるワークフロー構築機能を導入

Runway Agent上で、ノードベースのワークフローを自然言語で構築・編集・実行できるようになりました。これにより、複雑な映像生成プロセスを大規模かつ効率的に自動化できます。

なぜ注目?

クリエイティブ制作現場において、専門的な操作スキルを問わずAIワークフローを構築できる点は、制作効率の劇的な向上につながる可能性があります。

注目

ByteDanceが音声生成モデル「Seed Audio 1.0」を発表:人声と環境音を統合した映像制作向けAI

人声、効果音、環境音を一つのモデルで生成可能な「Seed Audio 1.0」が登場しました。100ms単位の精密な制御が可能で、多言語対応かつ高い自然度を実現しています。

なぜ注目?

映像制作やコンテンツ制作において、高品質な音響効果をAIで自動生成できるようになるため、制作コストの削減と表現の幅の拡大が期待されます。