SoranoruNEWS
TOPIC

画像生成AIの最新情報

画像生成・編集モデルとクリエイティブ活用

Soranoru
NEWS FEED

全42件 · 1ページ目

Google Blog:AI(RSS)元記事へのリンクあり
参考

Google Workspaceに画像生成・編集ツール「Google Pics」が登場

GoogleはWorkspace向けに画像生成・編集ツール「Google Pics」を発表しました。今後数週間以内に、Google AI ProおよびUltraのサブスクリプション契約者と、多くのWorkspace法人顧客向けに提供を開始します。

なぜ注目?

日常的に利用するGoogle Workspace内で直接画像生成や編集が可能になることで、資料作成やコンテンツ制作のワークフローが大幅に効率化される可能性があります。

Midjourney:Updates(RSS)元記事へのリンクあり
参考

Midjourneyが画像編集モデルV8.2のテストを開始、直感的な編集機能を強化

Midjourneyは、指示による編集や最大4枚の参照画像を用いた生成、局部重绘や拡張が可能なV8.2モデルのテストを開始しました。WebサイトおよびDiscordのコマンドから利用可能です。

なぜ注目?

画像生成の精度だけでなく、意図した通りの修正が容易になることで、クリエイティブ制作におけるワークフローの効率化が期待されます。

OpenRouter:Announcements(RSS)元記事へのリンクあり
参考

OpenRouterが動画生成APIを公開、単一のインターフェースで複数モデルに対応

OpenRouterは、SeedanceやVeo、Wanなどの主要な動画生成モデルを統一されたAPI経由で利用できる機能を公開しました。モデルの切り替えは識別子を変更するだけで行えるため、開発者は実装コストを抑えて最新の動画生成技術を導入できます。

なぜ注目?

動画生成モデルの進化が速い中、特定のモデルに依存せず柔軟に切り替え可能なAPI環境は、制作現場のワークフロー構築において有用な選択肢となります。

公众号:MiniMax(稀宇科技)元記事へのリンクあり
参考

MiniMaxが動画生成・編集AI「MiniMax Design」を発表

MiniMax Designは、多模態モデル「H3」を基盤とし、タスクの分解から素材処理、最終出力までを自動化するAIエージェントツールです。ComfyUIなどの外部ワークフローとの連携にも対応しています。

なぜ注目?

動画制作の工程をAIが自律的に判断・実行することで、広告やコンテンツ制作における作業効率の大幅な向上が期待されます。

X:Sky Computing Lab (@haoailab)元記事へのリンクあり
参考

Macで動画生成を高速化する「FastMetal」が登場、ローカル環境で5秒動画を30秒で生成

Apple Silicon搭載Mac上で動作する動画生成フレームワーク「FastMetal」が公開されました。CUDAやクラウド環境を必要とせず、最小3.9GBのメモリ消費で効率的な動画生成を実現します。

なぜ注目?

高価なGPUサーバーを介さず、手元のMacで動画生成が可能になることで、クリエイターや小規模事業者の制作コスト削減とワークフローの効率化に寄与する可能性があります。

蚂蚁 inclusionAI:GitHub 新仓库元記事へのリンクあり
参考

Ant GroupのinclusionAIが画像編集データ生成パイプライン「ConceptEdit」をオープンソース公開

ConceptEditは、VLMによる指示生成、FLUXによる編集、VQAによる評価の3段階で大規模な画像編集用データセットを構築するパイプラインです。単一および複数の概念に対応したデータ生成をサポートしています。

なぜ注目?

画像生成AIの微調整やデータセット構築の効率化に寄与する技術であり、独自の画像生成モデルや編集ツールを開発する事業者にとって、高品質な学習データ作成の参考となります。

IT之家(RSS)元記事へのリンクあり
参考

動画生成AI「LTX-2.5」が登場、10秒の720p動画を6.8秒で生成しComfyUIに統合

LTX社が発表した動画生成モデル「LTX-2.5」は、ComfyUIにネイティブ対応し、高速な生成性能を実現しました。一定規模以下の企業は無料で利用可能で、音声付き動画を低コストで生成できます。

なぜ注目?

動画生成の高速化とコスト低減が進むことで、広告やSNS向けコンテンツ制作の効率が大幅に向上する可能性があります。特にComfyUIとの親和性が高く、ワークフローへの組み込みが容易な点が実務上のメリットです。

X:Runway (@runwayml)元記事へのリンクあり
注目

Runwayの動画生成AI「Seedance 2.5」が公開、50種類のキャラクター参照に対応

Runwayの最新モデル「Seedance 2.5」がリリースされ、最大50種類のキャラクター参照が可能になりました。音楽と同期した最大30秒の動画生成をサポートしています。

なぜ注目?

キャラクターの一貫性を保った動画生成が可能になることで、広告制作やコンテンツ制作におけるキャラクター活用の幅が大きく広がります。

MarkTechPost(RSS)元記事へのリンクあり
注目

ComfyUI APIを活用したMiniMax-H3による動画・音声生成パイプラインの実装

ComfyUIを推論バックエンドとして利用し、MiniMax-H3モデルによる動画・音声生成ワークフローを構築する手法が公開されました。GUIを介さずPythonから直接実行し、GPUリソースに応じた最適化が可能です。

なぜ注目?

動画生成AIを自社システムや自動化パイプラインに組み込む際、既存のオープンソースツールを活用した効率的な実装手法として参考になります。

公众号:卡尔的AI沃茨元記事へのリンクあり
注目

動画生成AI「Seedance 2.5」がアップデート、最大300秒の長尺生成や自然な人物描写に対応

Seedance 2.5は人物描写の質感を向上させ、最大300秒の長尺動画生成や部分的な再生成、続きの自動生成に対応しました。コミュニティでは広告制作やMV制作など6つの活用事例が注目されています。

なぜ注目?

動画生成の長尺化と品質向上により、低コストでの広告動画制作やコンテンツ制作の効率化が期待されます。実務での活用可能性を検証する価値があるでしょう。

X:Elon Musk (@elonmusk, xAI)元記事へのリンクあり
参考

XのAI「Grok Imagine」が画像編集機能を大幅強化、特定エリアの直感的な編集が可能に

XのAIツール「Grok Imagine」において、画像内の特定の領域をマウスオーバーして即座に編集できる機能が追加されました。直感的な操作で生成画像の細部を修正できるようになります。

なぜ注目?

SNS上での画像生成・編集の利便性が向上することで、マーケティング素材の作成や投稿コンテンツの制作フローが効率化される可能性があります。

X:Suno (@suno)元記事へのリンクあり
参考

音楽生成AI「Suno」のモバイルアプリで自分の声を録音・活用できる「Voices」機能が提供開始

SunoのiOSおよびAndroidアプリにて、自身の声を録音して楽曲制作に利用できる「Voices」機能が実装されました。ProおよびPremierプランでは無制限、無料プランでも制限付きで利用可能です。

なぜ注目?

自身の声をAI楽曲に組み込めるようになることで、オリジナリティの高いコンテンツ制作が容易になります。クリエイターやマーケティング担当者にとって、ブランド独自の音源制作の幅が広がる可能性があります。

X:Runway (@runwayml)元記事へのリンクあり
注目

Runwayが「Seedance 2.5」を公開、最大50のキャラクター参照で複雑な映像生成が可能に

Runwayに実装されたSeedance 2.5は、最大50個のキャラクター参照を用いて一貫性のある世界観を構築できます。最大30秒の音響・対話付き動画を生成し、ストーリーに合わせて編集や延長が可能です。

なぜ注目?

キャラクターの一貫性を保った長尺動画の生成が可能になることで、広告制作やコンテンツ制作における映像制作の効率化と表現の幅が大きく広がります。

X:Krea AI (@krea_ai)元記事へのリンクあり
注目

Krea AIが動画生成モデル「Seedance 2.5」を発表、最大30秒の連続生成に対応

Krea AIは、最大30秒の連続動画生成やマルチショット構成、最大50個の参照画像に対応した「Seedance 2.5」を公開しました。複雑なシーンの構築や一貫性のある映像制作を支援します。

なぜ注目?

長尺かつマルチショットの動画生成が可能になることで、広告やSNS向け動画制作の効率化や表現の幅が広がる可能性があります。

IT之家(RSS)元記事へのリンクあり
参考

ChatGPTのユーザー層が拡大、35歳以上の利用が増加しタスクツールへ変容

OpenAIの報告によると、ChatGPTのユーザー数は10億人を突破し、単なる質問ツールから業務遂行ツールへと利用目的が変化しています。特に35歳以上のユーザーによる利用が増加しており、業務でのコンテンツ作成やタスク処理が非業務時より2倍以上多くなっています。

なぜ注目?

AIが業務の標準ツールとして定着しつつあることを示しており、ビジネス現場でのAI活用スキルが今後より一層重要になることを示唆しています。

公众号:火山引擎元記事へのリンクあり
注目

火山エンジンがSeedance 2.5 APIを提供開始:30秒の長尺生成とマルチモーダル参照に対応

火山エンジン(ByteDance傘下)がSeedance 2.5 APIをリリースし、生成時間を従来の15秒から30秒へ延長しました。最大50個のマルチモーダル素材を参照し、長尺の物語や複数キャラクターの安定した描写が可能です。

なぜ注目?

長尺かつ一貫性のある動画生成能力は、広告やプロモーション動画の制作フローを大きく変える可能性があり、今後の動画マーケティングにおける新たな選択肢として注目されます。

注目

Alibaba Cloudが画像生成モデルQwen-Image-3.0を公開、高精度なテキスト描画を実現

Qwen-Image-3.0は、4.5Kトークンのプロンプトに対応し、ロゴの崩れを防ぐ高いテキスト描画精度を備えた商用利用可能な画像生成モデルです。12言語をネイティブサポートし、高解像度生成を低コストで提供します。

なぜ注目?

テキスト描画の精度向上により、広告クリエイティブや販促資料の作成において、AI生成画像の活用範囲がより実用的なレベルへ拡大することが期待されます。

注目

Metaの広告プラットフォームでAI生成による不適切な児童画像が配信される事態が発生

Metaの広告ライブラリにおいて、AIで生成された児童虐待を示唆する画像を含む広告がFacebookやInstagramなどで配信されていたことが判明しました。一部の広告は今週まで継続して表示されていたと報告されています。

なぜ注目?

AI生成コンテンツの安全性とプラットフォーム側の検閲体制に重大な懸念を投げかけており、広告主はブランドセーフティの観点から配信先の管理をより厳格に行う必要があります。

X:通义千问 / Qwen (@Alibaba_Qwen)元記事へのリンクあり
参考

Alibabaが画像生成AI「Qwen-Image-3.0-Pro」を公開、多言語対応と高精度な文字描画を実現

AlibabaのQwen Cloudにて、画像生成モデル「Qwen-Image-3.0-Pro」および「Standard」版が提供開始されました。最大4.5kトークンのプロンプトに対応し、12言語のサポートや高精度な文字レンダリング機能を備えています。

なぜ注目?

中国国内で高い評価を得ている画像生成モデルが利用可能となり、多言語対応や文字描画精度が向上したことで、グローバルなクリエイティブ業務における選択肢の一つとして注目されます。

X:OpenRouter (@OpenRouter)元記事へのリンクあり
参考

Black Forest Labsのマルチモーダルモデル「FLUX 3 Video」がOpenRouterで利用可能に

動画、音声、画像、動作予測を統合したマルチモーダルモデル「FLUX 3 Video」がOpenRouter上で公開されました。統一されたアーキテクチャにより、映画のような映像からクリエイティブな表現まで幅広く対応します。

なぜ注目?

API経由で最新の動画生成モデルを容易に組み込めるようになるため、映像制作やコンテンツ開発の効率化を検討する事業者にとって重要な選択肢となります。