SoranoruNEWS
NEWS ARCHIVE

AIニュース一覧

Soranoru
NEWS FEED

17件のニュース

注目

Black Forest Labsが次世代モデル「FLUX 3」を発表、ロボット制御と連携した動作予測を実現

Black Forest Labsは、画像・動画・音声を統合した基礎モデル「FLUX 3」を発表しました。ロボット企業mimicとの提携により、製造ラインでの動作予測にも対応した「FLUX-mimic」を展開しています。

なぜ注目?

動画生成AIが単なるコンテンツ制作を超え、物理的なロボット制御や産業現場の自動化に応用され始めています。製造業や物流分野でのAI活用を検討する企業にとって、重要な技術的転換点となるでしょう。

このニュースを事業に活かす
IT之家(RSS)元記事へのリンクあり
注目

Black Forest Labsが多模態モデル「FLUX 3」を発表、20秒の動画生成に対応

画像・動画・音声を統合学習した基礎モデル「FLUX 3」が早期アクセスで公開されました。単一の生成プロセスで最大20秒の動画と音声を生成でき、文生成や画像からの動画生成にも対応しています。

なぜ注目?

動画生成AIの進化は、広告やコンテンツ制作のワークフローを劇的に変える可能性があり、最新モデルの表現力はクリエイティブ業務の効率化に直結します。

このニュースを事業に活かす
X:通义千问 / Qwen (@Alibaba_Qwen)元記事へのリンクあり
注目

Alibabaが最新TTSモデル「Qwen-Audio-3.0-TTS」を公開、業界最高性能を記録

リアルタイム対話向けのFlash版と高品質なPlus版の2種類を展開する音声合成モデルです。16言語に対応し、感情表現の制御や最大3分間の長文生成が可能です。

なぜ注目?

TTS性能の向上は、顧客対応AIやコンテンツ制作の効率化に直結します。特にリアルタイム性と表現力の両立は、日本市場におけるAI接客の質を大きく引き上げる可能性があります。

このニュースを事業に活かす
参考

CactusがGemma 4ベースの混合モデルを公開、回答の信頼度に応じた自動ルーティングを実現

Cactusは、生成した回答に対して0から1の信頼度スコアを付与する「Cactus Hybrid」を公開しました。信頼度が低い場合に自動でより大規模なモデルへ切り替える仕組みを備えています。

なぜ注目?

デバイス上での推論効率と精度のバランスを最適化できるため、コストを抑えつつ信頼性の高いAIアプリケーションを構築したい開発者にとって重要な選択肢となります。

このニュースを事業に活かす
注目

動画生成AI「SANA-Video 2.0」発表、単一GPUで720p動画を効率的に生成

SANA-Video 2.0は、5Bおよび14Bのパラメータ規模を持つ混合型動画拡散Transformerです。線形とソフトマックスの注意機構を組み合わせることで、単一GPU環境での効率的な動画生成を実現しました。

なぜ注目?

高コストな計算リソースを必要とする動画生成において、単一GPUでの動作は中小規模の制作現場や個人クリエイターにとって導入のハードルを下げる重要な進歩です。

このニュースを事業に活かす
参考

GoogleがGeminiの新モデル3種を発表、処理性能向上とコスト削減を両立

「3.6 Flash」「3.5 Flash-Lite」「3.5 Flash Cyber」の3モデルが発表されました。コーディング効率の向上や、秒間350トークンという高速な推論性能を実現しています。

なぜ注目?

AI導入におけるコストと速度の課題が改善されることで、より大規模な業務システムへのAI組み込みが加速する可能性があります。

このニュースを事業に活かす
Google DeepMind:Blog(RSS)元記事へのリンクあり
参考

GoogleがGemini 3.6 Flashなど3つの新モデルを発表、用途に応じた最適化を実現

Google DeepMindは、主力モデル「Gemini 3.6 Flash」、低コスト・高効率な「3.5 Flash-Lite」、サイバーセキュリティ特化型の「3.5 Flash Cyber」の3モデルを公開しました。これらはGoogle AI開発者プラットフォームを通じてAPIで利用可能です。

なぜ注目?

用途に応じたモデルの使い分けが可能になることで、コスト最適化やセキュリティ対策など、ビジネス現場でのAI導入の柔軟性が高まる可能性があります。

このニュースを事業に活かす
公众号:小红书技术(dots.llm)元記事へのリンクあり
注目

小紅書(Xiaohongshu)のAIモデル「dots」が国際数学オリンピックで満点金メダルを獲得

小紅書の「dots-note 3.0」モデルが、第67回国際数学オリンピック(IMO 2026)の問題で満点を記録しました。形式言語に頼らず、LaTeX形式の課題を直接読み取り、自己批判プロセスを経て解法を導き出す能力が証明されました。

なぜ注目?

AIの論理的推論能力が人間トップレベルに達したことを示す事例であり、高度な推論を要する業務へのAI活用可能性を広げる技術として注目されます。

このニュースを事業に活かす
Qwen:Blog Retrieval(API)元記事へのリンクあり
注目

通義千問が画像生成モデル「Qwen-Image-3.0」を発表、実用性とテキスト描画精度を強化

「実」を追求した第3世代の画像生成モデルで、4.5kトークンの指示入力に対応し、複雑な情報を網羅したグリッドレイアウトの生成が可能です。12言語のテキストレンダリングに対応し、実務での活用を想定しています。

なぜ注目?

高精度なテキスト描画と長文指示への対応により、広告や資料作成など、ビジネス現場での画像生成AIの活用範囲がさらに広がる可能性があります。

このニュースを事業に活かす
Hugging Face:Blog(RSS)元記事へのリンクあり
参考

NVIDIA、ロボティクス向け軽量世界モデル「Cosmos 3 Edge」を公開

NVIDIAは、40億パラメータのオープンソース世界モデル「Cosmos 3 Edge」をHugging Faceで公開しました。エッジデバイス上でのリアルタイムな環境理解や動作生成を目的としています。

なぜ注目?

エッジAIやロボティクス分野でのリアルタイム推論が加速する可能性があり、製造業や物流現場での自律型AI活用における重要な技術基盤となるでしょう。

このニュースを事業に活かす
公众号:通义实验室(千问)元記事へのリンクあり
参考

通義実験室がリアルタイム音声合成モデル「Qwen-Audio-3.0-TTS」を発表

通義実験室は、低遅延の「Flash」版と高性能な「Plus」版からなる音声合成モデルを公開しました。16言語と20種類の方言に対応し、高い話者類似度とリアルタイム性を実現しています。

なぜ注目?

多言語対応の音声合成技術は、グローバルな顧客対応やコンテンツ制作の自動化において、日本企業にとっても活用が期待される技術です。

このニュースを事業に活かす
IT之家(RSS)元記事へのリンクあり
参考

上海科学智能研究院、科学マルチモーダル基盤モデル「神珍」を公開

DNAやタンパク質、医学画像など6種類の科学データを処理可能な110億パラメータのモデル。生物学的タスクや画像セグメンテーションで高い性能を記録し、コードと重みが公開されました。

なぜ注目?

創薬や医療診断など、専門性の高い科学分野におけるAI活用がオープンソース化により加速する可能性があり、関連業界の技術開発の選択肢を広げるものです。

このニュースを事業に活かす
公众号:面壁智能(MiniCPM)元記事へのリンクあり
注目

面壁智能、具身知能モデル「MiniCPM-Robot」シリーズを発表

汎用VLAモデル「MiniCPM-RobotManip」と追跡モデル「MiniCPM-RobotTrack」からなる、具身知能(ロボティクス)向けの軽量モデルシリーズです。OpenBMBと共同で開発され、オープンソースとして提供されます。

なぜ注目?

ロボット制御に特化した軽量AIモデルの登場は、製造業や物流現場における自律型エージェントの実装コストを下げ、現場導入を促進する可能性があります。

このニュースを事業に活かす
公众号:面壁智能(MiniCPM)元記事へのリンクあり
参考

軽量モデル「MiniCPM5-2B」発表:4B以下のパラメータで世界最高性能を記録

面壁智能(MiniCPM)が2Bパラメータの端側モデル「MiniCPM5-2B」を公開。512Kのコンテキスト長に対応し、主要なチップセットへの最適化も完了しています。

なぜ注目?

エッジデバイスでのAI活用において、低リソースで高い推論能力を発揮するモデルの選択肢が増えることは、オンデバイスAIの実装を検討する事業者にとって重要です。

このニュースを事業に活かす
公众号:昆仑万维(天工)元記事へのリンクあり
注目

昆仑万维が「世界モデル元年」を宣言、リアルタイム生成モデル等を発表

昆仑万维はWAICにて、世界モデル「Matrix-Game 3.5」や音楽生成モデルなどを発表しました。特にMatrix-Game 3.5は、単一GPUで20FPSのリアルタイム生成を実現しています。

なぜ注目?

動画やゲーム生成におけるリアルタイム性の向上は、エンターテインメントやシミュレーション分野でのAI活用を加速させる可能性があります。

このニュースを事業に活かす
X:通义千问 / Qwen (@Alibaba_Qwen)元記事へのリンクあり
注目

アリババが2.4Tパラメータの巨大モデル「Qwen3.8」を発表、オープンウェイト化へ

アリババは2.4兆パラメータを誇る「Qwen3.8」を発表し、今後オープンウェイトで公開する予定です。プレビュー版は既に一部プラットフォームで利用可能です。

なぜ注目?

超大規模モデルがオープンウェイトで提供されることは、自社環境での高度なAI構築を目指す企業にとって、モデル選定の強力な選択肢となります。

このニュースを事業に活かす
X:Greg Brockman (@gdb)元記事へのリンクあり
参考

サイバーセキュリティ特化モデル「GPT-5.6 Sol」が脆弱性対応で高い成果を記録

サイバーセキュリティ分野の最先端モデル「GPT-5.6 Sol」が発表されました。新型の脆弱性の発見および修正において、顕著な成果を上げています。

なぜ注目?

AIによるセキュリティ対策の自動化が進むことで、企業の脆弱性管理やインシデント対応のスピードと精度が劇的に向上する可能性があります。

このニュースを事業に活かす