SoranoruNEWS
TOPIC

オープンソースAIの最新情報

公開モデル、開発ツール、コミュニティの動向

Soranoru
NEWS FEED

全38件 · 2ページ目

MarkTechPost(RSS)元記事へのリンクあり
注目

NVIDIAがオープンソースの全二重音声対話モデルNemotronLabs VoiceChat 11Bを公開

NVIDIAは、約450ミリ秒の低遅延で応答可能な全二重音声対話モデルを公開しました。対話中にリアルタイムでツール呼び出しが可能で、API実行中の沈黙を防ぐ工夫も実装されています。

なぜ注目?

オープンソースで高度な音声対話AIを構築できるため、自社サービスへの低遅延な音声インターフェース導入を検討する際の重要な選択肢となります。

MarkTechPost(RSS)元記事へのリンクあり
注目

NVIDIAが自動運転向けVLAモデル「Alpamayo 2 Super」を公開

NVIDIAは、自動運転の長尾事象に対応する340億パラメータの視覚・言語・動作(VLA)モデル「Alpamayo 2 Super」を発表しました。本モデルはOpenMDW-1.1ライセンスで公開され、商用利用が可能です。

なぜ注目?

自動運転技術の高度化に向けたオープンソースモデルの選択肢が広がることで、関連する開発コストの低減や技術革新が加速する可能性があります。

X:商汤 SenseTime (@SenseTime_AI)元記事へのリンクあり
参考

商湯(SenseTime)が推論と画像生成を統合したオープンソースモデル「SenseNova U1」を公開

SenseNova U1は、単一のプロンプトから構造化されたスライド資料を作成したり、段階的に図解コンテンツを生成したりすることが可能です。現在、SenseNova StudioやHuggingFace、GitHubで利用可能です。

なぜ注目?

推論と画像生成を統合したモデルは、資料作成やプレゼンテーションの自動化を効率化する可能性があり、今後の業務ツールへの応用が注目されます。

X:商汤 SenseTime (@SenseTime_AI)元記事へのリンクあり
参考

センスタイムが軽量マルチモーダルモデル「SenseNova U1.5-Lite-Preview」を公開

NEO-Unifyアーキテクチャを採用した8B-MoTパラメータの軽量モデルです。商用クローズドモデルに匹敵する生成・編集品質を実現しています。

なぜ注目?

軽量かつ高性能なオープンソースモデルの選択肢が増えることで、オンプレミス環境やエッジデバイスでのAI活用が加速する可能性があります。

Qwen:Blog Retrieval(API)元記事へのリンクあり
重要

Qwen 3.8-Max発表:2.4兆パラメータを誇る最強クラスのコーディング・協調AI

Qwenシリーズで最も強力な「Qwen 3.8-Max」が発表されました。2.4兆パラメータ(アクティブ950億)を擁し、Qwen-Maxクラスのモデルとして初めて重みが公開される予定です。

なぜ注目?

オープンソースとして最高峰の性能を持つモデルが利用可能になることで、企業は自社環境で高度なコーディング支援やAI協調システムを構築できる選択肢が広がります。

注目

マルチモーダル埋め込みモデル「UEmbed」:疎な表現と密な表現を単一パスで生成

UEmbedは、デコーダーのみの構造を採用したマルチモーダル埋め込みモデルです。単一の因果的フォワードパスで、単語レベルの疎な表現と密な表現を同時に生成し、情報ボトルネックを解消します。

なぜ注目?

検索やレコメンドシステムの精度向上に寄与する技術であり、将来的にマルチモーダル検索の効率化を検討する際の重要な選択肢となる可能性があります。

X:Artificial Analysis (@ArtificialAnlys)元記事へのリンクあり
注目

DeepSeekが新モデル「DeepSeek V4 Flash 0731」を公開、オープンソース上位にランクイン

DeepSeekは、Artificial Analysisの指標でスコア50を獲得し、オープンソースモデルの上位3位にランクインした「DeepSeek V4 Flash 0731」を公開しました。MITライセンスで提供され、総パラメータ数284B(アクティブ13B)の構成で、公式APIも利用可能です。

なぜ注目?

高性能なオープンソースモデルの選択肢が増えることで、自社環境でのAI導入やコスト最適化の検討材料として注目されます。

MiniMax:Blog(网页)元記事へのリンクあり
注目

MiniMaxが全能型マルチモーダルモデル「H3」を発表、2K動画生成とオープンソース化を予定

MiniMaxはテキスト、画像、動画、音声を統合的に理解・生成できるマルチモーダルモデル「H3」を発表しました。最大2K解像度で15秒のステレオ音声付き動画を生成可能で、近日中にモデルの重みを公開する予定です。

なぜ注目?

既存モデルと比較して高いコストパフォーマンスを実現しており、オープンソース化されれば、動画制作やコンテンツ開発におけるAI活用の選択肢が大きく広がる可能性があります。

X:Thinking Machines (@thinkymachines)元記事へのリンクあり
参考

Thinking Machinesが軽量モデルInkling-Smallを公開、276Bパラメータで従来と同等の性能を実現

Thinking Machinesは、従来モデルの4分の1の規模となる276Bパラメータの「Inkling-Small」を公開しました。アクティブパラメータは12Bで、フルウェイトがオープンソースとして提供されます。

なぜ注目?

推論コストを抑えつつ高性能なモデルを利用できる可能性があり、自社環境でのAI導入や微調整を検討する事業者にとって選択肢の一つとなります。

参考

Feyn Labsが自動背景削除モデル「FeyNoBg」を公開、主要ベンチマークでSOTAを達成

Feyn Labsが開発した「FeyNoBg」は、BiRefNetアーキテクチャをベースにパラメータを最適化した自動背景削除モデルです。8つのベンチマークのうち4つで最高スコアを記録し、関連するトレーニングライブラリ「NoBg」もオープンソースとして公開されました。

なぜ注目?

画像編集やクリエイティブ制作の自動化において、高精度な背景削除は業務効率に直結します。オープンソースで提供されているため、自社システムへの組み込みやカスタマイズを検討する際の有力な選択肢となります。

X:Kimi.ai (@Kimi_Moonshot)元記事へのリンクあり
注目

Moonshot AIが最強モデルKimi K3を公開、2.8TパラメータのMoEモデルと技術レポートを発表

Moonshot AIは、2.8兆パラメータのMoEモデル「Kimi K3」の重みと技術レポートを公開しました。本モデルはネイティブな視覚理解と100万トークンのコンテキストウィンドウを備え、計算効率を大幅に向上させています。

なぜ注目?

高性能なMoEモデルと関連インフラがオープンソース化されたことで、企業が独自のAIエージェントや大規模な推論環境を構築する際の選択肢が広がります。

参考

CactusがGemma 4ベースの混合モデルを公開、回答の信頼度に応じた自動ルーティングを実現

Cactusは、生成した回答に対して0から1の信頼度スコアを付与する「Cactus Hybrid」を公開しました。信頼度が低い場合に自動でより大規模なモデルへ切り替える仕組みを備えています。

なぜ注目?

デバイス上での推論効率と精度のバランスを最適化できるため、コストを抑えつつ信頼性の高いAIアプリケーションを構築したい開発者にとって重要な選択肢となります。

公众号:小红书技术(dots.llm)元記事へのリンクあり
注目

小紅書(Xiaohongshu)のAIモデル「dots」が国際数学オリンピックで満点金メダルを獲得

小紅書の「dots-note 3.0」モデルが、第67回国際数学オリンピック(IMO 2026)の問題で満点を記録しました。形式言語に頼らず、LaTeX形式の課題を直接読み取り、自己批判プロセスを経て解法を導き出す能力が証明されました。

なぜ注目?

AIの論理的推論能力が人間トップレベルに達したことを示す事例であり、高度な推論を要する業務へのAI活用可能性を広げる技術として注目されます。

Hugging Face:Blog(RSS)元記事へのリンクあり
参考

NVIDIA、ロボティクス向け軽量世界モデル「Cosmos 3 Edge」を公開

NVIDIAは、40億パラメータのオープンソース世界モデル「Cosmos 3 Edge」をHugging Faceで公開しました。エッジデバイス上でのリアルタイムな環境理解や動作生成を目的としています。

なぜ注目?

エッジAIやロボティクス分野でのリアルタイム推論が加速する可能性があり、製造業や物流現場での自律型AI活用における重要な技術基盤となるでしょう。

IT之家(RSS)元記事へのリンクあり
参考

上海科学智能研究院、科学マルチモーダル基盤モデル「神珍」を公開

DNAやタンパク質、医学画像など6種類の科学データを処理可能な110億パラメータのモデル。生物学的タスクや画像セグメンテーションで高い性能を記録し、コードと重みが公開されました。

なぜ注目?

創薬や医療診断など、専門性の高い科学分野におけるAI活用がオープンソース化により加速する可能性があり、関連業界の技術開発の選択肢を広げるものです。

公众号:面壁智能(MiniCPM)元記事へのリンクあり
注目

面壁智能、具身知能モデル「MiniCPM-Robot」シリーズを発表

汎用VLAモデル「MiniCPM-RobotManip」と追跡モデル「MiniCPM-RobotTrack」からなる、具身知能(ロボティクス)向けの軽量モデルシリーズです。OpenBMBと共同で開発され、オープンソースとして提供されます。

なぜ注目?

ロボット制御に特化した軽量AIモデルの登場は、製造業や物流現場における自律型エージェントの実装コストを下げ、現場導入を促進する可能性があります。

公众号:面壁智能(MiniCPM)元記事へのリンクあり
参考

軽量モデル「MiniCPM5-2B」発表:4B以下のパラメータで世界最高性能を記録

面壁智能(MiniCPM)が2Bパラメータの端側モデル「MiniCPM5-2B」を公開。512Kのコンテキスト長に対応し、主要なチップセットへの最適化も完了しています。

なぜ注目?

エッジデバイスでのAI活用において、低リソースで高い推論能力を発揮するモデルの選択肢が増えることは、オンデバイスAIの実装を検討する事業者にとって重要です。

X:通义千问 / Qwen (@Alibaba_Qwen)元記事へのリンクあり
注目

アリババが2.4Tパラメータの巨大モデル「Qwen3.8」を発表、オープンウェイト化へ

アリババは2.4兆パラメータを誇る「Qwen3.8」を発表し、今後オープンウェイトで公開する予定です。プレビュー版は既に一部プラットフォームで利用可能です。

なぜ注目?

超大規模モデルがオープンウェイトで提供されることは、自社環境での高度なAI構築を目指す企業にとって、モデル選定の強力な選択肢となります。