IFMがオープンソースモデル K2 Horizon シリーズを発表、全6モデルを公開
IFMは0.9Bから375Bまで6種類のモデルからなる K2 Horizon シリーズを Apache 2.0 ライセンスで公開しました。一部モデルでは同規模で最高性能を達成し、新アーキテクチャ MoVA も採用されています。
商用利用可能な高性能オープンソースモデルの選択肢が増えることで、自社環境でのAI構築やコスト最適化の幅が広がります。
公開モデル、開発ツール、コミュニティの動向
SoranoruIFMは0.9Bから375Bまで6種類のモデルからなる K2 Horizon シリーズを Apache 2.0 ライセンスで公開しました。一部モデルでは同規模で最高性能を達成し、新アーキテクチャ MoVA も採用されています。
商用利用可能な高性能オープンソースモデルの選択肢が増えることで、自社環境でのAI構築やコスト最適化の幅が広がります。
DeepSeekは、マルチモーダルAIモデル「DeepSeek-V4-Flash-Vision-Exp」をMITライセンスで公開しました。モデルファイルや推論実装などがHugging Faceで利用可能です。
高性能なマルチモーダルAIがオープンソースで提供されることで、自社開発のAIエージェントや画像解析システムの構築コスト低減に寄与する可能性があります。
智譜AIは、複雑なコーディングや防御的サイバーセキュリティ、長期間のタスク実行に強みを持つ「GLM-5.3」のモデル重みをオープンソースとして公開しました。本モデルは主要なクローズドモデルと同等の性能を誇り、ローカル環境での実行やカスタマイズが可能です。
高性能なオープンソースモデルの選択肢が増えることで、企業は機密情報を外部に出さずに高度なAIエージェントを構築・運用できる可能性が広がります。
智譜AIは、エージェントによるコーディングやサイバーセキュリティ防御に最適化した高性能モデル「GLM-5.3」のウェイトを公開しました。現在、Hugging Faceを通じてモデルのダウンロードやカスタマイズが可能です。
開発業務の自動化やセキュリティ対策を強化したい企業にとって、オープンウェイトモデルの選択肢が増えることは、自社環境への導入コスト削減や柔軟な運用につながる可能性があります。
テンセントは総パラメータ数770B、アクティブパラメータ数49B、コンテキストウィンドウ1Mを誇る「Hunyuan-4 preview」を発表しました。本モデルはオープンソース化され、Tencent CloudのTokenHubおよびOpenRouterで利用可能です。
大規模なコンテキスト処理が可能な高性能モデルがオープンソースで提供されることで、企業は自社環境での高度なAI実装やコスト最適化の選択肢を広げることができます。
純国産チップで駆動する「GLM-5.3 Flash AA」が、OpenRouterにおいて週間のトークン利用シェアで約20%を占め首位となりました。最先端モデルの100分の1という低価格で提供されています。
特定のハードウェア環境に依存しないAIモデルの低価格化が進むことで、コスト効率を重視する日本企業のAI導入や開発の選択肢が広がる可能性があります。
GDNやQSA混合アテンションなど4つの技術アップグレードを施した多模態MoEモデルです。Qwen4アーキテクチャの先駆けとして、高いコスト効率と実務タスクでの処理能力を両立させています。
最新のアーキテクチャがオープンソースで提供されることで、開発者はより効率的なAIシステムを構築可能になり、特に推論コストの最適化を求める事業者にとって注視すべき技術動向です。
Google AIが発表した気象予測モデル「WeatherNext」は、風暴の経路や強度を従来より1日早く予測可能です。2025年のハリケーン「メリッサ」の予測で実証され、コードと重みも公開されました。
AIによる高精度な気象予測は、物流やインフラ管理など、気象リスクを抱えるあらゆるビジネスのBCP対策において重要な判断材料となる可能性があります。
Ant Groupは、パラメータ数の異なる「Ling-3.0-tiny-base」と「Ling-3.0-flash-base」の2モデルを公開しました。事前学習から微調整、強化学習まで幅広い用途に対応可能なチェックポイントが提供されています。
軽量かつ効率的なモデルが公開されたことで、特定のタスクに特化した自社専用AIの開発や、オンプレミス環境での運用コスト削減の選択肢が広がります。
MOSS-VLは、視覚入力と対話を同時に処理するリアルタイム性を重視したオープンソースの視覚言語モデル群です。特に「MOSS-VL-Realtime」は、ストリーミング形式のベンチマークで高い性能を記録しました。
視覚情報をリアルタイムで処理するAIの進化は、将来的な対話型インターフェースや自動化ツールの精度向上に寄与する可能性があり、開発者にとって注視すべき技術動向です。
27Bパラメータのモデルを含むQwen3.8シリーズがApache 2.0ライセンスで公開されました。262Kのコンテキスト長を標準サポートし、最大1Mトークンまで拡張可能です。
高性能なオープンソースモデルの選択肢が増えることで、企業が自社環境で構築するAIシステムのコスト最適化や柔軟な運用が促進されます。
小紅書(Xiaohongshu)が開発した dots3-note Preview は、280Bのパラメータを持ちながら16Bの活性化パラメータで動作する軽量モデルです。512Kのコンテキストウィンドウを備え、テキスト・画像・音声のマルチモーダル理解と複雑な推論タスクに対応しています。
長期間の自律的なタスク実行(エージェント機能)に最適化されており、業務自動化や複雑なワークフローを構築する際の新たな選択肢として注目されます。
SiliconFlowにてDeepSeek-V4-Pro-0813が利用可能となり、100万トークンのコンテキストウィンドウと3段階の推論強度を提供します。コーディングやツール呼び出し、AIエージェントのワークフローに最適化されており、MITライセンスで公開されています。
長大なコンテキスト処理とエージェント機能に特化したモデルが低価格で利用可能になることで、複雑な業務自動化や開発効率化の選択肢が広がります。
小紅書のdotsチームが、連続的な自己回帰型音声合成モデル「dots.tts」を公開しました。本モデルは主要な評価指標であるSeed-TTS-Evalにおいて、内容の正確性と話者の類似性で最高水準の性能を記録しています。
高品質な音声合成技術がオープンソースとして提供されることで、企業が独自の音声AIアプリケーションを開発する際の選択肢が広がります。商用利用やカスタマイズの可能性について、今後のライセンス動向を注視する必要があります。
MiniMaxは、作曲から編曲、演奏までをワンストップで行う音楽生成モデル「Music 3.0」を公開しました。コンセプトや歌詞に基づき、最大5分間の楽曲を生成できる生産レベルのモデルです。
オープンウェイトで提供されるため、商用コンテンツ制作や広告BGMの生成フローに組み込める可能性があり、クリエイティブ制作の効率化を検討する企業にとって注視すべき技術です。
SGLangがNVIDIAの最新オープンモデル「Nemotron 3.5 Lightning」のサポートを開始しました。本モデルは100万トークンの長文脈に対応し、OpenAI互換API経由でAIエージェント開発に利用可能です。
高速な推論が可能な軽量モデルがAIエージェント開発の選択肢に加わることで、低遅延かつ高機能な自社AIサービスの構築が加速する可能性があります。
アントグループは、総パラメータ数7.9Bながら推論時に1.3Bのみをアクティブ化する混合モデル「Ling-3.0-tiny」を公開しました。BF16、FP8、INT4の3つの形式で提供され、効率的な運用が可能です。
推論コストを抑えつつ実務レベルの性能を目指す軽量モデルの選択肢として、オンプレミスやエッジ環境でのAI活用を検討する事業者にとって注目すべき技術です。
Ant Groupは、総パラメータ数7.9Bのうち推論時に1.3Bのみを活性化する混合推理モデル「Ling-3.0-tiny」を公開しました。BF16、FP8、INT4の3つのバージョンが提供されています。
推論コストを抑えつつ実務的なタスクをこなせる軽量モデルの選択肢が増えることで、オンプレミス環境やエッジデバイスでのAI活用が加速する可能性があります。
Metaは、エージェントワークフロー向けに最適化されたオープンウェイトモデル「Muse Glimmer」を公開しました。消費電力やハードウェア要件を抑え、Macや高性能GPU搭載PCで動作するように設計されています。
クラウド依存を減らし、ローカル環境でセキュアかつ低遅延なAIエージェントを構築したい企業にとって、実用的な選択肢となる可能性があります。
Scale AIは、Muse Spark 1.2のオープンウェイト版を近日公開すると発表しました。同時に発表されたMuse Glimmerは24GBのVRAMで動作し、エージェントとしての信頼性を維持しています。
AI開発のインフラを支えるScale AIがモデル公開に注力することで、企業が自社環境で高度なAIエージェントを構築・運用するハードルが下がる可能性があります。