DeepSeek V4.1-Flash登場:KVキャッシュ削減でメモリ負荷を大幅軽減
要点:552BパラメータのMoEモデルであるV4.1-Flashは、前世代と比較してKVキャッシュのメモリ消費をHBMで4分の1、SSDで8分の1に削減しました。API価格の引き下げも同時に行われています。
日本の事業者にとって、なぜ重要?
メモリ負荷の軽減は、より安価なインフラ環境での大規模モデル運用を可能にするため、自社開発やオンプレミス環境でのAI活用を検討する企業にとって重要な選択肢となります。
元記事
DeepSeek just released V4.1-Flash with a new architecture, six weeks after its July V4-Flash update….
元記事を読むAI評価
外部公開データの選定スコアです。評価元の掲載内容も確認できます。
選定元:AI HOT