M1 Maxで2.8兆パラメータのKimi K3を動作させるDeltafinプロジェクト
要点:Deltafinプロジェクトにより、64GBメモリのM1 Max上で2.8兆パラメータのMoEモデル「Kimi K3」の推論が実現しました。推論速度は非常に低速ですが、OpenAI互換のAPIサーバーとして動作し、チャットやコード補完をサポートします。
日本の事業者にとって、なぜ重要?
超巨大モデルをローカル環境で動かす技術的試みとして注目されます。実用的な速度には達していませんが、将来的なオンプレミス環境での大規模モデル運用の可能性を示唆しています。
元記事
在 M1 Max 上运行 Kimi K3
元記事を読むAI評価
外部公開データの選定スコアです。評価元の掲載内容も確認できます。
選定元:AI HOT