Appleデバイスで大規模モデルを軽量動作させるSwiftletが登場
要点:SwiftとMetalを活用したランタイムSwiftletにより、MacやiPhoneでQwenなどの大規模な混合エキスパートモデルを効率的に実行可能になりました。必要な重みのみをストレージから読み込む手法で、メモリ消費を大幅に抑えています。
日本の事業者にとって、なぜ重要?
高性能なAIモデルを専用サーバーなしでローカル環境で運用できる可能性が広がり、プライバシー保護やコスト削減を重視するビジネス現場での活用が期待されます。
元記事
Show HN: 在 Mac 上运行 80B 版 Qwen(内存 4.3 GB),在 iPhone 上运行 35B 版
元記事を読むAI評価
外部公開データの選定スコアです。評価元の掲載内容も確認できます。
選定元:AI HOT