swiftlet

Swiftlet在苹果设备上本地运行大型Qwen MoE模型,降低内存需求以支持本地推理。

分享到 X许可证: Apache-2.0

概述

Swiftlet是面向Qwen3-Next和Qwen3.5/3.6 MoE模型的Swift/Metal运行时。它仅将小型稠密核心保留在内存中,并按需从存储中流式加载专家权重,使大型模型可在苹果设备上本地推理并降低内存需求。

主要特点

  • 在macOS和iOS设备上本地运行大型Qwen MoE模型
  • 仅保留密集核心在内存中,并按需从存储加载专家权重
  • 项目示例面向35B和80B模型规模
  • 使用Swift和Metal实现本地推理

适用场景

适合在苹果设备上进行本地AI推理的开发者和爱好者,尤其是在内存限制较严的场景中。若需要在macOS或iOS环境中运行大型Qwen MoE模型而不依赖云端托管,它是一个实际选择。

上游仓库
leonickson1/Swiftlet
GitHub 上的 fork
Guo-astro/swiftlet
上游 Star 数
654
分类
AI 智能体与大模型工具
许可证
Apache-2.0
Fork 时间
2026-10-05
同步状态
已同步上次同步 2026-10-11