扬声·CNDoor.Vip 首页 资讯 工具速递 查看内容

一个能让你在 Mac、甚至 iPhone 上本地跑大模型的开源小工具:Swiftlet ...

2026-8-4 12:27| 发布者: 糖糊碌| 查看: 42| 评论: 0

摘要: 一个能让你在 Mac、甚至 iPhone 上本地跑大模型的开源小工具:Swiftlet 本地跑大模型,很多人的印象是"得有大显卡、大内存"。近期有个开源项目 Swiftlet 想打破这个印象:它让 35B 和 80B 这种量级的 Qwen 大模型, ...

一个能让你在 Mac、甚至 iPhone 上本地跑大模型的开源小工具:Swiftlet

Swiftlet本地跑大模型

本地跑大模型,很多人的印象是"得有大显卡、大内存"。近期有个开源项目 Swiftlet 想打破这个印象:它让 35B 和 80B 这种量级的 Qwen 大模型,跑在普普通通的苹果设备上——Mac 上 80B 模型只用约 4.3GB 内存,35B 的那个甚至能在 iPhone 上跑起来。

怎么回事?原理说起来不复杂。很多大模型其实是"混合专家"结构,每次真正用到的只是其中一小部分权重。Swiftlet 就是在内存里只常驻那个体积小的"核心",其余"专家"权重按需从硬盘里临时读取。这样一张 18GB 的 35B 模型,运行时峰值内存只要 2.6GB;42GB 的 80B 模型,峰值约 4.3GB。

能跑多快? 据项目方在 Mac 上的实测,35B 模型大约每秒 7~11 个 token,80B 约 4.5~5 个 token;35B 在 iPhone 17 上约每秒 1 个 token。速度不算飞快,胜在"能本地跑"——数据不出设备。官方也坦诚说:这些模型每次实际激活的只有约 3B 参数,所以聊天、写作像大模型,但细节记忆会偏弱一些。

对谁有用?

  • 在乎隐私的人:不想把数据传到云端,本地离线跑模型正合适。
  • 想在自己设备上玩大模型的人:不需要买贵显卡,苹果芯片的老机器也能试试。
  • 开发者:它自带一个仅回环的 OpenAI 兼容接口,可以直接接进自己的项目里。

怎么上手?项目是开源免费的(Apache 2.0 协议),有 macOS 14+ 或 iOS 17+ 的苹果设备就能试。35B 那个模型还做成了 App Store 里的 App(叫 Priv AI),iPhone 用户下载就能体验,无需命令行。

来源:GitHub / Hacker News Show HN

链接:https://github.com/leonickson1/Swiftlet


鲜花

握手

雷人

路过

鸡蛋
扬声 · CNDoor.Vip 汇聚 AI 资讯、办公效率、写作、图鉴等实用内容,为新手提供从入门到上手的 AI 指南。我们相信:AI 不该只是技术圈的事——把复杂的事说人话,让每个人都用得上。
  • 手机博客
  • 手机扬声
Copyright © 2014-2026 扬声 · 菜鸟门 版权所有 All Rights Reserved. 冀ICP备2025120842号
关灯 返回顶部
返回顶部