PrismML 发布 Bonsai 2 27B:把 27B 模型压缩到 5.9GB
PrismML 用三值权重把 27B 模型压到 5.9GB、保留 98% 基准成绩,本地设备跑推理模型变得更现实。
AI 实验室 PrismML 值得关注,原因不是融资规模(目前只有 2225 万美元种子轮),而是团队成员背景和它正在做的技术:让具备推理能力的大模型变得足够小,小到能装进 PC 和手机。
正文摘录
如果 AI 实验室 [PrismML](https://prismml.com/) 还没进入你的视野,那它该进来了——不是因为它融了多少资(目前还没融多少,只有一轮 2225 万美元的种子轮),而是因为它背后的技术头脑,以及它正在开发的、有可能改变整个行业的技术。 PrismML 押注的是:能力强、表现好、会推理的大语言模型,其实并不一定要"大"。 它正在把推理模型做到小到能塞进 PC 和智能手机里。(甚至有传闻说它[正与 Apple 洽谈](https://www.cnbc.com/2026/07/14/apple-prismml-ai-compression-iphone.html),不过 CEO Babak Hassibi 拒绝对 TechCrunch 置评。) 周四,PrismML [发布了 Bonsai 2 27B](https://prismml.com/news/bonsai-2-27b),这是该系列模型的最新一款:它把 Qwen3.8 27B——来自阿里巴巴、被广泛使用的开源模型——压缩到了 5.9 GB。这已经小到能装进一台 PC,甚至可能装进一台高端智能手机。相比原始模型,内存占用减少了 9 到 10 倍。 PrismML 由一群 Caltech(加州理工)研究人员创立,由 Hassibi 领导,他是 Caltech 教授、压缩技术领域的专家。这家创业公司还请来了 Ion Stoica 担任顾问。