Aioga
AI资讯 / 模型更新
返回 AI资讯

苹果 iPhone 上最快本地 AI 模型:Maple-Preview-20B-A1B 登场,可达 127 tokens/s

IT之家(RSS)Aioga 编辑团队2026-08-06T06:21:57.000Z热度 52

DeepGrove 发布轻量 AI 模型 Maple-Preview,在 iPhone 上运行速度达 127 tokens/s,约为 Bonsai 27B 的 13 倍。该模型...

模型更新IT之家(RSS)

今日 AI 情报摘要

DeepGrove 发布轻量 AI 模型 Maple-Preview,在 iPhone 上运行速度达 127 tokens/s,约为 Bonsai 27B 的 13 倍。

该模型总参数量 202 亿,采用 MoE 架构,激活参数 14.9 亿,并提出"三值权重"方案降低内存占用。 目前处于预览阶段,处理 131,000 tokens 时内存占用仅 7.69GB。

正文 · AI 翻译

苹果 iPhone 上最快本地 AI 模型:Maple-Preview-20B-A1B 登场,可达 127 tokens/s 这条更新来自 ithome.com,发布时间为 2026-08-06,Aioga 保留原文入口以便核验。

摘要:DeepGrove 发布轻量 AI 模型 Maple-Preview,在 iPhone 上运行速度达 127 tokens/s,约为 Bonsai 27B 的 13 倍。该模型总参数量 202 亿,采用 MoE 架构,激活参数 14.9 亿,并提出"三值权重"方案降低内存占用。目前处于预览阶段,处理 131,000 tokens 时内存占用仅 7.69GB。

背景:材料称,DeepGrove 认为端侧 AI 目前主要依赖量化技术,并指出这会影响模型性能和效率。Maple-Preview 使用三值权重方案,将权重约束并量化为 {-1,0,1},以降低内存占用和计算带宽需求。

Aioga 观察:Aioga 判断,Maple-Preview 的信息重点不只在单项速度,还在于以较低激活参数量和三值权重方案服务本地运行。其 127 tokens/s 的表述应结合未披露具体 iPhone 机型、仍处预览阶段等条件谨慎看待。

On-device decode speed versus benchmark performance for Maple-Preview with its dense and Flash heads and comparison models.

影响与后续:值得关注的是,材料给出的长上下文数据称,处理 131,000 tokens 时内存占用为 7.69GB。若后续测试能够覆盖更多设备与任务,本地模型在速度、内存控制和上下文长度之间的取舍或将更易比较。 下一步可关注 DeepGrove 对预览版本的后续改进,以及其是否披露具体 iPhone 测试机型、测试条件和更多实际任务表现。同时,可留意其关于模型随对话自动调整并面向单个用户优化的系统是否形成可验证成果。

苹果 iPhone 上最快本地 AI 模型:Maple-Preview-20B-A1B 登场,可达 127 tokens/s

情报判断

Aioga 编辑摘要

DeepGrove 发布预览阶段轻量模型 Maple-Preview。按材料所述,该模型在未明确具体机型的 iPhone 上运行速度可达 127 tokens/s;总参数量为 202 亿,采用 MoE 架构,激活参数量为 14.9 亿。

背景分析

材料称,DeepGrove 认为端侧 AI 目前主要依赖量化技术,并指出这会影响模型性能和效率。Maple-Preview 使用三值权重方案,将权重约束并量化为 {-1,0,1},以降低内存占用和计算带宽需求。

Aioga 观点

Aioga 判断,Maple-Preview 的信息重点不只在单项速度,还在于以较低激活参数量和三值权重方案服务本地运行。其 127 tokens/s 的表述应结合未披露具体 iPhone 机型、仍处预览阶段等条件谨慎看待。

影响与后续

值得关注的是,材料给出的长上下文数据称,处理 131,000 tokens 时内存占用为 7.69GB。若后续测试能够覆盖更多设备与任务,本地模型在速度、内存控制和上下文长度之间的取舍或将更易比较。 下一步可关注 DeepGrove 对预览版本的后续改进,以及其是否披露具体 iPhone 测试机型、测试条件和更多实际任务表现。同时,可留意其关于模型随对话自动调整并面向单个用户优化的系统是否形成可验证成果。

来源与版权说明

本页正文由公开来源页面提取并按原有信息整理,同时保留来源、发布时间和原文入口。版权归原作者及来源网站所有,请通过原文链接核验和阅读来源版本。

抓取通道: RSS · 原始域名: ithome.com

来源: IT之家(RSS)

原文链接: 打开原始来源

Aioga 归档: 查看情报页

Content record: source-page · Updated: 2026-08-06T06:21:57.000Z

API 中转站
API RELAY · DEVELOPER INFRASTRUCTURE

API 中转站

统一接入主流 AI 模型 API,为开发、测试与生产环境提供稳定调用入口。

立即访问 api.w173.com
AIOGA SHARE POSTER

分享这篇 AI 情报

DeepGrove 发布轻量 AI 模型 Maple-Preview,在 iPhone 上运行速度达 127 tokens/s,约为 Bonsai 27B 的 13 倍。该模型...

IT之家(RSS)2026-08-06T06:21:57.000Z
扫码打开文章详情扫码直达文章详情

Aioga 自动聚合全球 AI 动态,并保留来源信息用于核验与引用。