AI应用与产品
苹果与PrismML接洽,270亿参数大模型有望塞进iPhone
发布时间:2026年07月10日 12:00:00美国AI初创PrismML宣布成功将阿里开源Qwen 3.6-270B从原始54GB权重压缩至不足4GB,苹果已与PrismML展开沟通,探索端侧AI部署方案。
模型压缩技术突破
PrismML实现了突破性的模型压缩技术:
- 原始模型:阿里Qwen 3.6-270B,权重54GB
- 压缩后:不足4GB,压缩比超过13倍
- 运行设备:iPhone 17 Pro
- 性能保持:可无损运行复杂推理、对话与代码任务
开源版本计划开放下载,大幅降低端侧AI开发门槛。
苹果端侧AI战略
苹果已与PrismML展开沟通,若合作落地将显著加速iOS端侧大模型战略:
- Siri升级:实现本地运行百亿级参数模型
- Apple Intelligence:系统级AI功能本地化
- 隐私保护:数据处理不依赖云端
- 低延迟响应:即时交互体验
端侧AI发展趋势
端侧AI正在成为行业新风口,主要驱动力包括:
- 隐私安全:用户对数据隐私的关注日益增加
- 响应速度:端侧推理延迟远低于云端
- 离线能力:无需网络连接即可使用AI功能
- 成本优化:减少云端推理费用
技术挑战与机遇
将百亿级参数模型压缩至移动端运行面临多重技术挑战:
- 内存限制:移动端内存资源有限
- 功耗控制:推理过程需控制功耗
- 性能保持:压缩后需保持模型性能
但成功突破后将带来巨大的市场机遇。
来源:综合自The Verge、9to5Mac及PrismML官方公告