AI应用与产品

苹果与PrismML接洽,270亿参数大模型有望塞进iPhone

发布时间:2026年07月10日 12:00:00

美国AI初创PrismML宣布成功将阿里开源Qwen 3.6-270B从原始54GB权重压缩至不足4GB,苹果已与PrismML展开沟通,探索端侧AI部署方案。


模型压缩技术突破

PrismML实现了突破性的模型压缩技术:

  • 原始模型:阿里Qwen 3.6-270B,权重54GB
  • 压缩后:不足4GB,压缩比超过13倍
  • 运行设备:iPhone 17 Pro
  • 性能保持:可无损运行复杂推理、对话与代码任务

开源版本计划开放下载,大幅降低端侧AI开发门槛。

苹果端侧AI战略

苹果已与PrismML展开沟通,若合作落地将显著加速iOS端侧大模型战略:

  • Siri升级:实现本地运行百亿级参数模型
  • Apple Intelligence:系统级AI功能本地化
  • 隐私保护:数据处理不依赖云端
  • 低延迟响应:即时交互体验

端侧AI发展趋势

端侧AI正在成为行业新风口,主要驱动力包括:

  • 隐私安全:用户对数据隐私的关注日益增加
  • 响应速度:端侧推理延迟远低于云端
  • 离线能力:无需网络连接即可使用AI功能
  • 成本优化:减少云端推理费用

技术挑战与机遇

将百亿级参数模型压缩至移动端运行面临多重技术挑战:

  • 内存限制:移动端内存资源有限
  • 功耗控制:推理过程需控制功耗
  • 性能保持:压缩后需保持模型性能

但成功突破后将带来巨大的市场机遇。


来源:综合自The Verge、9to5Mac及PrismML官方公告