加州理工分拆的初创公司 PrismML 宣布,已将阿里巴巴千问 3.6(Qwen 3.6)的 270 亿参数模型从 54GB 压缩至不到 4GB,并成功在 iPhone 17 Pro 本地运行,且声称未牺牲性能。苹果公司已被曝与 PrismML 就该技术展开沟通。
技术突破与苹果的算盘
模型参数量直接决定处理复杂任务的能力,长期以来,移动设备受限于处理器算力和显存容量,难以运行超百亿参数的模型。PrismML 采用的压缩技术据称能在大幅削减体积的同时保持性能,这恰恰是苹果“端侧 AI”战略最需要的拼图。苹果虽在 6 月的开发者大会上推出基于谷歌 Gemini 的 Siri 升级,但最复杂的功能仍需依赖谷歌云端的英伟达芯片支撑。此前苹果曾尝试自行压缩模型,却遭遇性能严重下滑的瓶颈。
对行业的潜在影响
PrismML 首席执行官哈西比预测,未来三年 95% 的智能服务将在手机、笔记本、家用设备本地完成,仅有 5% 的高端功能需要云端支持。他强调,压缩技术“从根本上改变了人工智能的商业模式”,公司下一步计划压缩万亿参数级别的模型,进军 OpenAI GPT、Anthropic Claude 所在的领域。该开源模型将于下周二开放下载。
编注:信源为财联社综合报道,涵盖技术细节、苹果战略背景与 CEO 采访引语。材料未涉及压缩技术的具体实现原理。