据悉,苹果公司目前正在认真评估AI初创公司PrismML的量化技术。该技术可将大型语言模型的内存占用从约54GB大幅缩减至不足4GB。
PrismML的核心突破是原生1-bit模型压缩技术,其模型体积可压缩至全精度版本的1/14左右,内存占用降低超90%。该技术能在保持接近FP16模型精度的同时,显著提升推理速度并降低能耗。
该公司近日宣布推出Bonsai 27B模型,该模型基于Qwen 3.6 27B微调,在保留90%智能水平的情况下,已能在配备12GB内存的iPhone 15及后续机型上原生运行完整27B参数模型。








