苹果、谷歌与英伟达联合开发新一代AI模型Apple Foundation Model Cloud Pro,打破巨头各自为战的局面。该模型旨在平衡高性能计算与隐私保护,性能对标谷歌Gemini,标志着科技巨头在AI基础设施与模型层面的深度融合。
苹果在2026年全球开发者大会上宣布新战略:首次下载量低于200万次的App开发者可免费调用其私有云基础模型,无需支付API费用。此举延续苹果扶持独立开发者的传统,门槛与“小企业计划”佣金减免政策一致,旨在降低AI基础设施成本。
苹果公司此前高调推出的Apple Intelligence功能,特别是图像生成工具Image Playground,因输出质量不佳被用户戏称为“最糟糕的AI功能”。然而,即将发布的OS27系统将带来转机,核心升级包括采用全新基础模型和引入Gemini算力支持,有望显著改善生成式AI的表现。
谷歌与苹果达成重要合作,成为其首选云服务提供商,苹果将基于谷歌Gemini技术开发下一代AI模型。同时,谷歌计划在2026年投入1750亿至1850亿美元加强基础设施建设,支持AI发展。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
Baidu
128
$6
$24
Bytedance
$1.2
$3.6
4
lmstudio-community
Qwen3-VL-32B-Instruct是一个强大的多模态视觉语言模型,基于Qwen基础模型开发,经过优化和量化处理,专门针对苹果芯片设备进行了优化,提供高效的图像文本处理能力。
花岗石-4.0-h-微型模型是基于IBM Granite基础模型优化的语言模型,经过MLX量化处理,专门针对苹果硅芯片进行了优化,为相关应用提供高效解决方案。
abnormalmapstudio
这是基于Qwen3-Next-80B-A3B-Thinking基础模型的苹果MLX优化4位mxfp4量化版本,专门针对苹果硅芯片优化,可在Mac设备上实现高效的本地推理,显著降低内存占用同时保持良好性能。
Qwen3-Coder-30B-A3B-Instruct是一款基于Qwen基础模型的文本生成模型,经过MLX 5位量化优化,专门针对苹果硅芯片设备进行了优化,提供高效的代码生成和文本处理能力。
百度ERNIE-4.5-21B-A3B是基于ERNIE-4.5-21B-A3B-PT基础模型的社区版本,采用MLX进行6位量化,专门为苹果芯片优化。该模型在LM Studio社区模型亮点计划中展示,具有高效的推理性能和良好的兼容性。