苹果更新Mac使用手册,国行Apple智能正式接入阿里巴巴千问大模型。搭载macOS 26.6以上系统并开启权限后,将彻底解锁全新AI体验,Siri功能与智能迎来质变。此举弥补了国内苹果设备AI短板,借助成熟中文大模型,Siri可针对复杂请求输出更具深度的回答。
苹果诉OpenAI商业秘密纠纷升级,苹果申请初步禁令,要求限制OpenAI开发涉苹果技术的AI设备,加速取证,被告含OpenAI、其基金会、io公司及高管Chang Liu、Tang Yew Tan。另查11名前苹果员工疑涉案。
苹果诉OpenAI窃密案中,媒体曝出其自身数据管理裂缝:已离职员工仍可通过个人iCloud查阅产品发布计划等机密。根源是公司长期允许员工将个人Apple ID绑定工作设备,离职后未及时收回权限,为双方法律战增添技术注脚。
苹果发布iOS 27首个公测版,用户可在Apple Beta网站注册后,通过“设置-软件更新”下载,无需开发者账号。苹果建议使用备用设备并提前备份。新版Siri基于Apple Intelligence系统完成AI彻底重构,实现重大功能升级。
OneTap改变了您在苹果设备上分享内容的方式,让您只需轻轻一点即可保存任何内容以供稍后复制和粘贴。
将任何文件拖放到iPhone或iPad中
Openai
$0.4
Input tokens/M
-
Output tokens/M
128
Context Length
Chatglm
Alibaba
$0.3
32
Deepseek
$2
$8
Google
$140
$280
Tencent
$1
$3
4
8
Baidu
$9
$0.8
$3.2
mlx-community
该模型是 Kimi-Linear-48B-A3B-Instruct 的 MLX 格式转换版本,专为苹果 Mac Studio 等 Apple Silicon 设备优化。它是一个 480 亿参数的大型语言模型,支持指令跟随,适用于本地推理和对话任务。
kyr0
这是一个专为苹果硅芯片设备优化的自动语音识别模型,通过转换为MLX框架并量化为FP8格式,实现在苹果设备上的快速端上语音转录。该模型针对逐字精度进行微调,特别适用于需要高精度转录的场景。
Wwayu
这是一个基于GLM-4.6架构的混合专家模型,使用REAP方法对专家进行了40%的均匀剪枝,参数量为218B,并转换为MLX格式的3位量化版本,适用于苹果芯片设备高效运行。
lmstudio-community
Qwen3-VL-32B-Instruct是一个强大的多模态视觉语言模型,基于Qwen基础模型开发,经过优化和量化处理,专门针对苹果芯片设备进行了优化,提供高效的图像文本处理能力。
Qwen3-VL-2B-Instruct 是一款高效的图像文本转文本模型,由 Qwen 团队开发。该模型经过 MLX 8位量化优化,特别适用于苹果硅芯片设备,能够处理视觉语言任务并提供高效的解决方案。
manasmisra
该模型是基于GLM-4.5-Air使用REAP方法进行25%均匀剪枝后的专家混合模型,已转换为MLX格式的4位量化版本,适用于苹果芯片设备的高效推理。
这是美团LongCat-Flash-Chat模型的MLX格式转换版本,采用创新的DQ6_K_M量化技术,专为配备512GB内存的苹果Mac Studio M3 Ultra设备优化,在保持接近8位量化性能的同时显著减少内存占用
LFM2-8B-A1B是针对苹果硅芯片优化的8位量化MLX构建版本,采用专家混合(MoE)架构,总参数约80亿,每个令牌激活约10亿参数,支持设备端快速推理。
cs2764
本模型是基于moonshotai的Kimi-K2-Instruct-0905模型使用mlx-lm 0.28.0版本转换的MLX格式版本,采用3位量化技术,分组大小为32,平均每个权重仅占用4.002位,优化了模型在苹果设备上的运行效率。
Jinx GPT OSS 20B MXFP4 MLX 是一个基于 MLX 框架转换的 200 亿参数大语言模型,采用混合精度量化技术优化,适用于苹果芯片设备的高效推理。
Qwen3-Next-80B-A3B-Instruct是阿里云通义千问团队开发的大规模语言模型,经过MLX框架4位量化优化,专门针对苹果芯片设备进行了性能优化,提供高效的推理能力。
abnormalmapstudio
这是基于Qwen3-Next-80B-A3B-Thinking基础模型的苹果MLX优化4位mxfp4量化版本,专门针对苹果硅芯片优化,可在Mac设备上实现高效的本地推理,显著降低内存占用同时保持良好性能。
这是一个转换为MLX格式的文本嵌入模型,基于Google的EmbeddingGemma-300m模型转换而来,专门用于句子相似度计算和文本嵌入任务。模型采用BF16精度,适用于苹果芯片设备上的高效推理。
Marvis-AI
Marvis 是一款先进的对话式语音模型,专为实现实时流式文本转语音合成而设计。它以高效和易用性为核心,支持在苹果芯片、iPhone、iPad、Mac 等消费设备上运行的高质量实时语音合成。
NexVeridian
这是一个基于OpenAI GPT-OSS-120B模型转换的3位量化版本,使用mlx-lm 0.26.3工具转换为MLX格式,适用于苹果芯片设备的高效推理。
Qwen3-Coder-30B-A3B-Instruct是一款基于Qwen基础模型的文本生成模型,经过MLX 5位量化优化,专门针对苹果硅芯片设备进行了优化,提供高效的代码生成和文本处理能力。
Qwen3-Coder-30B-A3B-Instruct是Qwen推出的30B参数规模的代码生成模型,经过指令微调优化,专门针对编程任务设计。该模型采用MLX框架进行4位量化,针对苹果芯片进行了优化,能够在Mac设备上高效运行。
该模型是基于Qwen3-235B-A22B-Thinking-2507转换的MLX格式版本,采用3-5位混合量化技术,在保持高性能的同时显著减少模型大小和计算需求,适用于苹果芯片设备的高效推理。
基于Qwen3-Coder-480B-A35B-Instruct模型的文本生成工具库,专门针对代码生成和文本内容生成任务,采用MLX 8位量化技术优化,适用于苹果芯片设备。
基于百度ERNIE-4.5-21B-A3B模型的社区版本,采用MLX实现8位量化优化,专门针对苹果芯片设备进行性能优化,适用于文本生成任务。
一个通过MCP协议访问苹果设备数据的服务,支持记忆存储与读取