雷神发布AI移动工作站M7000,9月21日开售,国补价1.99万元。号称可端侧运行1200亿参数大模型,机身重2.45kg,面向创作、开发、科研、涉密四大场景,搭载AMD锐龙AI芯片。
智谱发布新模型GLM-5.3-FlashX,最高速度达每秒200 token,主打企业开发者体验。其前身GLM-5.3-Flash曾以“Ox Alpha”面向全球开发者,凭同尺寸领先智能表现积累口碑,调用量快速增长。为应对需求,智谱依托10万张国产芯片算力,持续加码基础设施与推理优化。
据The Information报道,苹果正讨论在规划中的AI推理服务器上采用英伟达NVLink Fusion网络技术,该服务器将搭载自研芯片,或意味着苹果重返服务器市场。苹果拟推企业级AI服务器,面向开发者、企业和政府,可能配备两颗或四颗M8 Ultra芯片。消息传出后苹果股价盘前小幅上涨。
苹果被曝推进自研企业级AI服务器及芯片,其中一款芯片或基于M7 Ultra开发,预计2029年发布,将与英伟达竞争。服务器计划分两种版本:基础版搭载两颗M8 Ultra芯片,高配版搭载四颗。此前消息称,苹果正筹划采用自研AI芯片的企业级服务器。
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
$7.7
$30.8
200
-
Google
$0.7
$2.1
$17.5
Anthropic
$21
$105
Moonshot
$4
$16
256
Xai
$1.4
$10.5
Deepseek
$12
128
$0.4
$8.75
$70
400
$0.35
$0.63
$3.15
131
Alibaba
$1
$525
Bytedance
$0.8
$8
Chatglm
lmstudio-community
Qwen3-VL-32B-Instruct是一个强大的多模态视觉语言模型,基于Qwen基础模型开发,经过优化和量化处理,专门针对苹果芯片设备进行了优化,提供高效的图像文本处理能力。
Qwen3-VL-2B-Instruct 是一款高效的图像文本转文本模型,由 Qwen 团队开发。该模型经过 MLX 8位量化优化,特别适用于苹果硅芯片设备,能够处理视觉语言任务并提供高效的解决方案。
Qwen3-VL-8B-Instruct是由Qwen团队开发的多模态视觉语言模型,支持图像文本到文本转换。该版本经过MLX 8位量化处理,专门针对苹果硅芯片进行优化,在保持性能的同时提升运行效率。
KAT-Dev是由Kwaipilot开发的多语言自然语言处理模型,支持多种语言交互任务,提供高效准确的语言处理能力。该版本经过MLX团队8位量化优化,专门针对苹果硅芯片进行了性能优化。
Qwen3-Next-80B-A3B-Instruct是阿里云通义千问团队开发的大规模语言模型,经过MLX框架4位量化优化,专门针对苹果芯片设备进行了性能优化,提供高效的推理能力。
Seed-OSS-36B-Instruct是由ByteDance-Seed开发的大型语言模型,参数量达360亿,采用Apache-2.0开源许可证。该模型基于transformers库构建,支持vllm和mlx技术优化,特别针对苹果Silicon芯片进行了8位量化处理,提供高效的文本生成能力。
Seed-OSS-36B-Instruct是由字节跳动Seed团队开发的360亿参数指令调优大语言模型,基于Transformer架构构建,经过MLX量化处理,专门针对Apple Silicon芯片进行了优化,可在LM Studio中高效运行。
OpenAI开发的120B参数文本生成模型,通过LM Studio社区模型计划展示。提供8位量化版本,特别针对苹果Silicon芯片优化,支持高效文本生成任务。
Qwen3-Coder-30B-A3B-Instruct是由Qwen团队开发的代码生成大模型,专门针对编程任务进行优化。该模型经过MLX团队的8位量化处理,针对苹果芯片进行了特别优化,具有高效的代码生成能力。
基于Qwen开发的30B参数指令微调模型,经过MLX 8位量化处理,专门针对Apple Silicon芯片优化,适用于各种文本生成任务。
GLM-4.5-Air是zai-org开发的高效语言模型,经过MLX团队8位量化优化,专门针对苹果硅芯片进行了优化。该模型基于transformers架构,支持文本生成任务,采用MIT许可证发布。
GLM-4.5-Air是由zai-org开发的高效文本生成模型,采用MLX框架进行4位量化优化,专门针对苹果芯片进行了性能优化,提供快速且高质量的文本生成能力。
Qwen3-235B-A22B-Thinking-2507是由Qwen开发的大语言模型,经过LM Studio团队使用MLX进行6位量化处理,专门针对Apple Silicon芯片进行了优化,提供高效推理能力。
ERNIE-4.5-21B-A3B是百度开发的大语言模型,经过LM Studio团队的MLX 4位量化优化,专门针对苹果芯片进行了优化。该模型具有210亿参数,支持中文和英文,采用Apache-2.0开源许可证。
Devstral-Small-2507是由mistralai开发的一个小型文本生成模型,支持多种语言,并针对苹果芯片进行了优化。
Devstral-Small-2507 是由 mistralai 开发的多语言文本生成模型,支持多种语言,特别适用于苹果硅芯片设备。
Gemma-3n-E4B-it 是由 Google 开发的模型,经过 MLX 量化优化,特别适用于苹果硅芯片设备。
由DeepSeek AI开发的大语言模型,经过4位量化优化,适用于苹果芯片设备。
mlx-community
MedGemma-4B-IT是一个专注于医疗领域的视觉语言模型,由Google开发,现转换为MLX格式以便在Apple芯片上高效运行。