英伟达发布Nemotron-Labs-TwoTower离散扩散语言模型,解决大模型逐token生成速度慢的痛点,权重已在Huggingface开源。该模型复用现有骨干网预训练权重,无需从头训练,显著降低成本。采用60B双塔架构,两座30B网络并行协同,每塔激活3B参数并搭载128个可路由专家模块,提升生成效率。
智谱AI开源最新“混合思考”模型GLM-4.4-Flash,采用30B-A3B MoE架构,总参数量300亿,实际激活约30亿参数。该模型在保持轻量化部署优势的同时,凭借卓越推理与编码能力,登顶同类规格模型性能榜首,成为30B级别中的“全能王者”。
Jan团队推出30B参数多模态模型Jan-v2-VL-Max,专注解决AI在复杂自动化任务中易中断的痛点。该模型基于Qwen3-VL-30B-A3B-Thinking,引入LoRA-based RLVR技术,旨在提升多步操作的稳定性,实现更可靠的长周期任务执行。
Radical Numerics发布30B参数开源扩散语言模型RND1-Base,采用稀疏专家混合架构,仅激活3B参数。该模型具备并行生成优势,在基准测试表现优异,并公开完整权重与训练方案,推动扩散模型技术发展。
一款基于30B参数的图生视频模型,支持运动幅度可控和多种运镜效果
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
$6
$24
Baidu
128
Bytedance
$1.2
$3.6
4
TeichAI
这是一个基于Claude Sonnet 4.5推理数据集训练的30B参数大语言模型,专门针对高难度推理任务进行优化,在编码和科学领域表现出色。
noctrex
P1 - 30B - A3B是一个300亿参数的大语言模型,经过MXFP4_MOE量化处理,在保持模型性能的同时优化了推理效率,适用于文本生成任务。
Mungert
通义深度研究30B是一款具有300亿参数的大语言模型,专为长周期、深度信息搜索任务设计。该模型在多个智能搜索基准测试中表现出色,采用创新的量化方法提升性能,支持智能预训练、监督微调与强化学习。
geoffmunn
这是Qwen/Qwen3-Coder-30B-A3B-Instruct语言模型的GGUF量化版本,专为本地推理优化,支持llama.cpp、LM Studio、OpenWebUI、GPT4All等框架。该模型是一个30B参数规模的代码生成和编程助手模型。
DevQuasar
本项目是阿里巴巴通义深度研究30B模型的A3B量化版本,旨在通过量化技术降低模型部署成本,让知识为每个人所用。该模型基于30B参数规模的大语言模型进行优化,保持了原模型的强大能力同时提升了推理效率。
foobar2333
这是一个基于Qwen3-30B-A3B-Thinking-2507模型的GGUF格式量化版本,经过abliterated处理,采用Q4_K_M量化级别。该模型专注于文本生成任务,支持中文和英文,具有30B参数规模。
mlx-community
基于Qwen/Qwen3-Coder-30B-A3B-Instruct转换的MLX格式8位量化版本,专门用于代码生成和编程任务的30B参数大语言模型
lmstudio-community
Qwen3-Coder-30B-A3B-Instruct是Qwen推出的30B参数规模的代码生成模型,经过指令微调优化,专门针对编程任务设计。该模型采用MLX框架进行4位量化,针对苹果芯片进行了优化,能够在Mac设备上高效运行。
基于Qwen开发的30B参数指令微调模型,经过MLX 8位量化处理,专门针对Apple Silicon芯片优化,适用于各种文本生成任务。
inceptionai
Jais系列是专为阿拉伯语优化的双语大语言模型,同时具备强大的英语能力。30B-16K版本拥有300亿参数,支持16,384个token的上下文长度。