Alibaba
$2
输入tokens/百万
-
输出tokens/百万
256
上下文长度
huawei-csl
这是使用华为SINQ(Sinkhorn归一化量化)方法对Qwen3-Next-80B大语言模型进行4位量化后的版本。SINQ是一种新颖、快速且高质量的量化方法,旨在显著压缩模型体积(约减少75%),同时保持与原始模型几乎不变的准确性,使其更易于部署。
nightmedia
这是Qwen3-Next-80B-A3B-Instruct模型的MLX格式转换版本,专为在Apple Silicon设备上高效运行而优化。该模型是一个800亿参数的大型语言模型,支持文本生成任务,具有强大的对话和推理能力。
noctrex
这是Qwen3-Next-80B-A3B-Instruct的MXFP4量化实验版本,基于前沿的量化技术开发,提供高效的文本生成能力。该版本为实验性质,需要特殊版本的llama.cpp支持。
基于Qwen3-Next的800亿参数指令微调模型,采用Deckard qx64n混合精度量化技术,支持100万上下文长度,在抽象推理、内存效率和长上下文处理方面表现优异
lefromage
这是Qwen3-Next-80B-A3B-Instruct模型的GGUF量化格式版本,由lefromage提供。该模型是一个800亿参数的大型语言模型,采用Apache 2.0许可证,支持文本生成任务。GGUF格式便于在本地设备上部署和运行。
这是一个基于Qwen3-Next-80B-A3B-Instruct模型的Q4_0量化版本,通过特定量化技术显著提升了模型在存储和计算方面的效率,同时保持了良好的性能表现。
cturan
Qwen3-Next-80B-A3B-Instruct是Qwen3-Next系列的前沿大语言模型,通过创新架构提升了参数效率和推理速度,在多领域展现出卓越性能,原生支持超长上下文处理。
cpatonn
Qwen3-Next-80B-A3B-Instruct是通义千问团队开发的高效稀疏混合专家模型,总参数量80B,激活参数量仅3B。该模型采用创新的混合注意力机制和极低激活率的MoE架构,在保持强大性能的同时大幅提升推理效率,原生支持262K上下文长度并可扩展至1M令牌。
NexVeridian
本模型是基于Qwen/Qwen3-Next-80B-A3B-Instruct原模型使用mlx-lm 0.28.0版本转换的4位量化MLX格式模型,专为苹果芯片优化,支持高效的文本生成任务。
lmstudio-community
Qwen3-Next-80B-A3B-Instruct是阿里云通义千问团队开发的大规模语言模型,经过MLX框架4位量化优化,专门针对苹果芯片设备进行了性能优化,提供高效的推理能力。
Qwen3-Next-80B-A3B-Instruct-qx64-mlx 是 Qwen 系列的大型语言模型,专门转换为 MLX 格式用于高效文本生成。该模型具有 800 亿参数,支持多语言交互,特别针对指令跟随任务进行了优化。
这是Qwen3-Next-80B-A3B-Instruct模型的3位量化版本,专为MLX框架优化。该模型基于Qwen团队开发的下一代大语言模型,经过指令微调,支持高效的文本生成任务。量化后模型大小显著减小,同时保持了较好的性能表现。
kikekewl
基于MLX库优化的文本生成模型,采用Qwen/Qwen3-Next-80B-A3B-Instruct基础模型,使用bf16数据类型进行优化,专注于高效文本生成任务,为相关领域开发提供高性能支持。
TheClusterDev
这是Qwen3-Next-80B-A3B-Instruct模型的FP8量化版本,通过vLLM框架支持,在保持模型质量的同时显著减小了模型体积,提升了推理效率。
unsloth
Qwen3-Next-80B-A3B-Instruct是阿里巴巴通义千问团队开发的最新一代大型语言模型,采用创新的混合注意力机制和高稀疏专家混合架构,在保持80B总参数的同时仅激活3B参数,实现了高效的上下文建模和推理加速,原生支持262K上下文长度并可扩展至1M令牌。
mlx-community
这是Qwen3-Next-80B-A3B-Instruct模型的8位量化MLX格式版本,专为Apple Silicon优化的大型语言模型,支持指令跟随和对话任务
这是Qwen3-Next-80B-A3B-Instruct模型的MLX格式6位量化版本,专为Apple Silicon优化的大语言模型,支持指令跟随和对话任务。
这是Qwen3-Next-80B-A3B-Instruct模型的5位量化MLX格式版本,专为Apple Silicon优化,提供高效的推理性能。
DevQuasar
这是Qwen/Qwen3-Next-80B-A3B-Instruct的量化版本,基于llmcompressor工具实现,致力于让知识为每个人所用,推动知识的广泛传播。
这是Qwen3-Next-80B-A3B-Instruct模型的4位量化MLX格式版本,专为Apple Silicon优化。该模型是一个80B参数的大型语言模型,支持多轮对话和指令跟随,经过量化处理后可在Apple设备上高效运行。