Alibaba
$2
輸入tokens/百萬
-
輸出tokens/百萬
256
上下文長度
nightmedia
這是Qwen3-Next-80B-A3B-Instruct模型的MLX格式轉換版本,專為在Apple Silicon設備上高效運行而優化。該模型是一個800億參數的大型語言模型,支持文本生成任務,具有強大的對話和推理能力。
noctrex
這是Qwen3-Next-80B-A3B-Instruct的MXFP4量化實驗版本,基於前沿的量化技術開發,提供高效的文本生成能力。該版本為實驗性質,需要特殊版本的llama.cpp支持。
基於Qwen3-Next的800億參數指令微調模型,採用Deckard qx64n混合精度量化技術,支持100萬上下文長度,在抽象推理、內存效率和長上下文處理方面表現優異
lefromage
這是Qwen3-Next-80B-A3B-Instruct模型的GGUF量化格式版本,由lefromage提供。該模型是一個800億參數的大型語言模型,採用Apache 2.0許可證,支持文本生成任務。GGUF格式便於在本地設備上部署和運行。
這是一個基於Qwen3-Next-80B-A3B-Instruct模型的Q4_0量化版本,通過特定量化技術顯著提升了模型在存儲和計算方面的效率,同時保持了良好的性能表現。
cturan
Qwen3-Next-80B-A3B-Instruct是Qwen3-Next系列的前沿大語言模型,通過創新架構提升了參數效率和推理速度,在多領域展現出卓越性能,原生支持超長上下文處理。
cpatonn
Qwen3-Next-80B-A3B-Instruct是通義千問團隊開發的高效稀疏混合專家模型,總參數量80B,激活參數量僅3B。該模型採用創新的混合注意力機制和極低激活率的MoE架構,在保持強大性能的同時大幅提升推理效率,原生支持262K上下文長度並可擴展至1M令牌。
NexVeridian
本模型是基於Qwen/Qwen3-Next-80B-A3B-Instruct原模型使用mlx-lm 0.28.0版本轉換的4位量化MLX格式模型,專為蘋果芯片優化,支持高效的文本生成任務。
lmstudio-community
Qwen3-Next-80B-A3B-Instruct是阿里雲通義千問團隊開發的大規模語言模型,經過MLX框架4位量化優化,專門針對蘋果芯片設備進行了性能優化,提供高效的推理能力。
Qwen3-Next-80B-A3B-Instruct-qx64-mlx 是 Qwen 系列的大型語言模型,專門轉換為 MLX 格式用於高效文本生成。該模型具有 800 億參數,支持多語言交互,特別針對指令跟隨任務進行了優化。
這是Qwen3-Next-80B-A3B-Instruct模型的3位量化版本,專為MLX框架優化。該模型基於Qwen團隊開發的下一代大語言模型,經過指令微調,支持高效的文本生成任務。量化後模型大小顯著減小,同時保持了較好的性能表現。
kikekewl
基於MLX庫優化的文本生成模型,採用Qwen/Qwen3-Next-80B-A3B-Instruct基礎模型,使用bf16數據類型進行優化,專注於高效文本生成任務,為相關領域開發提供高性能支持。
TheClusterDev
這是Qwen3-Next-80B-A3B-Instruct模型的FP8量化版本,通過vLLM框架支持,在保持模型質量的同時顯著減小了模型體積,提升了推理效率。
unsloth
Qwen3-Next-80B-A3B-Instruct是阿里巴巴通義千問團隊開發的最新一代大型語言模型,採用創新的混合注意力機制和高稀疏專家混合架構,在保持80B總參數的同時僅激活3B參數,實現了高效的上下文建模和推理加速,原生支持262K上下文長度並可擴展至1M令牌。
mlx-community
這是Qwen3-Next-80B-A3B-Instruct模型的8位量化MLX格式版本,專為Apple Silicon優化的大型語言模型,支持指令跟隨和對話任務
這是Qwen3-Next-80B-A3B-Instruct模型的MLX格式6位量化版本,專為Apple Silicon優化的大語言模型,支持指令跟隨和對話任務。
這是Qwen3-Next-80B-A3B-Instruct模型的5位量化MLX格式版本,專為Apple Silicon優化,提供高效的推理性能。
DevQuasar
這是Qwen/Qwen3-Next-80B-A3B-Instruct的量化版本,基於llmcompressor工具實現,致力於讓知識為每個人所用,推動知識的廣泛傳播。
這是Qwen3-Next-80B-A3B-Instruct模型的4位量化MLX格式版本,專為Apple Silicon優化。該模型是一個80B參數的大型語言模型,支持多輪對話和指令跟隨,經過量化處理後可在Apple設備上高效運行。
這是基於 Qwen3-Next-80B-A3B-Instruct 模型使用 mlx-lm 0.27.1 版本轉換的 MLX 格式模型,專為 Apple Silicon 硬件優化,支持高效的文本生成任務。