Alibaba
$2
入力トークン/百万
-
出力トークン/百万
256
コンテキスト長
nightmedia
これはQwen3-Next-80B-A3B-InstructモデルのMLX形式への変換バージョンで、Apple Siliconデバイス上での効率的な実行のために最適化されています。このモデルは800億パラメータの大規模言語モデルで、テキスト生成タスクをサポートし、強力な対話と推論能力を持っています。
noctrex
これはQwen3-Next-80B-A3B-InstructのMXFP4量子化実験バージョンで、最先端の量子化技術に基づいて開発され、効率的なテキスト生成能力を提供します。このバージョンは実験的な性質を持ち、特殊バージョンのllama.cppが必要です。
Qwen3-Nextに基づく800億パラメータの命令微調整モデルで、Deckard qx64n混合精度量子化技術を採用し、100万のコンテキスト長をサポートし、抽象推論、メモリ効率、長コンテキスト処理において優れた性能を発揮します。
lefromage
これはQwen3-Next-80B-A3B-InstructモデルのGGUF量子化形式のバージョンで、lefromageによって提供されています。このモデルは800億パラメータの大規模言語モデルで、Apache 2.0ライセンスを採用し、テキスト生成タスクをサポートしています。GGUF形式はローカルデバイスでのデプロイと実行が容易です。
これはQwen3-Next-80B-A3B-Instructモデルに基づくQ4_0量子化バージョンで、特定の量子化技術により、モデルのストレージと計算の効率を大幅に向上させ、同時に良好なパフォーマンスを維持しています。
cturan
Qwen3-Next-80B-A3B-InstructはQwen3-Nextシリーズの最先端の大規模言語モデルで、革新的なアーキテクチャによりパラメータ効率と推論速度を向上させ、多領域で卓越した性能を発揮し、ネイティブで超長コンテキスト処理をサポートしています。
cpatonn
Qwen3-Next-80B-A3B-Instructは通義千問チームが開発した効率的な疎な混合エキスパートモデルで、総パラメータ数は80B、活性化パラメータ数はわずか3Bです。このモデルは革新的な混合注意力機構と極低活性化率のMoEアーキテクチャを採用し、強力な性能を維持しながら推論効率を大幅に向上させ、ネイティブで262Kのコンテキスト長をサポートし、1Mトークンまで拡張可能です。
NexVeridian
このモデルは、Qwen/Qwen3-Next-80B-A3B-Instructの元モデルをmlx-lm 0.28.0バージョンを使用して変換した4ビット量子化MLX形式のモデルで、Appleチップ用に最適化され、効率的なテキスト生成タスクをサポートします。
lmstudio-community
Qwen3-Next-80B-A3B-Instructはアリババクラウドの通義千問チームによって開発された大規模言語モデルで、MLXフレームワークを用いた4ビット量子化最適化を行い、Appleチップデバイス向けに性能最適化を行い、効率的な推論能力を提供します。
Qwen3-Next-80B-A3B-Instruct-qx64-mlxはQwenシリーズの大規模言語モデルで、MLX形式に変換され、効率的なテキスト生成に使用されます。このモデルは800億のパラメータを持ち、多言語対応で、特に命令追従タスクに最適化されています。
これはQwen3-Next-80B-A3B-Instructモデルの3ビット量子化バージョンで、MLXフレームワーク用に最適化されています。このモデルはQwenチームによって開発された次世代の大規模言語モデルに基づいており、命令微調整を行っており、効率的なテキスト生成タスクをサポートしています。量子化後のモデルサイズは大幅に減少し、同時に良好な性能を維持しています。
kikekewl
MLXライブラリに基づいて最適化されたテキスト生成モデルで、Qwen/Qwen3-Next-80B-A3B-Instruct基礎モデルを採用し、bf16データ型を使用して最適化され、効率的なテキスト生成タスクに特化し、関連分野の開発に高性能なサポートを提供します。
TheClusterDev
これはQwen3-Next-80B-A3B-InstructモデルのFP8量子化バージョンで、vLLMフレームワークを通じてサポートされ、モデルの品質を維持しながらモデルサイズを大幅に削減し、推論効率を向上させます。
unsloth
Qwen3-Next-80B-A3B-Instructは、アリババの通義千問チームによって開発された最新世代の大規模言語モデルです。革新的な混合注意力機構と高疎なエキスパート混合アーキテクチャを採用し、総パラメータ数を80Bに保ちながら3Bのパラメータのみを活性化させ、効率的なコンテキストモデリングと推論の高速化を実現しています。ネイティブで262Kのコンテキスト長をサポートし、1Mトークンまで拡張可能です。
mlx-community
これはQwen3-Next-80B-A3B-Instructモデルの8ビット量子化MLX形式のバージョンで、Apple Silicon向けに最適化された大規模言語モデルで、指令追従と対話タスクをサポートします。
これはQwen3-Next-80B-A3B-InstructモデルのMLX形式の6ビット量子化バージョンで、Apple Silicon向けに最適化された大規模言語モデルで、命令追従と対話タスクをサポートします。
これはQwen3-Next-80B-A3B-Instructモデルの5ビット量子化MLX形式のバージョンで、Apple Silicon用に最適化され、効率的な推論性能を提供します。
DevQuasar
これはQwen/Qwen3-Next-80B-A3B-Instructの量子化バージョンで、llmcompressorツールを基に実現され、知識を誰もが利用できるようにし、知識の広範な普及を推進します。
これはQwen3-Next-80B-A3B-Instructモデルの4ビット量子化MLX形式のバージョンで、Apple Silicon用に最適化されています。このモデルは80Bパラメータの大規模言語モデルで、多輪対話と指令追従をサポートし、量子化処理後はAppleデバイスで効率的に動作します。
これはQwen3-Next-80B-A3B-Instructモデルをmlx-lm 0.27.1バージョンで変換したMLX形式のモデルで、Apple Siliconハードウェア向けに最適化され、効率的なテキスト生成タスクをサポートします。