微软研究院推出Fara1.5系列智能体模型,专为浏览器场景设计,包含4B、9B和27B三种参数版本。该模型与MagneticLite沙盒浏览器配合,可直接读取截图并模拟鼠标键盘操作,自动完成网页任务,提升计算机使用的智能化水平。
阿里通义实验室推出Qwen3.5系列小尺寸模型,包括0.8B、2B、4B和9B四种参数规模。这些模型基于统一基座研发,主打轻量级和高适应性,旨在降低AI应用门槛,实现从端侧设备到垂直场景的低成本高效落地。
清华大学在司法人工智能大会上推出开源法律大模型LegalOne-R1,获华为云昇腾AI云服务支持。该模型提供1.7B、4B和8B三种参数版本,基于中国司法数据深度训练,旨在为法律领域提供智能支持。
谷歌发布基于Gemma3架构的TranslateGemma翻译模型系列,提供4B、12B、27B三种参数规模,支持55种核心语言翻译,并具备多模态图像翻译能力,实现文本与图片文字的无缝翻译。
Alibaba
$4
输入tokens/百万
$16
输出tokens/百万
1k
上下文长度
$1
$10
256
$6
$24
$2
$20
-
Moonshot
Baidu
32
Xai
$1.4
$10.5
Tencent
Deepseek
$12
128
Openai
$0.4
$0.75
64
$0.63
$3.15
131
24
DavidAU
Qwen3-4B-Hivemind-Instruct-NEO-MAX-Imatrix-GGUF 是一款基于 Qwen3 架构的 4B 参数指令微调大语言模型,采用 NEO Imatrix 与 MAX 量化技术,具备 256k 的超长上下文处理能力。该模型在多个基准测试中表现出色,是一款性能强劲的通用型模型。
John1604
Qwen3 VL 4B Thinking 是一个支持图像到文本以及文本到文本转换的多模态模型,具有4B参数规模,能够满足多种图文交互需求。
MaziyarPanahi
本项目提供了Qwen3-4B-Thinking-2507模型的GGUF格式文件,这是一个具有思维链推理能力的4B参数大语言模型,支持多种量化版本,便于在各种硬件上部署运行。
redponike
Qwen3-VL-4B-Instruct 是通义千问系列最新的视觉语言模型,在4B参数规模下实现了卓越的视觉感知、文本理解与生成、空间推理和智能体交互能力。它支持长上下文和视频理解,具备强大的OCR和多语言处理能力。
bartowski
Apollo-V0.1-4B-Thinking是基于4B参数的大语言模型,采用思维链推理架构,专门针对推理任务优化。该模型提供了多种量化版本,可在不同硬件环境下高效运行。
MBZUAI-Paris
Frugal-Math-4B是一款针对数学推理优化的4B参数语言模型,通过强化学习验证奖励(RLVR)方法训练,能够在保持高准确性的同时生成简洁、可验证的数学解决方案,显著减少推理冗长性。
mradermacher
Zen-Eco-4B-Instruct是一个4B参数的大语言模型,专门针对指令跟随和工具使用场景进行优化。本项目提供了该模型的多个GGUF量化版本,支持不同的精度和性能需求,便于在各种硬件上部署使用。
FractalAIResearch
Fathom-DeepResearch是一个智能深度研究系统,由两个专门的4B参数模型组成:Fathom-Search-4B针对长时证据搜索优化,Fathom-Synthesizer-4B用于开放式合成和报告生成。该系统在多个搜索密集型基准测试中取得了最先进的性能,并在开放式合成基准测试上超越了多个闭源深度研究代理。
marcelone
Qwen3 4B Instruct是基于Qwen3架构的40亿参数指令微调模型,支持多语言文本生成任务。该模型提供多种量化版本,从2比特到32比特,为用户提供灵活的性能与效率平衡选择。
unsloth
Gemma 3n是谷歌推出的轻量级、最先进的多模态开放模型,基于Gemini技术构建。专为低资源设备设计,支持文本、图像、视频和音频输入,生成文本输出。采用选择性参数激活技术,在4B参数规模下高效运行。
ertghiu256
基于Qwen 3 4B参数模型微调,提升推理与问题解决能力
michaelfeil
Qwen3-Reranker-4B是通义家族最新推出的4B参数规模文本重排序模型,支持100+种语言,在文本检索任务中表现卓越。
Eric1227
基于Llama 3.2架构的混合专家模型,包含8个专家,每个专家4B参数,总参数量约21B,支持128k上下文长度,经过专门微调优化的文本生成模型
lmstudio-community
由英伟达发布的4B参数规模大语言模型,支持128k tokens上下文长度,专为推理、对话及RAG等任务优化
google
MedGemma是基于Gemma 3优化的医学多模态模型系列,专为医学文本和图像理解设计,提供4B和27B两种参数规模版本。
Mozilla
Qwen3-4B是Qwen系列最新一代的大语言模型,具有4B参数规模,支持128k上下文窗口和100多种语言,在推理、指令遵循和代理能力方面表现优异。
QuantFactory
Qwen3-4B是通义千问系列大语言模型的最新版本,具有4B参数规模,支持思维与非思维模式切换,擅长推理、指令遵循和多语言处理。
zhiqing
基于Hugging Face transformers库的4B参数大语言模型,支持文本生成、思维模式切换、工具调用和长文本处理等功能。
Qwen3-4B是Qwen系列最新一代的大语言模型,具有4B参数规模,支持100多种语言,在推理、指令遵循、代理能力和多语言支持方面表现优异。
Qwen3-4B是Qwen系列最新一代的大语言模型,具有4B参数规模,支持100多种语言,在推理、指令跟随和代理能力方面表现突出。