OpenAI于7月31日公布GPT-5.6系列新定价,中端及轻量模型大幅降价,旗舰款不变。轻量级Luna模型成焦点,输入与输出费用同步削减80%,每百万输入Token降至0.2美元,输出亦相应大幅调低,掀起AI价格战新浪潮。
OpenAI 发布 GPT-5.6 模型家族,包括旗舰 Sol、均衡 Terra 与高性价比 Luna。新一代通过底层技术栈深度优化,大幅提升每 token 智能效率,在降低 API 成本的同时增强性能。其中,旗舰 Sol 开启最大推理能力后,在编码智能体基准测试中表现超越竞品。
OpenAI今日为ChatGPT桌面端大升级,该客户端已与Codex整合,正式上线基于GPT-Live模型的ChatGPT Voice语音模式。新版本支持在聊天、办公和编程三个板块通过语音直接发起、检查或调整任务,将多线程工作协同从键盘移至语音。早在2024年,OpenAI便为ChatGPT添加语音识别,此后持续发力语音技术。
Epoch AI研究显示,主流AI文本检测器能近乎完美识别普通AI生成内容,但当大语言模型刻意模仿特定作者写作风格时,准确率明显下降,科学写作最难辨别。实验测试了Pangram、GPTZero和Originality.ai三款工具,采用495篇涵盖博客、小说、科学的人类原创文本(均创作于ChatGPT问世前),发现风格模仿可有效逃逸检测。
OpenAI推出的最新语言模型GPT-4.5,专注于提升无监督学习能力,提供更自然的交互体验。
百聆是一个类似GPT-4o的语音对话机器人,通过ASR+LLM+TTS实现,低配置也可运行,支持打断。
VITA-1.5: 实时视觉和语音交互的GPT-4o级多模态大语言模型
全面对标GPT-4 Turbo的AI大语言模型
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
Baidu
128
$6
$24
$8
$240
52
Bytedance
$1.2
$3.6
4
mradermacher
这是一个专注于网络安全领域的20B参数开源大语言模型,基于GPT-OSS架构,并融合了多个网络安全指令数据集进行微调。模型提供了多种量化版本,便于在资源受限的环境中部署,可用于生成网络安全相关的文本、代码和分析报告。
bartowski
这是p-e-w/gpt-oss-20b-heretic模型的量化版本,使用llama.cpp的imatrix技术进行量化处理。该模型是一个200亿参数的大语言模型,提供了多种量化选项,从高质量到低质量不等,文件大小从41.86GB到11.52GB,适用于不同硬件条件。
Mungert
gpt-oss-safeguard-20b是基于GPT-OSS-20b微调的安全推理模型,专门用于大语言模型输入输出过滤、在线内容标注以及信任与安全用例的离线标注。该模型采用Apache 2.0许可证,支持自定义策略和透明决策过程。
unsloth
GPT-OSS-Safeguard-20B是基于GPT-OSS构建的210亿参数安全推理模型,专门针对安全相关的文本内容分类和过滤任务进行优化。该模型支持自定义安全策略,提供透明的推理过程,适用于大语言模型输入输出过滤、在线内容标注等安全用例。
ModelCloud
这是一个基于MiniMax M2基础模型的4bit W4A16量化版本,由ModelCloud的@Qubitum使用GPT-QModel工具进行量化。该模型专门针对文本生成任务进行了优化,在保持较好性能的同时显著减少了模型大小和推理资源需求。
QuantTrio
GLM-4.6-GPTQ-Int4-Int8Mix是基于zai-org/GLM-4.6基础模型的量化版本,在文本生成任务上表现出色。该模型通过GPTQ量化技术实现了模型大小的优化,同时保持了良好的性能表现。
geoffmunn
这是Qwen/Qwen3-0.6B语言模型的GGUF量化版本,一个拥有6亿参数的紧凑大语言模型,专为在低资源设备上进行超快速推理而设计。支持llama.cpp、LM Studio、OpenWebUI和GPT4All等框架,可在任何地方离线使用私有AI。
openai
gpt-oss-safeguard-20b是基于gpt-oss构建的安全推理模型,拥有210亿参数(其中36亿为活跃参数),专门针对安全用例设计。该模型可根据提供的安全策略对文本内容进行分类,并执行基础安全任务,适用于大语言模型输入输出过滤、在线内容标注等场景。
gpt-oss-safeguard-120b是基于gpt-oss构建的安全推理模型,专门为安全用例设计。该模型能够根据提供的安全策略对文本内容进行分类,并执行一系列基础安全任务,适用于大语言模型输入输出过滤、在线内容标注等场景。
mlx-community
Jinx GPT OSS 20B MXFP4 MLX 是一个基于 MLX 框架转换的 200 亿参数大语言模型,采用混合精度量化技术优化,适用于苹果芯片设备的高效推理。
DevQuasar
这是ValiantLabs/gpt-oss-20b-ShiningValiant3模型的量化版本,致力于让知识为每个人所用。该模型通过量化技术减少了模型大小和计算需求,同时保持了原始模型的文本生成能力。
DavidAU
基于OpenAI的gpt-oss-120b模型优化的大型语言模型,使用NEO数据集进行性能提升,支持多场景应用,可在CPU、GPU或部分卸载模式下运行,具有128k上下文长度和最多128个专家的混合专家架构。
这是一个基于GPT架构的大型语言模型,拥有1200亿参数并使用4位量化技术压缩,通过MLX框架优化在Apple芯片上运行,支持高效的文本生成任务。
NexVeridian
这是OpenAI GPT-OSS-120B模型的5位量化版本,使用mlx-lm 0.26.3转换为MLX格式。该模型是一个1200亿参数的大型语言模型,经过量化处理后可在Apple Silicon设备上高效运行。
inferencerlabs
基于MLX库实现的120B参数GPT模型,采用6.5bit量化技术,在保持接近原始性能的同时大幅降低内存占用,专注于高效的文本生成任务。
基于OpenAI GPT-OSS-20B模型的6.5位量化版本,使用MLX库进行优化处理,在保持与8位量化相当性能的同时大幅降低内存占用,适用于高效的文本生成任务。
这是OpenAI GPT OSS 20B模型的量化版本,旨在通过量化技术降低模型部署和运行成本,让更多人能够使用这个200亿参数的大型语言模型。
mediainbox
基于Qwen2.5-14B大语言模型的GPTQ量化版本,支持英语和西班牙语文本生成任务
arshiaafshani
基于GPT-2架构开发的大语言模型,专注于科研辅助功能,在有限硬件条件下完成训练
Qwen
Qwen3是通义千问系列大语言模型的最新版本,提供17亿参数的GPTQ 8位量化模型,支持思维与非思维模式切换,增强推理能力和多语言支持。
Meta API MCP Server是一个支持多API的网关服务器,通过Model Context Protocol (MCP)协议连接各类API与大型语言模型(如Claude、GPT等),使AI助手能够直接与API交互并访问真实数据源。支持从JSON配置文件或Postman集合快速添加API,提供HTTP方法全面支持和多种认证方式。