OpenAI與開發平臺Kiro合作,將GPT-5.6模型家族(含Sol、Terra、Luna)嵌入軟件規劃、構建、審查、測試全流程。新模型每Token產出效率大幅提升,性能更強、性價比更高,並能按需處理複雜任務。
OpenAI工程師Tibo宣佈,Codex中GPT-5.6 Sol模型的100萬Token上下文窗口,已從僅限API密鑰擴展至ChatGPT賬號。訂閱用戶可手動開啓百萬窗口,解決處理大項目時被迫截斷歷史記錄的限制。
8月13日,OpenAI發佈“Ultrafast”超快模式,搭載於旗艦大模型GPT-5.6Sol,速度較標準處理提升14倍,每秒最多生成750個輸出標記,並保持原有智能與輸出質量。該功能由OpenAI與芯片廠商Cerebras聯合開發,目前處於預覽階段,優先向部分企業客戶開放,後續隨算力擴容逐步推廣。
OpenAI擴展Daybreak網絡安全計劃,新增兩級訪問權限併發布專爲安全訓練的GPT-5.6-Cyber模型。該計劃認爲,攻擊者正利用AI加速攻擊,防禦窗口急劇收窄,須在惡意應用大規模部署前,將前沿智能交給可信防禦方。Daybreak Blue層級提供通用模型GPT-5.6 Sol,移除了妨礙合法防禦的限制。
百聆是一個類似GPT-4o的語音對話機器人,通過ASR+LLM+TTS實現,低配置也可運行,支持打斷。
VITA-1.5: 即時視覺和語音交互的GPT-4o級多模態大語言模型
全面對標GPT-4 Turbo的AI大語言模型
通過GPT等大型語言模型與你的文檔對話
Google
$0.49
輸入tokens/百萬
$2.1
輸出tokens/百萬
1k
上下文長度
Openai
$2.8
$11.2
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$6
$24
256
$4
$16
Baidu
128
Bytedance
$1.2
$3.6
4
$2
$3.9
$15.2
64
$0.8
Moonshot
bartowski
這是p-e-w/gpt-oss-20b-heretic模型的量化版本,使用llama.cpp的imatrix技術進行量化處理。該模型是一個200億參數的大語言模型,提供了多種量化選項,從高質量到低質量不等,文件大小從41.86GB到11.52GB,適用於不同硬件條件。
Mungert
gpt-oss-safeguard-20b是基於GPT-OSS-20b微調的安全推理模型,專門用於大語言模型輸入輸出過濾、在線內容標註以及信任與安全用例的離線標註。該模型採用Apache 2.0許可證,支持自定義策略和透明決策過程。
unsloth
GPT-OSS-Safeguard-20B是基於GPT-OSS構建的210億參數安全推理模型,專門針對安全相關的文本內容分類和過濾任務進行優化。該模型支持自定義安全策略,提供透明的推理過程,適用於大語言模型輸入輸出過濾、在線內容標註等安全用例。
ModelCloud
這是一個基於MiniMax M2基礎模型的4bit W4A16量化版本,由ModelCloud的@Qubitum使用GPT-QModel工具進行量化。該模型專門針對文本生成任務進行了優化,在保持較好性能的同時顯著減少了模型大小和推理資源需求。
QuantTrio
GLM-4.6-GPTQ-Int4-Int8Mix是基於zai-org/GLM-4.6基礎模型的量化版本,在文本生成任務上表現出色。該模型通過GPTQ量化技術實現了模型大小的優化,同時保持了良好的性能表現。
geoffmunn
這是Qwen/Qwen3-0.6B語言模型的GGUF量化版本,一個擁有6億參數的緊湊大語言模型,專為在低資源設備上進行超快速推理而設計。支持llama.cpp、LM Studio、OpenWebUI和GPT4All等框架,可在任何地方離線使用私有AI。
openai
gpt-oss-safeguard-20b是基於gpt-oss構建的安全推理模型,擁有210億參數(其中36億為活躍參數),專門針對安全用例設計。該模型可根據提供的安全策略對文本內容進行分類,並執行基礎安全任務,適用於大語言模型輸入輸出過濾、在線內容標註等場景。
gpt-oss-safeguard-120b是基於gpt-oss構建的安全推理模型,專門為安全用例設計。該模型能夠根據提供的安全策略對文本內容進行分類,並執行一系列基礎安全任務,適用於大語言模型輸入輸出過濾、在線內容標註等場景。
mlx-community
Jinx GPT OSS 20B MXFP4 MLX 是一個基於 MLX 框架轉換的 200 億參數大語言模型,採用混合精度量化技術優化,適用於蘋果芯片設備的高效推理。
Sci-fi-vy
GPT-OSS-20B是OpenAI推出的開放權重模型,專為強大推理、智能體任務和多樣化開發者用例設計。該模型具有210億參數(其中36億為活躍參數),採用混合專家架構,支持低延遲本地部署和特定場景應用。
professorf
GPT-OSS-20B是OpenAI推出的開放權重模型,擁有210億參數(其中36億為活躍參數),專為低延遲、本地部署和特定用例設計。該模型基於harmony響應格式訓練,具備強大的推理能力和智能體任務處理能力。
DevQuasar
這是ValiantLabs/gpt-oss-20b-ShiningValiant3模型的量化版本,致力於讓知識為每個人所用。該模型通過量化技術減少了模型大小和計算需求,同時保持了原始模型的文本生成能力。
0xShonen
GPT-OSS-20B是OpenAI發佈的開放權重模型,專為強大的推理、智能體任務和多樣化開發者用例設計。該模型具有21B參數(其中3.6B為活躍參數),支持低延遲推理和本地部署,採用Apache 2.0許可證,可自由用於實驗、定製和商業部署。
DavidAU
基於OpenAI的gpt-oss-120b模型優化的大型語言模型,使用NEO數據集進行性能提升,支持多場景應用,可在CPU、GPU或部分卸載模式下運行,具有128k上下文長度和最多128個專家的混合專家架構。
這是一個基於GPT架構的大型語言模型,擁有1200億參數並使用4位量化技術壓縮,通過MLX框架優化在Apple芯片上運行,支持高效的文本生成任務。
NexVeridian
這是OpenAI GPT-OSS-120B模型的5位量化版本,使用mlx-lm 0.26.3轉換為MLX格式。該模型是一個1200億參數的大型語言模型,經過量化處理後可在Apple Silicon設備上高效運行。
axolotl-ai-co
gpt-oss-20b是OpenAI推出的開放權重模型,擁有210億參數(其中36億為活躍參數),專為低延遲、本地部署和特定場景設計。該模型基於harmony響應格式訓練,具備強大的推理能力和智能體任務處理能力。
inferencerlabs
基於MLX庫實現的120B參數GPT模型,採用6.5bit量化技術,在保持接近原始性能的同時大幅降低內存佔用,專注於高效的文本生成任務。
基於OpenAI GPT-OSS-20B模型的6.5位量化版本,使用MLX庫進行優化處理,在保持與8位量化相當性能的同時大幅降低內存佔用,適用於高效的文本生成任務。
GPT-OSS-20b是OpenAI推出的開放權重模型,具備強大的推理能力,採用Apache 2.0許可證,支持多種開發場景。該模型具有低延遲特點,適用於本地或特定使用場景,支持文本生成任務。
Meta API MCP Server是一個支持多API的網關服務器,通過Model Context Protocol (MCP)協議連接各類API與大型語言模型(如Claude、GPT等),使AI助手能夠直接與API交互並訪問真實數據源。支持從JSON配置文件或Postman集合快速添加API,提供HTTP方法全面支持和多種認證方式。