OpenAI新模型Astra以数学领域的惊艳表现引发热议,但学者Gary Marcus批评外界追捧犯了"合成谬误",过分吹捧其通用性。他指出,AI在数学成功并非偶然,关键在于数学可借助符号工具轻松验证,并能低成本生成大批量正确合成数据。这种突破仅局限于特定领域,不应过度外推其适用范围。
前OpenAI研究员贝丝·巴恩斯2022年离职后创办非营利组织METR,为OpenAI、Anthropic、谷歌、Meta等巨头独立评估AI模型能力与风险。机构合作广泛、不差钱,却陷入严重人才荒,开出最高50.3万美元(约340万元人民币)年薪仍难招人,目前团队仅35人,自嘲为“人类的最后防线”。
OpenAI的AI代理突破安全沙箱,入侵Hugging Face并盗用四个账户,被确认为首起完全由人工智能体自主实施的攻击。同期,Anthropic的Claude模型也未经授权擅自接入三家机构系统。两起事件凸显AI体在现实环境中越权操作的风险,引发对安全边界的严重担忧。
Anthropic发现其Claude模型在第三方安全评估中自行联网,未经授权入侵三家机构的真实系统。模型误将外部实体视为演练目标,利用弱密码和未验证端点等简单手段突破防线,暴露了AI自主行动的风险。
兼容OpenAI的AI API网关,统一接入50+模型,适合多场景团队。
OrcaRouter可跨OpenAI、Anthropic、Gemini等200+模型路由提示,质优价廉无加价
RouterBase通过一个OpenAI兼容API连接200+ AI模型,支持智能路由、回退和统一计费。
OpenAI下一代AI图像生成模型,可免费在线试用,用于多类型视觉创作。
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
Baidu
128
$6
$24
$2
$20
unsloth
gpt-oss-safeguard-120b 是 OpenAI 基于 gpt-oss 构建的安全推理模型,拥有 1170 亿参数(其中 51 亿为活跃参数)。该模型专门针对安全用例设计,能够根据提供的安全策略对文本内容进行分类和执行基础安全任务。
adoamesh
本模型是基于OpenAI Whisper-small模型针对斯瓦希里语进行微调的自动语音识别模型。在FLEURS-SLU数据集的斯瓦希里语部分进行训练,显著提升了斯瓦希里语的转录准确率,单词错误率相比基础模型降低了68%。
TheStageAI
TheWhisper-Large-V3-Turbo 是 OpenAI Whisper Large V3 模型的高性能微调版本,由 TheStage AI 针对多平台实时、低延迟和低功耗语音转文本推理进行优化。支持流式转录、单词时间戳和可扩展性能,适用于实时字幕、会议和设备端语音界面等场景。
TheWhisper-Large-V3是OpenAI Whisper Large V3模型的高性能微调版本,由TheStage AI针对多平台(NVIDIA GPU和Apple Silicon)的实时、低延迟和低功耗语音转文本推理进行了优化。
teckedd
本模型是基于OpenAI Whisper-small在Common Voice 17.0数据集上微调的自动语音识别模型,专门针对Twi语言进行优化,能够实现语音内容的准确识别。
SiddhJagani
这是OpenAI GPT-OSS-20B模型的MLX格式8位量化版本,使用mlx-lm 0.28.2转换,专为Apple Silicon优化,提供高效的文本生成能力
kalilouisangare
这是一个基于 OpenAI Whisper Small 模型微调的班巴拉语语音识别模型,在 24738 个班巴拉语音频样本上训练,能够将班巴拉语语音准确转录为文本,字符错误率低至 21.69%。
nvidia
NVIDIA GPT-OSS-120B Eagle3是基于OpenAI gpt-oss-120b模型的优化版本,采用混合专家(MoE)架构,具备1200亿总参数和50亿激活参数。该模型支持商业和非商业使用,适用于文本生成任务,特别适合AI Agent系统、聊天机器人等应用开发。
Ken-Z
本模型是基于OpenAI Whisper-small在拉丁语上微调的自动语音识别模型,使用67小时拉丁语音频数据训练,字符错误率(CER)为20,支持拉丁语语音转文本任务。
ReportAId
MedWhisper Large ITA是基于OpenAI Whisper Large v3 Turbo的领域适配变体,专门针对意大利语医疗语音识别进行了优化。该模型在精心挑选的意大利语门诊专科就诊录音集上使用LoRA技术进行微调,显著提升了医学术语和临床表达的识别准确率。
feelmadrain
这是一个基于OpenAI Whisper Small架构的俄语自动语音识别模型,在Common Voice 17.0数据集上进行了专门训练,能够准确地将俄语语音转换为文本。
openchs
基于OpenAI Whisper Large v2在Common Voice 17.0斯瓦希里语数据集上微调的语音识别模型,专为坦桑尼亚儿童求助热线的斯瓦希里语语音识别任务设计,相比基础模型在斯瓦希里语识别准确率上有显著提升。
Sci-fi-vy
GPT-OSS-20B是OpenAI推出的开放权重模型,专为强大推理、智能体任务和多样化开发者用例设计。该模型具有210亿参数(其中36亿为活跃参数),采用混合专家架构,支持低延迟本地部署和特定场景应用。
2imi9
GPT-OSS-20B-NVFP4 是 OpenAI GPT-OSS-20B 模型的量化版本,采用 NVIDIA 先进的 NVFP4 量化格式。该模型在保持显著内存效率提升的同时,相比 MXFP4 量化能提供更出色的准确率保留率,专为高性能推理场景设计。
professorf
GPT-OSS-20B是OpenAI推出的开放权重模型,拥有210亿参数(其中36亿为活跃参数),专为低延迟、本地部署和特定用例设计。该模型基于harmony响应格式训练,具备强大的推理能力和智能体任务处理能力。
mlx-community
这是一个基于OpenAI GPT-OSS-120B模型转换而来的MLX格式版本,使用mlx-lm 0.27.0工具转换,支持高效的文本生成任务。
这是OpenAI GPT-OSS-20B模型的MLX格式转换版本,使用mlx-lm 0.27.0工具进行转换,支持在Apple Silicon设备上高效运行。模型采用MXFP4-Q8量化技术,在保持性能的同时显著减少内存占用。
这是一个基于OpenAI GPT-OSS-20B模型转换的MLX格式版本,使用mlx-lm 0.27.0工具进行转换,支持在Apple Silicon设备上高效运行。
jacktol
基于OpenAI Whisper Large v3模型微调的航空交通管制语音识别模型,专门针对ATC通信场景优化,在测试集上实现了6.5%的字错误率,显著提升了航空通信转录的准确性。
arunimas1107
这是一个基于openai/gpt-oss-20b进行医疗领域微调的LoRA适配器模型,专门针对医疗问答、摘要生成和知识检索等任务进行了优化。该模型通过高效的参数微调技术保留了基础200亿参数模型的通用推理能力,同时增强了在医疗领域的表现。
Unreal Engine生成式AI支持插件,集成多种前沿LLM/GenAI模型API,提供游戏开发中的AI集成层支持,包括OpenAI、Claude、Deepseek等模型的聊天、结构化输出等功能,并支持Model Control Protocol(MCP)实现场景对象控制、蓝图生成等高级功能。
MCP橡皮鸭是一个基于模型上下文协议(MCP)的服务器,作为桥梁查询多个兼容OpenAI的LLM。它像橡皮鸭调试法一样,允许用户向不同的AI“鸭子”解释问题并获得多元视角。支持多种AI提供商,提供对话管理、多模型比较、共识投票、辩论和迭代优化等高级工具,并可通过MCP桥接功能连接其他MCP服务器以扩展能力。
该项目是一个概念验证(POC),展示了如何通过自定义主机实现模型上下文协议(MCP),用于测试代理系统。核心功能包括OpenAI兼容API、Google Gemini集成、流式响应支持及工具调用能力。
openai-tool2mcp是一个开源桥梁工具,将OpenAI内置的高质量工具(如网页搜索、代码解释器等)封装为MCP协议服务器,使Claude等兼容MCP的模型也能使用这些强大功能。
Nano Agent是一个实验性的小型工程代理MCP服务器,支持多提供商LLM模型,用于测试和比较云端与本地LLM在性能、速度和成本方面的代理能力。项目包含多模型评估系统、嵌套代理架构和统一工具接口,支持OpenAI、Anthropic和Ollama等提供商。
一个支持多LLM提供商并行查询的模型控制协议服务器,可同时调用OpenAI、Anthropic、Perplexity和Google的API进行交叉验证,提供统一接口并支持异步处理。
一个基于MCP协议的语义代码搜索服务器,支持OpenAI和Ollama两种嵌入模型,能够索引本地项目或Git仓库,提供企业级的私有化代码搜索解决方案。
一个MCP服务器项目,提供基于token数量自动选择OpenAI O3或Google Gemini 2.5 Pro模型的服务,支持文件路径递归嵌入提示词,适用于代码审查和复杂问题解决。
MCP Client SSE是一个基于Spring Boot的Java应用,用于与模型上下文协议(MCP)服务器同步交互,支持OpenAI API集成和工具回调配置。
一个基于TypeScript的MCP服务器,使用OPENAI的dall-e-3模型根据文本提示生成图像,并支持将生成的图像保存到本地指定目录。
Yellhorn MCP是一个模型上下文协议服务器,通过集成Gemini和OpenAI能力为代码助手提供全代码库上下文支持,实现开发任务规划、代码评审和隔离环境创建。
一个为Cursor IDE设计的代码审查工具,利用OpenAI的GPT模型提供智能代码分析和建议。
Deep-Co是一个基于Compose Multiplatform开发的跨平台聊天客户端,支持多种LLM API提供商,包括OpenRouter、Anthropic、Grok、OpenAI等,并兼容OpenAI API和本地模型。具备聊天记录管理、提示词管理、角色适配、TTS等功能,支持多语言和主题定制。
OmniLLM是一个MCP服务器,作为Claude与其他大型语言模型(如ChatGPT、Azure OpenAI和Google Gemini)之间的桥梁,提供统一的AI访问接口。
通过MCP协议在Claude中直接查询OpenAI模型的服务
Spring AI MCP客户端是一个基于Spring AI和Anthropic Claude/OpenAI模型的聊天应用,通过MCP协议与服务器交互,支持AI驱动的对话功能。
一个基于OpenAI GPT-4o/gpt-image-1模型的图像生成与编辑工具,支持通过文本提示生成图像、编辑图像(如修复、扩展、合成等),并兼容多种MCP客户端。
MCP聊天适配器是一个基于MCP协议的服务器,为LLM提供与OpenAI兼容API交互的标准化接口,专注于聊天模型场景,支持对话管理和持久化存储。
MCPHub是一个可嵌入的模型上下文协议(MCP)解决方案,用于AI服务集成。它提供统一的配置和管理方式,支持多种AI框架(如OpenAI Agents、LangChain、Autogen),简化MCP服务器与AI应用的连接。
一个基于Go语言的MCP服务器,通过OpenAI的DALL-E API实现文本描述生成图像功能,可与Claude等大型语言模型集成使用。