本地部署大模型不等于胜任真实业务,AI还需精准理解复杂规则、遵守安全边界、正确调用外部工具。针对这一痛点,蚂蚁ASystem团队联合开源社区维护的本地化后训练工具包AReno,携手百灵大模型推出轻量级后训练实践路径,以提升模型业务落地能力。
企业AI部署成本压力加剧,开源模型虽能降低单token费用,但精准选型困难。面向营销人员的AI公司Writer推出旗舰模型Palmyra X6,基于开源GLM-5.2深度后训练调整,旨在提供更契合业务需求的低成本方案。
今日,CodeBuddy宣布WorkBuddy及IDE、插件、CLI全系产品全面升级至DeepSeek-V4-Pro正式版,为开发者提供最新模型能力。官方同步发布价格调整预告,DeepSeek V4系列近期将全线调价,建议用户提前规划模型使用需求,在现有价格窗口完成部署。此次升级覆盖多端产品体系,强化AI编程与智能开发支持。
Quantinuum与Oracle达成战略合作,将Helios量子计算机部署至Oracle Cloud Infrastructure AI数据中心,作为托管云服务提供。客户无需自购硬件,即可通过OCI量子服务直接访问,并与本地GPU及高性能计算资源协同使用,应用于药物研发、材料科学、金融建模及大规模优化等领域。
无代码AI智能体构建器,60秒部署,免费计划,支持BYOK
通过聊天构建企业AI工作流,可部署为API或MCP服务器,符合SOC 2标准。
通过与AI聊天创建全栈Web应用,浏览器运行Node.js环境,无需设置部署。
AI驱动的制造应用,含FabAI智能代理,数分钟即可部署。
Google
$0.49
输入tokens/百万
$2.1
输出tokens/百万
1k
上下文长度
Xai
$1.4
$3.5
2k
Anthropic
$105
$525
200
$0.7
$2.8
$7
$35
$17.5
$21
Alibaba
-
Baidu
128
$6
$24
256
Bytedance
$1.2
$3.6
4
$2
$3.9
$15.2
64
ubergarm
这是ai-sage/GigaChat3-10B-A1.8B-bf16模型的GGUF量化版本,提供了多种量化选项,从高精度的Q8_0到极度压缩的smol-IQ1_KT,满足不同硬件条件下的部署需求。该模型支持32K上下文长度,采用MLA架构,专为对话场景优化。
ss-lab
EXAONE-4.0-1.2B 是一个由 LG AI Research 开发的文本生成模型。它基于 EXAONE-4.0-1.2B 基础模型,使用 tatsu-lab/alpaca 数据集进行了微调,支持英文和韩语两种语言的文本生成任务。模型已转换为 GGUF 格式,便于在本地部署和运行。
bullpoint
GLM-4.6-AWQ是对智谱AI的GLM-4.6(357B MoE)进行高性能AWQ量化的模型,专为vLLM推理进行了优化,能有效提升生产部署的吞吐量。该模型采用4位量化技术,在保持高精度的同时显著减少显存占用。
nineninesix
KaniTTS是一款专为实时对话式AI应用优化的高速、高保真文本转语音模型。它采用两阶段流水线架构,结合大语言模型和高效音频编解码器,实现了卓越的速度和音频质量,支持多种语言并适用于边缘/服务器部署。
amd
Llama-3.1-8B-onnx-ryzenai-npu是由AMD基于Meta的Llama-3.1-8B模型开发的优化版本,专门针对AMD Ryzen AI NPU进行优化部署。该模型通过Quark量化、OGA模型构建器和NPU专用后处理技术,在保持高质量文本生成能力的同时,显著提升了在AMD硬件上的推理效率。
Mungert
LFM2是由Liquid AI开发的新一代混合模型,专为边缘AI和设备端部署而设计,在质量、速度和内存效率方面树立了新标准。该模型采用创新的混合Liquid架构,具有乘法门和短卷积,支持多语言处理。
LiquidAI
LFM2是由Liquid AI开发的新一代混合模型,专为边缘AI和设备端部署设计。该模型在质量、速度和内存效率方面树立了新标准,特别适合在资源受限的环境中运行。
gabriellarson
Foundation-Sec-8B-Instruct是一款专为网络安全应用设计的80亿参数指令调优语言模型。基于Llama-3.1-8B架构,具备出色的指令跟随能力和网络安全专业知识,支持本地部署,可帮助组织构建AI安全工具,减少对云服务的依赖。
NoemaResearch
Nous-V1 8B是由Apexion AI开发的80亿参数语言模型,基于Qwen3-8B架构构建。该模型专为处理各种自然语言处理任务而设计,在对话式AI、知识推理、代码生成和内容创作等方面表现出色,在模型能力和实际部署效率之间取得了良好平衡。
LFM2是由Liquid AI开发的新一代混合模型,专为边缘AI和设备端部署而设计,在质量、速度和内存效率方面树立了新标准。
LFM2是由Liquid AI开发的新一代混合模型,专为边缘AI和设备端部署设计,在质量、速度和内存效率方面树立了新标准。
unsloth
LFM2 是由 Liquid AI 开发的新一代混合模型,专为边缘 AI 和设备端部署设计,在质量、速度和内存效率方面树立了新标准。
LFM2-350M是由Liquid AI开发的第二代混合模型,专为边缘AI和设备端部署设计。该模型在质量、速度和内存效率方面树立了新标准,具有3.5亿参数,支持多种语言,适用于边缘计算场景。
LFM2-700M 是由 Liquid AI 开发的新一代混合模型,专为边缘 AI 和设备端部署设计,在质量、速度和内存效率方面树立了新标准。
LFM2-350M 是由 Liquid AI 开发的混合模型,专为边缘 AI 和设备端部署设计,具有高效训练和推理能力。
mykor
A.X 4.0 Light 是由 SKT AI Model Lab 开发的轻量级大语言模型,基于 Qwen2.5 构建,针对韩语理解和企业部署优化。
kshitijthakkar
LoggenixMoE133M是一款轻量级混合专家(MoE)因果语言模型,总参数量133M,活跃参数量80M。该模型在包含根因分析、代码生成和推理任务的自定义数据集上从头训练,支持智能体能力特殊标记,适合边缘设备部署和专业AI智能体构建。
zai-org
GLM-4-Z1-9B-0414是智谱AI推出的新一代90亿参数开源大语言模型,具有强大的文本生成和推理能力。该模型在数学推理和通用任务方面表现出色,在资源受限场景下实现了效率与效果的出色平衡,支持友好的本地部署。
Eino是一个专为Golang设计的LLM应用开发框架,旨在通过简洁、可扩展、可靠且高效的组件抽象和编排能力,简化AI应用开发流程。它提供丰富的组件库、强大的图形编排功能、完整的流处理支持以及高度可扩展的切面机制,覆盖从开发到部署的全周期工具链。
Refact Agent 是一个开源AI编程助手,支持多语言代码生成、调试和优化,集成主流开发工具,可本地化部署并提供智能补全和代码解释功能。
MCP Atlassian是一个为Atlassian产品(Confluence和Jira)设计的模型上下文协议服务器,支持云端和本地部署,提供AI助手集成功能。
微软官方MCP服务器集合,提供Azure、GitHub、Microsoft 365、Fabric等多种服务的AI助手集成工具,支持本地和远程部署,帮助开发者通过标准化协议连接AI模型与各类数据源和工具。
一个基于Claude AI的Docker操作协议服务器,提供容器和Compose堆栈的创建、部署、日志查看等功能。
automcp是一个工具,能够将现有的AI代理框架(如CrewAI、LangGraph等)轻松转换为MCP服务器,实现标准化接口访问。支持多种框架的适配和部署,提供快速启动和配置功能。
DevOps AI Toolkit是一个基于AI的平台工程和DevOps自动化工具,通过智能Kubernetes操作和对话式工作流,为团队提供资源部署推荐、问题修复、项目治理和共享提示库等功能,使复杂的云原生操作可通过自然语言交互实现。
一个轻量级的MCP服务器,为AI助手如Claude提供实时天气数据查询和解析功能。支持本地和远程两种部署方式,包含Docker容器化方案。
n8n是一个面向技术团队的工作流自动化平台,结合了代码灵活性和无代码速度,提供400+集成、原生AI功能和公平代码许可,支持自托管或云端部署。
该项目是一个MCP服务器,用于将代码部署到Google Cloud Run,支持通过AI代理、IDE和助手应用进行部署。
Pipelock是一个开源的AI代理防火墙,通过单二进制文件提供零运行时依赖的安全防护。它采用能力分离架构,在代理与互联网之间部署九层扫描管道,防止秘密泄露、提示注入和恶意工具调用。支持多种代理模式(Fetch代理、正向代理、WebSocket代理)和MCP代理,提供紧急停止开关、审计日志和SIEM集成等功能。
RagRabbit是一个自托管的AI站点搜索和LLM.txt生成工具,支持一键部署在Vercel上。
该项目提供了一个MCP服务器,用于将代码部署到Google Cloud Run服务,支持从AI辅助IDE、AI助手应用及代理SDK等多种方式进行部署。
Vaali MCP服务器是一个展示高级AI代理能力的开源项目,通过交互式参数收集和工作流自动化,实现了官方MCP询问和智能参数引导两种模式,支持云端部署和本地集成。
Cyclops MCP是一个允许AI代理通过模型上下文协议安全管理和部署Kubernetes应用的工具,提供模板验证和应用创建/更新功能
NextChat的定制版本,通过聊天交互创建和部署MCP服务器,集成OpenRouter的LLM模型,提供工具提取、一键部署和AI系统集成指南功能。
Ludus FastMCP是一个基于Model Context Protocol(MCP)的Python服务器,用于通过AI助手自动化管理Ludus网络靶场环境。它提供157个工具,涵盖靶场生命周期管理、场景部署、模板创建、Ansible角色管理和安全监控集成等功能,支持通过自然语言命令控制网络靶场。
PhonePi MCP是一个开源项目,可将手机转变为AI助手的工具箱,通过Model Context Protocol实现远程控制手机功能,包括管理联系人、消息、设置等,强调本地化部署和网络安全。
Data Agents是一个基于GenAI的数据工程代理平台,通过多智能体协作自动化数据工作流程,支持多种AI后端和n8n集成,提供现代化UI界面和Docker部署方案。
阿里云Supabase MCP服务器项目,通过Model Context Protocol标准将Supabase项目与AI助手连接,提供项目管理、数据库查询等工具,支持在阿里云平台部署和操作Supabase服务。