DeepSeek Harness 开发者预览版 v0.1 发布并以 MIT 协议开源。其采用“一切皆插件”设计,基于 Cordis 插件系统构建 Agent Harness,模型、工具、技能、会话、沙箱、存储、循环、调度、UI 等能力均以插件形式组合,可独立替换与灵活重组。Cordis 元框架负责插件加载等基础能力。
DeepSeek于8月13日发布首款Agent产品Harness v0.1开发者预览版,以MIT协议开源。其定位为模型之外的基础设施,公式“模型+Harness=Agent”:模型负责思考推理,Harness负责实际执行,旨在让AI真正落地执行任务。
xAI发布Grok 4.6,AI智能指数61分,追平GPT-5.6 Sol(Max),仅次于Claude Opus 5与Claude Fable 5,跻身全球前沿模型第一梯队。该模型在Grok 4.5基础上扩展训练,核心改进包括用模型生成的精选数据训练推理与高级技术概念,并结合高质量工程数据和改进的优化器。
国内大模型企业月之暗面完成工商变更,注册资本由152.36万元增至223.85万元,引发业界关注。该公司自2023年成立以来发展迅速,经营范围涵盖人工智能基础软件、应用软件开发等核心前沿领域。
FLUX 3是多模态基础模型,可联合学习图像、视频和音频实现视觉智能。
BytePlus是企业AI云平台,提供模型、工具和基础设施助力AI开发部署
由Ray驱动,助力AI构建者大规模运行数据密集型工作负载
面向AI编码代理的云基础设施平台,提供模型网关、计算等服务
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
Baidu
128
$6
$24
GuangyuanSD
Z-Image-Re-Turbo 是一个基于文本生成图像的模型,它在 Z-Image-De-Turbo 模型的基础上进行了去还原和重新加速优化。该模型旨在兼顾训练时的便利性与推理时的速度,恢复了接近原始 Turbo 模型的快速生成能力,同时保持了与 Z-Image-De-Turbo 相同的训练友好特性,使其能够完美兼容 Z-Image 生态系统中已训练的大量 LoRA 模型。
AiAF
D-ART - LoRA - Z-Image-Turbo 是一个基于 Tongyi-MAI/Z-Image-Turbo 基础模型的图像生成模型。它是一个LoRA(Low-Rank Adaptation)适配器,旨在为生成图像注入特定的“D-ART”艺术风格。该风格以生成自信、充满活力的年轻女性角色插画为特点,尤其强调角色的曲线和动态姿态。用户通过使用特定的触发词即可激活该风格,生成具有统一美学特征的多样化图像。
NewBie-AI
NewBie image Exp0.1 是一个基于 Next-DiT 架构开发的高效图像生成基础模型,专门用于生成高质量的动漫风格图像。它融合了先进的文本编码器和视觉组件,支持自然语言和结构化标签输入,是多角色动漫图像生成的强大工具。
drbaph
Z-Image(造相)是一个拥有60亿参数的高效图像生成基础模型,专门解决图像生成领域的效率和质量问题。其蒸馏版本Z-Image-Turbo仅需8次函数评估就能达到或超越领先竞品,在企业级H800 GPU上可实现亚秒级推理延迟,并能在16G VRAM的消费级设备上运行。
SerialKicked
这是Qwen3-VL-32B-Thinking-heretic的量化版本,采用新的消融方法进行量化,相比传统方法对基础模型的损害更小。提供多种量化精度版本,适合在24GB显存设备上运行,支持图文转文本任务。
ostris
这是一个基于LoRA技术的文本到图像转换模型,专门用于生成具有法国印象派画家贝尔特·莫里索艺术风格的图像。该模型在FLUX.2-dev基础模型上训练,能够将普通图像或文本描述转换为莫里索风格的画作。
Gjm1234
Wan2.2是基础视频模型的重大升级版本,专注于将有效MoE架构、高效训练策略和多模态融合等创新技术融入视频扩散模型,为视频生成领域带来更强大、更高效的解决方案。
Shawon16
这是一个基于VideoMAE架构的视频理解模型,在Kinetics数据集预训练的基础上进行了微调,专门用于手语识别任务。模型在评估集上表现有待提升,准确率为0.0010。
TeichAI
本模型是基于Qwen3-4B-Thinking-2507基础模型,使用高推理难度的Gemini 3 Pro预览数据集进行蒸馏训练得到的模型。它专注于提升在编码和科学领域的复杂推理能力,通过特定数据集的训练,旨在将大型模型(如Gemini 3 Pro)的推理能力高效地迁移到较小规模的模型中。
Arko007
Zenyx_114M-Tiny-Edu-Instruct 是一个实验性的小型指令微调语言模型,拥有约1.14亿参数。它基于TinyEdu-50M基础模型构建,在FineWeb-Edu数据集上预训练,并在OpenHermes-2.5和CodeFeedback-Filtered混合数据集上进行了指令微调。该模型旨在探索极小架构下指令微调的极限,验证损失收敛至约1.04。
Clemylia
Gheya-1是LES-IA-ETOILES生态系统中的新一代基础语言模型,拥有2.02亿参数,是旧版Small-lamina系列的升级版本。该模型专为专业微调而设计,在人工智能、专业语言模型和生物学领域具有针对性训练。
Qsana-coder-base 是一个小型语言模型(SLM),专门为编码基础(Python、伪代码)的概念创意而设计。它不生成可执行的生产代码,而是为教育和快速原型设计场景生成编码逻辑片段,主要目标是激发初学者的逻辑思维和概念理解。
Justin331
SAM 3 是 Meta 推出的第三代可提示分割基础模型,统一支持图像和视频分割任务。相比前代 SAM 2,它引入了开放词汇概念分割能力,能够处理大量文本提示,在 SA-CO 基准测试中达到人类表现的 75-80%。
ai-sage
GigaAM-v3是基于Conformer架构的俄语自动语音识别基础模型,拥有2.2-2.4亿参数。它是GigaAM系列的第三代模型,在70万小时俄语语音数据上使用HuBERT-CTC目标进行预训练,在广泛的俄语ASR领域提供最先进的性能。
GigaChat3-10B-A1.8B-base是GigaChat系列的基础预训练模型,采用混合专家(MoE)架构,总参数100亿,活跃参数18亿。模型集成了多头潜在注意力(MLA)和多令牌预测(MTP)技术,在推理时具备高吞吐量优势。
OpenMMReasoner
OpenMMReasoner是一个完全透明的两阶段多模态推理方案,涵盖有监督微调(SFT)和强化学习(RL)。该方案通过精心构建高质量数据集,在多个多模态推理基准测试中超越了强大的基线模型,为未来大规模多模态推理研究奠定了坚实的实证基础。
mradermacher
atom-v1-preview-12b是基于vanta-research/atom-v1-preview-12b基础模型的量化版本,提供多种GGUF量化格式选择,适用于对话、协作、教育等多个领域。
onnx-community
Supertonic-TTS-ONNX是一个基于ONNX格式的文本到语音转换模型,能够将英文文本转换为自然流畅的语音。该模型基于Supertone/supertonic基础模型开发,专为Transformers.js库优化,支持在浏览器环境中高效运行。
hum-ma
Wan2.2-TI2V-5B-Turbo-GGUF是基于quanhaol/Wan2.2-TI2V-5B-Turbo基础模型转换而来的图像转视频模型,经过优化可在4GB GPU上运行,具有出色的通用性和高效推理能力。
sensenova
SenseNova-SI是基于多模态基础模型构建的空间智能增强模型系列,通过精心策划的800万样本数据训练,在多个空间智能基准测试中取得了优异表现,同时保持了强大的通用多模态理解能力。
Awesome-MCP-ZH 是一个专为中文用户打造的 MCP(模型上下文协议)资源合集,包含 MCP 的基础介绍、玩法、客户端、服务器和社区资源,帮助用户快速上手 MCP。
AI基础设施代理是一个智能系统,允许用户通过自然语言命令管理AWS云资源。它利用AI模型将用户需求转化为可执行的AWS操作,并提供Web仪表板、状态管理和安全防护功能。
MCP Gateway是一个先进的AI基础设施中间件解决方案,作为模型上下文协议(MCP)服务器的代理网关,提供统一接口、敏感信息过滤和生命周期管理功能。
OpenCV MCP Server是一个基于Python的计算机视觉服务,通过Model Context Protocol (MCP)提供OpenCV的图像和视频处理能力。它为AI助手和语言模型提供从基础图像处理到高级对象检测的全套计算机视觉工具,包括图像处理、边缘检测、人脸识别、视频分析和实时对象跟踪等功能。
Loom是一个MCP服务器,支持用户与基础模型协作构建文本,通过短片段迭代生成和选择来优化长文本创作质量。
一个为大型语言模型提供基础数学和统计功能的MCP服务器
Pulumi MCP Server是一个实现模型上下文协议(MCP)的服务,通过Pulumi自动化API和Pulumi云API与Pulumi CLI交互,使客户端无需直接安装Pulumi CLI即可执行基础设施操作。
该项目是一个专为DevOps工具和平台设计的Model Context Protocol (MCP)服务器集合,通过标准化方式让大型语言模型(LLM)直接与主流DevOps系统交互,实现基础设施、部署流水线、监控等操作的自动化控制。
KOI-MCP是一个集成知识组织基础设施(KOI)与模型上下文协议(MCP)的桥梁框架,使自主代理能够交换丰富的个性特征并将能力暴露为标准化的工具。
这是一个FIWARE模型上下文协议(MCP)服务器的初始实现,提供上下文代理与其他服务之间的桥梁,包含基础交互功能和意图操作演示。
一个结合FastAPI后端和Gradio前端的MCP基础应用,支持通过简单界面与AI模型交互,集成Google Gemini API实现论文搜索与分析功能。
Vultr MCP是一个全面的模型上下文协议服务器,提供335+个工具来通过自然语言管理Vultr云基础设施,支持智能标识符解析和丰富的CLI界面。
项目旨在通过MCP协议将RAG应用与open-webui连接,实现模型上下文交互,包括基础PoC验证、知识库集成及客户端对接。
FedRAMP 20x MCP服务器是一个基于模型上下文协议的工具,提供对FedRAMP 20x安全要求和控制的访问,特别关注Azure优先指导。它加载官方FedRAMP文档数据,提供查询、代码分析、自动化证据收集和合规性验证等功能,支持多种编程语言和基础设施即代码,帮助团队实现FedRAMP合规。
Netskope NPA MCP Server是一个通过大型语言模型管理Netskope网络私有访问基础设施的协议服务器,提供50多种工具进行配置管理。
一个为大型语言模型提供基础数学和统计功能的MCP服务器。
Sauce Labs MCP服务器是一个与Sauce Labs测试平台全面集成的模型上下文协议服务器,支持AI助手通过自然语言交互管理设备云、测试任务、构建分析和监控测试基础设施。
一个用于构建模型通信协议(MCP)工具的Go语言SDK,提供实现MCP兼容工具的基础组件,可与Cursor IDE等AI应用集成。
AWS Security MCP是一个基于模型上下文协议的服务,允许AI助手通过自然语言查询自主检查和分析AWS基础设施的安全问题,支持多种AWS安全服务,包括IAM、EC2、S3等,并提供安全建议和威胁建模报告。
LocalStack MCP服务器是一个模型上下文协议服务,提供工具来管理LocalStack容器及相关任务,简化本地云开发和测试,支持容器操作、基础设施部署、日志分析、IAM策略管理、混沌测试和状态快照等功能。