Anthropic将百亿美元计算订单交给成立仅数月的Volta,打破以往必属亚马逊、微软、谷歌的格局。过去云巨头握有土地、电力和雄厚资金,但如今资金充裕,电力成为真正瓶颈,三大厂商新建数据中心的供电速度并不比新入局者更快,于是订单花落Volta。
当前人工智能算力竞赛趋于白热化,甲骨文公司正押注数千亿美元大规模建设数据中心,力图在云计算市场抢占先机。但随着基础设施陆续建成,华尔街开始担忧:若OpenAI等核心大客户无力长期消化巨额算力支出,这番豪赌或变成难以摆脱的沉重资产负担。甲骨文近期在年度财务报告中罕见地详细披露了相关风险。
谷歌因全球算力短缺限制Meta访问顶级AI模型Gemini,此前该模型是Meta自动化安全审核的核心,高效处理诈骗和有害内容检测。此举凸显云计算能力瓶颈正影响科技巨头关键业务。
腾讯云联合平安银行、中国银联推出“AI智算卡”借记卡,面向个人用户,整合基础金融与专属算力权益,解决多平台切换和重复充值痛点,实现AI算力消费、工具使用及日常金融一卡化。该卡一键链接银联云计算平台,预计7月开放申请。
面向AI编码代理的云基础设施平台,提供模型网关、计算等服务
实时推荐优化AWS成本的自动化平台。
提供高性能GPU出租服务,包括B200、H200、RTX4090、H100等型号。即时部署,价格透明。
TwelveLabs是被领先研究人员认可为视频理解中性能最出色的人工智能,超越了云计算巨头和开源模型的基准。
Openai
$7.7
Input tokens/M
$30.8
Output tokens/M
200
Context Length
Anthropic
$7
$35
$21
$105
Alibaba
-
Baidu
128
$2
256
32
Tencent
$1
$4
$1.6
$0.75
$1.75
$14
400
$15
1k
Huawei
$1.8
$5.4
16
$2.4
$12
8
$0.5
$10
Google
$0.8
$0.2
nvidia
NVIDIA Qwen3-235B-A22B FP4 模型是阿里云 Qwen3-235B-A22B 模型的量化版本,基于优化的 Transformer 架构,是一个自回归语言模型。该模型使用 TensorRT Model Optimizer 进行量化,将权重和激活值量化为 FP4 数据类型,显著减少了存储和计算需求。
bit-dny
MindLLM 1.3B是由北京市海量语言信息处理与云计算应用工程技术研究中心与北京理工大学东南信息技术研究院联合开发的13亿参数Transformer模型,支持中英文对话生成。
一个完全在本地运行的隐私优先文档搜索服务器,通过MCP协议为AI编程工具提供语义搜索功能,无需API密钥或云端服务,所有数据处理均在用户计算机上完成。
阿里云函数计算MCP服务器项目,支持通过MCP协议将函数计算能力集成到Cursor、Claude等代理应用中,提供快速部署和管理功能。
一个基于MCP协议的服务器实现,用于管理阿里云实时计算Flink资源,提供集群管理、作业部署、监控等功能。
OCI定价MCP服务器为AI助手提供Oracle云基础设施的定价数据,支持实时查询和离线数据,包含计算、存储、数据库等服务的成本估算工具。
该项目展示了如何在Cloudflare Workers上部署远程MCP服务器,并实现OAuth登录功能。支持本地开发调试,可通过MCP Inspector工具或Claude桌面客户端连接,提供数学计算等工具调用能力,最终可部署至Cloudflare云端。
这是一个用于Oracle云基础设施的MCP服务器项目,允许LLM直接管理OCI资源,支持动态配置文件切换、计算实例和数据库系统管理等功能
OCI核心服务FastMCP服务器是一个专为Oracle云基础设施设计的生产级管理工具,提供全面的计算实例生命周期管理、数据库操作和网络信息查询功能,采用LLM优先的设计理念,通过OCI Python SDK实现高性能和可靠性。
一个基于Azure CLI的MCP服务器实现,提供对Azure云资源的程序化访问,支持多种Azure服务操作,包括计算、存储、网络、数据库等,并包含身份认证和安全管理功能。
基于AWS MCP服务器的AI驱动云开发项目