快手2026年二季度总收入355亿元,核心商业收入同比增长7.4%,经调整净利润39亿元,净利率11%。应用日活4.12亿、月活7.97亿。AI成重要驱动力:可灵AI收入超8.5亿元,同比增长逾200%;全球用户破1亿,覆盖224个国家和地区,企业客户近5万家。
演语科技不研发底层大模型,凭多款AI创作应用三年崛起,现启动香港IPO,估值高达30亿美元,引发AI应用层“中间商”商业价值与竞争壁垒探讨。
阿里千问App向专业用户推出付费方案,包括办公助理订阅会员和AI视频生成单独额度。会员分三档:旗舰月付128元年付1499元配20倍额度,精英月付49元年付568元配5倍额度,高级月付19元年付200元配2倍额度,普通用户未提及。此举探索AI应用商业化。
微软正开发整合Copilot聊天、编码助手与智能代理的AI“超级应用”,计划年内推出,覆盖消费者与商业场景。CEO纳德拉称Copilot正从聊天转向协同办公和自动化执行,本季度将统一整合不同Copilot体验。
利用 Seedance 2.0 创建令人惊叹的 AI 视频。
mocktomer可让真实用户和AI测试网站,并反馈离开原因,每月10次免费
统一的 LLM API,访问多个 AI 模型提供商。
Clawdi是OpenClaw托管部署平台,可连接AI智能体等
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
-
Anthropic
$7
$35
200
Google
$2.1
$17.5
$21
$105
Alibaba
$3.9
$15.2
64
Bytedance
Baidu
32
Tencent
$0.63
$3.15
131
$15
24
Iflytek
$2
$2.4
$12
8
$0.8
nvidia
NVIDIA GPT-OSS-120B Eagle3是基于OpenAI gpt-oss-120b模型的优化版本,采用混合专家(MoE)架构,具备1200亿总参数和50亿激活参数。该模型支持商业和非商业使用,适用于文本生成任务,特别适合AI Agent系统、聊天机器人等应用开发。
ibm-granite
Granite-4.0-Micro 是 IBM 开发的 30 亿参数长上下文指令模型,具有优秀的指令遵循和工具调用能力,支持多种语言,适用于商业应用和 AI 助手场景。
NVIDIA Qwen3-32B FP4模型是阿里云Qwen3-32B模型的量化版本,使用优化的Transformer架构,通过将权重和激活量化为FP4数据类型实现高效推理。该模型支持商业和非商业用途,适用于各种AI应用场景。
NVIDIA Qwen3-14B FP4模型是阿里巴巴Qwen3-14B模型的量化版本,采用FP4数据类型进行优化,通过TensorRT-LLM进行高效推理。该模型专为NVIDIA GPU加速系统设计,适用于AI Agent系统、聊天机器人、RAG系统等多种AI应用场景,支持全球范围内的商业和非商业使用。
Jackmin108
GLM-4.5-Air是智谱AI推出的适用于智能体的基础模型,采用紧凑设计,统一了推理、编码和智能体能力,能满足智能体应用的复杂需求。该模型参数量适中且效率优越,已开源多种版本,可用于商业和二次开发。
NVIDIA-Nemotron-Nano-9B-v2是NVIDIA从头训练的大语言模型,专为推理和非推理任务设计。采用Mamba2-Transformer混合架构,支持多语言处理,具备可控推理能力,允许用户指定思考预算,在商业应用和AI代理系统中表现出色。
QuantStack
这是black-forest-labs/FLUX.1-Krea-dev模型的GGUF格式量化版本,专门用于文本到图像的生成任务。该模型通过GGUF格式优化,可在特定工具和库中使用,适用于非商业用途的图像生成应用。
NVIDIA Qwen3-30B-A3B FP4是阿里巴巴Qwen3-30B-A3B模型的量化版本,采用优化的Transformer架构,通过FP4量化技术将模型大小减少约3.3倍,同时保持较好的性能表现。该模型支持商业和非商业用途,适用于AI代理系统、聊天机器人、RAG系统等应用场景。
IBM开发的30亿参数指令微调语言模型,基于Granite-3.0架构,支持多语言任务和商业应用
stockmark
Stockmark-100B是由Stockmark公司开发的拥有1000亿参数的大语言模型,基于约9100亿日语和英语语料标记从头开始预训练。该模型专注于商业领域应用,在日语商业问题处理方面表现出色。
seedboxai
KafkaLM 8b是基于Llama3 8b模型微调而成的德语大语言模型,专注于德语商业场景应用
pborchert
面向商业应用的行业敏感语言模型,基于商业通信语料库进行预训练,整合行业信息以优化商业相关NLP任务。
h2oai
H2O.ai的h2ogpt-oasst1-512-12b是一个拥有120亿参数的指令跟随大语言模型,可用于商业用途。该模型基于特定基础模型,使用特定数据集微调,具有良好的性能和广泛的应用场景。
Rube是基于Composio平台的MCP服务器,可将AI聊天工具连接到500多个商业和生产力应用程序,通过自然语言命令实现自动化任务执行。
Databutton推出AI驱动的MCP服务器构建工具,支持React和Python应用开发
一个研究检索增强生成(RAG)与多云处理(MCP)服务器集成的开源项目,聚焦免费模型在商业软件中的应用,提供模块化学习路径和实践案例。