AI模型和算力正成为网络犯罪地下市场“最抢手商品”。黑客想用它们从事勒索、网络战和间谍活动。谷歌威胁情报集团首席分析师John Hultquist透露,今年“LLM劫持”攻击明显增多:有人倒卖公共AI工具被盗登录凭据,也有团伙直接偷算力、白嫖跑自己的模型。这位有20年安全经验的专家指出,地下市场正盯上此类资源。
英媒报道,非法获取AI模型与算力成网络犯罪黑市抢手货,黑客用于勒索、网络战和间谍活动。谷歌称“LLM劫持”激增,表现为倒卖AI工具被盗凭据、盗用算力免费运行模型,折扣最高达97%。
近日,Anthropic发布Fable 5.1,因价格贵、限制多遭客户冷遇;OpenAI的GPT-6 Astra则持续刷屏,虽编码略逊,但综合性能强、Token效率高、成本更低,应用广泛。梁文锋表示不搞视频与世界模型,专注LLM主线。
MiniMax推出音乐生成模型MiniMax-Music3,输入歌词与音乐描述即可生成最长5分钟完整歌曲,输出32kHz、16-bit立体声WAV。其采用分层自回归架构,两模型分工:全局语言模型Global LLM参数8B,逐帧预测首个RVQ码本,负责歌曲长程语义与结构变化;该模型由Qwen3-8B初始化,训练时先让嵌入层和输出层适配音乐。
检测PII,屏蔽提示和审核LLM流量,符合GDPR和欧盟AI法案的隐私代理平台。
通过一个OpenAI兼容API调用GPT、Claude、Gemini和Grok等模型。
自研大模型聚合AI社交、搜索、游戏等六大功能的超级智能体平台
Merge是生产AI的连接基础设施,连接产品与所需API、工具和LLM。
Openai
$2.8
输入tokens/百万
$11.2
输出tokens/百万
1k
上下文长度
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
$6
$24
Baidu
128
LLM-CLEM
Lam-3是Lamina系列的一个小型语言模型(SLM),基于Clemylia/Lamina-suite-pretrain进行微调。该项目从头开始构建,具有独特的创意文本生成能力,有时会产生新颖甚至看似荒谬但独特的回复。
lapa-llm
Lapa LLM v0.1.2是基于Gemma-3-12B开发的乌克兰语处理开源大语言模型,专注于乌克兰语的自然语言处理任务,在乌克兰语处理方面表现出卓越性能。
RESMP-DEV
这是使用LLM Compressor和NVFP4格式对Qwen/Qwen3-Next-80B-A3B-Thinking进行量化后的版本,采用FP4微缩放技术,在保持高精度的同时大幅减少模型存储和计算需求。
DragonLLM
LLM Pro Finance是一款专为金融和经济专业人士设计的多语言人工智能模型,基于大量高质量的金融和经济数据训练,能够针对复杂的金融问题生成准确且贴合上下文的回应。
Lapa LLM 12B PT是基于Google Gemma 3-12B开发的开源大语言模型,专门针对乌克兰语处理优化。由乌克兰多所高校研究团队开发,在乌克兰语处理方面表现卓越,具备高效的指令微调和多模态能力。
llm-semantic-router
这是一个基于bert-base-uncased微调的LoRA模型,专门用于检测文本中的个人身份信息(PII)。该模型采用低秩适应技术优化,是semantic-router项目的一部分,支持Python和Rust环境使用。
基于bert-base-uncased通过LoRA(低秩自适应)技术微调的意图分类模型,可将文本分类为商业、技术、科学等类别,是语义路由器项目的一部分,针对Rust中的Candle框架进行了优化。
基于BERT基础无大小写模型,使用LoRA(低秩自适应)技术进行微调的意图分类模型,可将文本分类为商业、技术、科学等类别,是语义路由器项目的一部分,针对Rust语言中的Candle框架进行了优化。
DevQuasar
这是Qwen/Qwen3-Next-80B-A3B-Instruct的量化版本,基于llmcompressor工具实现,致力于让知识为每个人所用,推动知识的广泛传播。
这是LLM360/K2-Think模型的量化版本,致力于让知识更加自由地传播,秉持'让知识为每个人所用'的理念。该版本通过量化技术优化了模型大小和推理效率。
llmat
Apertus-8B-Instruct-2509-NVFP4是基于swiss-ai/Apertus-8B-Instruct-2509的NVFP4量化版本,通过llmcompressor工具生成。该模型在保持性能的同时显著减少了存储空间和计算资源需求,提升了推理效率。
parthmodi152
这是一个基于Qwen2.5-7B-Instruct模型使用Unsloth技术进行微调的优化版本,实现了2倍的训练加速,专注于文本生成任务。
sugoitoolkit
Sugoi LLM 32B Ultra是基于Qwen2.5-32B-Instruct优化的高性能大语言模型,充分释放了前作Sugoi 32B模型的全部潜力。该模型采用GGUF格式,专注于翻译任务,具有出色的多语言处理能力。
nvidia
Llama-3.1-Nemotron-Safety-Guard-8B-v3 是 NVIDIA 开发的多语言内容安全审核模型,基于 Meta 的 Llama-3.1-8B-Instruct 模型优化,专门用于检测和分类人类与 LLM 交互中的不安全内容。
TildeAI
TildeOpen LLM 是一个开源的基础语言模型,专门为服务代表性不足的北欧和东欧语言而设计。该模型由欧盟委员会资助,在LUMI超级计算机上训练,拥有300亿参数,解决了19种重点语言使用者在现有AI系统中面临的性能差距问题。
dolfsai
这是使用llm-compressor对Qwen/Qwen3-Embedding-0.6B进行压缩后的版本,采用W8A8量化方案。该模型在保持性能的同时显著减少了存储和计算资源需求,适用于资源受限环境下的特征提取任务。
ramblingpolymath
Qwen3-30B-A3B-Thinking-2507的W4A16量化版本,使用LLM-Compressor进行4位权重和16位激活量化。相比FP16版本,内存占用减少约75%,在支持的硬件上实现更快的推理速度。该模型具有出色的推理能力、工具调用能力和长上下文支持。
这是基于LLM-Compressor对Qwen3-30B-A3B-Instruct-2507进行W8A8(8位权重和激活值)量化的版本。相比FP16版本,内存占用减少约50%,在支持的硬件上实现更快的推理速度,特别适合Ampere及更旧的GPU架构。
skt
A.X 3.1 Light 是一款专为韩语理解和企业部署优化的轻量级大语言模型(LLM),由SKT完全自主研发。
Mungert
xLAM-2-3b-fc-r GGUF模型是基于特定量化方法生成的文本生成模型,专注于函数调用、LLM代理和工具使用场景。
PraisonAI是一个生产就绪的多AI智能体框架,具有自反思功能,旨在创建AI智能体来自动化解决从简单任务到复杂挑战的各种问题。它通过将PraisonAI智能体、AG2和CrewAI集成到一个低代码解决方案中,简化了多智能体LLM系统的构建和管理,强调简单性、定制化和有效的人机协作。
一个基于Playwright的MCP服务器,为LLM提供浏览器自动化能力
Eino是一个专为Golang设计的LLM应用开发框架,旨在通过简洁、可扩展、可靠且高效的组件抽象和编排能力,简化AI应用开发流程。它提供丰富的组件库、强大的图形编排功能、完整的流处理支持以及高度可扩展的切面机制,覆盖从开发到部署的全周期工具链。
mcpo是一个简单易用的代理工具,可将任何MCP工具快速转换为兼容OpenAPI的HTTP服务器,使其能够通过标准RESTful接口访问,方便与LLM代理和应用集成。
Supabase MCP Server是一个连接Supabase项目与AI助手的工具,通过Model Context Protocol(MCP)标准化大型语言模型(LLMs)与外部服务的交互,实现数据库管理、配置获取和数据查询等功能。
WhatsApp MCP服务器是一个通过WhatsApp网页多设备API连接个人账户的工具,支持消息搜索、发送及多媒体处理,并与Claude等LLM集成。
Serena是一个强大的开源编码代理工具包,能够将LLM转化为可直接在代码库上工作的全功能代理。它提供类似IDE的语义代码检索和编辑工具,支持多种编程语言,并可通过MCP协议或Agno框架与多种LLM集成。
Opik是一个开源的LLM评估框架,支持追踪、评估和监控LLM应用,帮助开发者构建更高效、更经济的LLM系统。
Supermemory是一个AI驱动的记忆引擎,旨在通过整合个人数据为LLM提供上下文知识,实现信息的智能管理和检索。
Playwright MCP是一个基于Playwright的浏览器自动化服务器,通过结构化数据而非像素输入实现LLM与网页的交互。
Notion MCP Server是一个连接Notion API与LLM的中间件服务,通过Markdown转换优化交互效率。
MCP Go 是一个 Go 语言实现的模型上下文协议(MCP)服务端框架,用于连接 LLM 应用与外部数据源和工具。它提供了资源管理、工具调用、提示模板等核心功能,支持会话管理和中间件扩展。
Context7 MCP是一个为AI编程助手提供实时、版本特定文档和代码示例的服务,通过Model Context Protocol直接集成到提示中,解决LLM使用过时信息的问题。
Notte是一个开源的全栈网络AI代理框架,提供浏览器会话、自动化LLM驱动的代理、网页观察与操作、凭证管理等功能,旨在将互联网转化为代理友好的环境,并通过自然语言描述网站结构,降低LLM的认知负担。
mcp-get是一个命令行工具,用于发现、安装和管理MCP服务器,简化LLM与外部数据源的连接。
MCP LLMS-TXT文档服务器是一个开源工具,允许开发者通过MCP协议控制IDE和应用程序访问llms.txt文档资源。
这是一个关于Web3 Model Context Protocol (MCP) 服务器的精选列表,涵盖了链交互、交易、DeFi、市场数据、工具和社交等多个类别。MCP是一个开放协议,标准化了应用程序如何向LLM提供上下文,类似于AI应用程序的USB-C端口。DeMCP是第一个去中心化的MCP网络,专注于为代理提供自研和开源的MCP服务,支持加密支付,并结合TEE和区块链注册表重新定义了MCP的安全性和可靠性。
DuckDuckGo搜索MCP服务器,为Claude等LLM提供网页搜索和内容抓取服务
MCP MongoDB服务器是一个模型上下文协议服务,允许LLM与MongoDB数据库交互,提供集合模式检查、查询执行和智能ID处理等功能,支持只读模式和安全配置。
Security Detections MCP 是一个基于Model Context Protocol的服务器,允许LLM查询统一的安全检测规则数据库,涵盖Sigma、Splunk ESCU、Elastic和KQL格式。最新3.0版本升级为自主检测工程平台,可自动从威胁情报中提取TTPs、分析覆盖差距、生成SIEM原生格式检测规则、运行测试并验证。项目包含71+工具、11个预构建工作流提示和知识图谱系统,支持多SIEM平台。