企业构建AI时,核心机密数据常埋于长文档、金融申报、法律合同等文件中。传统一次性RAG仅检索固定文本块,缺乏迭代推理,难以处理复杂长文档与跨源对比。为此,Mistral AI推出Agentic升级方案,增强推理迭代能力,破解长文档信息提取难题。
豆包“工作任务”模式更新,上线手机远程控制电脑功能。用户手机端授权后,可随时接管同账号电脑处理桌面任务,并调取本地文件上下文,高效处理文档、图片、代码、表格等,突破设备限制,为移动办公提供更灵活方案。
美国康涅狄格州一自行出庭原告在法院文件中藏匿白底白字、仅供AI读取的隐藏指令,企图干预案件处理,成美国司法体系首例“提示注入”案例。但该州法院未实际用AI审阅材料,手段未奏效,当事人因滥用程序被制裁。
Meta于8月10日发布开源模型Muse Glimmer,300亿参数,为Muse Spark的开源版,权重Apache2.0,可修改微调。该模型用于消费级硬件本地AI Agent,实现个人超级智能,支持多步骤代理任务:调用工具、编写调试代码、处理文件及屏幕截图,执行扩展工作流。
AnyDoc Online可将多种文件转换为Markdown,支持批量处理和OCR。
可处理表格数据,生成PPT等多类型文件,适用于多行业场景分析
上传LinkedIn数据导出文件,获重连报告,显示重连对象、未处理机会等。
Doxxo是智能文件处理平台,提供多种AI工具,按需付费。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
-
Anthropic
$7
$35
200
$21
$105
Alibaba
$2
256
$3.9
$15.2
64
$0.8
128
Baidu
32
Tencent
$1
$4
Bytedance
$8
$0.75
$8.75
$70
400
bartowski
本项目是TheDrummer的Cydonia-24B-v4.3模型的量化版本,使用llama.cpp进行量化处理,旨在提供不同量化类型的模型文件,以满足不同硬件和性能需求。它是一个24B参数的大语言模型,主要用于文本生成任务。
这是由miromind-ai开发的MiroThinker-v1.0-8B模型的量化版本,使用特定工具和数据集进行量化处理,提供多种量化类型的文件供用户选择,可在不同环境中运行,以满足不同性能和质量需求。
这是对VibeStudio的MiniMax-M2-THRIFT模型进行的量化处理版本,使用llama.cpp工具和特定数据集生成,提供多种量化类型的GGUF文件,支持在LM Studio或基于llama.cpp的项目中运行。
这是对Qwen3-4B-Instruct-2507-heretic模型进行的量化处理版本,使用llama.cpp工具和imatrix数据集生成了多种量化类型的模型文件,可在多种环境下运行,为用户提供了更多选择。
这是p-e-w/gpt-oss-20b-heretic模型的量化版本,使用llama.cpp的imatrix技术进行量化处理。该模型是一个200亿参数的大语言模型,提供了多种量化选项,从高质量到低质量不等,文件大小从41.86GB到11.52GB,适用于不同硬件条件。
本项目对MiniMaxAI的MiniMax-M2模型进行了量化处理,使用llama.cpp工具,为不同需求的用户提供了多种量化类型的模型文件,方便在不同硬件条件下高效运行模型。
这是internlm的JanusCoder-14B模型的量化版本,使用特定工具和数据集进行量化处理,提供了从低质量到高质量的多种量化类型文件,可在LM Studio或基于llama.cpp的项目中运行。
这是对allenai的olmOCR-2-7B-1025模型进行的量化处理版本,使用llama.cpp工具生成了多种量化级别的模型文件,方便不同硬件条件和需求的用户使用。该模型支持在LM Studio或基于llama.cpp的项目中运行。
这是一个基于TheDrummer的Behemoth-X-123B-v2.1模型进行量化处理的项目,使用llama.cpp工具和特定数据集生成了多种量化类型的模型文件,适用于不同硬件条件下的推理需求。
Akicou
Qwen3-Omni-30B-A3B-Thinking模型的Q4_K_S量化GGUF版本,支持文本、视觉和音频多模态处理,通过llama.cpp实现高效推理。该版本在保证质量的前提下显著减小文件大小,提升推理速度。
这是对lemon07r的VellumMini-0.1-Qwen3-14B模型进行量化处理后的版本,通过特定的量化方法和工具,提供了多种不同量化类型的文件,以满足不同用户在性能、质量和资源占用方面的需求。
这是一个基于swiss-ai的Apertus-70B-Instruct-2509模型进行量化处理的版本,使用llama.cpp的imatrix技术生成多种量化模型文件,旨在提升模型运行效率和资源利用率,支持在不同硬件条件下灵活选择适合的量化级别。
这是对swiss-ai的Apertus-8B-Instruct-2509模型进行量化处理的版本,使用llama.cpp工具和imatrix数据集生成多种量化类型的GGUF文件,便于在不同硬件环境下高效运行。
这是IBM Granite-4.0-h-micro模型的GGUF量化版本,使用llama.cpp工具结合特定数据集完成量化处理,提供多种量化类型文件供不同硬件条件下高效运行。
mradermacher
本项目是对zenlm/zen-eco-4b-instruct模型进行量化处理后的成果,提供了多种量化版本的模型文件,包括IQ1_S、IQ2_XXS、IQ3_S、Q4_K_S、Q5_K_S等多种量化级别,方便不同硬件配置和性能需求的用户使用。
本项目是对owlninjam/nytheria-3b模型进行量化处理后的成果,提供了多种量化类型的模型文件,包括Q2_K、Q3_K_S、Q4_K_S等,满足不同场景下的性能和质量需求。
这是一个基于Qwen2.5-14B模型优化的波斯语科学文档问答模型,专门针对波斯语科学文档进行问答任务优化,通过量化处理提供了多种不同大小的模型文件以适应不同场景需求。
这是基于mookiezii/Discord-Hermes-3-8B模型进行量化处理后的版本,提供了多种量化格式的GGUF模型文件,适用于不同硬件环境和性能需求的对话AI应用场景。
ReasonRank-32B 是基于 liuwenhan/reasonrank-32B 基础模型的量化版本,提供多种量化权重文件,专门用于段落排序、文本排序、推理和信息检索等任务。该模型经过静态量化处理,适用于多种应用场景。
这是SuperbEmphasis的Velvet-Eclipse-4x12B-v0.2模型的量化版本,通过llama.cpp的imatrix量化技术处理,提供多种量化选项,能够在不同硬件条件下高效运行。模型支持文本生成任务,提供从BF16到IQ2_XXS等多种量化级别,满足不同用户对模型质量和文件大小的需求。
Acemcp是一个代码库索引和语义搜索的MCP服务器,支持自动增量索引、多编码文件处理、.gitignore集成和Web管理界面,帮助开发者快速搜索和理解代码上下文。
Awesome MCP Servers 是一个全面的Model Context Protocol (MCP)服务器集合,涵盖了7158个MCP服务器,分为33个类别,包括AI集成、艺术媒体、浏览器自动化、云服务、数据库、开发者工具、文件系统、金融、游戏、硬件、医疗、基础设施、知识管理、位置地图、市场营销、监控、多媒体处理、操作系统、项目管理、科学研究、安全、社交媒体、旅行交通、实用工具和版本控制等。
Code Merge MCP 是一个基于MCP协议的代码处理服务器,提供代码文件提取、合并和分析功能,助力大语言模型高效处理代码库。
Qwen MCP工具是一个基于模型上下文协议的服务器,可将Qwen CLI与AI助手集成,提供大上下文窗口分析、文件处理、沙箱执行和多模型支持等功能
OpenSCAD MCP服务器是一个通过文本或图像生成参数化3D模型的服务,支持多视角重建、AI图像生成、远程CUDA处理和工作流审批,最终输出OpenSCAD兼容的模型文件。
一个现代高效的CLI工具,可将任何输入文件转换为base64字符串,支持多种输出格式和双向转换,包含专为AI工作流优化的MCP服务器。
AI Studio MCP Server是一个集成Google AI Studio/Gemini API的模型上下文协议服务器,提供支持文件、对话历史和系统提示的内容生成功能。
gbox是一个开源的自托管沙箱项目,为MCP集成和其他AI代理用例提供安全环境。它包含终端、浏览器、文件编辑器等工具,支持本地任务执行和文件处理,并提供了Python和Typescript SDK。
Upstage MCP Server是一个连接AI助手与Upstage AI文档处理API的服务器,支持从PDF、图片和Office文件中提取结构化内容,并集成Claude Desktop等MCP客户端。
腾讯云COS MCP Server是一个基于MCP协议的服务,无需编码即可让大模型快速接入腾讯云存储(COS)和数据万象(CI)能力,提供文件上传下载、图片处理、视频截帧等云端存储与处理功能。
Context Lens 是一个本地化语义搜索工具,可将任何内容转换为可搜索的知识库,让AI助手理解含义而非仅匹配关键词。它使用内置的LanceDB向量数据库,支持本地文件、GitHub仓库和URL内容,无需API密钥或云服务,完全在本地处理数据。
一个高效处理Figma文件的MCP服务器,支持分块处理和分页功能
基于MCP的高性能PDF转Markdown服务,支持本地文件和URL批量处理,保留文档结构并智能优化输出。
Vulcan File Ops是一个基于Model Context Protocol(MCP)的高性能文件操作服务器,可将桌面AI助手(如Claude Desktop、ChatGPT Desktop等)转变为强大的开发伙伴。它提供安全的文件读写、批量操作、文档处理、图像分析和Shell命令执行功能,具有企业级安全控制、动态目录注册和智能工具过滤特性,让用户完全控制本地文件系统访问。
Shaka Packager MCP服务器是一个实验性项目,将Shaka Packager视频处理工具与Claude AI应用集成,提供视频转码、封装和分析功能。通过MCP协议与文件系统服务器配合,使Claude能访问和处理本地视频文件。
GemForge是将Google的Gemini AI与MCP生态系统连接的企业级工具,提供实时网络访问、高级推理、代码分析和多文件处理等功能,支持60多种文件格式,具备智能模型选择和强大的错误处理机制。
该项目是一个基于Model Context Protocol (MCP)标准的文档处理服务器,通过构建向量数据库和MCP接口,使AI助手能够访问外部文档资源,突破大语言模型的知识限制。项目包含文档处理流水线和MCP服务端两大组件,支持多种嵌入模型和文件格式,可应用于最新技术文档查询、私有代码库理解等场景。
一个MCP服务器,为AI编程助手提供上下文优化工具,通过精准提取信息而非处理大量终端输出和文件来节省上下文空间,提升助手效率。
MCP 3D打印机服务器是一个连接Claude与多种3D打印机管理系统的协议服务器,支持OctoPrint、Klipper、Duet等多种打印机API,提供文件管理、打印控制、STL模型处理等高级功能。
用于对xcstrings(字符串目录)文件进行增删改查操作的CLI工具和MCP服务器,提供针对性的本地化键值管理,避免AI助手处理大型文件时消耗过多token。