腾讯开源统训框架AngelSpec,通过多方案协同与工作负载异构适配,降低大模型自回归解码成本,提升推理吞吐量。针对不同场景文本特征采取差异化训练策略,如高熵多轮对话采用轻量稳定方案,实现真实场景下的高效推理。
OpenRouter推出提示词缓存与粘性路由技术,通过复用多轮对话中重复的系统指令、工具定义等不变内容,大幅降低智能体交互的token消耗与成本,助力长时间智能体应用普及。
苹果在2026全球开发者大会上发布Xcode 27,深度整合AI智能体,开启“氛围编程”新模式。该智能体精准理解Swift,开发者可通过自然语言多轮对话完成复杂编程任务,实现智能化开发体验重大升级。
百度于6月10日发布高考服务升级方案,推出免费“AI志愿报告”,首次引入真人专家背书机制。该产品通过文心助手多轮对话采集考生信息,结合历年分数线、高校专业数据及就业前景,生成个性化志愿报告,并由资深咨询师审核认证,直击志愿填报核心痛点。
LLaDA是一种大规模语言扩散模型,具备强大的语言生成能力,与LLaMA3 8B性能相当。
DeepHermes 3 是一款支持推理和常规响应模式的大型语言模型。
Kimi 视觉模型可理解图片内容,包括文字、颜色和物体形状等。
基于AIGC的可追问、千人千问和多轮对话的L5级别AI面试官
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
$6
$24
Baidu
128
mlx-community
这是Qwen3-Next-80B-A3B-Instruct模型的4位量化MLX格式版本,专为Apple Silicon优化。该模型是一个80B参数的大型语言模型,支持多轮对话和指令跟随,经过量化处理后可在Apple设备上高效运行。
这是Qwen3-235B-A22B-Instruct-2507模型的4位深度量化(DWQ)版本,专为MLX框架优化。该模型具有2350亿参数,经过指令微调,支持多轮对话和复杂推理任务。
Mungert
xLAM-2-32b-fc-r GGUF模型是一款专为文本生成任务设计的先进模型,在多轮对话和函数调用等方面表现卓越。
基于特定技术生成的语言模型,在多轮对话和函数调用等任务中表现出色。
tarun7r
基于Llama 3.1 8B微调的金融领域专用模型,擅长金融推理、问答和多轮对话
lmstudio-community
Qwen3-1.7B是由Qwen开发的1.7B参数规模的大语言模型,支持32k tokens超长上下文,擅长创意写作、角色扮演和多轮对话。
Qwen3-4B是由Qwen开发的大语言模型,支持131,072 tokens的上下文长度,擅长创意写作、角色扮演和多轮对话。
Qwen3-14B是由Qwen开发的大语言模型,支持多种语言和方言,擅长创意写作、角色扮演和多轮对话。
由Qwen开发的大语言模型,支持131,072 tokens上下文长度,擅长创意写作、角色扮演和多轮对话。
eaddario
Salesforce开发的8B参数大型动作模型(LAM),专注于将用户意图转化为可执行动作,在多轮对话和工具使用方面表现优异。
Salesforce
xLAM-2是Salesforce研发的大型动作模型系列,专注于多轮对话和函数调用能力,可作为AI代理的核心组件。
nitky
奥陌陌-7b指令调优版v2是一个融合多个预训练语言模型的日语和英语文本生成模型,特别强化了角色扮演和多轮对话能力。
slupart
基于SPLADE++改进的对话式搜索模型,通过多教师蒸馏策略优化多轮对话查询语义理解
基于SPLADE++模型适配的对话式搜索版本,通过QReCC数据集微调查询编码器,优化多轮对话式搜索性能。
xLAM-2-3b-fc-r是Salesforce推出的3B参数大型行动模型,专注于将用户意图转化为可执行行动,在多轮对话和工具使用方面表现优异。
DataPilot
一个以成为AI虚拟主播灵魂为目标的混合专家模型,结合了代码生成、指令跟随和多轮对话能力
xLAM-2系列是基于先进数据合成和训练流程构建的大型动作模型(LAMs),专注于多轮对话和工具使用,在函数调用和代理任务中表现卓越。
xLAM-2是Salesforce推出的新一代大型动作模型,专注于多轮对话和函数调用能力,能够将用户意图转化为可执行动作,作为AI代理的核心组件。
xLAM-2系列是基于APIGen-MT框架训练的大型动作模型,专注于多轮对话和函数调用能力,适用于AI代理开发。
FINGU-AI
RombUltima-32B 是一个融合模型,结合了 Rombos-LLM-V2.5-Qwen-32b 和 Ultima-32B 的优势,优化了推理能力、多语言理解能力以及多轮对话表现。
DeepSeek MCP服务器项目,为Claude Desktop等应用提供匿名API代理服务,支持多轮对话和自动模型切换。
这是一个让本地AI获取远程AI指导的MCP服务器,支持多轮对话、文件上传和智能对话管理,特别针对GLM-4.7模型优化。
RevitMCP项目为Revit引入自然语言交互能力,通过MCP协议实现BIM建模自动化,采用分层架构设计,支持多轮对话与参数补全,显著提升建模效率。
Yelp Fusion AI的MCP服务器项目,提供基于自然语言的本地商业搜索和交互功能,支持多轮对话、商业查询和餐厅预订。
该项目是一个实现Model Context Protocol(MCP)规范的服务器,作为桥梁让MCP客户端(如Claude桌面版)通过标准化接口与Google的Gemini AI模型交互。支持多种Gemini模型和功能调用,提供工具如单次提问、多轮对话和函数调用,可通过本地或Docker部署。
一个MCP服务器工具,用于测试不同LLM提供商的提示词效果,支持OpenAI和Anthropic模型的多轮对话和对比测试。
DeepSeek MCP服务器是一个为DeepSeek API设计的模型上下文协议服务器,支持与Claude Desktop等MCP兼容应用无缝集成,提供匿名API访问、多轮对话支持和自动模型回退等功能。