谷歌9月23日发布Gemini3.8Flash TTS与Gemini3.8Flash-Lite TTS两款文本转语音模型,分别面向个性化角色配音与大规模音频生成。其中Flash TTS主打声音和角色设计,支持通过自然语言描述创建定制化声音,标志语音合成进入精细化时代。
阿里云无影团队正研发AI设备QwenBook,定位原生智能体电脑,形态接近“千问平板”,尚处早期试水,主打办公场景,接入Qwen3.8-Max和Flash模型。产品定义与硬件自研,融合无影云电脑系统及端云能力,团队约150人。
9月22日,小米发布新一代大模型MiMo-V2.6,推出Pro和Flash两个原生全模态版本。Pro版在Artificial Analysis综合智能指数上拿到46分,超越Kimi K3和Qwen3.8Max,成为当前最强开源模型;但小米坦言,与Claude Fable5.1、GPT-6Astra等顶级闭源模型仍有差距。
小米9月22日发布开源全模态模型MiMo-V2.6系列(Pro/Flash),基于可验证任务扩展强化学习,探索递归自我改进。Pro版在Artificial Analysis综合智能指数获46分,超越Kimi K3与Qwen3.8Max,成最强开源模型;多数Agent基准比肩Claude Opus5与GPT-5.6Sol,但与最强闭源仍有差距。两款模型Live RL训练不足6天,成本约85万和262万元。
基于谷歌Gemini 2.5 Flash模型的免费AI图像编辑与生成工具
Gemini 2.0 Flash-Lite 是高效的语言模型,专为长文本处理和多种应用场景优化。
FlashVideo 是一个高效的高分辨率视频生成模型,专注于细节和保真度的流动。
Gemini 2.0 是谷歌推出的最新一代生成式 AI 模型,包含 Flash、Flash-Lite 和 Pro 版本。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
$2
$20
$6
$24
Baidu
128
TeichAI
本模型是基于Qwen3-4B架构的知识蒸馏模型,通过约5440万个由Gemini 2.5 Flash生成的标记进行训练,旨在整合Gemini-2.5 Flash的行为、推理过程和知识到单一数据集中。
Mungert
基于RWKV-7架构的轻量级语言模型,采用flash-linear attention格式,具备多语言支持和深度思考能力,适用于文本生成任务。
基于RWKV-7架构的多语言文本生成模型,拥有29亿参数,支持英语、中文、日语、韩语、法语、阿拉伯语、西班牙语和葡萄牙语等多种语言,采用flash-linear attention格式,适用于高质量的文本生成任务。
FlashVL
FlashVL是一种优化视觉语言模型(VLMs)以用于实时应用的新方法,旨在实现超低延迟和高吞吐量,同时不牺牲准确性。
基于flash-linear attention格式的RWKV-7模型,支持多语言文本生成任务。
RWKV
采用闪存线性注意力(flash-linear attention)格式的RWKV-7模型,支持英语文本生成任务。
fla-hub
这是一个采用flash-linear注意力格式的RWKV-7模型,参数量为0.45B,支持多种语言的文本生成任务,具有65,536的大词汇量。
nvidia
NVIDIA NeMo Canary Flash 是一个多语言多任务语音模型,支持英语、德语、法语和西班牙语的自动语音识别和翻译任务。
基于Flash线性注意力机制的RWKV-7 g1模型,支持多语言处理并具备深度思考能力
NVIDIA NeMo Canary Flash 是一个多语言多任务模型家族,在多个语音基准测试中实现了最先进的性能。支持四种语言的自动语音识别和翻译任务。
sdadas
基于sdadas/polish-roberta-large-v2改进的波兰语重排序模型,采用RankNet损失函数训练,支持Flash Attention 2加速
timpal0l
基于Mistral-7B-v0.1的预训练延续模型,使用瑞典论坛Flashback的40GB文本数据进行微调,支持多语言生成。
一个基于Gemini Flash 2 AI模型的数据分析与研究MCP服务器,提供数据解析、智能分析、报告生成和邮件自动发送功能。
一个基于Gemini Flash 2 AI模型的数据分析与研究MCP服务器,提供数据解析、统计分析、研究报告生成和邮件自动发送功能。
一个基于TypeScript的MCP服务器实现,通过直接调用Google Gemini API集成Gemini模型,支持最新Gemini 2.0 Flash模型并保持对话上下文。
一个基于Google Gemini模型的AI图像生成MCP服务器,支持智能模型选择(Flash快速生成和Pro高质量4K生成)、多种宽高比控制、文件管理和模板功能,提供生产级图像生成能力。
一个基于Gemini Flash 2 AI模型的数据分析与研究MCP服务器,提供数据解析、AI分析、可视化报告和邮件自动发送功能
LLM Gateway是一个基于MCP协议的服务器,支持高级AI代理(如Claude 3.7)将任务智能委托给成本更低的LLM模型(如Gemini Flash),实现成本优化和性能平衡。