国内首部AIGC长剧《后西游记》8月31日18:00开播,首推“花果山篇”5集、每集40分钟;同步芒果TV上线,当晚20:00登陆湖南卫视黄金档,SVIP/VIP可抢先看。该剧改编自明末清初同名神魔小说,第一季共30集,重构“西游后传”。
国内首部全AI生成长篇剧集《后西游记》8月31日开播,18:00芒果TV独播,20:00登陆湖南卫视黄金档。首批“花果山篇”5集,每集40分钟,SVIP抢先看3集、VIP看2集。该剧改编自明末清初同名神魔小说,属《西游记》三大续书之一。
8月27日,小鹏举办“TIME 时间”物理AI分享会,第二代VLA大模型首次重大升级,XOS6.3.0将在小鹏G9L全球首发。升级核心是让AI理解时间,从静态3D空间理解跃升至动态4D时空理解,并扩大端侧模型参数量,持续验证自动驾驶Scaling Law。
小鹏汽车8月27日宣布,搭载第二代VLA大模型的Robotaxi正式开启全无人道路测试,已获广州市智能网联汽车远程测试资质,可在指定测试道路开展无人驾驶。自6月启动员工内测以来,两个月完成超2000单订单,验证线上下单、接驾到行程服务完整流程。
VNovels是视觉小说平台,可读原创故事,也能自建发布作品。
免费ATS简历检查器,30秒获VANTAGE-7分数,专家24小时重写,94%面试率。
ReaderLM v2是一个用于HTML转Markdown和JSON的前沿小型语言模型。
Alibaba
$1
Input tokens/M
$10
Output tokens/M
256
Context Length
$2
$20
-
$0.8
128
Baidu
32
Bytedance
$8
Deepseek
$4
$12
$1.6
Tencent
24
Iflytek
$0.5
$3
$9
Clemylia
Lam-2是基于自定义架构Aricate V4开发的第二代小型语言模型(SLM),在问答任务中表现出色,具有卓越的语言连贯性和创造力。相比前代产品,Lam-2在语法正确性和文本生成质量上有显著提升。
TheClusterDev
这是Qwen3-Next-80B-A3B-Instruct模型的FP8量化版本,通过vLLM框架支持,在保持模型质量的同时显著减小了模型体积,提升了推理效率。
DFloat11
这是原始lodestones/Chroma(v39)模型的DFloat11无损压缩版本,将模型大小缩小了32%,同时保持位级相同的输出,并支持高效的GPU推理。
ubergarm
当前V3-0324模型在该尺寸类别中表现最佳的量化版本,在保持性能接近Q8_0的同时显著减小了体积
mradermacher
这是Casual-Autopsy/Llama-3-VNTL-Yollisa-8B的加权/矩阵量化版本,适用于英语和日语处理,特别针对日本媒体、御宅族媒体和视觉小说(VNs)领域。
2121-8
Parler-TTS Mini v1 是一个基于日语的小型文本转语音模型,支持高质量的语音合成。
parler-tts
Parler-TTS Mini v1.1 是一个轻量级的文本转语音模型,基于45,000小时的音频数据训练而成,能够生成高质量、自然流畅的语音,其特性可以通过简单的文本提示进行控制。
simran14
基于simran14/mr-model-h在Common Voice 17.0马拉地语数据集上微调的Whisper小型语音识别模型
fairportrobotics
FRC 578团队开发的YOLO v10小模型,用于教学演示,展示目标检测模型原理
yujiepan
这是一个用于调试的小型CLIP模型,基于ViT架构,随机初始化权重。
1aurent
DinoBloom是一个基于Vision Transformer的小型特征提取模型,专门为血液学中的细胞嵌入任务设计。
avsolatorio
NoInstruct小型嵌入模型v0是一种改进的嵌入模型,专注于提升检索任务性能,同时保持对任意指令编码的独立性。
ipsilondev
Parler-TTS Mini v0.1 是一个轻量级的文本转语音模型,基于10.5K小时的音频数据训练而成,能够生成高质量、自然流畅的语音,并通过简单的文本提示控制语音特征。
unum-cloud
UForm是一款小巧的多模态AI模型,可将视觉和英文文本映射到共享向量空间,支持内容理解与生成。该模型采用轻量级设计,文本编码器为4层BERT,视觉编码器为ViT-S/16,可生成256维嵌入向量。
UForm-Gen2-dpo 是一个小型生成式视觉语言模型,通过直接偏好优化(DPO)在 VLFeedback 和 LLaVA-Human-Preference-10K 偏好数据集上针对图像描述生成和视觉问答任务进行对齐训练。
timm
基于ViT架构的小型CLIP模型,适用于零样本图像分类任务,训练于LAION-400M数据集。
fluently
Fluently V3-inpainting 是一个基于多个检查点和LoRA合并而成的图像修复模型,特别擅长处理小部件和复杂物体的修复任务。
YanweiLi
LLaMA-VID是基于LLaMA/Vicuna微调的开源多模态聊天机器人,通过扩展上下文令牌支持长达数小时的视频处理能力。
calum
这是一个小型GPT-2模型,在TinyStories V2数据集上预训练,具有3M可训练参数,表现出良好的文本生成连贯性。
rinna
由rinna株式会社训练的日语HuBERT基础模型,基于约19,000小时的日语语音语料库ReazonSpeech v1训练。
一个用于访问视觉小说数据库(VNDB)的MCP服务器,提供视觉小说搜索和详细信息查询功能,并具有API请求缓存优化。