字节跳动Seed为传闻超5万亿参数的下一代大模型铺路,近期完成深度组织架构调整,打破按模态和研究方向划分的传统模式,整合分散团队以优化研发效率。Seed基础模型新设四个一级部门,其中预训练数据团队Pretrain Data由李成刚负责。
字节跳动 Seed 团队与清华 AIR 联合发布 CUDA Agent,这是一套训练大模型编写高性能 GPU 内核的智能体强化学习系统。该系统针对大模型生成 CUDA 代码效率低、难超传统编译器的痛点,标志着 AI 在底层代码优化领域取得重要进展,并以 KernelBench 为评测基准。
字节跳动近期成立全新AI一级部门,专注大模型数据与安全建设,由王赢磊挂帅,与Seed、Flow、抖音等核心业务平行。该部门前身为2023年组建的Global Data团队,标志着继Seed和Flow之后,字节在AI领域又一关键布局。
字节跳动新设一级部门“AI数据与安全”,与Seed、Flow、抖音平级,由原TikTok直播负责人王赢磊负责。该部门前身为傅越2023年组建的Global Data团队(约百人),并整合数据中台DMC及AI数据平台AIDP等分散资源。字节暂无回应。
利用 Seedance 2.0 创建令人惊叹的 AI 视频。
日本向けAI動画生成ツール,テキストや画像から最大15秒動画生成
免费Seedance 2.5生成器,帮猫狗主人将照片秒变有趣宠物视频
多合一AI创作平台,快速创建广告、视频、视觉和营销内容
Bytedance
$1.2
输入tokens/百万
$3.6
输出tokens/百万
4
上下文长度
$0.8
$2
256
-
$0.15
$1.5
$8
magiccodingman
这是一个实验性的混合量化模型,采用MXFP4_MOE混合权重技术,在保持接近Q8精度的同时,实现了更小的文件大小和更高的推理速度。模型探索了MXFP4与高精度嵌入/输出权重的组合,在密集模型上取得了精度近乎无损的优化效果。
catalystsec
这是一个基于ByteDance Seed-OSS-36B-Instruct模型通过DWQ量化为4位的轻量化版本,使用mlx-lm 0.27.1从BF16教师模型中蒸馏而来,支持中英双语文本生成任务。
giladgd
这是ByteDance-Seed/Seed-OSS-36B-Instruct模型的静态量化版本,提供了多种量化级别的GGUF格式文件,帮助开发者在不同硬件配置下更高效地使用该模型。
lmstudio-community
Seed-OSS-36B-Instruct是由ByteDance-Seed开发的大型语言模型,参数量达360亿,采用Apache-2.0开源许可证。该模型基于transformers库构建,支持vllm和mlx技术优化,特别针对苹果Silicon芯片进行了8位量化处理,提供高效的文本生成能力。
Seed-OSS-36B-Instruct是由字节跳动Seed团队开发的360亿参数指令调优大语言模型,基于Transformer架构构建,经过MLX量化处理,专门针对Apple Silicon芯片进行了优化,可在LM Studio中高效运行。
bartowski
这是ByteDance-Seed的Seed-OSS-36B-Instruct模型的量化版本,通过llama.cpp工具进行多种精度量化处理,提供了从BF16到IQ2_XXS等20多种量化选项,旨在提升模型在不同硬件上的运行效率和性能。
gabriellarson
Seed-OSS是由字节跳动Seed团队开发的开源大语言模型系列,具备强大的长上下文处理、推理和智能体交互能力。仅使用12T token训练,在多个公开基准测试中表现出色,支持高达512K的原生长上下文处理。
RDson
Seed OSS 36B Instruct是字节跳动开发的大规模语言模型,拥有360亿参数,专门针对指令跟随任务进行了优化。基于llama.cpp框架构建,支持高效的文本生成能力。
yarikdevcom
Seed-OSS-36B-Instruct是由ByteDance开发的360亿参数大型语言模型,基于Apache-2.0许可证开源。该模型专门针对指令跟随任务进行了优化,支持文本生成和对话功能,具有强大的理解和生成能力。
dnakov
Seed-OSS-36B-Instruct是字节跳动开发的文本生成模型,基于36B参数规模的大语言模型架构,专门针对指令跟随任务进行优化。该模型支持中英文双语,采用Apache-2.0开源许可证,可通过vllm和mlx推理框架进行高效部署。
Seed-OSS-36B-Instruct是由ByteDance开发的大规模语言模型,参数量达360亿,专注于文本生成任务。该模型基于MLX框架实现,支持中英文双语,具备强大的指令跟随和文本生成能力。
Seed-OSS-36B-Instruct是由字节跳动开发的360亿参数大型语言模型,基于MLX框架优化,专注于文本生成任务。该模型支持中英文双语,采用Apache-2.0开源许可证,具备强大的指令跟随和内容生成能力。
QuantTrio
Seed-OSS-36B-Instruct-AWQ 是字节跳动 Seed 团队开发的 36B 参数大语言模型的量化版本,具备强大的长上下文处理能力、推理能力和智能体功能,支持高达 512K 的上下文长度和灵活的思考预算控制。
ByteDance-Seed
Seed-OSS是由字节跳动Seed团队开发的开源大语言模型系列,具备强大的长上下文处理、推理、智能体交互能力和通用性能。该模型仅使用12T token训练,在多个公开基准测试中表现出色。
prithivMLmods
cudaLLM-8B是由ByteDance Seed开发的专业语言模型,专门用于生成高性能且语法正确的CUDA内核代码。基于Qwen3-8B基础模型构建,通过监督微调和强化学习两阶段训练,能够协助开发人员编写高效的GPU并行编程代码。
Seed-X-RM-7B是Seed-X系列中的奖励模型,专门用于评估翻译质量。该模型基于70亿参数的Mistral架构,能够为多语言翻译分配奖励分数,支持25种语言间的翻译质量评估。
Seed-X-Instruct-7B是一款强大的开源多语言翻译语言模型,在70亿参数范围内突破翻译能力界限,具备卓越的翻译性能、轻量级架构和广泛领域覆盖,为翻译研究和应用提供有力支持。
Seed-X-PPO-7B 是一个强大的开源多语言翻译语言模型,采用强化学习训练,专注于提供高质量的翻译服务。
ai9stars
AutoTriton是一个拥有80亿参数的Triton编程模型,基于Seed-Coder-8B-Reasoning模型,通过有监督微调和强化学习训练得到。它是首个由强化学习驱动、专门用于Triton编程的模型,能够自动优化计算单元、内存管理和并行性等复杂内核开发任务。
Mungert
Seed-Coder-8B-Reasoning是基于Transformer架构的代码生成模型,具有强大的推理能力,适用于多种编码任务,在同规模的开源模型中表现出色。
基于火山引擎SeeDream模型的MCP图片生成工具,支持高质量图片生成、自定义尺寸和智能参考图,可通过MCP协议在Cursor、Claude Desktop等客户端中使用。
基于火山引擎Seedream 4.0 API的MCP工具集,提供文生图、图生图、多图融合和组图生成功能,支持七牛云自动上传、提示词模板和图片本地保存。
基于MCP协议的豆包Seedream 4.0文生图服务器,支持AI图片生成、自动下载和本地存储,可集成到Claude Code中使用