字節跳動Seed爲傳聞超5萬億參數的下一代大模型鋪路,近期完成深度組織架構調整,打破按模態和研究方向劃分的傳統模式,整合分散團隊以優化研發效率。Seed基礎模型新設四個一級部門,其中預訓練數據團隊Pretrain Data由李成剛負責。
字節跳動 Seed 團隊與清華 AIR 聯合發佈 CUDA Agent,這是一套訓練大模型編寫高性能 GPU 內核的智能體強化學習系統。該系統針對大模型生成 CUDA 代碼效率低、難超傳統編譯器的痛點,標誌着 AI 在底層代碼優化領域取得重要進展,並以 KernelBench 爲評測基準。
字節跳動近期成立全新AI一級部門,專注大模型數據與安全建設,由王贏磊掛帥,與Seed、Flow、抖音等核心業務平行。該部門前身爲2023年組建的Global Data團隊,標誌着繼Seed和Flow之後,字節在AI領域又一關鍵佈局。
字節跳動新設一級部門“AI數據與安全”,與Seed、Flow、抖音平級,由原TikTok直播負責人王贏磊負責。該部門前身爲傅越2023年組建的Global Data團隊(約百人),並整合數據中臺DMC及AI數據平臺AIDP等分散資源。字節暫無迴應。
免費Seedance 2.5生成器,幫貓狗主人將照片秒變有趣寵物視頻
多合一AI創作平臺,快速創建廣告、視頻、視覺和營銷內容
Seedream 5.0 Pro可快速生成高質量AI圖,支持多種創作類型。
一款支持多模態輸入、可單次生成30秒原生4K畫質及同步音頻的AI視頻生成器。
Bytedance
$1.2
輸入tokens/百萬
$3.6
輸出tokens/百萬
4
上下文長度
-
$0.8
$2
256
$0.15
$1.5
$8
magiccodingman
這是一個實驗性的混合量化模型,採用MXFP4_MOE混合權重技術,在保持接近Q8精度的同時,實現了更小的文件大小和更高的推理速度。模型探索了MXFP4與高精度嵌入/輸出權重的組合,在密集模型上取得了精度近乎無損的優化效果。
catalystsec
這是一個基於ByteDance Seed-OSS-36B-Instruct模型通過DWQ量化為4位的輕量化版本,使用mlx-lm 0.27.1從BF16教師模型中蒸餾而來,支持中英雙語文本生成任務。
giladgd
這是ByteDance-Seed/Seed-OSS-36B-Instruct模型的靜態量化版本,提供了多種量化級別的GGUF格式文件,幫助開發者在不同硬件配置下更高效地使用該模型。
lmstudio-community
Seed-OSS-36B-Instruct是由ByteDance-Seed開發的大型語言模型,參數量達360億,採用Apache-2.0開源許可證。該模型基於transformers庫構建,支持vllm和mlx技術優化,特別針對蘋果Silicon芯片進行了8位量化處理,提供高效的文本生成能力。
Seed-OSS-36B-Instruct是由字節跳動Seed團隊開發的360億參數指令調優大語言模型,基於Transformer架構構建,經過MLX量化處理,專門針對Apple Silicon芯片進行了優化,可在LM Studio中高效運行。
bartowski
這是ByteDance-Seed的Seed-OSS-36B-Instruct模型的量化版本,通過llama.cpp工具進行多種精度量化處理,提供了從BF16到IQ2_XXS等20多種量化選項,旨在提升模型在不同硬件上的運行效率和性能。
gabriellarson
Seed-OSS是由字節跳動Seed團隊開發的開源大語言模型系列,具備強大的長上下文處理、推理和智能體交互能力。僅使用12T token訓練,在多個公開基準測試中表現出色,支持高達512K的原生長上下文處理。
RDson
Seed OSS 36B Instruct是字節跳動開發的大規模語言模型,擁有360億參數,專門針對指令跟隨任務進行了優化。基於llama.cpp框架構建,支持高效的文本生成能力。
yarikdevcom
Seed-OSS-36B-Instruct是由ByteDance開發的360億參數大型語言模型,基於Apache-2.0許可證開源。該模型專門針對指令跟隨任務進行了優化,支持文本生成和對話功能,具有強大的理解和生成能力。
dnakov
Seed-OSS-36B-Instruct是字節跳動開發的文本生成模型,基於36B參數規模的大語言模型架構,專門針對指令跟隨任務進行優化。該模型支持中英文雙語,採用Apache-2.0開源許可證,可通過vllm和mlx推理框架進行高效部署。
Seed-OSS-36B-Instruct是由ByteDance開發的大規模語言模型,參數量達360億,專注於文本生成任務。該模型基於MLX框架實現,支持中英文雙語,具備強大的指令跟隨和文本生成能力。
Seed-OSS-36B-Instruct是由字節跳動開發的360億參數大型語言模型,基於MLX框架優化,專注於文本生成任務。該模型支持中英文雙語,採用Apache-2.0開源許可證,具備強大的指令跟隨和內容生成能力。
QuantTrio
Seed-OSS-36B-Instruct-AWQ 是字節跳動 Seed 團隊開發的 36B 參數大語言模型的量化版本,具備強大的長上下文處理能力、推理能力和智能體功能,支持高達 512K 的上下文長度和靈活的思考預算控制。
ByteDance-Seed
Seed-OSS是由字節跳動Seed團隊開發的開源大語言模型系列,具備強大的長上下文處理、推理、智能體交互能力和通用性能。該模型僅使用12T token訓練,在多個公開基準測試中表現出色。
prithivMLmods
cudaLLM-8B是由ByteDance Seed開發的專業語言模型,專門用於生成高性能且語法正確的CUDA內核代碼。基於Qwen3-8B基礎模型構建,通過監督微調和強化學習兩階段訓練,能夠協助開發人員編寫高效的GPU並行編程代碼。
Seed-X-RM-7B是Seed-X系列中的獎勵模型,專門用於評估翻譯質量。該模型基於70億參數的Mistral架構,能夠為多語言翻譯分配獎勵分數,支持25種語言間的翻譯質量評估。
Seed-X-Instruct-7B是一款強大的開源多語言翻譯語言模型,在70億參數範圍內突破翻譯能力界限,具備卓越的翻譯性能、輕量級架構和廣泛領域覆蓋,為翻譯研究和應用提供有力支持。
Seed-X-PPO-7B 是一個強大的開源多語言翻譯語言模型,採用強化學習訓練,專注於提供高質量的翻譯服務。
ai9stars
AutoTriton是一個擁有80億參數的Triton編程模型,基於Seed-Coder-8B-Reasoning模型,通過有監督微調和強化學習訓練得到。它是首個由強化學習驅動、專門用於Triton編程的模型,能夠自動優化計算單元、內存管理和並行性等複雜內核開發任務。
Mungert
Seed-Coder-8B-Reasoning是基於Transformer架構的代碼生成模型,具有強大的推理能力,適用於多種編碼任務,在同規模的開源模型中表現出色。
基於火山引擎Seedream 4.0 API的MCP工具集,提供文生圖、圖生圖、多圖融合和組圖生成功能,支持七牛雲自動上傳、提示詞模板和圖片本地保存。
基於火山引擎SeeDream模型的MCP圖片生成工具,支持高質量圖片生成、自定義尺寸和智能參考圖,可通過MCP協議在Cursor、Claude Desktop等客戶端中使用。
基於MCP協議的豆包Seedream 4.0文生圖服務器,支持AI圖片生成、自動下載和本地存儲,可集成到Claude Code中使用