Anthropic宣布将原为内部新员工培训的Claude Academy平台免费向公众开放。该平台含289个学习资源,系统覆盖AI基础知识、Claude Code、API调用、智能体开发等内容,旨在普及大模型协作核心技能。
xAI多模态负责人蔺旭东近日加入腾讯,任混元多模态内容生成算法负责人。他2018年毕业于清华,后赴哥伦比亚大学读博,研究方向为嵌入学习、视频分析与生成模型;曾实习于腾讯、Facebook AI及谷歌,并第一作者参与Vx2Text框架研发,提升字幕生成能力。
字节跳动 Seed 团队与清华 AIR 联合发布 CUDA Agent,这是一套训练大模型编写高性能 GPU 内核的智能体强化学习系统。该系统针对大模型生成 CUDA 代码效率低、难超传统编译器的痛点,标志着 AI 在底层代码优化领域取得重要进展,并以 KernelBench 为评测基准。
腾讯大模型布局调整:原混元资深研究员徐灿转岗微信事业群,加入WeLM团队,专注后训练与Agent研发。徐灿曾创建WizardLM并提出Evol-Instruct,在合成数据、强化学习等领域积淀深厚。此举正值微信AI加速落地期。
在线学习Python、AI、大模型、AI写作绘画课程,零基础轻松入门。
Openai
$2.8
Input tokens/M
$11.2
Output tokens/M
1k
Context Length
Google
$0.49
$2.1
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$4
$16
$1
$10
256
Baidu
128
$6
$24
$2
$20
Smith-3
这是一个专为圣西蒙大学科学与技术学院学生设计的微调AI模型,集成在TecnoTime应用程序中,帮助学生保持学习组织性、提高学术连续性,通过结构化通知和激励信息强化学习习惯。
Mungert
PokeeResearch-7B是由Pokee AI开发的70亿参数深度研究代理模型,结合了AI反馈强化学习(RLAIF)和强大的推理框架,能够在工具增强的大语言模型中实现可靠、对齐和可扩展的研究级推理,适用于复杂的多步骤研究工作流程。
lmstudio-community
Kevin 32B是由Cognition AI开发的大语言模型,支持超长上下文(40960 tokens),专注于CUDA内核生成和强化学习任务。
Or4cl3-1
CSUMLM是整合多模态AI引擎和大语言模型优势的前沿人工智能系统,具备多模态处理、复杂语言理解和实时学习能力。
LDCC
LDCC-SOLAR-10.7B是由乐天数据通信AI技术团队研发的大语言模型,基于SOLAR架构构建,具有107亿参数规模,主要针对韩语优化,采用创新的学习方法进行训练。
CallComply
Starling-7B是一个通过AI反馈强化学习(RLAIF)训练的开源大语言模型,基于Openchat 3.5微调,在MT Bench中表现优异。
berkeley-nest
首个基于AI反馈强化学习(RLAIF)训练的开源大语言模型,在MT Bench测试中表现优异