AIBase
Home
AI NEWS
AI Tools
GEO & AEO
MCP
AI Models
EN

AI News

View More

Vision-R1:强化学习助力视觉定位,图文模型性能提升 50%

近日,中国科学院自动化研究所与中科紫东太初团队联手推出了一种新方法 ——Vision-R1,利用类 R1强化学习技术,显著提升了视觉定位的能力。这个方法不仅在目标检测和视觉定位等复杂任务上实现了50% 的性能提升,甚至超过了参数规模超过10倍的现有最优模型(SOTA)。当前,图文大模型通常依赖 “预训练 + 监督微调” 的方法来提高对用户指令的响应能力,但这种方法在资源消耗和训练效率上都存在较大挑战。Vision-R1通过结合高质量的指令对齐数据和强化学习,创新性地改变了这一局面

20.3k 2 days ago
Vision-R1:强化学习助力视觉定位,图文模型性能提升 50%

Models

View More

DeepSeek-R1

Deepseek

DeepSeek-R1

$4

Input tokens/M

$16

Output tokens/M

32

Context Length

Spark X1

Iflytek

Spark X1

$2

Input tokens/M

-

Output tokens/M

-

Context Length

qwq-plus

Alibaba

qwq-plus

$1.6

Input tokens/M

$4

Output tokens/M

128

Context Length

DeepSeek-R1-Distill-Qwen-7B

Deepseek

DeepSeek-R1-Distill-Qwen-7B

$1

Input tokens/M

-

Output tokens/M

8

Context Length

Baichuan-M2-32B

Baichuan

Baichuan-M2-32B

-

Input tokens/M

-

Output tokens/M

32

Context Length

ERNIE X1.1 Preview

Baidu

ERNIE X1.1 Preview

$1

Input tokens/M

$4

Output tokens/M

64

Context Length

o1

Openai

o1

$105

Input tokens/M

$420

Output tokens/M

200

Context Length

Qwen_v2.5_3b_Instruct

Alibaba

Qwen_v2.5_3b_Instruct

$1

Input tokens/M

-

Output tokens/M

32

Context Length

o1-mini

Openai

o1-mini

$21

Input tokens/M

$84

Output tokens/M

128

Context Length

o1-preview

Openai

o1-preview

$105

Input tokens/M

$420

Output tokens/M

128

Context Length

AIBase
Empowering the future, your artificial intelligence solution think tank
English简体中文繁體中文にほんご
FirendLinks:
AI Newsletters AI ToolsMCP ServersAI NewsAI MarketingLLM LeaderboardAI Ranking
© 2026AIBase
Business CooperationSite Map