百度旗下的PaddleOCR项目正式登顶 GitHub Star 排名,成为全球 OCR(光学字符识别)领域关注度最高的开源项目。这一里程碑标志着以飞桨(PaddlePaddle)为代表的中国深度学习开源框架,在垂直技术领域已经具备了国际领先的影响力,成功超越了包括 Tesseract 在内的众多老牌国际开源项目。

技术实力支撑:超轻量模型与全栈能力
生态繁荣:从学术研究走向千行百业
除了技术指标的领先,
百度旗下的PaddleOCR项目正式登顶 GitHub Star 排名,成为全球 OCR(光学字符识别)领域关注度最高的开源项目。这一里程碑标志着以飞桨(PaddlePaddle)为代表的中国深度学习开源框架,在垂直技术领域已经具备了国际领先的影响力,成功超越了包括 Tesseract 在内的众多老牌国际开源项目。

技术实力支撑:超轻量模型与全栈能力
生态繁荣:从学术研究走向千行百业
除了技术指标的领先,
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。

科大讯飞子公司词元星火9月1日开源星火X2.5-4B和1.7B两款端侧通用大模型,为端侧首个原生支持100万Token上下文,并开放权重、代码仓库与部署文档。模型采用混合注意力架构,优化智能体、代码、数学、指令遵循等核心能力,实现小模型“读全书”,综合实测能力领先。
9月1日,科大讯飞子公司词元星火开源星火X2.5-4B和1.7B两款端侧通用大模型,原生支持最高100万Token超长上下文,突破端侧算力瓶颈,让小体积设备也能处理超长文本,推动端侧AI性能与容量双重升级。
近日,中科院大连化物所联合科大讯飞、阿里云发布智能化工大模型3.0 Pro。作为我国化工行业首个大模型的最新迭代版,其发布标志着行业大模型正告别单一知识问答,向更深层次工业落地迈进;技术上从过去聚焦信息检索与内容生成,跨越到全新阶段。

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。新鲜AI产品点击了解:https://app.aibase.com/zh1、不到四百美元还能自己动手训练!8、一个创意,一支AI团队:千问创作AgentTeams上线,编剧导演美术全承包千问创作上线AgentTeams功能,通过多智能体协作模式,实现从创意到成片的全流程自动化制作,显著降低专业内容生产的门槛。
科大讯飞9月1日将开源星火X2.5-4B和1.7B两款端侧通用大模型,原生支持1M token长上下文,重点提升智能体交互、数学计算与通用理解能力,面向车载、智能硬件及万物互联等端侧场景。9月7日还将发布更大规模模型。
科大讯飞在2026年半年度业绩说明会上透露,将于今年1024开发者节正式推出基于全国产算力的全新主力通用大模型;8月底率先发布阶段性版本,供市场和开发者提前体验,技术落地节奏已明确。

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。新鲜AI产品点击了解:https://app.aibase.com/zh1、腾讯混元发布HyOCR-1.5:仅1B参数推理提速6.37倍HyOCR-1.5作为轻量化端到端OCR模型,通过技术创新实现了性能与效率的飞跃,同时开放全栈源代码,降低了开发门槛,推动了OCR技术的普及和应用。AI原生App的用户黏性显著提升,表明其正在快速改写竞争格局。
轻量级端到端OCR模型HyOCR-1.5发布,在保持轻量化同时大幅提升性能与效率。作为首个全栈开源OCR模型,它全面开放权重、训练配方、数据构造方法及推理加速框架,显著降低开发门槛,让开发者可轻松复现、微调,并在消费级显卡或笔记本上部署。
百度开源3B参数端到端OCR模型Unlimited OCR,专攻书籍论文等长文档。项目上线5天GitHub Star破万,登顶四项趋势榜。技术上,推理激活约570M参数,创新引入Reference Sliding Window Attention机制,突破逐页拼接限制,支持数十页一次性连续解析,大幅提升长文档处理效率。

法国Mistral AI推出OCR4文档识别模型,支持跨越10个语族的170种语言。该模型在OmniDocBench测试中获93.07分,输出准确自然,用户体验优于GPT5.5Pro和Gemini3.1Pro。