面壁智能聯合清華大學及OpenBMB開源社區發佈新一代端側多模態大模型MiniCPM-V4.6,僅1.3B參數,推出Instruct與Thinking兩個版本,憑藉高智能密度與跨平臺適配能力,在多項評測中表現超越更大參數模型,加速端側AI應用落地。
面壁智能聯合清華大學及OpenBMB開源社區發佈MiniCPM-V 4.6端側多模態大模型,僅1.3B參數、6G內存即可流暢運行,性能卓越,在內存漲價背景下實現“低內存、極速跑”,爲AI應用拓展新可能。
開源AI社區發佈多模態大語言模型MiniCPM-V4.5,專爲智能手機和平板等端側設備優化。該模型僅8億參數,輕量化設計實現高效運行,在OpenCompass評估中獲77.2分,性能領先同類開源模型,爲移動端AI應用開闢新可能。
面壁智能聯合清華大學發佈端側多模態大模型MiniCPM-V4.5,採用SigLIP2-400M視覺模塊與MiniCPM4架構,以更小參數實現更強性能,顯著提升邊緣AI部署效率和應用廣度,推動端側多模態技術發展。
高性能多模態語言模型,適用於圖像和視頻理解。
openbmb
AgentCPM-GUI是一款具備RFT增強推理能力的設備端圖形界面代理,可操作中英文應用,基於80億參數的MiniCPM-V構建。
FriendliAI
MiniCPM-V 2.6是一款強大的多模態大語言模型,能夠在手機等設備上高效運行,支持單圖像、多圖像和視頻理解任務。
c01zaut
MiniCPM-V 2.6是支持單圖、多圖和視頻理解的GPT-4V級別多模態大語言模型,專為RK3588 NPU優化
AI-Engine
MiniCPM-V-2_6的GGUF量化版本,基於llama.cpp實現高效圖像文本轉換
jchevallard
MiniCPM-V 2.6是MiniCPM-V系列最新最強的多模態大模型,支持單圖、多圖和視頻理解,具有領先的性能和極致效率。
gaianet
MiniCPM-V-2_6 是一個視覺問答模型,支持中英文,專注於處理視覺相關的問答任務。
MiniCPM-V是一個手機端GPT-4V級多模態大語言模型,支持單圖、多圖與視頻理解,具備視覺、光學字符識別等功能。
MiniCPM-V 2.6是一個多模態視覺語言模型,支持圖像文本到文本的轉換,具備多語言處理能力。
RhapsodyAI
免OCR的視覺文檔嵌入模型,能夠通過圖像理解文檔內容並生成表示向量,適用於文本和視覺密集型文檔檢索。
MiniCPM-V 2.6是OpenBMB推出的多模態大模型,在單圖、多圖及視頻理解任務上超越GPT-4V,支持iPad端即時視頻理解。
MiniCPM-V 2.0是面向高效終端部署的強大多模態大語言模型,基於SigLip-400M和MiniCPM-2.4B構建,通過感知器重採樣器連接。
MiniCPM-V是一款高效輕量級多模態模型,專為終端設備部署優化,支持中英雙語交互,性能超越同規模模型。