mPLUG-DocOwl
攤 No.226MODEL · 基建模块化多模态文档理解大模型,支持OCR与问答
SKILL SCORE
68/ 100—(7日)
30D · STARS
安装
INSTALL$git clone https://github.com/X-PLUG/mPLUG-DocOwl.git拉源码本地跑,README 有完整安装说明
AI 速读
TL;DR这是什么
- 模块化多模态文档理解大模型
- 支持OCR文字识别与版面分析
- 可回答文档相关问答
适合谁
做目标检测、图像分割与多模态理解的算法工程师
上手门槛
中高 —— 需要 PyTorch 与深度学习基础,部分任务需 GPU
由 AI 生成 · 数据截至 2026-07-29 · 方法论 v2.3
星标增长
STARS GROWTH站内指标 · ON-SITE 30D
页面浏览0
收藏0
安装复制0
摊前留言
COMMENTS · 0还没有留言 · 登录后可发第一条
S·91PaddleOCR百度飞桨 OCR 工具箱,把 PDF/图片变成 AI 可用的结构化数据★86.4k—7日 +458★多模态视觉S·90tesseract最老牌的开源 OCR 引擎,百余种语言文字识别★75.6k—7日 +121★多模态视觉S·89ultralyticsYOLO11 目标检测/分割/追踪,工业级实时视觉★60.0k—7日 +275★多模态视觉S·88supervision可复用的计算机视觉工具库:检测、追踪、标注全套★48.4k—7日 +199★多模态视觉S·85tesseract.js纯 JavaScript OCR,支持 100+ 语言★38.6k—7日 +23★多模态视觉S·84segment-anythingMeta 万物分割 SAM,一键抠出任意物体★54.6k—7日 +43★多模态视觉

