MGM
攤 No.151MODEL · 基建Mini-Gemini多模态视觉语言模型官方实现
SKILL SCORE
69/ 100—(7日)
30D · STARS
安装
INSTALL$git clone https://github.com/JIA-Lab-research/MGM.git拉源码本地跑,README 有完整安装说明
AI 速读
TL;DR这是什么
- Mini-Gemini多模态视觉语言模型
- 挖掘视觉语言模型潜力的研究
- 提供官方代码与模型实现
适合谁
研究与应用大语言模型的开发者与研究者
上手门槛
中 —— 依项目而定:调用类 SDK 易上手,训练类需算力
由 AI 生成 · 数据截至 2026-07-29 · 方法论 v2.3
星标增长
STARS GROWTH站内指标 · ON-SITE 30D
页面浏览0
收藏0
安装复制0
摊前留言
COMMENTS · 0还没有留言 · 登录后可发第一条
S·91PaddleOCR百度飞桨 OCR 工具箱,把 PDF/图片变成 AI 可用的结构化数据★86.4k—7日 +458★多模态视觉S·90tesseract最老牌的开源 OCR 引擎,百余种语言文字识别★75.6k—7日 +121★多模态视觉S·89ultralyticsYOLO11 目标检测/分割/追踪,工业级实时视觉★60.0k—7日 +275★多模态视觉S·88supervision可复用的计算机视觉工具库:检测、追踪、标注全套★48.4k—7日 +199★多模态视觉S·85tesseract.js纯 JavaScript OCR,支持 100+ 语言★38.6k—7日 +23★多模态视觉S·84segment-anythingMeta 万物分割 SAM,一键抠出任意物体★54.6k—7日 +43★多模态视觉

