LIVESSI 79,387.00▲0.03%
未登录 · 登录

LLaVA

攤 No.368MODEL · 基建

视觉指令微调,开源多模态对话大模型

SKILL SCORE
80/ 100(7日)
24,951 7日 +18·Fork 2.8k·Issues 1141·Apache-2.0·更新于 4 小时前
30D · STARS

安装

INSTALL
$https://github.com/haotian-liu/LLaVA

官方安装 / 下载入口

AI 速读

TL;DR

这是什么

  • 视觉指令微调,开源多模态对话大模型
  • 把视觉编码器接入 LLM,能看图对话推理
  • 开源多模态的代表作,复现与二开友好

适合谁

做目标检测、图像分割与多模态理解的算法工程师

上手门槛

中高 —— 需要 PyTorch 与深度学习基础,部分任务需 GPU

由 AI 生成 · 数据截至 2026-07-29 · 方法论 v2.3

星标增长

STARS GROWTH
站内指标 · ON-SITE 30D
页面浏览0
收藏0
安装复制0

摊前留言

COMMENTS · 0

还没有留言 · 登录后可发第一条

同街摊位

RELATED · VISION看整条街 →
SKILL·STUDY · 夜市每 10 分钟补货一次 · 排名公正性政策SKILL.STUDYS·96README 徽章 · 一键佩戴本夜市靈感來自 士林 · 寧夏 · 饒河