47+AI
ZH
← 返回列表
工具资讯 来源:AI 每日采集 多模态 开源模型 视觉语言模型

多模态开源模型发布节奏加快

开源社区出现多款轻量级视觉语言模型,支持图像理解、OCR 与结构化信息提取。

开源社区近期新增多个多模态模型及微调版本,参数量覆盖 1B 至 13B 区间。

这些模型在文档解析、图表理解和图文问答等任务上表现稳定,便于本地部署。

开发者可通过常见开源框架快速接入并针对行业语料进行继续训练。