跳到正文
原文
Hugging Face Blog·· 2024-11-26精选AI 评分68

Hugging Face 发布 SmolVLM 2B 视觉语言模型

SmolVLM - small yet mighty Vision Language Model

AI 导读

Hugging Face 发布 SmolVLM,这是一款参数量为 2B 的视觉语言模型,在 transformers 库中实现了最低的显存占用(约 5.02 GB)。

推荐理由

SmolVLM 在保持视觉问答能力的同时将显存占用降至约 5GB,为端侧部署和低成本微调提供了具体的性能基准与开源训练配方。

来源:Hugging Face Blog · huggingface.co