跳到正文
原文
Hugging Face Blog·· 2025-02-20精选AI 评分78

Hugging Face 发布 SmolVLM2 系列模型,支持全设备视频理解

SmolVLM2: Bringing Video Understanding to Every Device

AI 导读

Hugging Face 发布 SmolVLM2 系列模型,包含 2.2B、500M 和 256M 三种参数规模,旨在让视频理解能力在所有设备上运行。SmolVLM2 2.2B 在 Video-MME 基准测试中表现优于现有 2B 级模型,而 500M 和 256M 版本则提供了极小的内存占用。

推荐理由

原文给出了三种参数规模的视频理解模型及端侧部署方案,读者可以据此评估小模型在本地设备上的实际可用性。

来源:Hugging Face Blog · huggingface.co