Hugging Face Blog·· 2025-02-20精选AI 评分78
Hugging Face 发布 SmolVLM2 系列模型,支持全设备视频理解
SmolVLM2: Bringing Video Understanding to Every Device
AI 导读
Hugging Face 发布 SmolVLM2 系列模型,包含 2.2B、500M 和 256M 三种参数规模,旨在让视频理解能力在所有设备上运行。SmolVLM2 2.2B 在 Video-MME 基准测试中表现优于现有 2B 级模型,而 500M 和 256M 版本则提供了极小的内存占用。
推荐理由
原文给出了三种参数规模的视频理解模型及端侧部署方案,读者可以据此评估小模型在本地设备上的实际可用性。
来源:Hugging Face Blog · huggingface.co