Hugging Face Blog·· 2025-02-20
Hugging Face 发布 SmolVLM2:提供 2.2B、500M 和 256M 视频理解模型
SmolVLM2: Bringing Video Understanding to Every Device
AI 导读
Hugging Face 发布 SmolVLM2,推出 2.2B、500M 和 256M 参数三个视频理解模型,并称模型及演示已开放,支持 Transformers 与 MLX。官方称 2.2B 在其评测的 Video-MME 中优于现有 2B 模型;500M 可在 iPhone 本地分析视频,而 256M 被定位为实验性版本。
来源:Hugging Face Blog · huggingface.co