模型发布
Liquid AI 发布 LFM2.5-VL-3B 视觉模型,支持手机本地运行
Liquid AI 推出 31 亿参数视觉模型 LFM2.5-VL-3B,权重约 2GB,可在 iPhone 17 上本…
2026.08.13 · 周四约 2 分钟阅读
Liquid AI 今日正式发布 LFM2.5-VL-3B 视觉语言模型。这是一个参数量为 31 亿(3.1B)的视觉模型,权重约 2 GB,可装入手机端本地运行。模型权重已在 Hugging Face 开放下载,社区可通过 atomic.chat 等移动端应用进行体验。
模型规格与本地部署
LFM2.5-VL-3B 属于 Liquid AI 的 LFM2.5 系列,主打端侧可用的轻量化视觉理解能力:
- 参数量:31 亿(3.1B)
- 权重体积:约 2 GB
- 部署形态:可本地运行于手机等移动设备
社区用户在 iPhone 17 上进行了实测:让模型识别一张 Minecraft「Steve」玩偶的照片,推理耗时约 2 分 31 秒。速度偏慢,但模型最终正确识别出目标,并给出了分部位的细节描述,而非仅笼统贴标签。
主要改进:定位能力显著跃升
相较上一代,LFM2.5-VL-3B 最关键的变化是空间定位能力大幅增强:
- ScreenSpot-v2 桌面基准得分从 6 提升至 78.7
- 定位能力提升后,模型能够「分部位」拆解画面元素并逐一描述
这一能力对 UI 自动化、屏幕内容理解、辅助交互等场景具有直接价值,也是该版本相较前代最值得关注的升级点。
获取方式
模型权重已在 Hugging Face 发布,仓库地址为 LiquidAI/LFM2.5-VL-3B。本次社区测试使用的是 atomic.chat 移动应用(开发者本人为该应用创始人),更多端侧推理体验有待更多设备和应用接入验证。
