桃子桃子快讯
返回首页
模型发布

Liquid AI 发布 LFM2.5-VL-3B 视觉模型,支持手机本地运行

Liquid AI 推出 31 亿参数视觉模型 LFM2.5-VL-3B,权重约 2GB,可在 iPhone 17 上本…

2026.08.13 · 周四2 分钟阅读

Liquid AI 今日正式发布 LFM2.5-VL-3B 视觉语言模型。这是一个参数量为 31 亿(3.1B)的视觉模型,权重约 2 GB,可装入手机端本地运行。模型权重已在 Hugging Face 开放下载,社区可通过 atomic.chat 等移动端应用进行体验。

模型规格与本地部署

LFM2.5-VL-3B 属于 Liquid AI 的 LFM2.5 系列,主打端侧可用的轻量化视觉理解能力:

  • 参数量:31 亿(3.1B)
  • 权重体积:约 2 GB
  • 部署形态:可本地运行于手机等移动设备

社区用户在 iPhone 17 上进行了实测:让模型识别一张 Minecraft「Steve」玩偶的照片,推理耗时约 2 分 31 秒。速度偏慢,但模型最终正确识别出目标,并给出了分部位的细节描述,而非仅笼统贴标签。

主要改进:定位能力显著跃升

相较上一代,LFM2.5-VL-3B 最关键的变化是空间定位能力大幅增强:

  • ScreenSpot-v2 桌面基准得分从 6 提升至 78.7
  • 定位能力提升后,模型能够「分部位」拆解画面元素并逐一描述

这一能力对 UI 自动化、屏幕内容理解、辅助交互等场景具有直接价值,也是该版本相较前代最值得关注的升级点。

获取方式

模型权重已在 Hugging Face 发布,仓库地址为 LiquidAI/LFM2.5-VL-3B。本次社区测试使用的是 atomic.chat 移动应用(开发者本人为该应用创始人),更多端侧推理体验有待更多设备和应用接入验证。

信源