Liquid AI的新模型完全在手机上运行,无需云端
Liquid AI刚刚发布了LFM2.5-2.6B——一个紧凑而强大的模型,旨在完全在您的智能手机上运行。无需云,无需API调用,只有纯粹的设备端智能。该模型于8月5日发布,拥有26亿参数,专为代理工作流设计,对于追求速度、隐私和成本效益的开发者来说,这是一个改变游戏规则的产品。
它有什么特别之处?
LFM2.5-2.6B的核心在于将AI带到您身边。通过在本地运行,它避免了将数据发送到云端所带来的延迟和隐私问题。想象一下,让您的手机预订餐厅、管理日历,甚至起草电子邮件——所有这些都不需要您的个人数据离开设备。这就是它的承诺。
但它在技术上是如何表现的呢?该模型在高达34万亿个令牌上进行了预训练,词汇量扩展到128K。这是大量的数据,效果显而易见。后训练过程同样令人印象深刻,包括四个阶段:监督微调、教师专业化、多领域策略蒸馏和代理强化学习。结果呢?一个在规划、工具调用和处理复杂多步骤任务方面表现出色的模型。
性能令人惊喜
您可能会期望一个较小的模型落后于较大的模型,但LFM2.5-2.6B打破了预期。在基准测试中,它在指令遵循和工具使用方面与近四倍大小的模型性能相当。这绝非易事。
在硬件方面,它同样令人印象深刻。在Apple M5 Max芯片上,它达到了惊人的每秒220个令牌。即使在移动设备上,它也能保持每秒30个令牌的稳定速度——足以满足实时交互。因此,无论您使用的是高端笔记本电脑还是中端手机,都能获得响应迅速、流畅的体验。
开源且随时可用
最令人兴奋的方面之一是LFM2.5-2.6B已在Hugging Face上完全开源,包括其基础版本。这意味着开发者可以立即深入研究、定制和部署它。它原生支持llama.cpp、MLX和vLLM等流行的推理框架,因此集成轻而易举。
对于开发者来说,这是一个黄金机会。您可以构建不仅高效而且尊重用户隐私的边缘代理。而且,由于不依赖云基础设施而节省成本,这是一个双赢的局面。
更大的图景
Liquid AI的举措标志着AI向边缘计算发展的更广泛趋势。随着模型变得更小、更智能,对持续云连接的需求减少。这可能导致更快、更私密、更易访问的AI应用。
但这不仅仅是技术问题。它关乎这对日常用户意味着什么。想象一个世界,您的设备更好地理解您,响应更快,并保护您的数据安全。这就是LFM2.5-2.6B正在帮助构建的未来。
关键点
- Liquid AI发布了LFM2.5-2.6B,一个用于边缘设备的26亿参数模型。
- 它完全在本地运行,无需云API。
- 在指令遵循和工具使用方面,性能与4倍大小的模型相当。
- 在M5 Max上达到每秒220个令牌,在移动设备上达到每秒30个令牌。
- 已在Hugging Face上开源,支持llama.cpp、MLX和vLLM。