LFM2.5-2.6B : IA locale performante et légère
LFM2.5-2.6B est un modèle d'IA conçu pour fonctionner entièrement sur appareil, avec des performances compétitives face à des modèles 4x plus grands. Il atteint 220 tok/s sur un Apple M5 Max et 113 tok/s sur un AMD Ryzen CPU, tout en conservant les données privées.
« Competitive with models 4x larger on tool use, instruction following, and multi-step agentic tasks. » — Hugging Face Blog
Que faut-il retenir ?
- LFM2.5-2.6B atteint 220 tokens/s sur un Apple M5 Max et 113 tokens/s sur un AMD Ryzen CPU.
- Le modèle est pré-entraîné sur ~34T de tokens avec une fenêtre de contexte étendue à 128K.
- Il surpasse des modèles plus grands sur les benchmarks d'instruction following et tool use.
- Il supporte le tool calling et les workflows multi-étapes tout en restant léger.
Pourquoi cette nouvelle compte-t-elle ?
Ce modèle permet aux développeurs de déployer des agents IA localement, sans dépendre du cloud, garantissant confidentialité et réduction des coûts. Ses performances compétitives avec des modèles plus grands en font une solution viable pour des applications variées.
220 tokens/s sur un Apple M5 Max
Public concerné : développeurs, entreprises