Veille IA Veille IA sans buzz : pour stratèges québécois.
La veille

LFM2.5-2.6B : IA locale performante et légère

LFM2.5-2.6B : IA locale performante et légère

5 min de lecture · Hugging Face Blog · 4 août 2026 IA générative 9/10 Élevé
LFM2.5-2.6B : IA locale performante et légère

LFM2.5-2.6B est un modèle d'IA conçu pour fonctionner entièrement sur appareil, avec des performances compétitives face à des modèles 4x plus grands. Il atteint 220 tok/s sur un Apple M5 Max et 113 tok/s sur un AMD Ryzen CPU, tout en conservant les données privées.

« Competitive with models 4x larger on tool use, instruction following, and multi-step agentic tasks. » — Hugging Face Blog

Que faut-il retenir ?

  • LFM2.5-2.6B atteint 220 tokens/s sur un Apple M5 Max et 113 tokens/s sur un AMD Ryzen CPU.
  • Le modèle est pré-entraîné sur ~34T de tokens avec une fenêtre de contexte étendue à 128K.
  • Il surpasse des modèles plus grands sur les benchmarks d'instruction following et tool use.
  • Il supporte le tool calling et les workflows multi-étapes tout en restant léger.

Pourquoi cette nouvelle compte-t-elle ?

Ce modèle permet aux développeurs de déployer des agents IA localement, sans dépendre du cloud, garantissant confidentialité et réduction des coûts. Ses performances compétitives avec des modèles plus grands en font une solution viable pour des applications variées.

220 tokens/s sur un Apple M5 Max

Public concerné : développeurs, entreprises

Quels sont les avantages de LFM2.5-2.6B par rapport aux modèles cloud ?

LFM2.5-2.6B permet un déploiement local, garantissant la confidentialité des données et évitant les coûts d'inférence cloud. Il offre des performances compétitives avec des modèles 4x plus grands.

🔐 Connexion rapide

Entrez votre courriel pour recevoir un code à 6 chiffres.

Pas besoin de mot de passe ni d'inscription. Entrez votre courriel, recevez un code par courriel, et c'est tout !