>_Reeboot
Needle 3 : le modèle d'IA ultra-compact pour l'embarqué et le mobile

Needle 3 : le modèle d'IA ultra-compact pour l'embarqué et le mobile

Découvrez Needle 3, un modèle de fondation compact de 8 à 29 Mo conçu pour l'intelligence artificielle embarquée, l'appel d'outils et l'extraction locale.

L'univers de l'intelligence artificielle embarquée franchit une étape majeure avec l'arrivée de Needle 3, un modèle de fondation compact développé par Cactus Compute. Conçu spécifiquement pour les appareils mobiles, les objets connectés, la robotique, la domotique et les microcontrôleurs, ce modèle redéfinit ce qu'il est possible d'accomplir sur des architectures à ressources contraintes. Avec un fichier unique pesant entre 8 et 29 mégaoctets, Needle 3 fait le choix délibéré de sacrifier la conversation générique pour exceller dans trois domaines précis : l'appel d'outils, l'extraction de données structurées et l'embedding de texte.

L'architecture de Needle 3 repose sur le Laddered Simple Attention Network, intégrant le Monarch Hadamard MLP et l'Engram N-gram Memory pour réduire le nombre de paramètres tout en maintenant la capacité de calcul.