
Une équipe de Imperial College London et de ETH Zurich a présenté une architecture d'IA inspirée du cerveau qui pourrait traiter de longues séquences avec plus de rapidité et beaucoup moins de consommation énergétique, a rapporté le portail technologique TechXplore. Cette avancée, publiée dans la revue scientifique Nature Machine Intelligence, cible l'une des limitations centrales des systèmes actuels : maintenir un contexte utile pendant de longues périodes sans augmenter les dépenses énergétiques ni les besoins en mémoire.
Les tests initiaux ont montré une augmentation de plus de quatre fois la performance de traitement et une amélioration de plus de cinq fois en efficacité énergétique par rapport aux implémentations de dernière génération.
L'architecture repose sur des réseaux neuronaux à pics (SNN, pour son acronyme en anglais), des modèles d'IA inspirés de la manière dont les neurones biologiques communiquent. Au lieu de traiter l'information de manière continue, ils fonctionnent avec des signaux brefs appelés pics, ce qui permet d'activer le calcul seulement lorsque des changements pertinents se produisent.
Cette logique orientée vers des événements les rend attrayants pour réduire la consommation électrique par rapport à de nombreux systèmes d'IA actuels, connus pour leur forte demande énergétique. Le problème est que, bien que les versions antérieures de ces réseaux aient offert des résultats prometteurs, elles avaient tendance à perdre des informations utiles avec le temps, en particulier lorsqu'elles devaient fonctionner avec peu de mémoire disponible ou sous des contraintes énergétiques. La nouvelle architecture vise précisément à résoudre cette limitation.

Memoire lente et pics rapides à chaque couche
La proposition des chercheurs vise à résoudre cette tendance à perdre un contexte utile avec une conception conjointe de logiciel et de matériel. Le cœur du système reproduit une caractéristique observée dans le cerveau humain : la coexistence de processus neuronaux très rapides avec d'autres plus lents, capables de conserver des informations plus longtemps.
A un niveau algorithmique, les auteurs ont développé un réseau multicouche avec une voie explicite de mémoire lente combinée avec une activité rapide basée sur des pics. Chaque couche maintient un état compact et de faible dimension qui résume l'activité récente et module la dynamique des pics.
L'équipe a expliqué que ce mécanisme stabilise l'apprentissage et conserve la dispersion propre au traitement activé par des événements. Selon les auteurs, il atteint également une précision compétitive dans des tâches de longues séquences avec entre 40 % et 60 % de paramètres en moins que des réseaux neuronaux à pics équivalents considérés comme références.
Ce point répond à la question centrale du travail : qu'est-ce qui change par rapport aux SNN précédentes. La différence est que le nouveau système ne se contente pas de traiter les données entrantes de manière efficace, mais retient également des informations pertinentes pour la tâche dans une représentation compacte, ce qui réduit la charge sur la mémoire.

Logiciel et matériel comme un système unique
Les avancées ne se limitent pas au modèle mathématique. L'équipe a également conçu un matériel spécifique optimisé pour exécuter cette architecture, avec une approche de calcul proche de la mémoire qui maintient cet état partagé compact et améliore le flux de données entre des trajectoires hétérogènes.
Les chercheurs ont décrit cette conception comme une architecture capable d'exploiter les avantages de la double voie de mémoire en coordonnant des trajectoires de pics dispersés et des trajectoires de mémoire dense. L'objectif est que le logiciel et le matériel fonctionnent comme un système unique, au lieu d'adapter un nouveau modèle à des plateformes conçues pour d'autres charges de travail.
Pour évaluer la proposition, les scientifiques ont mesuré trois variables : la vitesse à laquelle des tâches de longues séquences étaient complétées, le consommation d'énergie, et le volume de données qu'ils pouvaient traiter dans un temps déterminé. Ce type de tâche exige d'analyser d'importants flux d'informations, un scénario où la rétention de contexte s'avère décisive.

Applications prévues pour le nouveau système
Les résultats expérimentaux indiquent que des principes biologiques peuvent être traduits en abstractions fonctionnelles efficaces tant au niveau algorithmique qu'au niveau matériel. Pour les auteurs, cela établit un cadre évolutif de codesign pour la calcul et l'apprentissage neuromorphiques —c'est-à-dire inspirés du fonctionnement du cerveau— en temps réel.
Le développement devra encore être affiné et testé sur un éventail plus large de tâches computationnelles. Néanmoins, le travail dessine déjà des applications concrètes dans des scénarios où l'énergie, la mémoire et le temps de réponse sont limités.
Parmi ces usages potentiels figurent la robotique, les dispositifs portables, l'intelligence artificielle en périphérie de réseau et les réseaux de capteurs connectés.