La transparence comme partie de l'architecture
Un réseau neuronal classique détecte bien les régularités, mais ne peut les expliquer qu'après coup. Le plus souvent, on fait appel à des interpréteurs externes ou à des modèles de substitution simplifiés, et ces explications ne sont qu'une approximation de ce qui se passe réellement à l'intérieur. Le modèle BIRDNet tente de contourner ce compromis : il intègre les règles dans l'architecture et les lit directement depuis le réseau.
Chaque bloc caché d'un tel réseau n'est pas un « neurone » abstrait, mais une représentation compacte d'une règle booléenne : « si le trait A est présent, alors le trait B est attendu ». Après l'apprentissage, aucun modèle explicatif séparé n'est nécessaire : les connexions et les poids portent déjà un sens symbolique.
Comment les règles émergent des tableaux
BIRDNet commence à extraire des règles symboliques des tableaux sans base de connaissances externe. Dans les données de domaines riches en connaissances accumulées — par exemple, les tableaux biomédicaux — des implications booléennes se cachent souvent entre des paires de traits. La recherche de ces relations est effectuée statistiquement, à l'aide d'un test binomial, et les exceptions rares ne détruisent pas la règle, mais sont considérées comme des écarts acceptables.
Une fois les paires de traits identifiées, un graphe d'implications typé est construit à partir d'elles. Ce graphe est ensuite transformé en couches du réseau neuronal :
- chaque bloc caché correspond à une règle extraite ;
- un bloc n'est connecté qu'à ses deux traits ;
- dans la couche d'implications, la proportion de poids actifs ne dépasse pas
2/d, oùdest la dimension de l'entrée.
Cette parcimonie rend le réseau léger tout en préservant un lien direct entre l'architecture et les règles symboliques.

Expériences : la précision n'en souffre presque pas
Pour vérifier que la transparence ne se paie pas en qualité de prédiction, BIRDNet a été testé sur six benchmarks transcriptomiques et protéomiques. La comparaison avec des modèles de base denses a donné deux chiffres importants :
- l'écart avec la meilleure solution dense en termes d'AUROC n'a pas dépassé 0,02 ;
- en parallèle, BIRDNet utilise jusqu'à 95 fois moins de paramètres actifs qu'un MLP dense architecturalement comparable.
En d'autres termes, le modèle ne cède presque rien en précision, mais nécessite un nombre de paramètres nettement inférieur. En pratique, cela se traduit par une architecture plus robuste et plus économique, plus facile à déployer et à analyser.

Les règles valent par leur sens, pas seulement par leur métrique
Cette approche comporte un aspect contre-intuitif. Dans les expériences de contrôle, où les paires de traits étaient mélangées ou remplacées par des paires aléatoires, la précision ne chutait pas : les connexions aléatoires se révélaient comparables aux connexions d'origine, voire supérieures en termes d'AUROC. Les paires extraites en elles-mêmes ne confèrent donc aucun avantage prédictif au modèle. Leur valeur réside ailleurs.
Les implications porteuses de sens conservent une interprétation symbolique. Les règles de la première couche de BIRDNet concordent avec des signatures biologiques connues pour plusieurs sous-types de cancer et types de tissus. Les paires aléatoires, malgré une précision comparable, ne portent aucun sens.
BIRDNet n'est donc pas simplement une manière de prédire un peu mieux la variable cible. C'est un exemple de la façon dont un réseau neuronal peut être utilisé à la fois comme modèle prédictif et comme source d'hypothèses vérifiables. Les travaux ont été publiés sur arXiv et acceptés à CIKM 2026 — un signal fort que le thème des architectures neurosymboliques interprétables ne fait que prendre de l'ampleur.



