À propos de cet atlas
L'Atlas structurel des LLM est une référence indépendante et non commerciale qui documente la conception structurelle des modèles de langage à poids ouverts. Il consigne délibérément l'architecture plutôt que les scores de benchmarks : variantes d'attention, parcimonie, normalisation, encodage positionnel et provenance.
Méthodologie
Chaque donnée structurelle provient du fichier config.json distribué avec la publication à poids ouverts du modèle sur Hugging Face ou, lorsqu'aucun poids n'a été publié, des tableaux d'architecture de l'article original. Les classifications dérivées (MHA/GQA/MLA/linéaire hybride, dense/MoE) suivent les définitions standards du domaine. Rien n'est estimé : toute valeur invérifiable reste vide.
Sources
Les sources primaires sont les dépôts publics de modèles sur Hugging Face (config.json), les articles arXiv listés sur la page Articles et les rapports techniques des modèles. L'attention, RoPE, RMSNorm, SwiGLU et le MoE citent leurs publications originales.
Fraîcheur des données
Le corpus est resynchronisé régulièrement avec les publications amont ; la date d'instantané figure en pied de page de chaque vue.
Périmètre et avertissement
Ce site est une référence pédagogique tenue par des chercheurs indépendants ; il n'est affilié à aucun laboratoire et n'en reçoit aucun aval. Les noms de modèles demeurent des marques déposées de leurs propriétaires respectifs. Les données reflètent la date d'instantané indiquée en pied de page ; les révisions ultérieures peuvent différer.