Les matrices sont des tableaux de nombres qui représentent des transformations linéaires, encodent des données et alimentent les algorithmes de l’informatique moderne. De la rotation de personnages 3D dans les jeux vidéo à l’entraînement de réseaux de neurones et à la résolution de systèmes d’équations, elles comptent parmi les outils mathématiques les plus polyvalents et les plus utiles en pratique.

Infographie et jeux vidéo

Chaque objet 3D affiché à l’écran est transformé par des matrices. La rotation, le changement d’échelle, la translation et la projection en perspective s’expriment par des multiplications matricielles, généralement avec des matrices homogènes 4×4 afin d’enchaîner ces transformations en un seul produit. Pour chaque objet et chaque image, un moteur de jeu calcule une matrice de modèle (position de l’objet dans le monde), une matrice de vue (position de la caméra) et une matrice de projection (projection de l’espace 3D sur l’écran 2D). Leur produit forme la matrice MVP (modèle-vue-projection), appliquée à chaque sommet. Une scène de 100,000 polygones exige 100,000 multiplications matrice-vecteur par image à 60 images par seconde, soit environ 6 millions d’opérations par seconde, traitées en parallèle par les milliers de cœurs de nuanceur du processeur graphique. Les personnages animés utilisent une matrice par os ; la hiérarchie du squelette les combine pour déformer en temps réel le maillage du personnage. Comprendre la composition et l’inversion des matrices est essentiel en programmation graphique, de la simple rotation d’un sprite 2D aux pipelines de rendu physique complets.

Apprentissage automatique et réseaux de neurones

Les réseaux de neurones reposent fondamentalement sur des multiplications matricielles. Chaque couche calcule une somme pondérée de ses entrées : sortie = W × entrée + b, où W est une matrice de poids et b un vecteur de biais. Entraîner un réseau consiste à ajuster W par descente de gradient : on calcule le gradient de la perte par rapport à W grâce à la rétropropagation, elle-même constituée d’une suite d’opérations matricielles (la règle de la chaîne sous forme matricielle). Un grand modèle de langage peut comporter des matrices de poids contenant des centaines de millions d’éléments. NumPy, PyTorch et TensorFlow sont optimisés pour exécuter rapidement des opérations matricielles par lots sur processeur et processeur graphique. La réduction de dimension par ACP (analyse en composantes principales) repose aussi sur les vecteurs propres de la matrice de covariance. Les mécanismes d’attention des transformeurs calculent les similarités entre matrices de requêtes et de clés, puis utilisent ces scores pour pondérer les matrices de valeurs : trois opérations matricielles par tête d’attention, répétées dans des dizaines de couches. L’algèbre linéaire, et les matrices en particulier, constitue le socle de calcul de l’apprentissage automatique moderne.

Systèmes d’équations en ingénierie

Les circuits électriques, l’analyse des structures, le transfert thermique et l’écoulement des fluides se ramènent à des systèmes d’équations linéaires : Ax = b. Pour un circuit à n nœuds, la matrice d’admittance nodale Y décrit toutes les conductances ; résoudre Yv = i donne simultanément la tension de chaque nœud. L’analyse par éléments finis d’un pont soumis à une charge assemble une matrice de rigidité K à partir de milliers de matrices élémentaires ; résoudre Ku = f donne le déplacement de chaque nœud. Ces matrices peuvent être gigantesques : les modèles structurels comportent couramment des millions d’équations. Elles sont toutefois souvent creuses (la plupart des éléments sont nuls), ce qui permet aux solveurs spécialisés de réduire la mémoire et le temps de calcul. L’élimination de Gauss, la décomposition LU et les méthodes itératives comme le gradient conjugué résolvent Ax = b selon la forme et le degré de creux de la matrice. En théorie du contrôle, la représentation d’état x′ = Ax + Bu décrit la dynamique du système par A et les entrées de commande par B ; les valeurs propres de A déterminent sa stabilité. Sans méthodes matricielles, l’ingénierie des infrastructures modernes — ponts, avions et gratte-ciel — serait impossible à calculer.

Statistiques et science des données

Les matrices constituent la structure de données naturelle des statistiques. Un jeu de données de n observations et p variables se représente par une matrice X de dimension n×p. La matrice de covariance S = Xᵀ X / (n−1) résume les relations deux à deux entre variables dans un tableau p×p. L’ACP consiste à calculer les vecteurs propres de S, qui définissent les composantes principales capturant le maximum de variance. La régression linéaire résout les équations normales Xᵀ Xβ = Xᵀ y pour obtenir le vecteur de coefficients β, ce qui nécessite l’inverse (ou la pseudo-inverse) de Xᵀ X. L’analyse multivariée, l’analyse factorielle et la centralité des réseaux reposent également sur les décompositions en valeurs propres. L’algorithme PageRank de Google trouve le vecteur propre dominant d’une matrice de transition des liens du Web ; chaque composante de ce vecteur correspond au rang d’une page. La régression logistique, l’analyse discriminante linéaire et les modèles de chaînes de Markov expriment leurs mises à jour par des multiplications matricielles répétées jusqu’à convergence. Maîtriser les matrices est donc indispensable aux spécialistes des données : elles fondent presque tous les modèles statistiques.

Valeurs propres : la structure des données

Les valeurs propres révèlent la structure intrinsèque d’une matrice. Pour une matrice carrée A, une valeur propre λ et un vecteur propre v vérifient Av = λv : la matrice multiplie simplement v par λ sans en changer la direction. L’équation caractéristique det(A − λI) = 0 donne toutes les valeurs propres. Pour une matrice 2×2, elle devient une équation du second degré : λ² − tr(A)λ + det(A) = 0, où tr(A) est la trace, soit la somme des éléments diagonaux. Des valeurs propres positives indiquent un étirement ; des valeurs négatives, une réflexion suivie d’un étirement ; une valeur propre nulle indique une matrice singulière. En ingénierie des structures, les valeurs propres de la matrice de rigidité donnent les fréquences de résonance, que la conception doit éviter pour prévenir une résonance catastrophique. Dans les systèmes dynamiques, leur module détermine la stabilité : |λ| inférieur à 1 signifie que le système converge ; |λ| supérieur à 1, qu’il diverge. En mécanique quantique, les valeurs propres de l’opérateur hamiltonien donnent les niveaux d’énergie permis d’une particule. L’analyse spectrale relie ainsi l’algèbre matricielle abstraite à des grandeurs physiques observables.