#attention

3 articles about attention

llm27 septembre 2026

Épisode 1 : L'Attention, c'est juste 4 opérations mathématiques

Derrière les Transformers et le mécanisme d'attention, il n'y a que quatre opérations simples : multiplication matricielle, transposition, scaling et softmax. Les voici, en Rust.

llm27 septembre 2026

Épisode 2 : Q, K, V — Pourquoi 3 matrices et pas une seule ?

Query, Key, Value : pourquoi les vrais modèles projettent chaque mot dans trois espaces différents, et comment cette séparation des rôles rend l'attention plus fine.

llm27 septembre 2026

Épisode 3 : Embeddings — Absolus au départ, contextuels à l'arrivée

Un embedding, c'est le mot dans l'absolu ou dans son contexte ? Les deux, à des moments différents. Plus les trois détails d'ingénierie autour de l'attention : multi-head, masking et position encoding.