Vous avez oublié la signification de \b au milieu de l’écriture d’une regex ? Ou vous en avez écrit une qui a l’air correcte mais qui ne renvoie rien à l’exécution ? Ce guide vous propose un mémo pratique, organisé en 4 sections : métacaractères, quantificateurs, groupes et exemples concrets, chacune accompagnée d’une explication en français courant. Utilisez-le avec le testeur de regex de Piick pour consulter et tester en parallèle.

Mémo des métacaractères

Tous les symboles spéciaux en regex qui ne sont pas des caractères littéraux sont appelés métacaractères. Les 12 plus courants :

  • . n’importe quel caractère unique (ne correspond pas aux sauts de ligne par défaut ; nécessite le flag s pour les inclure)
  • ^ début de ligne (correspond au début de chaque ligne en mode multiligne)
  • $ fin de ligne (correspond à la fin de chaque ligne en mode multiligne)
  • \b limite de mot (entre un caractère de mot \w et un non-\w)
  • \d chiffre, équivalent à [0-9]
  • \D non-chiffre
  • \w caractère de mot, équivalent à [A-Za-z0-9_]
  • \W caractère hors mot
  • \s espace blanc (espace, tabulation, saut de ligne)
  • \S caractère non blanc
  • [abc] classe de caractères, correspond à l’un des caractères a/b/c
  • [^abc] classe négative, correspond aux caractères qui ne sont pas a/b/c

Astuce mnémotechnique : d pour digit (chiffre), w pour word (mot), s pour space (espace) — la majuscule signifie « non ».

Quantificateurs : glouton ou paresseux

Les quantificateurs contrôlent combien de fois l’élément précédent apparaît :

  • * zéro ou plusieurs fois
  • + une ou plusieurs fois
  • ? zéro ou une fois
  • {n} exactement n fois
  • {n,} au moins n fois
  • {n,m} entre n et m fois

Piège majeur : glouton par défaut, il avale autant que possible. Par exemple, ".*" qui tente de correspondre à "a" and "b" renverra l’ensemble "a" and "b", pas deux segments distincts. Ajoutez ? pour le rendre paresseux : ".*?" isolera "a" et "b" séparément.

Lors du débogage d’une regex, si vous soupçonnez que la correspondance est trop gloutonne, le premier réflexe est d’ajouter ?.

Groupement et capture

Les parenthèses () servent au groupement et ont 3 usages :

  • Groupe de capture : stocke le contenu correspondant, réutilisable plus tard avec \1.
  • Groupe non capturant (?:...) : regroupe sans capturer, ce qui économise de la mémoire.
  • Groupe nommé (?<name>...) : accessible par son nom, le code est plus lisible.

Exemple concret : pour faire correspondre une balise HTML <a href="...">, vous voulez à la fois le nom de la balise et les attributs. Utilisez <\/?([a-z]+)([^>]*)> : la première paire de parenthèses capture le nom de la balise, la seconde capture les attributs. La version avec capture nommée est <\/?(?<tag>[a-z]+)(?<attrs>[^>]*)>, bien plus lisible.

Le groupement en regex est plus complexe qu’il n’y paraît : le panneau Explication du testeur de regex de Piick détaille ce que fait chaque parenthèse, pour que vous n’ayez plus à deviner.

5 exemples concrets de regex

  1. E-mail [A-Za-z0-9._%+-]+@[A-Za-z0-9.-]+\.[A-Za-z]{2,} — valide les formats courants ; la RFC 5322 stricte est trop longue, autant utiliser la version simplifiée en pratique.
  2. URL https?:\/\/[^\s]+ — correspond au début http/https jusqu’au premier espace.
  3. IPv4 \b(?:[0-9]{1,3}\.){3}[0-9]{1,3}\b — 4 segments de 0 à 255 ; une validation complète impose des comparaisons numériques segment par segment.
  4. Date ISO \d{4}-\d{2}-\d{2} — format de type 2026-06-28.
  5. Slug d’URL [a-z0-9]+(?:-[a-z0-9]+)* — lettres/chiffres minuscules avec traits d’union, le format classique d’URL d’article.

N’écrivez pas de regex complexes de tête : collez-les dans le testeur de regex de Piick. Saisissez à gauche, les correspondances se surlignent en direct à droite, modifiez une ligne et voyez immédiatement l’effet. C’est 10 fois plus rapide que de recharger la page en boucle.


Ouvrez dès maintenant le testeur de regex de Piick, collez un peu de texte et essayez une regex que vous n’avez encore jamais exécutée.