Théorie quantique des champs – Partie 7

note

Notes de lecture du livre Quantum field theory for the gifted amateur de Thomas Lancaster et Stephen Blundell.

Retour sommaire

La matrice S

Les chapitres précédents ont construit le propagateur (l’amplitude de propagation d’un quantum). Ce chapitre construit l’objet qui parle aux expériences. Trois idées s’emboîtent :

  • L'objet mesurable : la matrice $S$, tableau des amplitudes entre états asymptotiques libres (car dans une collision, on ne mesure jamais « pendant », seulement « longtemps avant » et « longtemps après »).
  • L'outil : la représentation d'interaction, qui répartit l'évolution de sorte que les champs restent les champs libres du chapitre précédent (développements en modes et propagateur $\Delta$ compris), l'interaction ne pilotant que les états.
  • Deux théorèmes de conversion : la série de Dyson (qui écrit $\hat S$ comme exponentielle chronologique de l'interaction) et le théorème de Wick (qui convertit les produits chronologiques en produits de propagateurs). Le chapitre suivant ne fera plus que dessiner le résultat.


Ce qu’on mesure

Posons $\hat H = \hat H_0 + \hat H’$, où $\hat H_0$ est la partie libre (celle du chapitre précédent, exactement soluble, dont on connaît les états propres : le vide et les états de Fock) et $\hat H’$ l’interaction.

Dans une collision, on ne mesure jamais « pendant », seulement « longtemps avant » et « longtemps après ».

Anatomie d’une expérience de diffusion :

  • on prépare des paquets d'ondes très éloignés les uns des autres (donc sans interaction, des états propres de $\hat H_0$) ;
  • ils se rapprochent, interagissent pendant un temps fini ;
  • on détecte des paquets à nouveau très éloignés (encore des états libres). Toute la physique accessible tient dans le tableau des amplitudes « entrée $\to$ sortie ».

L’opérateur $\hat S$ envoie les états libres du passé lointain sur ceux du futur lointain :

$$ \hat S = \lim_{\substack{t_+ \to +\infty \\ t_- \to -\infty}} \hat U(t_+, t_-) $$

$$ S_{fi} = \langle f|\, \hat S\, |i\rangle, $$

où $|i\rangle$ et $|f\rangle$ sont des états propres de $\hat H_0$ (états de Fock construits par des $\hat a^\dagger$ sur le vide), et $\hat U$ l’opérateur d’évolution. La probabilité mesurée est $|S_{fi}|^2$.

La matrice $S$ est le tableau des amplitudes entre états asymptotiques libres.

$\hat S$ est unitaire : $\hat S^\dagger \hat S = \mathbb 1$.


$\hat S$ est une limite d’opérateurs d’évolution, tous unitaires ($\hat U^\dagger\hat U = \mathbb 1$ car l’équation de Schrödinger conserve la norme).
Lecture physique : $\sum_f |S_{fi}|^2 = 1$ : quelque chose sort toujours de la collision, la somme des probabilités vaut $1$.
L’unitarité de $\hat S$ est la conservation des probabilités déguisée, et deviendra un outil de contrainte puissant (théorème optique, au chapitre sur la diffusion).

note

Hypothèse cachée : aux temps asymptotiques, les particules sont si éloignées que l’interaction est négligeable, et les états sont « libres ». C’est raisonnable pour la diffusion, mais subtil sur deux points : les états liés (qui n’existent que par l’interaction) et l’auto-interaction d’une particule avec son propre champ (une particule n’est jamais « nue », elle est habillée par son nuage de quanta). Ces subtilités sont remisées jusqu’au chapitre de renormalisation. Pour ce chapitre, on suppose l’interaction « éteinte » aux temps infinis.


La représentation d’interaction

Qui, des états ou des opérateurs, porte l’évolution temporelle ? Trois choix cohérents :

Schrödinger Heisenberg Interaction (Dirac)
États portent toute l’évolution figés évoluent sous $\hat H_I$ seulement
Opérateurs figés portent toute l’évolution évoluent sous $\hat H_0$ seul
Intérêt MQ élémentaire champs libres (ch. précédent) théorie des perturbations

La représentation d’interaction répartit l’évolution :

$$ |\psi_I(t)\rangle = e^{i\hat H_0 t}\, |\psi_S(t)\rangle $$

$$ \hat O_I(t) = e^{i\hat H_0 t}\, \hat O_S\, e^{-i\hat H_0 t} $$

Les indices disent la représentation : $|\psi_S\rangle$ est l’état en représentation de Schrödinger (l’état « ordinaire », celui qui obéit à $i\partial_t|\psi_S\rangle = \hat H|\psi_S\rangle$) et $|\psi_I\rangle$ sera son avatar en représentation d’Interaction.

Si $\hat H’ = 0$, l’évolution se réduit à $|\psi_S(t)\rangle = e^{-i\hat H_0 t}|\psi_S(0)\rangle$ : une « rotation » libre dans l’espace de Hilbert, connue et sans intérêt. Multiplier par $e^{+i\hat H_0 t}$ défait exactement cette rotation (c’est passer dans le référentiel tournant qui accompagne l’évolution libre). Dans ce référentiel, un état libre est immobile, et tout mouvement résiduel est imputable à l’interaction seule. La définition est conçue pour cela.

La loi de transformation des opérateurs n’est pas un choix indépendant : elle est forcée par l’exigence que les grandeurs physiques ne dépendent pas de la représentation : en effet, pour avoir $\langle\psi_S|\hat O_S|\psi_S\rangle = \langle\psi_I|\hat O_I|\psi_I\rangle$ pour tout état, il faut $\hat O_I = e^{i\hat H_0 t}\hat O_S\, e^{-i\hat H_0 t}$ (suffit d’insérer $|\psi_I\rangle = e^{i\hat H_0 t}|\psi_S\rangle$). Noter qu’à $t = 0$, les trois représentations coïncident.

Les états n’évoluent que sous l’effet de l’interaction :

$$ i\frac{\mathrm{d}}{\mathrm{d}t}|\psi_I(t)\rangle = \hat H_I(t)\, |\psi_I(t)\rangle $$

$$ \hat H_I(t) \equiv e^{i\hat H_0 t}\, \hat H’\, e^{-i\hat H_0 t} $$


On dérive la définition ($\hat H_0$ commute avec sa propre exponentielle) :

$$ i\partial_t |\psi_I\rangle = -\hat H_0\, e^{i\hat H_0 t}|\psi_S\rangle + e^{i\hat H_0 t}\underbrace{(\hat H_0 + \hat H’)|\psi_S\rangle}_{i\partial_t|\psi_S\rangle} = e^{i\hat H_0 t}\, \hat H’\, e^{-i\hat H_0 t}\, |\psi_I\rangle = \hat H_I(t)\,|\psi_I\rangle $$

Le terme libre $\hat H_0$ s’est exactement compensé : si $\hat H’ = 0$, les états ne bougent plus du tout.

Le point capital : les opérateurs, eux, évoluent sous $\hat H_0$ seul. Donc les champs, en représentation d’interaction, obéissent aux équations libres (en TQC, les champs sont les opérateurs). Tout l’acquis du chapitre précédent (développements en modes, commutateurs, propagateur $\Delta$) reste utilisable tel quel, même en présence d’interactions. C’est précisément pour cela que cette représentation existe.


La série de Dyson

Notons $\hat U_I(t, t’)$ l’opérateur d’évolution des états en représentation d’interaction : $i\partial_t \hat U_I = \hat H_I(t)\hat U_I$, avec $\hat U_I(t’,t’) = \mathbb 1$. En intégrant, l’équation différentielle devient une équation intégrale :

$$ \hat U_I(t, t’) = \mathbb 1 + (-i)\int_{t’}^{t} \mathrm{d}t_1\, \hat H_I(t_1)\, \hat U_I(t_1, t’), $$

qu’on résout par itération (on réinjecte l’équation dans elle-même) :

$$ \hat U_I(t,t’) = \mathbb 1 + (-i)\int_{t’}^{t}\mathrm{d}t_1\, \hat H_I(t_1) + (-i)^2 \int_{t’}^{t}\mathrm{d}t_1 \int_{t’}^{t_1}\mathrm{d}t_2\, \hat H_I(t_1)\hat H_I(t_2) + \cdots $$

Noter la structure du terme d’ordre $2$ : les temps sont ordonnés, $t_1 \geq t_2$, et l’opérateur le plus ancien est à droite (l’itération produit d’elle-même des produits chronologiques). Comme $[\hat H_I(t_1), \hat H_I(t_2)] \neq 0$ en général, cet ordre n’est pas négociable.

$$ \hat U_I(t,t’) = T\exp\left( -i\int_{t’}^{t} \mathrm{d}t_1\, \hat H_I(t_1) \right) \Longrightarrow \hat S = T\exp\left( -i\int \mathrm{d}^4x\, \hat{\mathcal H}_I(x) \right) $$


Il faut convertir les intégrales ordonnées en intégrales libres sous $T$, au prix d’un facteur combinatoire. À l’ordre $2$ : le domaine ordonné est le triangle $t’ \leq t_2 \leq t_1 \leq t$, moitié du carré $[t’,t]^2$.

Sur le carré entier, considérons $\frac{1}{2}\iint T[\hat H_I(t_1)\hat H_I(t_2)]$.

  • Sur le triangle $t_1 \geq t_2$, le $T$ donne $\hat H_I(t_1)\hat H_I(t_2)$.
  • Sur le triangle $t_2 \geq t_1$, il donne $\hat H_I(t_2)\hat H_I(t_1)$, qui redevient le premier intégrande en échangeant les noms des variables muettes $t_1 \leftrightarrow t_2$.

Les deux triangles contribuent donc autant, et

$$ \int_{t’}^{t}\mathrm{d}t_1 \int_{t’}^{t_1}\mathrm{d}t_2\, \hat H_I(t_1)\hat H_I(t_2) = \frac{1}{2!}\int_{t’}^{t}\mathrm{d}t_1 \int_{t’}^{t}\mathrm{d}t_2\; T\big[\hat H_I(t_1)\hat H_I(t_2)\big] $$

À l’ordre $n$, même argument : le domaine libre $[t’,t]^n$ se découpe en $n!$ secteurs (un par ordre chronologique possible des $t_i$), et sous $T$ ils contribuent tous autant (d’où le $1/n!$ qui reconstitue l’exponentielle) :

$$ \hat U_I = \sum_{n} \frac{(-i)^n}{n!} \int \cdots \int\; T\big[\hat H_I(t_1)\cdots \hat H_I(t_n)\big] = T\exp\left(-i\int \hat H_I\right) $$

Quelques détails :

Le terme d’ordre $n$ de l’itération vit sur le simplexe $t \geq t_1 \geq \cdots \geq t_n \geq t’$, les opérateurs déjà rangés du plus récent au plus ancien par les bornes emboîtées. Aucun $T$ n’est encore intervenu.

Le cube $[t’,t]^n$ se découpe (à des ensembles de mesure nulle près) en $n!$ secteurs $D_\sigma = \{t_{\sigma(1)} > \cdots > t_{\sigma(n)}\}$, un par permutation.
Point crucial : la fonction $F(t_1,\dots,t_n) = T[\hat H_I(t_1)\cdots\hat H_I(t_n)]$ est totalement symétrique ($T$ trie selon les valeurs des temps, pas selon les étiquettes). C’est ce qui autorise, sur chaque secteur, le changement de variables $s_i = t_{\sigma(i)}$ (jacobien de $1$) qui l’envoie sur le simplexe standard : les $n!$ secteurs livrent la même intégrale. Sans le $T$, ce renommage serait illicite, les $\hat H_I(t_i)$ ne commutant pas.

Le signe « $=$ » final est une définition.
L’exponentielle ordinaire de $\hat A = -i\int_{t’}^t \hat H_I$ donne $\sum_n \frac{(-i)^n}{n!}\int_{\text{cube}} \hat H_I(t_1)\cdots\hat H_I(t_n)$ (le produit non ordonné).
On définit $T\exp(-i\int\hat H_I)$ comme la même série avec un $T$ dans chaque terme : « développer comme si les $\hat H_I(t)$ commutaient, puis ordonner ».
Cohérence : si les $\hat H_I(t)$ commutaient pour tout temps, le $T$ ne ferait rien et on retomberait sur $e^{-i\int\hat H_I}$, le résultat familier.

De $\hat U_I$ à $\hat S$ :
Par définition, $\hat S = \hat U_I(+\infty, -\infty)$. On prend $t’ \to -\infty$ et $t \to +\infty$ dans la formule. En écrivant alors le hamiltonien d’interaction comme l’intégrale de sa densité, $\hat H_I(t_1) = \int \mathrm{d}^3x\, \hat{\mathcal H}_I(\mathbf x, t_1)$, chaque intégrale temporelle fusionne avec son intégrale spatiale :

$$ \int_{-\infty}^{+\infty} \mathrm{d}t_1 \int \mathrm{d}^3 x \;=\; \int \mathrm{d}^4 x $$

et le $T$ continue d’ordonner ce qu’il a toujours ordonné, la coordonnée temporelle des points d’espace-temps où les $\hat{\mathcal H}_I$ sont évalués.
D’où $\hat S = T\exp\big(-i\int\mathrm{d}^4x\,\hat{\mathcal H}_I(x)\big)$.

Rq (covariance) : dans la forme $\hat S = T\exp(-i\int\mathrm{d}^4x\,\hat{\mathcal H}_I)$, chaque ingrédient est Lorentz-invariant : $\mathrm{d}^4x$, la densité scalaire $\hat{\mathcal H}_I$, et le $T$ (grâce à la micro-causalité du chapitre précédent qui rendait le produit chronologique non ambigu hors du cône). La théorie des perturbations est ainsi bien relativiste ordre par ordre.

note

La série de Dyson est asymptotique, pas convergente. Dyson a même développé un argument expliquant que si elle convergeait, le vide pourrait devenir instable. Moralité, on ne peut qu’utiliser la série tronquée à un ordre fini. Pour l’électrodynamique, cela suffit à obtenir 12 chiffres significatifs…


Le théorème de Wick

Développons $\hat S$ et prenons un élément de matrice : il apparaît des objets du type $\langle f|\, T[\hat{\mathcal H}_I(x_1)\cdots\hat{\mathcal H}_I(x_n)]\,|i\rangle$. Comme $\hat{\mathcal H}_I$ est un produit de champs libres (le hamiltonien est une fonction des champs et en représentation d’interaction, les champs obéissent aux équations libres) et que $|i\rangle, |f\rangle$ sont construits par des $\hat a^\dagger$ sur le vide, tout se ramène à des valeurs moyennes dans le vide de produits chronologiques de champs libres. Il faut un mécanisme pour les évaluer : c’est le théorème de Wick.

Rappel : l’ordre normal $N[\hat A]$ range toutes les créations à gauche de toutes les annihilations (ex. : $N[\hat a_{\mathbf p}\hat a^\dagger_{\mathbf q}] = \hat a^\dagger_{\mathbf q}\hat a_{\mathbf p}$). Propriété clé :

$$ \langle 0|\, N[\hat A]\, |0\rangle = 0 $$

pour tout produit normal non trivial (l’annihilation de droite tue le ket, ou la création de gauche tue le bra).

C’est l’ordre normal qui évacuait l’énergie de point zéro (redéfinir le zéro, c’est exactement soustraire la valeur dans le vide).

La contraction de deux champs est l’écart entre ordre chronologique et ordre normal :


La contraction de deux champs est un simple nombre (un multiple de l’identité), pas un opérateur (ce que Dirac appellait un « c-nombre »). Et ce nombre est le propagateur de Feynman :


Séparons le champ en ses deux moitiés, $\hat\phi = \hat\phi_{\mathrm a} + \hat\phi_{\mathrm c}$ :

  • $\hat\phi_{\mathrm a}$ la partie annihilation (les termes en $\hat a_{\mathbf p}\, e^{-ip\cdot x}$)
  • et $\hat\phi_{\mathrm c}$ la partie création (les termes en $\hat a^\dagger_{\mathbf p}\, e^{+ip\cdot x}$).

Prenons $x^0 > y^0$, de sorte que $T\hat\phi(x)\hat\phi(y) = \hat\phi(x)\hat\phi(y)$, et développons les quatre produits :

$\hat\phi_{\mathrm a}\hat\phi_{\mathrm a}$, $\hat\phi_{\mathrm c}\hat\phi_{\mathrm a}$, $\hat\phi_{\mathrm c}\hat\phi_{\mathrm c}$ sont déjà en ordre normal.

Seul $\hat\phi_{\mathrm a}(x)\hat\phi_{\mathrm c}(y)$ (annihilation à gauche d’une création) ne l’est pas. On le remet en ordre par le commutateur :

$$ \hat\phi_{\mathrm a}(x)\,\hat\phi_{\mathrm c}(y) = \hat\phi_{\mathrm c}(y)\,\hat\phi_{\mathrm a}(x) + [\hat\phi_{\mathrm a}(x), \hat\phi_{\mathrm c}(y)], $$

et le commutateur est un simple nombre, déjà calculé au chapitre précédent (seuls les crochets $[\hat a, \hat a^\dagger] = \delta^{(3)}$ survivent) :

$$ [\hat\phi_{\mathrm a}(x), \hat\phi_{\mathrm c}(y)] = \int\widetilde{\mathrm{d}p}\; e^{-ip\cdot(x-y)} = D(x-y). $$

Donc, pour $x^0 > y^0$ : $T\hat\phi\hat\phi = N[\hat\phi\hat\phi] + D(x-y)$. Le cas $y^0 > x^0$ donne de même $D(y-x)$. En recollant les deux avec leurs $\theta$ :

$$ T\,\hat\phi(x)\hat\phi(y) = N\big[\hat\phi(x)\hat\phi(y)\big] + \underbrace{\theta(x^0-y^0)D(x-y) + \theta(y^0-x^0)D(y-x)}_{=\;\Delta(x,y)} $$

Vérification de cohérence : en prenant la valeur moyenne dans le vide, l’ordre normal disparaît et il reste $\langle 0|T\hat\phi\hat\phi|0\rangle = \Delta$ (définition du chapitre précédent).


Théorème de Wick.

Pour des champs libres :

$$ T\big[\hat\phi_1 \cdots \hat\phi_n\big] = N\big[\hat\phi_1\cdots\hat\phi_n\big] + \sum_{\text{1 contraction}} N[\cdots] + \sum_{\text{2 contractions}} N[\cdots] + \cdots $$

Somme sur toutes les façons de contracter des paires, les champs non contractés restant en ordre normal ($\hat\phi_k \equiv \hat\phi(x_k)$, chaque contraction valant $\Delta(x_j, x_k)$).


Esquisse de la démonstration (récurrence)

À l’intérieur d’un $T$, l’ordre d’écriture est libre : renommons pour que $x_1^0$ soit le plus récent, de sorte que $T[\hat\phi_1\cdots\hat\phi_n] = \hat\phi_1\, T[\hat\phi_2\cdots\hat\phi_n]$.

Supposons Wick vrai pour $n-1$ champs et multiplions son développement à gauche par $\hat\phi_1 = \hat\phi_{\mathrm a}(x_1) + \hat\phi_{\mathrm c}(x_1)$ :

  • $\hat\phi_{\mathrm c}(x_1)$ (création) se place à gauche des produits normaux sans rien casser : il s'y intègre.
  • $\hat\phi_{\mathrm a}(x_1)$ (annihilation) doit traverser toutes les parties création $\hat\phi_{\mathrm c}(x_k)$ des produits normaux pour rejoindre sa place à droite ; chaque traversée coûte un commutateur $[\hat\phi_{\mathrm a}(x_1), \hat\phi_{\mathrm c}(x_k)] = D(x_1 - x_k)$. Et comme $x_1^0$ est le plus récent, $D(x_1 - x_k) = \Delta(x_1, x_k)$ : chaque terme restant engendre exactement une contraction de $\hat\phi_1$ avec $\hat\phi_k$.

En collectant : les termes sans commutateur reconstituent les contractions de Wick à $n-1$ champs précédées de $\hat\phi_1$ non contracté ; les termes avec commutateur fournissent toutes les contractions impliquant $\hat\phi_1$. C’est l’énoncé à $n$ champs.


Exemple : développement complet pour quatre champs bosoniques.

On pose $\hat\phi_k \equiv \hat\phi(x_k)$ :

soit $1 + \binom{4}{2} + 3 = 10$ termes : zéro contraction (un terme), une contraction ($\binom{4}{2} = 6$ façons de choisir la paire contractée), deux contractions (les $3$ appariements complets).

Deux remarques :

  • chaque crochet est un simple nombre (théorème ci-dessus) : on pourra le sortir devant le produit normal restant et l'évaluer (ce qu'on fera à la suite du corollaire) ;
  • contracter deux champs non adjacents (crochet qui enjambe, par exemple $\hat\phi_1$–$\hat\phi_3$) ne pose aucun problème pour des bosons car tout se réordonne librement. Pour des fermions, chaque enjambement coûterait un signe $(-1)$.

Corollaire (celui qu’on utilise en pratique)

Dans le vide, seuls survivent les termes complètement contractés :

$$ \langle 0|\, T\big[\hat\phi_1\cdots\hat\phi_n\big]\, |0\rangle = \sum_{\text{appariements\\complets}}\; \prod_{\text{paires} \\ (j,k)} \Delta(x_j, x_k) $$

  • nul si $n$ est impair ;
  • pour $n$ pair, la somme compte $(n-1)!! = (n-1)(n-3)\cdots 3\cdot 1$ termes.

Tout terme de Wick contenant un produit normal non trivial meurt dans le vide ($\langle 0|\,N[\cdots]\,|0\rangle = 0$).
Ne restent que les termes où tous les champs sont appariés (impossible si $n$ est impair).
Comptage : $\hat\phi_1$ choisit son partenaire parmi $n-1$ champs, puis le premier champ restant parmi $n-3$, etc.


Retour à l’exemple à quatre champs :

Dans le développement ci-dessus, les sept premiers termes contiennent un $N[\cdots]$ et meurent dans le vide ; survivent les trois termes complètement contractés, $(4-1)!! = 3$ appariements :

Et chaque crochet s’évalue par le théorème de la contraction (crochet sur $\hat\phi_j$ et $\hat\phi_k$ $= \Delta(x_j, x_k)$), d’où le résultat en propagateurs de Feynman :

$$ \langle 0|T\big[\hat\phi_1\hat\phi_2\hat\phi_3\hat\phi_4\big]|0\rangle = \Delta(x_1,x_2)\Delta(x_3,x_4) + \Delta(x_1,x_3)\Delta(x_2,x_4) + \Delta(x_1,x_4)\Delta(x_2,x_3) $$

Lecture physique : la naissance des diagrammes.
Chaque appariement complet est une façon de câbler le processus : chaque paire contractée est une propagation d’un point à un autre, et le corollaire dit qu’une amplitude est la somme sur tous les câblages possibles de produits de propagateurs.
Dessinez chaque câblage (un point par $x_k$, un trait par $\Delta$) et vous avez un diagramme de Feynman : le chapitre suivant n’est que la codification de ce geste (avec les vertex qu’apportent les $\hat{\mathcal H}_I(x)$, et les facteurs de symétrie qui comptent les câblages équivalents).


Bilan

$\displaystyle |S_{fi}|^2 \;\longleftarrow\; S_{fi} = \Big\langle f \Big|\, T e^{-i\int \mathrm{d}^4x\, \hat{\mathcal H}_I}\, \Big| i \Big\rangle \;\longleftarrow\; \text{développer en puissances de } \hat{\mathcal H}_I\;\longleftarrow\; \langle 0|\, T\big[\text{champs libres}\big]\, |0\rangle \;\overset{\text{Wick}}{\longleftarrow}\; \sum_{\text{câblages}} \prod \Delta \;\longleftarrow\; \text{diagrammes (chapitre suivant)} $

Chaque maillon a son théorème : Dyson pour le deuxième, Wick pour l’avant-dernier. Et chaque ingrédient ($\Delta$, la micro-causalité qui rend $T$ covariant, les champs libres) vient des chapitres précédents.


Pièges

  • Le $T$ n'est pas décoratif : $[\hat H_I(t_1), \hat H_I(t_2)] \neq 0$, l'ordre des facteurs compte, et c'est l'itération de l'équation intégrale qui l'impose.
  • En représentation d'interaction, les champs sont libres : ne pas les confondre avec les champs de Heisenberg de la théorie complète (qui, eux, portent l'interaction).
  • L'ordre normal n'est pas gratuit : c'est une redéfinition du zéro d'énergie (la même qui évacuait l'énergie du vide).
  • La série est asymptotique : tronquer est la règle, pas un pis-aller provisoire.
  • L'hypothèse asymptotique (interaction « éteinte » à $t = \pm\infty$) est le tapis sous lequel dorment les états liés et l'habillage des particules (rendez-vous à la renormalisation).

Les diagrammes de Feynman

Le chapitre précédent a détaillé la stratégie pour obtenir les amplitudes de transition entre états asymptotiques initiaux et finaux : on développe $\hat S = T e^{-i\int \hat{\mathcal H}_I}$ en puissances de l’interaction, puis le théorème de Wick réduit chaque terme à des produits de propagateurs.
Ce chapitre exécute la chaîne sur un exemple ($\phi^4$), constate que chaque terme se dessine, puis renverse la logique : une fois les règles de Feynman extraites, on ne développe plus jamais rien, on dessine les diagrammes et on écrit directement l’intégrale que chacun représente.

Lire un dessin avant de savoir le calculer

Convention : le temps monte le long de la page. Une particule est une ligne dont la flèche suit le temps, une antiparticule une ligne dont la flèche le remonte (c’est la traduction graphique de l’interprétation de Feynman des antiparticules). La flèche suit le flot de charge, pas le mouvement.

On peut dessiner des paires créées ou annihilées, et raconter des histoires : une ligne qui semble « boucler en arrière dans le temps » se lit, en survolant le dessin dans l’ordre chronologique, comme création d’une paire à $t_1$, puis annihilation de l’antiparticule créée avec une autre particule à $t_2$. Les particules étant identiques, personne ne peut distinguer les deux lectures.

Le bestiaire des interactions

Les hamiltoniens d’interaction sont des produits de champs libres localisés en un même point $z$. L’interaction sera lue comme une collision des particules au point d’espace-temps $z$, et le $\int\mathrm{d}^4z$ de la série de Dyson dit que la collision peut avoir lieu partout (on somme sur toutes les positions du vertex : Huygens version interaction).

Quatre modèles :

  • Source externe : $\hat{\mathcal H}_I(z) = J(z)\hat\phi(z)$
    Un blob $J$ d'où sort une patte de champ :
  • Auto-interaction $\phi^4$ : $\hat{\mathcal H}_I(z) = \dfrac{\lambda}{4!}\hat\phi(z)^4$
    Quatre pattes de champ se rencontrent en $z$ (le $4!$ est là pour simplifier les facteurs de symétrie, voir plus bas) :
  • Type Yukawa : $\hat{\mathcal H}_I(z) = g,\hat\psi^\dagger(z)\hat\psi(z)\hat\phi(z)$, $\hat\psi$ complexe
    Un $\psi$ (flèche entrante), un $\psi^\dagger$ (flèche sortante) et un $\phi$ se rencontrent en $z$. Même structure que QED ($\psi \to$ électron, $\phi \to$ photon)1.

  • Coulomb non relativiste : $\hat{\mathcal H}_I(x-y) = \tfrac12 \hat\psi^\dagger(\mathbf x)\hat\psi^\dagger(\mathbf y) V(\mathbf x - \mathbf y)\,\delta(x^0 - y^0)\,\hat\psi(\mathbf y)\hat\psi(\mathbf x)$
    Délocalisée mais instantanée (le $\delta$ sur les temps) :

$\phi^4$

Théorie de travail :

$$ \mathcal L = \frac{1}{2}\big[\partial_\mu\phi(x)\big]^2 - \frac{m^2}{2}\phi(x)^2 - \frac{\lambda}{4!}\phi(x)^4, $$

La partie libre donne $\hat H_0$ par quantification canonique, et la partie interagissante $\hat{\mathcal H}_I = \dfrac{\lambda}{4!}\hat\phi(x)^4$.

On travaille en représentation d’interaction (chapitre précédent) : les champs $\hat\phi$ évoluent librement (tout l’attirail des modes et le propagateur $\Delta$ restent valables).


Choisir l’élément de matrice et l’écrire en valeur moyenne dans le vide

Exemple : une particule entre avec l’impulsion $\mathbf p$, une particule sort avec $\mathbf q$. Avec la normalisation relativiste $|p\rangle = (2\pi)^{3/2}(2E_{\mathbf p})^{1/2}\, \hat a^\dagger_{\mathbf p}|0\rangle$ :

$$ \mathcal A = {}^{\text{out}}\langle q|p\rangle^{\text{in}} = \langle q|\hat S|p\rangle = (2\pi)^3 (2E_{\mathbf q})^{\frac12}(2E_{\mathbf p})^{\frac12}\; \langle 0|\, \hat a_{\mathbf q}\, \hat S\, \hat a^\dagger_{\mathbf p}\, |0\rangle $$

Tout est ramené au vide : c’est la condition d’application du corollaire de Wick.
Le facteur de normalisation s’expliquera dans la suite.


Développer $\hat S$ par Dyson

$ \hat S = T\exp\Big(-i\int\mathrm{d}^4z\, \hat{\mathcal H}_I(z)\Big) = T\bigg[ 1 - \frac{i\lambda}{4!}\int\mathrm{d}^4z\, \hat\phi(z)^4 + \frac{(-i)^2}{2!}\Big(\frac{\lambda}{4!}\Big)^2 \int\mathrm{d}^4y\,\mathrm{d}^4w\, \hat\phi(y)^4\hat\phi(w)^4 + \cdots \bigg] $


Injecter dans l’élément de matrice

$\mathcal A = \mathcal A^{(0)} + \mathcal A^{(1)} + \mathcal A^{(2)} + \cdots$, où $\mathcal A^{(n)} \propto \lambda^n$ : la série est ordonnée par le nombre de collisions.


Moudre avec Wick

À l’ordre $1$, il faut $\langle 0|\hat a_{\mathbf q}\, \hat\phi(z)\hat\phi(z)\hat\phi(z)\hat\phi(z)\, \hat a^\dagger_{\mathbf p}|0\rangle$ : une chaîne de six opérateurs, que Wick réduit à des appariements complets2. Deux familles :

  • Famille A (les $\hat a$ entre eux, les $\hat\phi$ entre eux) : $\langle 0|\hat a_{\mathbf q}\hat a^\dagger_{\mathbf p}|0\rangle\,\langle 0|T\hat\phi\hat\phi|0\rangle\,\langle 0|T\hat\phi\hat\phi|0\rangle$.
    Comptage : apparier $4$ champs deux à deux $= 3$ façons.
    Exemple de représentant de la famille :
  • Famille B ($\hat a$ contractés avec des $\hat\phi$) : $\langle 0|\hat a_{\mathbf q}\hat\phi(z)|0\rangle\,\langle 0|T\hat\phi\hat\phi|0\rangle\,\langle 0|\hat\phi(z)\hat a^\dagger_{\mathbf p}|0\rangle$.
    Comptage : $4$ pattes pour $\hat a^\dagger_{\mathbf p}$, puis $3$ pour $\hat a_{\mathbf q}$ $= 12$ façons.
    Exemple de représentant de la famille :

D’où le premier ordre :

$ \mathcal A^{(1)} = -\frac{i\lambda}{4!}\int\mathrm{d}^4z\,\Big[ 3\,\langle 0|\hat a_{\mathbf q}\hat a^\dagger_{\mathbf p}|0\rangle\, \langle 0|T\hat\phi\hat\phi|0\rangle \, \langle 0|T\hat\phi\hat\phi|0\rangle + 12\,\langle 0|\hat a_{\mathbf q}\hat\phi(z)|0\rangle\, \langle 0|T\hat\phi\hat\phi|0\rangle \, \langle 0|\hat\phi(z)\hat a^\dagger_{\mathbf p}|0\rangle \Big] $

Il reste à évaluer les contractions externes en suivant les règles de conversion :

  • Champ–champ — le propagateur (cf. chapitre précédent>ici) :
  • Champ–état initial — une onde entrante :
  • Champ–état final — une onde sortante :
  • Initial–final — rien ne s'est passé :

Démonstration de la deuxième, par le développement en modes et $[\hat a_{\mathbf q}, \hat a^\dagger_{\mathbf p}] = \delta^{(3)}(\mathbf q - \mathbf p)$ :

$\displaystyle \langle 0|\hat\phi(z)\hat a^\dagger_{\mathbf p}|0\rangle = \int \frac{\mathrm{d}^3q}{(2\pi)^{3/2}(2E_{\mathbf q})^{1/2}}\, \langle 0|\big(\hat a_{\mathbf q}e^{-iq\cdot z} + \hat a^\dagger_{\mathbf q}e^{iq\cdot z}\big)\hat a^\dagger_{\mathbf p}|0\rangle = \int \frac{\mathrm{d}^3q}{(2\pi)^{3/2}(2E_{\mathbf q})^{1/2}}\, e^{-iq\cdot z}\,\delta^{(3)}(\mathbf q - \mathbf p) = \frac{e^{-ip\cdot z}}{(2\pi)^{3/2}(2E_{\mathbf p})^{1/2}} $

Seul $\hat a\hat a^\dagger$ survit et $\hat a\hat a^\dagger = \hat a^\dagger \hat a + [\hat a, \hat a^\dagger]$, puis le $\delta^{(3)}$ épingle $\mathbf q = \mathbf p$.

Remarque : les facteurs $\frac{1}{(2\pi)^{3/2}}\frac{1}{(2E_{\mathbf p})^{1/2}}$ de la contraction compensent exactement la normalisation relativiste $(2\pi)^{3/2}(2E_{\mathbf p})^{1/2}$ des états. Au total, la contraction « champ sur état » vaut $\hat\phi(z)|p\rangle \to e^{-ip\cdot z}$, une onde plane nue. C’est la raison même du facteur de normalisation devant $\langle 0|\, \hat a_{\mathbf q}\, \hat S\, \hat a^\dagger_{\mathbf p}\, |0\rangle$.

Que donne l’ordre 1 finalement ?

$\displaystyle \mathcal A^{(1)}_A = -\frac{i\lambda}{8} (2\pi)^3(2E_{\mathbf p}) \, \delta^{(3)}(\mathbf q - \mathbf p) \int\mathrm{d}^4z \left( \int \frac{\mathrm{d}^4k}{(2\pi)^4} \frac{i}{k^2 - m^2 + i\epsilon} \right)^{\!2} $

Dans la famille A, la particule traverse sans interagir avec le champ. L’intégrande sur $\mathrm{d}^4z$ est indépendant de $z$ (les fluctuations du vide sont homogènes). L’intégration génère donc un volume infini de l’espace-temps. Physiquement, ces termes de vide se factoriseront et disparaîtront lors de la normalisation de la matrice $\hat S$.

Dans la famille B, la particule interagit réellement avec le champ :

$\displaystyle \mathcal A^{(1)}_B = \frac{(-i\lambda)}{2}\int\mathrm{d}^4z\, \frac{\mathrm{d}^4k}{(2\pi)^4}\, e^{i(q-p)\cdot z}\, \frac{i}{k^2 - m^2 + i\varepsilon} = (2\pi)^4\delta^{(4)}(q-p)\, \frac{(-i\lambda)}{2}\int\frac{\mathrm{d}^4k}{(2\pi)^4}\frac{i}{k^2 - m^2 + i\varepsilon} $

La particule entre, interagit en un point avec une fluctuation du vide (la boucle paramétrée par $k$), et repart avec la même impulsion quadridimensionnelle ($q = p$).
On remarque que l’intégrale résiduelle sur $\mathrm{d}^4k$ diverge violemment pour les grandes impulsions (divergence ultraviolette). Ce “problème” sera réglé grâce à la renormalisation.


Dessiner

Chaque vertex $\hat{\mathcal H}_I(z)$ est une petite bestiole dont les pattes sont les champs. Les contractions de Wick câblent les pattes : entre elles (propagateurs, lignes internes) ou vers les particules externes (lignes entrantes/sortantes).

Expérimentons sur la famille B : on pose le vertex en $z$ avec ses quatre pattes ; la contraction champ–état initial attrape une patte et en fait la ligne entrante ; la contraction champ–champ noue deux pattes entre elles formant une boucle ; la contraction champ–état final attrape la patte restante et sort du dessin.

Résultat : le diagramme “boucle” de la famille B.
La famille A, elle, devient un diagramme déconnecté : la ligne directe $\delta^{(3)}(\mathbf q - \mathbf p)$ d’un côté, un « huit » de vide de l’autre.


Anatomie d’un diagramme

  • Un diagramme connexe est un morceau d’un seul tenant ; un diagramme déconnecté en assemble plusieurs. Des processus déconnectés ne peuvent pas s’influencer. L’intuition dit (et la suite confirmera) qu’on ne devra garder que les connexes3.

  • Les lignes externes ont une extrémité libre : la connexion au monde extérieur (particules réelles, sur couche, entrantes en bas, sortantes en haut).

  • Les lignes internes relient deux vertex : particules virtuelles, hors couche.

  • Un diagramme du vide n’a aucune ligne externe : il ne touche pas aux particules, ne contribue qu’à $\langle 0|\hat S|0\rangle$, donc seulement à une phase globale $e^{i\phi}$ des amplitudes, invisible dans les probabilités.

Planche anatomique d’un diagramme déconnecté d’ordre 3 :

Le renversement final : connaissant la correspondance dessins ↔ contractions, on n’a plus jamais besoin de développer ; on dessine, puis on traduit :

Règles de Feynman de $\phi^4$ en espace des positions :

  • Chaque vertex contribue un facteur $-i\lambda$.
  • Chaque ligne interne apporte un propagateur $\Delta(x-y)$ où $x$ et $y$ sont le départ et l'arrivée de la ligne.
  • Une ligne externe entrante contribue une onde entrante $\mathrm{e}^{-\mathrm{i}p\cdot x}$ et une ligne externe sortante contribue une onde sortante $\mathrm{e}^{-\mathrm{i}p\cdot x}$ pour ligne sortante
  • Intégrer les positions des vertex sur tout l'espace-temps.
  • Diviser par le facteur de symétrie $D$.

Les facteurs de symétrie

Le nombre $D$ par lequel on divise vient du comptage des contractions qui produisent le même dessin.

Règle générale : s’il y a $m$ façons d’arranger vertex et propagateurs donnant des parties identiques du diagramme (extrémités des lignes externes fixées, sans couper de propagateur), on récolte un facteur $D_i = m$, et $D = \prod_i D_i$.

Deux cas particuliers à connaître par cœur :

  • chaque propagateur dont les deux bouts rejoignent le même vertex (une boucle) : $D_i = 2$ ;
  • chaque paire de vertex directement reliés par $n$ propagateurs : $D_i = n!$.

Exemples :

  1. Ligne traversée d'une seule boucle : un propagateur dont les deux bouts rejoignent le même vertex, $D = 2$. (Les extrémités des lignes externes sont fixées : rien d'autre à compter.)
  2. Deux boucles en série sur la ligne : chaque boucle apporte un $2$, $D = 2\times 2 = 4$. Les diagrammes (a) et (b) sont des self-énergies : des propagateurs libres décorés de boucles, qui n'interagissent avec rien d'autre. On verra qu'ils ne font que déplacer les constantes du propagateur (« renormaliser »).
  3. Le « double huit » du vide (deux boucles accrochées au même vertex) : $2$ par boucle, et l'échange des deux bulles (rotation de $180°$ autour de l'axe horizontal) redonne le même dessin, d'où un $m = 2$ supplémentaire : $D = 2\times 2\times 2 = 8$.
  4. Saturne : une paire de vertex directement reliés par trois propagateurs, $D = 3! = 6$.
  5. Une boucle ($2$) et une paire de vertex reliés par deux lignes ($2!$) : $D = 2\times 2! = 4$.
  6. Trois vertex en chaîne, à voir comme deux paires (le vertex central compté dans chacune), chaque paire reliée par deux lignes : $D = 2!\times 2! = 4$.
  7. Une bulle quelque part sur le dessin : $D = 2$.
  8. Deux bulles ($2\times 2$), plus l'échange des parties gauche et droite entre les deux vertex : $D = 2\times 2\times 2 = 8$.
  9. Une paire de vertex reliés par deux lignes : $D = 2! = 2$.

(D’autres théories que $\phi^4$ auront des règles de comptage légèrement différentes.) Ces facteurs ne changent pas la physique d’un diagramme isolé, mais deviennent indispensables dès qu’on somme plusieurs diagrammes.

D'où sort le $D = 6$ de Saturne ?

Ordre $2$ : préfacteur $\dfrac{1}{2!}\Big(\dfrac{1}{4!}\Big)^{\!2}$ et huit champs ($4$ pattes au vertex $y$, $4$ au vertex $w$).
Comptons les contractions qui dessinent Saturne : choisir le vertex qui accueille la ligne entrante ($2$ façons puisque les vertex sont interchangeables), la patte qui la reçoit ($4$), la patte de l’autre vertex pour la ligne sortante ($4$), puis apparier les $3$ pattes restantes de chaque côté ($3!$) : au total $2 \times 4 \times 4 \times 3! = 192$ contractions identiques. D’où le coefficient

$$ \frac{1}{2!}\Big(\frac{1}{4!}\Big)^2 \times 192 = \frac{192}{1152} = \frac{1}{6} = \frac{1}{D}. $$

Moralité : le $4!$ du préfacteur et le $n!$ de Dyson compensent presque tout le comptage (c’est leur raison d’être) et le résidu $D$ mesure les symétries internes du dessin que rien ne distingue.


L’espace des impulsions : le diagramme de Saturne

À l’ordre $\lambda^2$, le théorème de Wick produit toute une galerie de câblages : lignes décorées de boucles, morceaux de vide, et un diagramme à deux vertex reliés par trois propagateurs appelé « Saturne ».

Prenons le terme du deuxième ordre $O(\lambda^2)$ dans l’expansion de $\langle q| \hat{S}|p\rangle$ :

$$ \begin{aligned} \hat{S}^{(2)} &=\frac{(-\mathrm{i})^2}{2!} \int \mathrm{d}^4 y \mathrm{~d}^4 w \hat{\mathcal{H}}_{\mathrm{I}}(y) \hat{\mathcal{H}}_{\mathrm{I}}(w)\\ &= \frac{(-\mathrm{i} \lambda)^2}{2!(4!)^2} \int \mathrm{~d}^4 y \mathrm{~d}^4 w \hat{\phi}(y) \hat{\phi}(y) \hat{\phi}(y) \hat{\phi}(y) \hat{\phi}(w) \hat{\phi}(w) \hat{\phi}(w) \hat{\phi}(w) \end{aligned} $$

On applique maintenant le théorème de Wick pour obtenir les différents diagrammes. Celui qui nous intéresse est donné par le terme :

Avec une patte entrante sur le vertex $w$, une sortante sur le vertex $y$, et les trois pattes restantes de chaque côté nouées deux à deux. Cela donne une onde entrante en $w$, une sortante en $y$ et trois propagateurs $\Delta(y-w)$) Et comme on l’a vu, $D=6$.

L’amplitude pour le diagramme de Feynman Saturne est donc donnée par :

$$ -\frac{\lambda^2}{6} \int \mathrm{~d}^4 y \mathrm{~d}^4 w \, \mathrm{e}^{\mathrm{i} q \cdot y} \Delta(y-w)^3 \mathrm{e}^{-\mathrm{i} p \cdot w} $$

Passage maintenant en espace des impulsions, pas à pas.

Chaque propagateur s’écrit $\Delta(y-w) = \displaystyle\int\frac{\mathrm{d}^4k}{(2\pi)^4}\, e^{-ik\cdot(y-w)}\,\frac{i}{k^2 - m^2 + i\varepsilon}$ : trois impulsions muettes $k_1, k_2, k_3$.

On regroupe toutes les exponentielles :

$$ \int\mathrm{d}^4y\; e^{i(q - k_1 - k_2 - k_3)\cdot y} = (2\pi)^4\delta^{(4)}(k_1 + k_2 + k_3 - q) $$

Et après le premier delta :

$$ \int\mathrm{d}^4w\; e^{i(k_1 + k_2 + k_3 - p)\cdot w} = (2\pi)^4\delta^{(4)}(q - p) $$

Lecture physique des deltas :
intégrer la position d’un vertex sur tout l’espace-temps fabrique un delta de conservation de la quadri-impulsion à ce vertex. C’est la dualité de Fourier position/impulsion en action. Le second delta est la conservation globale, que tout diagramme trimballe. Le delta du vertex $y$ épingle $k_1 = q - k_2 - k_3$, et il reste :

$$ \text{Saturne} = -\frac{\lambda^2}{6}(2\pi)^4\delta^{(4)}(q-p) \int\frac{\mathrm{d}^4k_2}{(2\pi)^4}\frac{\mathrm{d}^4k_3}{(2\pi)^4}\, \frac{i}{[(q - k_2 - k_3)^2 - m^2 + i\varepsilon]}\, \frac{i}{(k_2^2 - m^2 + i\varepsilon)}\, \frac{i}{(k_3^2 - m^2 + i\varepsilon)}. $$

Même nombre d’intégrales qu’en position, mais plus aucune exponentielle : c’est pour cela qu’on calcule en espace des impulsions.

Les règles de Feynman de $\phi^4$ en espace des impulsions

Règles de Feynman de $\phi^4$ en espace des impulsions :

  • chaque vertex : un facteur $-i\lambda$ ;
  • chaque ligne interne, étiquetée par une impulsion $q$ : un propagateur $\dfrac{i}{q^2 - m^2 + i\varepsilon}$ ;
  • imposer la conservation de la quadri-impulsion à chaque vertex ;
  • intégrer les impulsions internes non contraintes avec la mesure $\dfrac{\mathrm{d}^4q}{(2\pi)^4}$ ;
  • chaque ligne externe : un facteur $1$ (en espace des impulsions, la contraction champ–état se réduit à $1$ grâce à la normalisation relativiste) ;
  • diviser par le facteur de symétrie $D$ ;
  • inclure le $\boldsymbol{(2\pi)^4\delta^{(4)}}$ global de conservation.

Les lignes externes ne portent pas de propagateur. Et on n’intègre que les impulsions dont les deltas n’ont pas déjà fixées (au moindre doute : mettre un delta par vertex et intégrer tout).

Pour s’entraîner, calculons les contributions à $\langle|\hat S|p\rangle$ des 3 diagrammes ci-dessus :

  1. Ligne + une boucle :
    $\displaystyle \dfrac{(-i\lambda)}{2}\displaystyle\int\frac{\mathrm{d}^4k}{(2\pi)^4}\frac{i}{k^2 - m^2 + i\varepsilon}$
  2. Ligne + boucle, accompagnées d'un « huit » du vide :
    le même facteur $\displaystyle\times\, \dfrac{(-i\lambda)}{8}\displaystyle\int\frac{\mathrm{d}^4k_1}{(2\pi)^4}\frac{\mathrm{d}^4k_2}{(2\pi)^4}\frac{i}{(k_1^2 - m^2 + i\varepsilon)}\frac{i}{(k_2^2 - m^2 + i\varepsilon)}$
    Le vide se factorise !
  3. Deux boucles en série sur la ligne :
    $\displaystyle \dfrac{(-i\lambda)^2}{4}\displaystyle\int\frac{\mathrm{d}^4k_1}{(2\pi)^4}\frac{\mathrm{d}^4k_2}{(2\pi)^4}\frac{i}{(k_1^2 - m^2 + i\varepsilon)}\,\frac{i}{(p^2 - m^2 + i\varepsilon)}\,\frac{i}{(k_2^2 - m^2 + i\varepsilon)}$
    Noter la ligne interne d'impulsion $p$ entre les deux vertex ;

Les deux premiers types sont des diagrammes de self-énergie : des propagateurs libres décorés de boucles, qui n’interagissent avec rien d’autre. On verra qu’ils ne font que déplacer les constantes du propagateur libre (dans le jargon, ils « renormalisent le propagateur »).


Première diffusion : deux particules entrent, deux sortent

Jusque-là, on s’est occupé de diagrammes décrivant une seule particule. Et si deux particules entrent puis sortent ? L’amplitude devient :

$$ \langle q_1 q_2|\hat S|p_2 p_1\rangle = (2\pi)^6\big(16 E_{\mathbf p_1}E_{\mathbf p_2}E_{\mathbf q_1}E_{\mathbf q_2}\big)^{\frac12}\, \langle 0|\hat a_{\mathbf q_1}\hat a_{\mathbf q_2}\, \hat S\, \hat a^\dagger_{\mathbf p_2}\hat a^\dagger_{\mathbf p_1}|0\rangle. $$

Plus besoin de contractions : on dessine et on traduit.

note

On n’a pas encore dit comment faire ces intégrales — parce que beaucoup divergent ! Apprivoiser ces infinis révèle une grande part de la physique cachée de la théorie des champs (renormalisation, ch. 32 du livre) ; certaines intégrales convergent, et le chapitre suivant en tire déjà de la physique mesurable.


Bilan

Le processus complet pour obtenir les amplitudes :


Pièges


Théorie de la diffusion

Les chapitres précédents ont construit la machinerie nécessaire pour déterminer une amplitude : propagateurs, matrice $S$, théorème de Wick, diagrammes. Ce chapitre utilise cette machinerie sur une expérience. Trois parties :


La théorie $\psi^\dagger\psi\phi$, doublure de la QED

Deux champs : $\hat\psi$ complexe (les « psions », masse $m$, avec leurs antiparticules) et $\hat\phi$ réel (les « phions », masse $\mu$) :

$$ \mathcal L = \partial^\mu\psi^\dagger\partial_\mu\psi - m^2\psi^\dagger\psi + \frac{1}{2}(\partial_\mu\phi)^2 - \frac{1}{2}\mu^2\phi^2 - g\,\psi^\dagger\psi\phi. $$

L’interaction est $\mathcal L_I = -g\psi^\dagger\psi\phi$, donc $\hat{\mathcal H}_I(z) = +\,g\,\hat\psi^\dagger(z)\hat\psi(z)\hat\phi(z)$4.

En QED, l’électron est l’excitation d’un champ complexe et le photon celle d’un champ de jauge, couplés par un vertex à trois pattes. Ici, le psion joue l’électron (scalaire, bosonique) et le phion joue un photon massif scalaire $\to$ même structure de vertex, mêmes canaux, mêmes gestes de calcul, sans la machinerie des spins. Tout ce qui suit est une répétition générale de QED.

Rappels : on note $E_{\mathbf p} = (\mathbf p^2 + m^2)^{1/2}$ pour les psions et $\omega_{\mathbf q} = (\mathbf q^2 + \mu^2)^{1/2}$ pour les phions (pour ne pas confondre avec le $i\varepsilon$ des propagateurs) :

Deux conséquences du vertex à trois pattes :


Le dictionnaire des contractions

La règle de lecture qui engendre tout le dictionnaire : une contraction externe est non nulle si et seulement si le champ contient l’opérateur conjugué de celui de l’état. Il faut que quelqu’un détruise ce qui a été créé. Et on a toujours pour les exponentielles : $e^{-ip\cdot x}$ = quelque chose entre, $e^{+ip\cdot x}$ = quelque chose sort.

Les contractions non nulles de la théorie :

Les deux propagateurs (lignes internes) :

Psion entrant / sortant (la contraction entre $\hat\psi$ et $\hat a$ détruit ce que celle entre $\hat a^{\dagger}_{\mathbf p}$ a créé, et celle entre $\hat\psi^\dagger$ et $\hat a^{\dagger}$ crée ce que $\hat a_{\mathbf p}$ va détruire) :

Antipsion entrant / sortant (c’est $\hat\psi^\dagger$ qui reçoit l’antipsion entrant, et $\hat\psi$ qui l’expédie) :

Phion entrant / sortant :

Toutes les autres contractions sont nulles (par exemple $\hat\psi$ avec $\hat\psi$ : personne n’y détruit ce que l’autre crée).

On peut vérifier chacune de ces contractions comme on l’a fait au chapitre précédent (développement en modes, $[\hat a, \hat a^\dagger] = \delta^{(3)}$, le delta épingle l’impulsion).


Premières récoltes : le têtard et l’huître

note

Convention d’étiquetage pour toute la suite : entrées $p, k$, sorties $p’, k’$, la lettre $q$ restant réservée aux impulsions des lignes internes.

Calculons $\mathcal A = \langle p’|\hat S|p\rangle$ (un psion entre avec $p$, un psion sort avec $p’$). Le premier ordre est nul (le $\hat\phi$ orphelin) ; à l’ordre $2$, la chaîne à digérer est $\langle 0|\hat a_{\mathbf p’}\,\hat\psi^{\dagger}(y)\hat\psi(y)\hat\phi(y)\,\hat\psi^{\dagger}(w)\hat\psi(w)\hat\phi(w)\,\hat a^{\dagger}_{\mathbf p}|0\rangle$.

Premier câblage :

Lecture : le psion traverse le vertex $y$ en émettant un phion, lequel aboutit au vertex $w$ où une boucle de psion se referme sur elle-même. Ce diagramme est baptisé le têtard5.
Intuition de sa valeur : la boucle $\hat\psi^\dagger(w)\hat\psi(w)$ au même point mesure la densité de psions dans l’état fondamental $\to$ nulle dans le vide, d’où un diagramme nul ici.

note

En matière condensée, où l’état fondamental est peuplé, les têtards vivent très bien.

Deuxième câblage :

Lecture : le psion entre en $y$, émet un phion virtuel, continue, et le réabsorbe en $w$. On obtient l’huître, première self-énergie de la théorie. Par les règles (voir plus bas), son amplitude vaut

$$ \mathcal A_{\text{huître}} = (-ig)^2 \int \frac{\mathrm{d}^4k}{(2\pi)^4}\, \frac{i}{(k^2 - \mu^2 + i\varepsilon)}\, \frac{i}{[(p-k)^2 - m^2 + i\varepsilon]}\, (2\pi)^4\delta^{(4)}(p’ - p) $$

Il existe aussi deux câblages déconnectés (la ligne directe $\hat a_{\mathbf p’}\hat a^{\dagger}_{\mathbf p}$ accompagnée d’un morceau de vide à deux vertex). Même sort qu’au chapitre précédent : ils ne contribueront pas.

Les flèches :

Ces flèches ne représentent pas l’impulsion mais le flot du nombre de particules conservé (le courant de Noether de la symétrie $U(1)$, $\hat Q = \int\mathrm{d}^3p\,(\hat n^{(a)}_{\mathbf p} - \hat n^{(b)}_{\mathbf p})$ (« flèche = flot de charge ») : un psion entrant augmente le nombre, ligne qui rentre ; un antipsion entrant le diminue, ligne qui sort.
Conséquence : un antipsion a son impulsion opposée à son flot de nombre (d’où l’astuce de dessiner des flèches d’impulsion séparées à côté des lignes pour y voir plus clair).


La grammaire des processus : les canaux $t$, $u$, $s$

Faisons maintenant interagir deux particules.

Deux psions entrent, deux sortent. L’élément à calculer est $\langle p’ k’|\hat S|k\, p\rangle$ (normalisations sous-entendues). Premier ordre nul (trois pattes pour quatre clients). À l’ordre $2$, premier câblage :

Lecture : chaque psion traverse son vertex, et les deux vertex s’échangent un phion virtuel (un psion émet un quantum de force, l’autre l’encaisse, les deux repartent déviés). C’est le processus en canal $t$.

Second câblage, mêmes ingrédients, sorties permutées :

C’est le canal $u$ : identique au canal $t$ à l’échange près des particules finales. Les psions étant indiscernables, personne ne peut dire laquelle des deux sorties vient de laquelle des entrées : on additionne donc les amplitudes $t$ et $u$ (c’est l’indiscernabilité quantique en action).

Psion contre antipsion. Entrées : psion $p$, antipsion $\bar k$ ; sorties : psion $p’$, antipsion $\bar k’$. L’élément est $\langle p’\bar k’|\hat S|\bar k\, p\rangle = \langle 0|\hat b_{\mathbf k’}\hat a_{\mathbf p’}\,\hat S\,\hat a^{\dagger}_{\mathbf p}\hat b^{\dagger}_{\mathbf k}|0\rangle$) : le câblage type canal $t$ existe toujours (avec des lignes d’antipsions à flèches descendantes), mais une possibilité nouvelle se révèle :

Lecture : au vertex $w$, le psion et l’antipsion entrants s’annihilent en un phion virtuel, qui se rematérialise au vertex $y$ en une nouvelle paire. C’est le canal $s$. Les antiparticules rendent possible la disparition de la matière en force pure avant renaissance.

Qui s’additionne avec quoi ?


Règles de Feynman de la théorie $\psi^\dagger\psi\phi$ (espace des impulsions) :

  • chaque vertex : un facteur $-ig$ ;
  • chaque ligne interne de phion d'impulsion $q$ : $\dfrac{i}{q^2 - \mu^2 + i\varepsilon}$ ; chaque ligne interne de psion : $\dfrac{i}{q^2 - m^2 + i\varepsilon}$ ;
  • intégrer les impulsions non déterminées par la conservation ;
  • lignes externes : facteur $1$ ;
  • tous les facteurs de symétrie valent $1$ ;
  • un $(2\pi)^4\delta^{(4)}$ global de conservation par diagramme.

Application aux trois canaux (l’impulsion du phion interne est entièrement fixée par la conservation aux vertex $\to$ rien à intégrer) :

$$ \mathcal A^{(2)} = (-ig)^2\, \frac{i}{q^2 - \mu^2 + i\varepsilon}\, (2\pi)^4\delta^{(4)}\Big(\sum p_{\text{f}} - \sum p_{\text{i}}\Big), $$

où $q$ est l’impulsion du phion échangé.

D’où les trois cas, en notant $p, k$ les entrées et $p’, k’$ les sorties :

  • canal $t$ : $q = p' - p$, et $q^2 = (p'-p)^2 \equiv t$ (l'impulsion transférée) ;
  • canal $u$ : $q = p' - k$, et $q^2 = (p'-k)^2 \equiv u$ (le transfert croisé) ;
  • canal $s$ : $q = p + k$ (les deux entrées fusionnent), et $q^2 = (p+k)^2 \equiv s$ (le carré de l'énergie totale disponible).

$s$, $t$ et $u$ sont les variables de Mandelstam.

note

Les trois variables ne sont pas indépendantes.
Cela donne un bonus utile pour vérifier ses calculs : pour tout processus $2\to 2$, $s + t + u = \sum_i m_i^2$ (ici $4m^2$).


De l’amplitude au nombre mesuré

Distiller l’amplitude : la matrice $T$ et l’amplitude invariante

Deux scories encombrent nos amplitudes. La première : le terme $\mathbb 1$ de $\hat S$ (« rien ne se passe »), sans intérêt pour la diffusion. On l’ôte en écrivant :

$$ \hat S = \mathbb 1 + i\hat T, $$

Les éléments de $\hat T$ forment la matrice de transition.

La seconde : le $(2\pi)^4\delta^{(4)}$ que tout diagramme trimballe. On le factorise en définissant l’amplitude invariante $\mathcal M$ (pour un processus $2\to 2$) :

$$ \langle p_{1\text f}\, p_{2\text f}|\, i\hat T\, |p_{2\text i}\, p_{1\text i}\rangle = (2\pi)^4\delta^{(4)}\big(p_{1\text f} + p_{2\text f} - p_{2\text i} - p_{1\text i}\big)\; \mathrm{i}\mathcal M $$

(le $\mathrm{i}$ est là pour raccorder aux conventions de la diffusion non relativiste6).

Et la simplification la plus forte : seuls les diagrammes entièrement connexes contribuent à $\hat T$. Les déconnectés décrivent des processus qui ne s’influencent pas (cela semble physiquement évident, et c’est démontrable par le théorème des amas liés).

De plus, les diagrammes portant des boucles sur les pattes externes (les self-énergies type huître accrochées aux jambes) n’y contribuent pas non plus : on les élimine par l’amputation7.

D’où le mode d’emploi définitif :

$$ \mathrm{i}\mathcal M\, (2\pi)^4\delta^{(4)}\Big(\sum p_{\text f} - \sum p_{\text i}\Big) = \sum \left(\begin{array}{c}\text{tous les diagrammes de Feynman}\\ \text{connexes et amputés,}\\ \text{d’entrées } p_{\text i} \text{ et de sorties } p_{\text f}\end{array}\right) $$


La section efficace

Que mesure-t-on ? La section efficace $\sigma$ : l’aire effective que la cible présente au faisceau, définie opérationnellement par le taux d’événements

$$ R = \sigma L $$

où $L$ est la luminosité du faisceau (dimensions : temps$^{-1}\times$aire$^{-1}$).

$\sigma$ est le facteur permettant de passer du « nombre de projectiles par seconde et par m² » au « nombre de clics par seconde » sur le détecteur.

La diffusion part dans toutes les directions, et un détecteur ne couvre qu’un morceau d’angle solide : la grandeur naturelle utile est alors la section efficace différentielle $\mathrm{d}\sigma/\mathrm{d}\Omega$. C’est la part de $\sigma$ envoyée dans $\mathrm{d}\Omega$ (direction $(\theta,\phi)$). Intégrée sur $4\pi$, elle redonne $\sigma$ ($\int_0^{2\pi}\mathrm{d}\varphi\int_{-1}^{1}\mathrm{d}(\cos\theta)\,\frac{\mathrm{d}\sigma}{\mathrm{d}\Omega} = \sigma$).

Reste le pont entre ce que l’expérience compte et ce que la théorie produit. Le schéma est celui de la règle d’or de Fermi :

$ \text{taux} \;=\; \big|\text{amplitude de transition}\big|^2 \;\times\; \big(\text{densité d’états finals accessibles}\big) $

Il suffit ensuite de rapporter la règle au flux incident pour obtenir une aire. Les trois ingrédients, un par un :

En menant ce décompte avec soin, on obtient pour deux particules de même masse diffusant l’une sur l’autre :

$$ \frac{\mathrm{d}\sigma}{\mathrm{d}\Omega} = \frac{|\mathcal M|^2}{64\pi^2 E_{\text{CM}}^2}, $$

où $E_{\text{CM}}$ est l’énergie totale dans le référentiel du centre de masse


Born redonne Yukawa

Diffusion de deux psions discernables :

seul le canal $t$ contribue. Limite non relativiste : $p \approx (m, \mathbf p)$ pour les quatre pattes, donc

$$ t = (p’ - p)^2 \approx -|\mathbf p’ - \mathbf p|^2 = -|\mathbf q|^2, $$

où $\mathbf q = \mathbf p’ - \mathbf p$ est le transfert de tri-impulsion (la composante temporelle $\approx m - m = 0$ s’efface : à basse énergie, on ne transfère que de l’impulsion, pas de l’énergie). L’amplitude du canal $t$ devient :

$$ i\mathcal M = (-ig)^2\,\frac{i}{t - \mu^2} = -g^2\,\frac{i}{-|\mathbf q|^2 - \mu^2} = \frac{ig^2}{|\mathbf q|^2 + \mu^2} $$

Rq : le $i\varepsilon$ est superflu puisque le dénominateur ne s’annule jamais.

Avec $E_{\text{CM}} = 2m$ :

$$ \frac{\mathrm{d}\sigma}{\mathrm{d}\Omega} = \frac{1}{256\pi^2 m^2}\left(\frac{g^2}{|\mathbf q|^2 + \mu^2}\right)^2 $$

C’est une prédiction mesurable, angle par angle (via $|\mathbf q|^2 = 4|\mathbf p|^2\sin^2(\theta/2)$).

Ce que Born prévoit :

Qu'est-ce que l'approximation de Born ?

On est dans le cadre de la mécanique quantique non relativiste (sans création ni destruction de particules). Une particule d’impulsion $\mathbf p$ arrive sur un potentiel fixe $V(\mathbf r)$ (fixe = la cible est lourde et ne recule pas), et repart avec l’impulsion $\mathbf p’$. Question : avec quelle amplitude ?

Le geste est exactement celui du chapitre sur la matrice $S$, en version appauvrie : on traite $V$ comme une perturbation et on tronque la série de Dyson au premier ordre,

$\displaystyle \hat S \simeq \mathbb 1 - \mathrm{i}\int\mathrm{d}t\; \hat V_I(t) \Longrightarrow \langle \mathbf p'|\,\mathrm{i}\hat T\,|\mathbf p\rangle = -\mathrm{i}\int\mathrm{d}t\; \langle\mathbf p'|\hat V_I(t)|\mathbf p\rangle $

En représentation d’interaction, $\hat V_I(t)$ porte les phases $e^{\mathrm{i}(E_{\mathbf p’} - E_{\mathbf p})t}$, dont l’intégrale sur $t$ donne $(2\pi)\delta(E_{\mathbf p’} - E_{\mathbf p})$ ; et l’élément de matrice spatial se calcule entre ondes planes :

$\displaystyle \langle\mathbf p'|\hat V|\mathbf p\rangle = \int\mathrm{d}^3r\; e^{-i\mathbf p'\cdot\mathbf r}\, V(\mathbf r)\, e^{i\mathbf p\cdot\mathbf r} = \int\mathrm{d}^3r\; e^{-i\mathbf q\cdot\mathbf r}\, V(\mathbf r) \equiv \tilde V(\mathbf q)$
avec $\mathbf q = \mathbf p' - \mathbf p$

D’où le résultat : $\langle\mathbf p’|\,i\hat T\,|\mathbf p\rangle = -i\,\tilde V(\mathbf q)\,(2\pi)\delta(E_{\mathbf p’} - E_{\mathbf p})$.

Ce que ça raconte :
au premier ordre, la particule entre en onde plane, « touche » le potentiel une seule fois, et ressort en onde plane. L’amplitude de déviation $\mathbf q$ est simplement la composante de Fourier du potentiel à la fréquence spatiale $\mathbf q$.
Un potentiel non négligeable sur une échelle $a$ dévie efficacement jusqu’à $|\mathbf q| \sim 1/a$, et pas au-delà. C’est l’analogue exact de la diffraction : la figure de diffusion est la transformée de Fourier de l’obstacle. L’approximation est bonne tant que le potentiel est faible (une seule « touche » suffit à raconter l’histoire).

Un détail qui compte :
il n’y a ici qu’un delta d’énergie, pas le $\delta^{(4)}$ de la théorie des champs. Raison : un potentiel fixe brise l’invariance par translation d’espace (la cible encaisse l’impulsion sans qu’on la compte), alors qu’en théorie des champs la cible est une particule dynamique à part entière, et l’impulsion est conservée pour de bon. C’est pourquoi la comparaison ci-dessous porte sur les coefficients, pas sur les deltas.

Ce qui nous donne le droit de comparer la prédiction de la théorie quantique des champs à celle de la mécanique quantique est le fait qu’à basse énergie les deux récits décrivent le même phénomène observable : une particule qui repart déviée. La théorie des champs dit « il y a eu échange d’un phion » ; la mécanique quantique dit « il y a eu un potentiel ». On définit donc le potentiel effectif comme celui qui reproduirait la même amplitude. C’est la traduction, dans le langage des forces, de ce que l’échange de quanta produit.

Identifions donc les coefficients, $\mathrm{i}\mathcal M \;\leftrightarrow\; -\mathrm{i}\tilde V(\mathbf q)$ :

$$ \tilde V(\mathbf q) = -\frac{g^2}{|\mathbf q|^2 + \mu^2} $$

Le signe moins n’est cette fois-ci pas parachuté. Le potentiel est bien négatif entre deux psions de même « charge » et donc attractif. L’échange d’un scalaire attire toujours, contrairement à l’échange d’un vecteur (le photon), qui fait se repousser les charges identiques.

La transformée inverse redonne le potentiel de Yukawa (calcul mené pas à pas dans la partie sur le propagateur de Feynman : pôle en $|\mathbf q| = i\mu$, fermeture du contour par le haut) :

$$ \Longrightarrow V(\mathbf r) = -\frac{g^2}{4\pi|\mathbf r|}\, e^{-\mu|\mathbf r|} $$

note

Une honnêteté de comptable : l’identification $i\mathcal M \leftrightarrow -i\tilde V(\mathbf q)$ est un peu cavalière, car les deux membres ne portent pas la même normalisation d’états. Les états relativistes traînent un facteur $\sqrt{2E_{\mathbf p}} \approx \sqrt{2m}$ par patte externe que la mécanique quantique non relativiste ignore. Le raccordement soigneux fait donc apparaître des facteurs $2m$ qu’on absorbe dans les conventions. Ce qui est robuste, et qui porte toute la physique est la dépendance en $\mathbf q$ (donc la forme du potentiel et sa portée $1/\mu$) et le signe.

Dans la partie sur le propagateur de Feynman, ce potentiel avait été obtenu en résolvant Klein–Gordon statique avec une source (un raccourci semi-classique). Ici, il ressort tout seul de la théorie des champs complète : échange d’un phion en canal $t$, limite non relativiste, dictionnaire de Born. Les deux routes se rejoignent exactement, signe attractif compris (des « charges » identiques s’attirent par échange scalaire), portée $1/\mu$ comprise.

C’est ce bouclage qui vaut à la théorie $\psi^\dagger\psi\phi$ son nom de théorie de Yukawa : la force est l’ombre non relativiste de l’échange de quanta.


Bilan

Le trajet complet, du lagrangien au compteur de l’expérimentateur :

$\displaystyle \mathcal L \;\longrightarrow\; \text{règles de Feynman} \;\longrightarrow\; \sum\, \text{connexes amputés} = i\mathcal M \;\longrightarrow\; \frac{\mathrm{d}\sigma}{\mathrm{d}\Omega} = \frac{|\mathcal M|^2}{64\pi^2 E_{\text{CM}}^2} \;\longrightarrow\; R = \sigma L \;\longrightarrow\; \text{clics}. $


Pièges



SommaireChapitre précédentChapitre suivant

  1. En QED, l’électron est l’excitation du champ $\psi$ et le photon celle du champ de jauge ; le vertex à trois pattes $\psi^\dagger\psi A$ est le moteur de toute l’électrodynamique. ↩︎

  2. Les contractions impliquant les $\hat a$ n’ont pas besoin de $T$ : $\hat a^\dagger_{\mathbf p}$ crée à $t = -\infty$ et $\hat a_{\mathbf q}$ détruit à $t = +\infty$, l’ordre chronologique est fixé d’office. ↩︎

  3. Derrière l’intuition, un principe profond : la décomposition en amas (cluster decomposition). Des expériences distantes donnent des résultats décorrélés. Une matrice $S$ construite sur des opérateurs de création/annihilation la satisfait automatiquement : c’est la raison structurelle pour laquelle ces opérateurs sont requis en théorie des champs, et pas une simple commodité. ↩︎

  4. $\hat{\mathcal H}_I = -\hat{\mathcal L}_I$ est vrai ici parce que l’interaction ne contient pas de dérivées ; avec des couplages dérivatifs, le passage Lagrangien → Hamiltonien est plus subtil. ↩︎

  5. Nom forgé par Sidney Coleman. Quand la Physical Review s’offusqua du terme « tadpole », Coleman proposa comme alternative « spermion ». La Physical Review céda. ↩︎

  6. C’est ce $i$ qui fera tomber juste la comparaison avec l’approximation de Born ci-dessous. ↩︎

  7. Amputer : couper toutes les boucles de self-énergie qui poussent sur les pattes externes. La justification profonde (les pattes externes doivent décrire des particules physiques, déjà « habillées ») attend la renormalisation ; pour l’instant, c’est une règle. ↩︎