Cote de tennis et probabilité implicite : ce qu’elle dit vraiment

· Pronocast

Matchs recommandés par Pronocast, triés par rendement attendu à partir des cotes du marché

Une cote de bookmaker n'est pas juste un multiplicateur de gain. C'est une probabilité, déguisée, et la plupart des gens la lisent mal : ils voient un chiffre comme 1,80 et n'en retiennent que « je gagne 1,80 fois ma mise », sans jamais convertir ce chiffre en ce qu'il dit vraiment sur les chances du joueur. C'est pourtant cette conversion qui permet de comparer une cote à un pronostic, de repérer un écart entre les deux, et de comprendre pourquoi le marché des cotes reste, encore aujourd'hui, la référence que peu de modèles battent durablement.

Cet article explique comment lire une cote, pourquoi la somme des probabilités qu'elle implique dépasse toujours 100 %, comment retirer cette marge pour obtenir une vraie probabilité, et comment le modèle Pronocast s'en sert.

Convertir une cote en probabilité

Avec une cote décimale (la convention européenne, celle utilisée dans l'application), la conversion est directe : probabilité implicite = 1 ÷ cote. Une cote de 1,50 correspond à une probabilité implicite de 66,7 % ; une cote de 3,00, à 33,3 % ; une cote de 1,10, à un peu plus de 90 %. Plus la cote est basse, plus le bookmaker (et le marché derrière lui) juge la victoire probable.

Un exemple chiffré

Sur un match où le favori est coté 1,40 et l'outsider 3,20 : 1 ÷ 1,40 = 71,4 %, et 1 ÷ 3,20 = 31,3 %. Deux choses sautent aux yeux. D'abord, le favori paraît nettement plus probable, ce qui est cohérent. Ensuite, les deux pourcentages additionnés font 102,7 %, pas 100 %. Ce n'est pas une erreur d'arrondi.

La marge du bookmaker, ou pourquoi ça ne fait jamais 100 %

Ce surplus au-dessus de 100 % s'appelle la marge, ou overround. C'est la commission du bookmaker, intégrée directement dans les cotes plutôt que prélevée à part : il fixe des cotes légèrement inférieures à ce que la probabilité réelle justifierait, des deux côtés du match, pour encaisser un profit quel que soit le résultat. Sur le tennis, cette marge tourne le plus souvent entre 2 et 6 % selon le bookmaker et la visibilité du match.

Karl Whelan, professeur d'économie à l'University College Dublin, détaille le calcul dans un article de référence sur le sujet : la marge se retrouve en additionnant les probabilités implicites de toutes les issues possibles, et en retranchant 100 % au total (Calculating the Bookmaker's Profit Margin).

Retirer la marge : la probabilité « de-vigée »

Pour obtenir une estimation propre de la probabilité, il faut répartir cette marge entre les deux issues plutôt que la laisser gonfler chacune d'elles artificiellement. La méthode la plus simple, dite de normalisation proportionnelle, divise chaque probabilité implicite par la somme de toutes les probabilités implicites du match.

Sur l'exemple précédent

71,4 % et 31,3 % totalisent 102,7 %. La probabilité « de-vigée » du favori devient donc 71,4 ÷ 102,7 ≈ 69,5 %, et celle de l'outsider 31,3 ÷ 102,7 ≈ 30,5 %. Ces deux chiffres, eux, totalisent exactement 100 % : c'est cette version qui a un sens statistique, pas les pourcentages bruts lus directement sur la cote.

Pourquoi le marché bat (presque) tous les modèles

Une cote n'est pas fixée au hasard. Elle part d'une estimation du bookmaker, puis elle bouge avec l'argent misé par des dizaines de milliers de parieurs, dont une minorité professionnelle qui corrige les cotes mal calibrées jusqu'à ce qu'elles cessent d'être rentables à attaquer. Le résultat agrège donc beaucoup plus d'information qu'un seul modèle statistique, aussi soigné soit-il.

C'est précisément ce que mesure la recherche académique sur le sujet. Dans une revue de la littérature portant sur des dizaines de modèles de pronostic tennis, Sascha Wilkens constate qu'ils plafonnent presque tous entre 70 et 75 % de précision, quelle que soit la sophistication de l'approche, et que la plupart ne parviennent pas à dépasser durablement la précision déjà contenue dans les cotes des bookmakers (Wilkens, « Sports prediction and betting models in the machine learning age: The case of tennis », Journal of Sports Analytics, 2021). C'est la même étude qui sous-tend le repère de 70 % cité dans la méthodologie de Pronocast.

Comment Pronocast utilise la cote du marché

Plutôt que d'ignorer ce signal par principe, le modèle le lit. Quand une cote est disponible pour un match, sa probabilité implicite (de-vigée, selon la méthode décrite plus haut) est mélangée à la probabilité calculée par le modèle à partir de l'Elo, de la forme et des confrontations directes. Le mélange ne remplace jamais totalement le modèle : sur les matchs sans cote disponible (environ 8 % des cas, jamais en double), et sur tous les tournois Challenger où les cotes sont plus rares, le modèle reste seul.

Quand une cote existe, l'écart entre elle et la probabilité du modèle est publié sur la page de chaque match : un grand écart signale un désaccord entre le modèle et le marché, dans un sens ou dans l'autre, plutôt que d'être masqué derrière un seul chiffre final.

Lire les cotes sur Pronocast

Les cotes des bookmakers sont affichées sur chaque pronostic à venir qui en dispose, à côté de la probabilité du modèle. Elles sont visibles sur la page des pronostics du jour, par circuit sur les hubs ATP, WTA et Challenger, ainsi que sur la page des recommandations, qui trie les matchs par rendement attendu plutôt que par confiance seule quand une cote permet de le calculer.

Questions fréquentes

Comment calculer la probabilité implicite d’une cote de tennis ?
En divisant 1 par la cote décimale. Une cote de 1,50 correspond à 66,7 % de probabilité implicite, une cote de 3,00 à 33,3 %. C’est une conversion directe, qui inclut encore la marge du bookmaker.
Pourquoi la somme des probabilités implicites dépasse-t-elle 100 % ?
À cause de la marge du bookmaker (l’overround), intégrée dans les deux cotes du match plutôt que prélevée à part. Elle tourne le plus souvent entre 2 et 6 % au tennis. Il faut la retirer, par normalisation, pour obtenir une probabilité exploitable.
Le marché des cotes est-il plus fiable qu’un modèle de pronostic tennis ?
D’après la recherche académique sur le sujet, la plupart des modèles plafonnent entre 70 et 75 % de précision et ne battent pas durablement la précision déjà contenue dans les cotes des bookmakers, qui agrègent l’information de dizaines de milliers de parieurs.
Comment Pronocast utilise-t-il la cote du marché ?
Quand une cote est disponible, sa probabilité de-vigée est mélangée à celle du modèle. Sur les matchs sans cote (environ 8 % des cas) et la plupart des tournois Challenger, le modèle reste seul ; l’écart entre modèle et marché est publié sur chaque page de match.

Autres articles