La preuve

Le 75 % est-il plus fiable que le 70 % ?

Choisissez un marché et regardez ce qui s’est vraiment passé chaque fois que le système a annoncé une probabilité donnée. Si le modèle est calibré, dans chaque tranche la fréquence observée tombe près de la probabilité annoncée — et là où ce n’est pas le cas, on voit de combien.

Tout l’historique, en refaisant le modèle pour chaque fenêtre sur les seules données qui la précèdent. Ce sont les probabilités brutes, avant les calibrateurs : les appliquer ici serait circulaire, puisqu’ils sont estimés sur ces mêmes données. C’est aussi pourquoi le défaut de calibration se voit.

Marché

Aucun match évalué avec ces filtres.

La validation couvre les championnats, pas les coupes européennes : celles-ci sont prévues par le modèle hiérarchique, absent de cette archive. Cette page est l’agrégat. Les matchs de ces derniers jours, un par un, sont dans Résultats

La prochaine étape

L’application sortira quand les chiffres seront prêts à soutenir la comparaison.

iOS et Android, gratuite. D’ici là le travail continue là où cela compte : collecter des données toutes les trois heures, réentraîner les modèles chaque lundi et accumuler le track record qui rend tout le reste vérifiable.

iOSbientôtAndroidbientôt