Notre méthodologie
Pas de boîte noire. Voici exactement comment nos analyses sont générées.
Le pipeline en 5 étapes
Collecte de données
Des dizaines de sources de données sportives sont agrégées quotidiennement : stats joueurs, historiques H2H, blessures, conditions, cotes en temps réel sur Pinnacle.
Modèles ML par sport
Chaque sport a son propre modèle de Machine Learning (gradient boosting). Un modèle NHL Totals ≠ un modèle Tennis ML. Chaque modèle est entraîné sur des années de données historiques pour estimer la vraie probabilité d'un résultat.
Couche d'analyse IA
Pour chaque match, une IA dédiée (l'Analyst) projette le déroulement du match : Game Script pour la NBA, lecture tactique pour le Soccer, analyse de surface pour le Tennis. Elle rédige une analyse complète expliquant le raisonnement.
Filtres et garde-fous
Des filtres anti-patterns bloquent automatiquement les signaux qui ont historiquement mené à des pertes. Seuls les matchs avec un edge significatif (probabilité modèle > probabilité implicite des cotes) sont sélectionnés.
Publication et traçabilité
Chaque analyse est horodatée, publiée avant le match, et jamais modifiée après coup. Victoires ET défaites sont visibles dans notre track record. Nous trackons aussi le CLV (Closing Line Value) pour prouver que nos cotes battent la clôture.
Modélisation détaillée par sport
Chaque sport a sa propre dynamique statistique. Notre stack ML n'utilise pas un modèle unique : six pipelines distincts, calibrés indépendamment, partagent simplement la même infrastructure (Scout → Analyst → Executor → Writer).
NBA — régression sur totaux
Notre modèle NBA a été audité en walk-forward sur 8 042 matchs (7 saisons). Conclusion : aucun modèle ML ne bat le marché ATS (against the spread) de manière robuste. En revanche, les patterns de fatigue produisent un edge mesurable : équipe en back-to-back avec spread 4-8 favori AWAY (65,4 % WR), back-to-back avec spread < 4 favori AWAY (57,8 % WR). Sur les totals, nous utilisons une régression directe qui prédit le score combiné réel et le compare à la ligne du marché. Le seuil de publication est edge ≥ 5 points + confiance ≥ 63.
NHL — Moneyline + Totals avec gating gardien
Le hockey est dominé par la performance des gardiens partants. Notre pipeline impose un goalie gating : aucun pick officiel n'est publié avant confirmation des deux gardiens (souvent annoncée 60-90 min avant la mise au jeu). Cette discipline élimine les pertes liées aux changements de dernière minute. Sur les Totals, le modèle décide en mode model-direct — notre analyste IA n'inverse jamais la direction Over/Under, il rédige seulement l'analyse. Cela préserve la qualité du signal statistique brut, identifiée comme supérieure aux corrections narratives.
MLB — CatBoost multi-marchés sur 466 000 matchs
Le baseball offre la plus longue base historique (depuis 1871). Nous combinons trois modèles CatBoost spécialisés : Totals First 5 (5 premières manches, focus sur les lanceurs partants), Totals Full Game (match complet avec gestion des bullpens), Spreads Full Game (handicap). Les variables clés : xERA, FIP, WHIP, K%, BB% des lanceurs partants, wOBA et ISO des frappeurs rolling 14 jours, facteurs de ballpark (dimensions, altitude, conditions météo). Pitcher gating obligatoire : les deux starters doivent être confirmés.
WNBA — modèle calibré sur les particularités du basketball féminin
Le marché WNBA est moins mature que la NBA — les bookmakers y prennent moins de risque, ce qui crée plus d'opportunités de valeur. Notre modèle exploite trois spécificités : avantage à domicile dynamique par franchise (Indiana +3,2 pts vs NY Liberty -2,6 pts, ce que le marché ne price pas finement), Four Factors avancés (eFG%, TOV%, OREB%, FT Rate) plus prédictifs que les stats classiques, impact du repos et back-to-back avec les voyages fréquents du circuit. En 2025, sur les Totals, nous affichons 58,2 % de win rate (325 picks officiels, +37,8 unités cumulées).
Soccer — modèle V5 OSXG sur 5 ligues majeures
Notre modèle Soccer V5 (Open-play Shot xG) couvre les cinq grands championnats européens : Premier League, La Liga, Serie A, Bundesliga, Ligue 1. Pour chaque match, il évalue xG calculé sur séquence (séparation des situations de jeu et des coups de pied arrêtés), forme rolling 5 et 10 matchs, historique des confrontations directes pondéré par récence, dynamique domicile/extérieur par équipe, contexte (lendemain de coupe d'Europe, derby, match couperet). Marchés : Over/Under 2.5 buts, BTTS, Asian Handicap, 1X2. L'Analyst Soccer applique quatre hard gates non négociables, identifiés empiriquement sur des séries de pertes (par exemple : refus BTTS Yes quand le ratio xG est très déséquilibré — piège du shutout dominant).
Tennis — Elo séparé ATP/WTA par surface
Notre modèle Tennis sépare deux classements Elo (ATP et WTA), avec un Elo spécifique par surface (terre battue, dur, gazon, indoor). Pour chaque match, sept features clés sont croisées : Elo général, Elo surface, forme récente sur 10 matchs, win rate sur la surface, H2H direct, fatigue (matchs sur 14 jours), qualité moyenne des adversaires récents. Marchés couverts : Moneyline (vainqueur) et Totals jeux. Le calendrier tennis est annuel sans saison morte marquée — ATP et WTA tournent en permanence sur les Grand Chelem, Masters 1000 et tournois 250/500.
Mise à jour et réentraînement
Tous les modèles sont réentraînés chaque semaine sur l'ensemble des données historiques disponibles plus la semaine écoulée. Le NBA est retrainé le lundi 09:00 UTC, les autres sports via un pipeline unifié le lundi 06:00 UTC. Un agent Learner dédié analyse chaque semaine les picks perdants pour identifier de nouveaux patterns d'anti-patterns ou ajuster les seuils dynamiques. Toute modification de la modélisation est documentée et horodatée dans nos audits internes.
Bookmakers de référence et CLV
Pour chaque pick, nous comparons l'estimation probabiliste de notre modèle à la cote implicite proposée par sept bookmakers européens de référence : Pinnacle (notre baseline du « marché efficient »), Unibet, 888sport, Winamax, Betfair, Betclic et Bwin. Lorsque l'edge dépasse le seuil de sélection du sport, le pick devient officiel. Nous trackons aussi le CLV (Closing Line Value) : notre cote au moment du pick vs cote de clôture. Un CLV positif sur la durée prouve que notre modèle bat le marché informationnellement — c'est l'indicateur prédictif le plus robuste de la profitabilité long terme.
CLV mesuré — 365 derniers jours, cote prise (la meilleure des 7 books) vs clôture Pinnacle :
Nos cotes prises battent en moyenne la clôture de Pinnacle (le book le plus efficient) sur ces sports — le marché « nous donne raison » après coup. Seuls les sports au CLV positif et statistiquement significatif (≥ 100 picks réglés) figurent ici ; le détail pick par pick est dans le journal public.
Comment reconnaître un service de pronostics fiable
Avant de payer un abonnement, un parieur averti regarde le processus, pas les captures d'écran de gains. Voici les six critères qui séparent une méthode vérifiable du reste — et où se situe ProbWin sur chacun.
1. Un journal complet et vérifiable
Tous les picks, gagnants et perdants, horodatés avant le match, jamais supprimés. Très peu de services publient un journal réglé complet, accessible sans compte. Le nôtre est public.
2. La preuve par le CLV
Battre la cote de clôture — pas seulement « avoir eu raison » après coup. C'est l'indicateur le plus robuste d'un vrai edge. Nous le mesurons et l'affichons (ci-dessus).
3. Des probabilités calibrées
Quand le modèle annonce 60 %, l'événement doit se produire environ 60 % du temps. C'est mesurable — pas une impression, pas un « ressenti ».
4. La meilleure cote, pas un seul book
Un demi-point de cote change le rendement sur la durée. Nous comparons sept books et retenons le meilleur prix disponible pour chaque pick.
5. Aucune promesse de gain
Personne ne peut garantir un pari. Un service sérieux vend une méthode et de l'analyse, pas des certitudes — c'est aussi la loi en France.
6. Publié avant le coup d'envoi
Une sélection horodatée avant le match ne peut pas être « choisie » après coup. C'est la condition de base d'un track record honnête.
| Le critère | Approche « pronos » courante | ProbWin |
|---|---|---|
| Journal complet public | Souvent partiel ou absent | Oui, tout est là |
| Suivi du CLV | Quasi jamais | Oui, mesuré |
| Probabilités calibrées | Rarement affichées | Oui, vérifiables |
| Meilleure cote (multi-books) | Un seul book | 7 books comparés |
| Promesse de gain | Fréquente | Aucune |
| Publié avant le coup d'envoi | Variable | Toujours, horodaté |
Ce que nous ne faisons PAS
Modèles indépendants — nos analyses ne sont influencées par aucun bookmaker
Pas de résultats cherry-pickés — tout est visible, y compris les pertes
Pas de win rates gonflés — 60% est exceptionnel et nous le présentons tel quel
Pas de "guru" humain — c'est le modèle qui décide, pas un ego
Exemples d'analyses récentes
Victoires ET défaites — rien n'est caché. Cliquez pour voir l'analyse complète.
3 victoires, 2 défaites — c'est la réalité. L'analyse complète est visible sur chaque page de match.
Tous les résultats, transparents et vérifiables.