Accuratezza
La valutazione reale e attuale del modello di conteggio degli impianti aperti di Open Lifts — ogni suddivisione, la base di riferimento con cui viene misurato e esattamente quanti dati la sostengono. Questa pagina è generata direttamente dagli stessi artefatti di valutazione con cui il modello stesso è stato registrato — nulla qui è scritto a mano.
Il modello reconstruction-hgb-v1-20260918 è attualmente etichettato come EXPERIMENTAL. Il PRD richiede un tasso di successo dell'intervallo ≥75.0%, superando una base di riferimento semplice, su ogni suddivisione tenuta da parte sotto elencata prima che un modello possa essere definito convalidato. Questo non ha ancora superato quella soglia — ogni previsione che produce su questo sito è contrassegnata come sperimentale, non una promessa pronta per la prenotazione.
model held-out-date coverage 0.743 does not beat the resort-historical-mean baseline's 0.788 — PRD §2.9.1 requires both; held-out-date coverage 0.7428571428571429 < 0.75; held-out-resort evidence insufficient: only 3 eligible resorts (need >=10 per Phase 3E Sec 14's own criterion for a trustworthy estimate); held-out-season evidence insufficient: only 79 training rows (Phase 3E Sec 14 flags 300+ as the scale needed to trust this split); held-out-season coverage 0.5263157894736842 < 0.75
Le tre suddivisioni richieste
Un "successo" dell'intervallo significa che il numero reale di impianti aperti osservato rientrava nell'intervallo previsto. Ogni suddivisione risponde a una domanda diversa sul fatto che il modello generalizzi davvero, non solo che si adatti a dati già visti.
Una data su cui il modello non si è mai allenato, stesse stazioni.
n = 35 n
Una stazione su cui il modello non si è mai allenato del tutto.
n = 3 stazioni valutate
Una stagione su cui il modello non si è mai allenato del tutto.
n = 38 n
Il confronto con la base di riferimento
Una base di riferimento è la stima ragionevole più semplice senza alcun modello — qui, la media storica propria di una stazione per quel periodo dell'anno. Un vero modello deve superarla, non solo raggiungere il 75%, altrimenti non aggiunge nulla.
Questo modello attualmente non supera la base di riferimento su questa suddivisione — onestamente, una semplice media storica è al momento una stima altrettanto buona.
Base di riferimento valutata su 33 di 35 giorni di test tenuti da parte (per gli altri non erano disponibili dati storici di quella stazione su cui calcolare una media).
Perché la soglia non è solo una percentuale
Un tasso di copertura basato su troppo pochi dati non è affidabile di per sé. Ecco esattamente quanti dati reali sostengono questa valutazione:
Stazioni usate per la valutazione a stazione tenuta da parte: cauterets, galibier-thabor, valloire.
Verifica delle previsioni in tempo reale
Indipendentemente dal backtest in fase di addestramento sopra riportato, ogni previsione reale di questo modello viene verificata rispetto a ciò che è realmente accaduto una volta trascorsa la data — il registro di accuratezza reale e continuo.
Modello reconstruction-hgb-v1-20260918, addestrato su dati fino al 16 June 2026, registrato il 18 September 2026. Vedi come funziona per cosa significano osservato/ricostruito/previsione, oppure /data per l'attribuzione delle fonti.