Meteo.sm San Marino e Romagna · 100 m

Benchmark previsioni puntuali⚠ rodaggio

Verifica comparativa product-to-product su 7 stazioni istituzionali terze — protocollo pre-registrato.

🔒 Contenuto riservato

La dashboard del benchmark è riservata.

Errore per orizzonte di previsione

Aggregato sui 7 punti; la stessa osservazione è usata per tutti i provider (confronto appaiato). Meno è meglio (per il bias conta la vicinanza allo zero).

Skill rispetto alle baseline

1 − MAE/MAEbaseline su coppie appaiate: >0 = batte la baseline. La persistenza (obs di 24 h prima) è difficile da battere sotto le 6-12 h: il vero test dei modelli è da 12 h in su.

Precipitazione — accumuli 6h / 24h

MAE e bias sugli accumuli (mm); ETS a soglie quando il campione è sufficiente (n≥50).

Probabilità di precipitazione — Brier score

Più basso è meglio; BSclim = riferimento climatologico (frequenza osservata nel periodo). Le PoP Open-Meteo dei vari modelli coincidono spesso (fonte ensemble unica): leggerle come un solo prodotto.

Significatività statistica (Diebold-Mariano)

Δ = MAEmeteo.sm − MAEaltro su differenziali giornalieri (HAC): Δ<0 = meteo.sm meglio. In grassetto p<0.05. Serve una serie di ≥10 giorni per confronto.

Temperatura 0-24h — chi vince dove

MAE (°C) per punto di verifica; in verde il migliore di ciascun punto.

Metodo. Confronto product-to-product: agli snapshot delle 05 e 17 UTC si archivia ciò che ciascun servizio mostra in quel momento (per meteo.sm gli stessi JSON pubblici del sito), poi si verifica contro osservazioni indipendenti con controllo qualità. Metriche e test congelati nel protocollo pre-registrato (v1.0.2); baseline: persistenza a 24 h e climatologia per stazione/giorno/ora costruita su storico precedente l'avvio del benchmark. Le stazioni di verifica alimentano anche la correzione statistica di meteo.sm: la fase di pubblicazione prevede stazioni held-out come controprova. Dati riservati agli utenti registrati, non ripubblicabili.

Caricamento dashboard…