C’è un momento preciso, nel lavoro di chi analizza i dati, in cui ci si sente un po’ come il professor Franzò di Sciascia: circondati da una complessità monumentale che, a guardarla bene, nasconde una spiegazione lineare, In questo mio esperimento su Orange Data Mining , l'obiettivo è stato tanto elementare quanto cruciale: dare in pasto a un algoritmo un dataset “sporco” — pieno di variabili fisiche e ambientali come la temperatura della stanza, l'umidità e persino il codice del colore — per vedere se il sistema fosse in grado di isolare l'unica vera legge geometrica sottostante: l'area di un cilindro ( A = 2 π · r · h + 2 π · r² ). Il verdetto del widget Rank è stato spietato e bellissimo. Nel romanzo di Sciascia, si cercano piste intricate, complotti e spiegazioni fumose per quello che è, fondamentalmente, un delitto evidente. Così si viene a creare molto “rumore” investigativo. Nel nostro dataset è successa la stessa cosa, ma al contrario. Gli algoritmi di rank...