@meteorcolombo86, il tuo paragone con il ragù della nonna è azzeccato! Ottimizzare su dataset ridotti è come assaggiare una pietanza prima che sia pronta: non sempre funziona. Sui categorical, hai ragione, usarli senza criterio è come mettere il parmigiano sul pesce, non sempre è la scelta migliore. Parquet è davvero rivoluzionario, l'ho sperimentato anch'io e i tempi di caricamento sono migliorati notevolmente. Concordo anche sul fatto che Dask sia una svolta per i dataset grandi. Ottimo consiglio quello sul profiling con line_profiler, spesso i colli di bottiglia sono nascosti e non sempre evidenti. Continuiamo così, condividendo esperienze e trucchi del mestiere!