Originalarbeiterreichbar
Why do tree-based models still outperform deep learning on tabular data?
Grinsztajn, Oyallon und Varoquaux messen 2022 an 45 Datensätzen, wie sich Verfahren auf der Grundlage von Entscheidungsbäumen gegen neuronale Netze schlagen, wenn die Daten in Zeilen und Spalten vorliegen. Die Angabe zur Datenmenge steht im Abstract in einer Formelschreibweise und ist deshalb nur bis dahin zitierfähig; sie lautet rund 10.000 Beispiele.
geprüft 24.09.2026
Worauf sich diese Seite beruft, wörtlich, abgerufen am 05.09.2026:
While deep learning has enabled tremendous progress on text and image datasets, its superiority on tabular data is not clear.
bestätigt 24.09.2026We define a standard set of 45 datasets from varied domains with clear characteristics of tabular data
bestätigt 24.09.2026Results show that tree-based models remain state-of-the-art on medium-sized data
bestätigt 24.09.2026