Saltar al contenido principal
ToolPotion

Modelos de Deep Learning para Datos Tabulares

Este repositorio de GitHub proporciona la implementación oficial del artículo de NeurIPS 2021 'Revisiting Deep Learning Models for Tabular Data'. Explora arquitecturas de deep learning para datos tabulares, destacando los modelos tipo MLP como bases sólidas e introduciendo FT-Transformer como una adaptación potente de la arquitectura Transformer.

Visitar URL

Descripción

Este repositorio sirve como la implementación oficial del artículo de investigación "Revisiting Deep Learning Models for Tabular Data", presentado en NeurIPS 2021. El proyecto profundiza en la efectividad de varias arquitecturas de deep learning cuando se aplican a conjuntos de datos tabulares, un dominio donde los métodos tradicionales como los árboles de decisión potenciados por gradiente (GBDTs) a menudo sobresalen.

Los hallazgos principales del artículo, reflejados en este repositorio, indican que los Perceptrones Multicapa (MLPs) simples y bien ajustados siguen siendo altamente competitivos, a menudo rindiendo a la par o incluso superando a modelos de deep learning más complejos. La arquitectura ResNet, una variante de MLP que incorpora conexiones de salto y normalización por lotes, refuerza aún más la fortaleza de las estructuras tipo MLP para datos tabulares. Sin embargo, la investigación también introduce el FT-Transformer, una arquitectura novedosa que adapta el modelo Transformer para datos tabulares. FT-Transformer demuestra un rendimiento promedio superior en benchmarks en comparación con otros modelos profundos y reduce significativamente la brecha de rendimiento entre el deep learning y los GBDTs en conjuntos de datos donde los GBDTs tradicionalmente dominan.

El repositorio está estructurado para facilitar la reproducción de los resultados del artículo y la investigación futura. Incluye un paquete de Python para uso práctico, métricas detalladas e hiperparámetros para varios modelos y conjuntos de datos, e instrucciones claras sobre la configuración, descarga de datos y ejecución de scripts de ajuste, evaluación y ensamblaje. El código está organizado en directorios para entrenamiento, ensamblaje, ajuste, análisis y herramientas comunes, con salidas que incluyen estadísticas detalladas y configuraciones.

Este proyecto es valioso para investigadores y profesionales en machine learning, particularmente aquellos que trabajan con datos tabulares. Proporciona un marco robusto para experimentar y desplegar modelos de deep learning, ofreciendo información sobre qué arquitecturas funcionan mejor y bajo qué condiciones. La inclusión de FT-Transformer sugiere una dirección prometedora para avanzar el deep learning en datos estructurados.

Aspectos destacados de Modelos de Deep Learning para Datos Tabulares

  • Implementación oficial del artículo de NeurIPS 2021 'Revisiting Deep Learning Models for Tabular Data'

  • Explora modelos tipo MLP como bases sólidas para datos tabulares

  • Introduce FT-Transformer, una adaptación de la arquitectura Transformer para datos tabulares

  • Proporciona un paquete de Python para aplicación práctica e investigación futura

  • Incluye métricas detalladas e hiperparámetros ajustados para varios modelos y conjuntos de datos

  • Código base para reproducir los resultados reportados

  • Scripts para ajuste de hiperparámetros, evaluación de modelos y ensamblaje

  • Soporta entornos PyTorch y TensorFlow para experimentación

  • Facilita la comparación entre modelos de deep learning y GBDTs en conjuntos de datos tabulares

  • Ofrece información sobre las características de rendimiento de diferentes arquitecturas de deep learning en datos tabulares

Primeros pasos con Modelos de Deep Learning para Datos Tabulares

  1. Configurar entorno: Instalar las dependencias necesarias usando Conda y pip.

  2. Descargar datos: Obtener el archivo del conjunto de datos y descomprimirlo en la raíz del repositorio.

  3. Reproducir resultados: Seguir los pasos del tutorial para ajuste, evaluación y ensamblaje.

  4. Ejecutar scripts: Ejecutar scripts de Python desde la raíz del repositorio, proporcionando archivos de configuración.

  5. Integrar vía API: Utilizar el paquete de Python para aplicación práctica.

  6. Explorar métricas: Analizar los archivos `stats.json` para comprender el rendimiento del modelo.

  7. Configurar modelos: Modificar los archivos de configuración TOML para experimentos personalizados.

Casos de uso de Modelos de Deep Learning para Datos Tabulares

  • Análisis de Datos Tabulares
  • Benchmarking de Modelos
  • Implementación de Investigación
  • Exploración de Ingeniería de Características
  • Modelado Predictivo

Preguntas frecuentes de Modelos de Deep Learning para Datos Tabulares

Reseñas de Modelos de Deep Learning para Datos Tabulares

Cargando...

Herramientas de IA populares como Modelos de Deep Learning para Datos Tabulares

Modelos de IA

Implementación de PyTorch del paper TabNet, que ofrece un enfoque atento e interpretable para el aprendizaje de datos tabulares. Soporta clasificación, regresión y aprendizaje…

Plataformas de aprendizaje automático

Este repositorio proporciona la implementación oficial en PyTorch del modelo SAINT, diseñado para mejorar las redes neuronales en datos tabulares. Aprovecha la atención por filas…

Plataformas de aprendizaje automático

Este modelo de IA detalla una red neuronal convolucional grande y profunda entrenada para la clasificación de ImageNet. Logró resultados de vanguardia con tasas de error top-1 y…

Modelos de IA y LLM

SqueezeNet es un modelo de red neuronal convolucional profunda disponible a través de PyTorch. Logra una precisión a nivel de AlexNet con significativamente menos parámetros y un…

Modelos de IA y LLM

Modelos de IA

FNet es una arquitectura de codificador eficiente similar a Transformer que reemplaza la autoatención con Transformadas de Fourier. Desarrollado por Google Research, ofrece una…

Modelos de IA y LLM

Modelos de IA

UniLM es un marco de preentrenamiento autosupervisado a gran escala desarrollado por Microsoft. Permite que los modelos aprendan a través de diversas tareas, idiomas y…

Modelos de IA y LLM

Neural Oblivious Decision Ensembles (NODE) es una biblioteca de Python para aprendizaje profundo en datos tabulares. Implementa ensembles de árboles de decisión oblivios y…

Plataformas de aprendizaje automático

Modelos de IA

El repositorio Vision Transformer (ViT) proporciona modelos y código para tareas de reconocimiento de imágenes. Incluye implementaciones de las arquitecturas Vision Transformer y…

Modelos de IA y LLM