• Saltar al contenido principal
  • Skip to secondary menu
  • Saltar a la barra lateral principal
  • Saltar al pie de página
  • Inicio
  • Secciones
    • Ciencia de datos
    • Criptografía
    • Herramientas
    • Machine Learning
    • Noticias
    • Opinión
    • Productividad
    • Programación
      • JavaScript
      • Julia
      • Matlab
      • Python
      • R
  • Programación
    • JavaScript
    • Julia
    • Matlab
    • Python
    • R
  • Laboratorio
    • Encuestas: Tamaño de Muestra
    • Lotería: Probabilidad de Ganar
    • Reparto de Escaños (D’Hondt)
    • Tres en Raya con IA
  • Noticias
  • Boletín
  • Contacto
  • Tienda
    • Libros
    • Equipamiento de oficina
    • Equipamiento en movilidad
    • Tiendas afiliadas
      • AliExpress
      • Amazon
      • Banggood
      • GeekBuying
      • Lenovo

Analytics Lane

Ciencia e ingeniería de datos aplicada

  • Ciencia de datos
  • Machine Learning
  • IA Generativa
  • Python
  • Pandas
  • NumPy
  • Excel
  • Matlab

Diagramas de dispersión y gráficos de regresión con Seaborn: Visualización de relaciones entre variables numéricas

julio 20, 2023 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 6 minutos

La visualización de las relaciones existentes entre las variables numéricas de un conjunto de datos es clave para poder comprender los patrones y tendencias existentes. Seaborn, una biblioteca de visualización de datos en Python, ofrece varias funciones para representar estas relaciones. En esta entrada, se mostrará cómo se pueden crear diagramas de dispersión y gráficos de regresión con Seaborn para visualizar las relaciones entre las variables numéricas. Mostrando cómo estas herramientas pueden ayudar a identificar patrones y evaluar la presencia de una relación lineal entre las variables.

Tabla de contenidos

  • 1 Carga de los datos
  • 2 Crear un diagrama de dispersión con Seaborn
    • 2.1 Cambiar el tamaño y el color de los puntos
    • 2.2 Agregar grupos y colores por categoría
    • 2.3 Añadir título al gráfico
  • 3 Gráficos de regresión
  • 4 Conclusión

Carga de los datos

Antes de poder crear diagramas de dispersión o gráficos de regresión con Seaborn es necesario disponer de un conjunto de datos cargado en Python. Para facilitar el seguimiento de los ejemplos, en esta entrada, se van a usar el popular conjunto de datos de iris que se encuentra dentro de Seaborn. Así para cargar este conjunto de datos en la variable iris se puede ejecutar el siguiente código.

import seaborn as sns

# Cargar los datos
iris = sns.load_dataset("iris")

# Imprimir los primeros registros del conjunto de datos
print(iris.head())
   sepal_length  sepal_width  petal_length  petal_width species
0           5.1          3.5           1.4          0.2  setosa
1           4.9          3.0           1.4          0.2  setosa
2           4.7          3.2           1.3          0.2  setosa
3           4.6          3.1           1.5          0.2  setosa
4           5.0          3.6           1.4          0.2  setosa

Publicidad


Crear un diagrama de dispersión con Seaborn

Los diagramas de dispersión son una de las formas más efectivas para visualizar la relación entre dos variables numéricas. En estos diagramas, cada punto representa un registro del conjunto de datos, y la posición en gráfico se determina por los valores de cada una de las variables. La función para crear estos gráficos en Seaborn scatterplot(). Al ser un gráfico bidimensional la función necesita tres parámetros: los datos, indicados mediante la propiedad data, el nombre de la variable que se mostrará en el eje x, indicada mediante la propiedad x, y el nombre de la variable que se mostrará en el eje y, lo cual se indica mediante el parámetro y. La forma habitual de trabajar en Seaborn.

Curiosidad: La maldición de la dimensionalidad, o por qué añadir más datos puede empeorar tu modelo
En Analytics Lane
Curiosidad: La maldición de la dimensionalidad, o por qué añadir más datos puede empeorar tu modelo

En el siguiente ejemplo se muestra cómo se puede crear una gráfica en la que se muestra la longitud de pétalo frente al ancho del pétalo en los datos de irir

import matplotlib.pyplot as plt

# Crear un gráfico de dispersión de petal_length vs. petal_width
sns.scatterplot(data=iris, x="petal_length", y="petal_width")

# Mostrar el gráfico
plt.show()
Gráfico de dispersión de la longitud de pétalo frente al ancho del pétalo
Gráfico de dispersión de la longitud de pétalo frente al ancho del pétalo

En la gráfica se puede ver que existe una relación entre ambas variables, a mayor valor de la longitud mayor valor del ancho del pétalo.

Seaborn ofrece muchas opciones de personalización para adaptar los diagramas de dispersión a las necesidades de cada usuario. Veamos algunos ejemplos.

Cambiar el tamaño y el color de los puntos

Es posible ajustar el tamaño y el color de los puntos en el diagrama de dispersión utilizando respectivamente los parámetros s y color de la función scatterplot(). Por ejemplo, se puede aumentar el tamaño de los puntos y cambiar el color a rojo.

# Cambiar el tamaño y el color de los puntos
sns.scatterplot(data=iris, x="petal_length", y="petal_width", s=50, color="red")

# Mostrar el gráfico
plt.show()
Gráfico de dispersión de con los colores configurados
Gráfico de dispersión de con los colores configurados

Publicidad


Agregar grupos y colores por categoría

Es posible agregar un color a cada uno de los puntos en base a una categoría. Para ello se debe usar el parámetro hue al que se le debe indicar el nombre de este parámetro. Así los datos se mostrarán en diferente colores, lo que puede facilitar la comprensión de los mismos. Por ejemplo, se puede agregar la especie a la gráfica anterior para ver cómo se distribuyen los datos en base a esta. Figura que se crea en el siguiente código.

# Agregar grupos y colores por categoría
sns.scatterplot(data=iris, x="petal_length", y="petal_width", hue="species")

# Mostrar el gráfico
plt.show()
Gráfico de dispersión de la longitud de pétalo frente al ancho del pétalo separados por especies
Gráfico de dispersión de la longitud de pétalo frente al ancho del pétalo separados por especies

En donde simplemente se ha asignado el nombre de la columna a la propiedad hue.

Añadir título al gráfico

Una opción bastante habitual es la inclusión de títulos y etiquetes en los ejes de los gráficos. Algo que se puede hacer con los métodos set_title(), set_xlabel() y set_ylabel() del objeto que devuelve la función scatterplot(). Algo que se puede hacer tal como se muestra en el siguiente código.

# Crear un gráfico de dispersión de petal_length vs. petal_width
ax = sns.scatterplot(data=iris, x="petal_length", y="petal_width")

# Añadir título y etiquetas al gráfico
ax.set_title("Diagrama de dispersión de longitud del pétalo vs. ancho del pétalo")
ax.set_xlabel("Longitud del pétalo (cm)")
ax.set_ylabel("Ancho del pétalo (cm)")

# Mostrar el gráfico
plt.show()
Gráfico de dispersión de la longitud de pétalo frente al ancho del pétalo con títulos y etiquetas
Gráfico de dispersión de la longitud de pétalo frente al ancho del pétalo con títulos y etiquetas

Publicidad


Gráficos de regresión

Además de los diagramas de dispersión también se pueden utilizar gráficos de regresión para analizar la relación entre dos variables numéricas y visualizar una posible tendencia lineal. Un gráfico de regresión, además de los puntos del diagrama de dispersión, muestra una línea de regresión que representa el mejor ajuste lineal entre las variables. En Seaborn existe una la función regplot() que combina un diagrama de dispersión con un gráfico de regresión. Haciendo más sencillo crear estos gráficos, no es necesario crear un modelo de regresión lineal por separado. Así, para crear un gráfico de regresión, solamente se debe reemplazar la función scatterplot() por regplot(). Como se muestra a continuación.

# Crear un gráfico de regresión para las variables "petal_length" y "petal_width"
sns.regplot(data=iris, x="petal_length", y="petal_width")

# Mostrar el gráfico de regresión
plt.show()
Gráfico de dispersión de la longitud de pétalo frente al ancho del pétalo
Gráfico de dispersión de la longitud de pétalo frente al ancho del pétalo

Además de la línea de regresión, el gráfico de regresión muestra el intervalo de confianza alrededor de la línea. Lo que nos permite evaluar la incertidumbre en la estimación.

Conclusión

Mediante los diagramas de dispersión y gráficos de regresión es posible visualizar las relaciones existentes entre variables numéricas. Los diagramas de dispersión nos permiten identificar patrones generales, mientras que los gráficos de regresión nos proporcionan una estimación lineal y un intervalo de confianza. En Seaborn existen dos funciones con las que se pueden crear estos gráficos: scatterplot() y regplot(). La primera para los diagramas de dispersión y la segunda para los gráficos de regresión. Esta última es especialmente interesante, ya que se encarga de calcular la regresión lineal entre los datos, el intervalo de confianza y mostrarlo en la gráfica. Sin necesidad realizar la regresión por separado. Lo que hace extremadamente sencillo crear gráficos de regresión con Seaborn.

¿Te ha parecido de utilidad el contenido?

¡Puntúalo entre una y cinco estrellas!

Puntuación promedio 0 / 5. Votos emitidos: 0

Ya que has encontrado útil este contenido...

¡Síguenos en redes sociales!

¡Siento que este contenido no te haya sido útil!

¡Déjame mejorar este contenido!

Dime, ¿cómo puedo mejorar este contenido?

Publicidad


Publicaciones relacionadas

  • Curiosidad: La maldición de la dimensionalidad, o por qué añadir más datos puede empeorar tu modelo
  • ¿Está concentrado el MSCI World? Un análisis con Gini, Lorenz y leyes de potencia
  • Curiosidad: ¿Por qué usamos p < 0.05? Un umbral que cambió la historia de la ciencia
  • Programador de tareas de Windows: Guía definitiva para automatizar tu trabajo (BAT, PowerShell y Python)
  • La Paradoja del Cumpleaños, o por qué no es tan raro compartir fecha de nacimiento
  • Cómo abrir una ventana de Chrome con tamaño y posición específicos desde la línea de comandos en Windows
  • Curiosidad: El sesgo de supervivencia, o por qué prestar atención sólo a los que “llegaron” puede engañarte
  • Documentar tu API de Express con TypeScript usando OpenAPI (Swagger)
  • Data Lake y Data Warehouse: diferencias, usos y cómo se complementan en la era del dato

Publicado en: Python Etiquetado como: Seaborn

Interacciones con los lectores

Deja una respuesta Cancelar la respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

I accept the Terms and Conditions and the Privacy Policy

Este sitio usa Akismet para reducir el spam. Aprende cómo se procesan los datos de tus comentarios.

Barra lateral principal

Suscríbete a nuestro boletín

Suscríbete al boletín semanal para estar al día de todas las publicaciones.

Política de Privacidad

Analytics Lane en redes sociales

  • Amazon
  • Bluesky
  • Facebook
  • GitHub
  • Instagram
  • Mastodon
  • Pinterest
  • RSS
  • Telegram
  • Tumblr
  • Twitter
  • YouTube

Publicidad

Entradas recientes

Data Lake y Data Warehouse: diferencias, usos y cómo se complementan en la era del dato

octubre 23, 2025 Por Daniel Rodríguez

Documentar tu API de Express con TypeScript usando OpenAPI (Swagger)

octubre 21, 2025 Por Daniel Rodríguez

Curiosidad: El sesgo de supervivencia, o por qué prestar atención sólo a los que “llegaron” puede engañarte

octubre 16, 2025 Por Daniel Rodríguez

Publicidad

Es tendencia

  • Aprovecha un 40% de descuento en Coursera Plus para impulsar tus habilidades en Ciencia de Datos e Inteligencia Artificial publicado el noviembre 9, 2024 | en Noticias, Reseñas
  • Entendiendo la validación cruzada: Selección de la profundidad óptima en un árbol de decisión publicado el septiembre 13, 2024 | en Ciencia de datos
  • Diferencias entre CPU, GPU, TPU y NPU publicado el abril 19, 2023 | en Herramientas
  • El método de Muller e implementación en Python publicado el marzo 24, 2023 | en Ciencia de datos
  • Listado de contraseñas de aplicación creadas Resolver problema de credenciales en Bitbucket publicado el marzo 16, 2022 | en Herramientas

Publicidad

Lo mejor valorado

4.9 (24)

Seleccionar filas y columnas en Pandas con iloc y loc

4.6 (16)

Archivos JSON con Python: lectura y escritura

4.4 (14)

Ordenación de diccionarios en Python mediante clave o valor

4.7 (13)

Operaciones de filtrado de DataFrame con Pandas en base a los valores de las columnas

4.5 (10)

Diferencias entre var y let en JavaScript

Publicidad

Comentarios recientes

  • Daniel Rodríguez en Probabilidad básica: cómo entender el azar en nuestra vida diaria
  • Pepe en Probabilidad básica: cómo entender el azar en nuestra vida diaria
  • CARLOS ARETURO BELLO CACERES en Justicio: La herramienta gratuita de IA para consultas legales
  • Piera en Ecuaciones multilínea en Markdown
  • Daniel Rodríguez en Tutorial de Mypy para Principiantes

Publicidad


Footer

Analytics Lane

  • Acerca de Analytics Lane
  • Boletín de noticias
  • Contacto
  • Libros
  • Lo más popular
  • Noticias
  • Tienda
  • Tiendas afiliadas

Secciones

  • Ciencia de datos
  • Criptografía
  • Herramientas
  • Machine Learning
  • Opinión
  • Productividad
  • Programación
  • Reseñas

Sobre de Analytics Lane

En Analytics Lane tratamos de explicar los principales conceptos de la ciencia e ingeniería de datos con un enfoque práctico. Los principales temas tratados son ciencia de datos, ingeniería de datos, inteligencia artificial, machine learning, deep learning y criptografía. Además, también se habla de los principales lenguajes de programación y herramientas utilizadas por los científicos e ingenieros de datos.

Copyright © 2018-2025 Analytics Lane ·Términos y condiciones ·Política de Cookies ·Política de Privacidad ·Herramientas de privacidad ·Contacto