• Saltar al contenido principal
  • Skip to secondary menu
  • Saltar a la barra lateral principal
  • Saltar al pie de página
  • Inicio
  • Secciones
    • Ciencia de datos
    • Criptografía
    • Herramientas
    • Machine Learning
    • Noticias
    • Opinión
    • Productividad
    • Programación
      • JavaScript
      • Julia
      • Matlab
      • Python
      • R
  • Programación
    • JavaScript
    • Julia
    • Matlab
    • Python
    • R
  • Laboratorio
    • Estadística
      • Calculadora del Tamaño Muestral en Encuestas
      • Calculadora de estadísticos descriptivos
      • Test de normalidad
      • Calculadora de contrastes de hipotesis
      • Calculadora de tamano del efecto
      • Simulador de Regresión Lineal con Ruido
      • Visualizador de PCA
      • Visualizador de Series Temporales
      • Simulador de Regresión Logística
      • Simulador de K-Means
      • Simulador de DBSCAN
      • Detector de la Ley de Benford
      • Ajuste de Curvas
      • Calculadora de Matrices
    • Probabilidad
      • Calculadora de Probabilidad de Distribuciones
      • Calculadora de Probabilidades de Lotería
      • Simulador del Problema de Monty Hall
      • Simulador de la Estrategia Martingala
    • Finanzas
      • Calculadora de Préstamos e Hipotecas
      • Conversor TIN ↔ TAE
      • Calculadora DCA con ajuste por inflación
      • Calculadora XIRR con Flujos Irregulares
      • Simulador FIRE (Financial Independence, Retire Early)
    • Negocios
      • CLV
      • Scoring
    • Herramientas
      • Formateador / Minificador de JSON
      • Conversor CSV ↔ JSON
      • Comparador y Formateador de Texto y JSON
      • Formateador y Tester de Expresiones Regulares
      • Inspector de JWT
      • Generador y verificador de hashes
      • Codificador / Decodificador Base64 y URL
      • Conversor de bases numericas
      • Conversor de Timestamp Unix
      • Conversor de colores
      • Generador de UUIDs
    • Juegos
      • Tres en Raya
      • Nim con Q-Learning
    • Más
      • Método D’Hondt
      • Generador de Contraseñas Seguras
  • Noticias
  • Boletín
  • Contacto
  • Tienda
    • Libros
    • Equipamiento de oficina
    • Equipamiento en movilidad

Analytics Lane

Ciencia e ingeniería de datos aplicada

  • Ciencia de datos
  • Machine Learning
  • IA Generativa
  • Python
  • Pandas
  • NumPy
  • R
  • Excel

Comparación entre la regresión logística y SVM (máquinas de vectores de soporte)

Machine learning

febrero 6, 2019 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 4 minutos

Unos de los problemas más habituales en aprendizaje automático son los problemas de clasificación. El objetivo en este tipo de problemas es asignar la clase correcta a cada uno de los registros de un conjunto de datos. Un caso particular de estos es la clasificación binaria, en el que solamente existen dos clases que suelen etiquetadas como verdadero y falso. Los algoritmos de clasificación buscan una función que separe de la mejor forma posible los registros. Entre los algoritmos que se utilizan para resolver este tipo de problemas dos de los más habituales son la regresión logística y las máquinas de vector soporte (SVM, “Support Vector Machine”). En esta entrada se realizará una comparación entre la regresión logística y SVM.

La regresión logística

En la regresión logística se utiliza la función sigmoide para asignar un valor entre 0 y 1 a cada punto del espacio de características. La etiqueta que se le asigna a cada registro dependerá del valor que tome la función. Por encima de un valor umbral, generalmente 0,5, se le asigna el valor positivo y por debajo el valor negativo. La función sigmoidea es una curva en forma de S que solamente puede tener valores entre 0 y 1, pero nunca valores fuera de estos límites. La expresión que define la función sigmoidea es

Por qué migrar tus proyectos TypeScript a ES Modules en 2026
En Analytics Lane
Por qué migrar tus proyectos TypeScript a ES Modules en 2026

f(x) = \frac{1}{1 + e^{-\omega x}}

Máquinas de vector soporte (SVM)

En objetivo de SVM es localizar el hiperplano del espacio de características que separe de forma optima a los puntos de cada clase. Siendo el hiperplano la extensión del concepto de plano en espacios de tres dimensiones a espacios con N dimensiones. Ya que, en tres dimensiones, los planos dividen el espacio en dos mitades. Por ejemplo, en una recta (espacio de una dimensión) el punto es el hiperplano y en un plano (espacio de dos dimensiones) la recta es el hiperplano. Así los puntos que caen a un lado del hiperplano se pueden atribuir a una clase y el resto a otra.

Publicidad


Comparación de la función de coste

Ambos métodos se entrenan minimizando su función de coste, la que nos indica el error que se comete al clasificar. Las diferencias que existen entre ambas nos pueden ayudar a comprender las diferencias que existen entre los dos métodos. En el caso de la regresión logística la función de coste es:

J_{LR}(\omega) = \sum_i \log\left(1 + \exp\left(1 -y_i \omega^T x_i\right) \right)

Por otro lado, para las máquinas de vector soporte la función de coste es:

J_{SVM}(\omega) = \sum_i \max\left\{0, 1 - y_i \omega^T x_i\right\}

Al analizar ambas funciones de esfuerzo de la regresión logística frente a SVM hay dos aspectos a tener en cuenta:

  • La función de coste de la regresión logística diverge más rápido que la de las SVM, por lo que será más sensible a la presencia de datos atípicos. Provocando peores resultados cuando existe este tipo de valores en el conjunto de datos.
  • La función de coste logística no puede ser cero, aunque la clasificación sea muy precisa. Lo que podría conducir a una menor degradación en la precisión.

Ambos puntos indican que normalmente las SVM ofrecerán un rendimiento superior al de la regresión logística. Además, se puede observar que en el caso de SVM se maximiza el margen entre los vectores de soporte más cercanos, mientras que en la regresión logística busca maximizar la probabilidad de la clase posterior. Por lo que SVM suele encontrar soluciones que son más económicas para las dos categorías.

Otra diferencia entre ambos métodos es que la regresión logística ofrece un valor probabilístico de la clase, en lugar de una predicción como SVM. Lo que puede ser una ventaja, dado que ofrece una gran flexibilidad. En la regresión logística la predicción se realiza a fijando un valor umbral, por encima del cual la clase es verdadera y por debajo falsa. Esto permite adaptar las predicciones para reducir los falsos positivos o los falsos negativos, según nos interese en cada situación.

Conclusiones

Generalmente es aconsejable probar primero con la regresión logística, para ver cómo clasifica el algoritmo más sencillo. En caso de que falle o los resultados no sean satisfactorios se puede probar con SVM. La regresión logística y SVM pueden fallar porque los datos no se pueden separar linealmente. En estas situaciones se puede probar evaluar SVM con kernels no lineales.

En la entrada de hoy se han comparado la regresión logística frente a SVM, dos de los métodos más utilizados en aprendizaje automático. Ambos ofrecen buenos resultados en la mayoría de las ocasiones, aunque cada uno tiene sus ventajas.

Imágenes: Unsplash (Franck V.)

¿Te ha parecido de utilidad el contenido?

¡Puntúalo entre una y cinco estrellas!

Puntuación promedio 5 / 5. Votos emitidos: 1

Ya que has encontrado útil este contenido...

¡Síguenos en redes sociales!

¡Siento que este contenido no te haya sido útil!

¡Déjame mejorar este contenido!

Dime, ¿cómo puedo mejorar este contenido?

Publicaciones relacionadas

  • Por qué migrar tus proyectos TypeScript a ES Modules en 2026
  • Actualizar expresslanets a ES Modules con tsx y Vitest
  • Migrar tslane a un paquete dual CommonJS y ESM con tsup y Vitest
  • Curiosidad: Por qué la criptografía habla siempre de Alice y Bob
  • Errores comunes al interpretar resultados estadísticos
  • Método del codo: interpretación correcta y limitaciones
  • Dashboard CLV: cuatro modelos, un mismo dataset, conclusiones muy distintas
  • Pareto/NBD: cuando el abandono silencioso cambia el CLV
  • Cómo construir tu primer scorecard paso a paso

Publicado en: Ciencia de datos Etiquetado como: Machine learning

Interacciones con los lectores

Deja una respuesta Cancelar la respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

I accept the Terms and Conditions and the Privacy Policy

Este sitio usa Akismet para reducir el spam. Aprende cómo se procesan los datos de tus comentarios.

Barra lateral principal

Suscríbete a nuestro boletín

Suscríbete al boletín semanal para estar al día de todas las publicaciones.

Política de Privacidad

Analytics Lane en redes sociales

  • Amazon
  • Bluesky
  • Facebook
  • GitHub
  • Instagram
  • Mastodon
  • Pinterest
  • RSS
  • Telegram
  • Tumblr
  • Twitter
  • YouTube

Publicidad

Entradas recientes

Migrar tslane a un paquete dual CommonJS y ESM con tsup y Vitest

octubre 1, 2026 Por Daniel Rodríguez

Cómo construir tu primer scorecard paso a paso

septiembre 29, 2026 Por Daniel Rodríguez

Actualizar expresslanets a ES Modules con tsx y Vitest

septiembre 24, 2026 Por Daniel Rodríguez

Publicidad

Es tendencia

  • Hoja de cálculo para repartir los escaños en base al método D’Hont Aplicar el método D’Hondt en Excel publicado el abril 14, 2021 | en Herramientas
  • Gráficos de barras en Matplotlib publicado el julio 5, 2022 | en Python
  • Cómo comparar tendencias con gráficos de líneas en Matplotlib: guía práctica paso a paso publicado el junio 9, 2026 | en Python
  • 7 extensiones de Visual Studio Code para ciencia de datos publicado el enero 27, 2023 | en Herramientas
  • Seleccionar las mejores características para un modelo con Scikit-learn publicado el abril 1, 2022 | en Ciencia de datos, Python

Publicidad

Lo mejor valorado

4.9 (24)

Seleccionar filas y columnas en Pandas con iloc y loc

4.6 (16)

Archivos JSON con Python: lectura y escritura

4.4 (14)

Ordenación de diccionarios en Python mediante clave o valor

4.7 (13)

Operaciones de filtrado de DataFrame con Pandas en base a los valores de las columnas

4.1 (11)

Aplicar el método D’Hondt en Excel

Comentarios recientes

  • Daniel Rodríguez en Curiosidad: La Paradoja de Simpson, o por qué no siempre debes fiarte de los promedios
  • Hatepi en Curiosidad: La Paradoja de Simpson, o por qué no siempre debes fiarte de los promedios
  • Daniel Rodríguez en Los récords con asterisco, o la épica del titular sin contexto – El bestiario de los indicadores económicos absurdos (parte 8 y final)
  • Juan en Los récords con asterisco, o la épica del titular sin contexto – El bestiario de los indicadores económicos absurdos (parte 8 y final)
  • bif en JSON en bases de datos: cuándo es buena idea y cuándo no

Publicidad


Footer

Analytics Lane

  • Acerca de Analytics Lane
  • Boletín de noticias
  • Contacto
  • Libros
  • Lo más popular
  • Noticias
  • Tienda
  • Tiendas afiliadas

Secciones

  • Ciencia de datos
  • Criptografía
  • Herramientas
  • Machine Learning
  • Opinión
  • Productividad
  • Programación
  • Reseñas

Sobre de Analytics Lane

En Analytics Lane tratamos de explicar los principales conceptos de la ciencia e ingeniería de datos con un enfoque práctico. Los principales temas tratados son ciencia de datos, ingeniería de datos, inteligencia artificial, machine learning, deep learning y criptografía. Además, también se habla de los principales lenguajes de programación y herramientas utilizadas por los científicos e ingenieros de datos.

Copyright © 2018-2026 Analytics Lane ·Términos y condiciones ·Política de Cookies ·Política de Privacidad ·Herramientas de privacidad ·Contacto