• Saltar al contenido principal
  • Skip to secondary menu
  • Saltar a la barra lateral principal
  • Saltar al pie de página
  • Inicio
  • Secciones
    • Ciencia de datos
    • Criptografía
    • Herramientas
    • Machine Learning
    • Noticias
    • Opinión
    • Productividad
    • Programación
      • JavaScript
      • Julia
      • Matlab
      • Python
      • R
  • Programación
    • JavaScript
    • Julia
    • Matlab
    • Python
    • R
  • Laboratorio
    • Estadística
      • Calculadora del Tamaño Muestral en Encuestas
      • Calculadora de estadísticos descriptivos
      • Test de normalidad
      • Calculadora de contrastes de hipotesis
      • Calculadora de tamano del efecto
      • Simulador de Regresión Lineal con Ruido
      • Visualizador de PCA
      • Visualizador de Series Temporales
      • Simulador de Regresión Logística
      • Simulador de K-Means
      • Simulador de DBSCAN
      • Detector de la Ley de Benford
      • Ajuste de Curvas
      • Calculadora de Matrices
    • Probabilidad
      • Calculadora de Probabilidad de Distribuciones
      • Calculadora de Probabilidades de Lotería
      • Simulador del Problema de Monty Hall
      • Simulador de la Estrategia Martingala
    • Finanzas
      • Calculadora de Préstamos e Hipotecas
      • Conversor TIN ↔ TAE
      • Calculadora DCA con ajuste por inflación
      • Calculadora XIRR con Flujos Irregulares
      • Simulador FIRE (Financial Independence, Retire Early)
    • Negocios
      • CLV
      • Scoring
    • Herramientas
      • Formateador / Minificador de JSON
      • Conversor CSV ↔ JSON
      • Comparador y Formateador de Texto y JSON
      • Formateador y Tester de Expresiones Regulares
      • Inspector de JWT
      • Generador y verificador de hashes
      • Codificador / Decodificador Base64 y URL
      • Conversor de bases numericas
      • Conversor de Timestamp Unix
      • Conversor de colores
      • Generador de UUIDs
    • Juegos
      • Tres en Raya
      • Nim con Q-Learning
    • Más
      • Método D’Hondt
      • Generador de Contraseñas Seguras
  • Noticias
  • Boletín
  • Contacto
  • Tienda
    • Libros
    • Equipamiento de oficina
    • Equipamiento en movilidad

Analytics Lane

Ciencia e ingeniería de datos aplicada

  • Ciencia de datos
  • Machine Learning
  • IA Generativa
  • Python
  • Pandas
  • NumPy
  • R
  • Excel

Ciencia de datos

La ciencia de datos es un área de conocimiento interdisciplinar en el cual se utilizan procesos para recopilar, preparar, analizar, visualizar y modelar datos para extraer todo su valor. Pudiéndose emplear tanto con conjuntos de datos estructurados como no estructurados. Los científicos de datos, los profesionales de esta área deben poseer grandes conocimientos de estadística e informática. Además de conocimiento de los procesos que están modelando.

Con la ciencia de datos es posible revelar tendencias y obtener información para que tanto las empresas como las instituciones puedan tomar mejores decisiones. Basando estas así en conocimiento validado no en intuiciones.

Las publicaciones de esta sección abarca diferentes temas de áreas como la estadística, la minería de datos, el aprendizaje automático y la analítica predictiva.

Customer Lifetime Value: la fórmula clásica que todo analista debería dominar

julio 14, 2026 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 8 minutos

El Customer Lifetime Value (CLV) es, probablemente, la métrica más importante que puede calcular una empresa orientada al cliente. No porque sea la más fácil, no lo es, sino porque obliga a pensar correctamente: un cliente no es una transacción, es una relación con valor económico distribuido en el tiempo.Este artículo cubre la formulación clásica del CLV basada en … [Leer más...] acerca de Customer Lifetime Value: la fórmula clásica que todo analista debería dominar

Data Leakage en Credit Scoring: El Error que Invalida tu Modelo

julio 7, 2026 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 13 minutos

Imagina que construyes un scorecard con un Gini de 0,85. Un resultado extraordinario, muy por encima de los valores típicos de 0,40 a 0,65 en credito al consumo. El modelo pasa todas las pruebas de validación, el equipo está satisfecho y se despliega en producción.Tres meses después el modelo deja de funcionar. El Gini cae a 0,35. Las predicciones son inútiles. El equipo de … [Leer más...] acerca de Data Leakage en Credit Scoring: El Error que Invalida tu Modelo

DBSCAN y la selección de ε: teoría, intuición y aplicación práctica

junio 30, 2026 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 11 minutos

Cuando hablamos de clustering, lo primero que viene a la mente suele ser k-means. Pero k-means tiene dos limitaciones importantes: hay que decidir cuántos clusters queremos a priori, y trata cualquier punto como parte de algún grupo, aunque sea claramente un valor atípico.DBSCAN (Density-Based Spatial Clustering of Applications with Noise) resuelve precisamente esos dos … [Leer más...] acerca de DBSCAN y la selección de ε: teoría, intuición y aplicación práctica

El Binning en Credit Scoring: El Arte de Discretizar Variables

junio 16, 2026 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 14 minutos

Si el WOE y el IV son la base matemática del credit scoring, el binning es el arte que hace que esa matemática funcione en la práctica. Es el paso más crítico, probablemente el más subjetivo y también el menos documentado de todo el proceso de construcción de un scorecard.Dicho de forma simple: el binning consiste en discretizar las variables continuas en intervalos y … [Leer más...] acerca de El Binning en Credit Scoring: El Arte de Discretizar Variables

Calibración vs Discriminación en Credit Scoring: diferencias clave y cómo evaluarlas

junio 2, 2026 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 14 minutos

Imagina que construyes un modelo de credit scoring y obtienes un Gini de 0,65. Un resultado excelente por cualquier estándar de la industria. Lo validas en el conjunto de test y el Gini se mantiene en 0,62. Publicas el modelo, lo pones en producción y empiezas a usarlo para tomar decisiones de crédito.Seis meses después el departamento de riesgo detecta un problema: las … [Leer más...] acerca de Calibración vs Discriminación en Credit Scoring: diferencias clave y cómo evaluarlas

Ley de Benford: cómo detectar datos manipulados con ejemplos reales

mayo 28, 2026 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 8 minutos

En un mundo donde los datos se han convertido en el lenguaje dominante de la toma de decisiones, surge una pregunta inevitable: ¿cómo podemos saber si esos datos son realmente fiables?Más allá de técnicas complejas de auditoría o análisis forense, existe una herramienta sorprendentemente simple, elegante y poderosa que permite detectar posibles manipulaciones en conjuntos … [Leer más...] acerca de Ley de Benford: cómo detectar datos manipulados con ejemplos reales

Síndrome del objeto brillante en ciencia de datos: el error simétrico a los costes hundidos

mayo 21, 2026 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 15 minutos

Hace poco publiqué una entrada en la que trataba de un sesgo bien documentado: aferrarse a sistemas existentes porque el esfuerzo pasado pesa más de lo que debería en la toma de decisión. La falacia del coste hundido aplicada a modelos de aprendizaje automático en producción produce inercia técnica, deuda acumulada, y decisiones de mantenimiento que se justifican con argumentos … [Leer más...] acerca de Síndrome del objeto brillante en ciencia de datos: el error simétrico a los costes hundidos

De la Regresión Logística al Scorecard: La Transformación Matemática

mayo 19, 2026 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 11 minutos

En un entrada previa explicamos qué son el WOE y el IV y por qué son la base matemática del credit scoring. En esta entrada vamos un paso más alla: una vez que tenemos las variables transformadas a WOE y hemos ajustado la regresión logística, ¿cómo convertimos los coeficientes estadísticos en una tabla de puntos que cualquier analista puede aplicar con una hoja de … [Leer más...] acerca de De la Regresión Logística al Scorecard: La Transformación Matemática

Interés compuesto: la fuerza que multiplica tu dinero (y los errores que la anulan)

mayo 14, 2026 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 13 minutos

“El interés compuesto es la octava maravilla del mundo. El que lo entiende lo gana y el que no lo paga.” La cita se atribuye a Einstein, aunque probablemente nunca la dijo. No importa, la idea es correcta y el hecho de que se le atribuya a Einstein dice algo sobre cómo percibimos este concepto: como algo casi mágico, reservado para los genios.No es magia. Es aritmética. … [Leer más...] acerca de Interés compuesto: la fuerza que multiplica tu dinero (y los errores que la anulan)

Costes hundidos en ciencia de datos: cuándo mantener un modelo y cuándo migrar

mayo 7, 2026 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 17 minutos

Imagina la situación. Tu equipo lleva tres años con un modelo en producción. No es el estado del arte, pero funciona: predice razonablemente bien, el pipeline de datos está estabilizado, el sistema de monitorización detecta la mayoría de las derivas, y todo el mundo sabe cómo tocarlo sin romper nada. Es el tipo de sistema que genera confianza silenciosa — nadie habla de él … [Leer más...] acerca de Costes hundidos en ciencia de datos: cuándo mantener un modelo y cuándo migrar

WOE e IV: La Base Matemática del Credit Scoring

mayo 5, 2026 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 12 minutos

Cuando un banco evalúa una solicitud de crédito necesita responder a una pregunta aparentemente simple: ¿cuál es la probabilidad de que este cliente no pague? Para responderla dispone de decenas de variables sobre el solicitante — sus ingresos, su edad, el importe que solicita — pero esas variables tienen escalas, unidades y distribuciones completamente distintas. ¿Cómo … [Leer más...] acerca de WOE e IV: La Base Matemática del Credit Scoring

Exactitud, precisión, recall… y los errores que cometemos al interpretarlas en proyectos reales

abril 7, 2026 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 7 minutos

En dos artículos anteriores hemos intentado explicar qué mide cada métrica de clasificación desde una perspectiva conceptual e intuitiva y cuál deberíamos usar para el problema que queremos resolver en cada caso, viendo a qué pregunta responde cada una de las métricas. En concreto, se han visto los siguientes puntos:Como se puede apreciar, son preguntas distintas. Y, por … [Leer más...] acerca de Exactitud, precisión, recall… y los errores que cometemos al interpretarlas en proyectos reales

  • Página 1
  • Página 2
  • Página 3
  • Páginas intermedias omitidas …
  • Página 19
  • Ir a la página siguiente »

Barra lateral principal

Suscríbete a nuestro boletín

Suscríbete al boletín semanal para estar al día de todas las publicaciones.

Política de Privacidad

Analytics Lane en redes sociales

  • Amazon
  • Bluesky
  • Facebook
  • GitHub
  • Instagram
  • Mastodon
  • Pinterest
  • RSS
  • Telegram
  • Tumblr
  • Twitter
  • YouTube

Publicidad

Entradas recientes

Los indicadores que se autocumplen, o cuando medir es modificar – El bestiario de los indicadores económicos absurdos (parte 7)

julio 16, 2026 Por Daniel Rodríguez

Customer Lifetime Value: la fórmula clásica que todo analista debería dominar

julio 14, 2026 Por Daniel Rodríguez

Noticias

Analytics Lane lanza la versión 1.4 del laboratorio con nuevas herramientas de conversión y modelos avanzados de CLV

julio 10, 2026 Por Daniel Rodríguez

Publicidad

Es tendencia

  • Error de VirtualBox: Kernel Driver Not Installed (rc=-1908) Solucionar problema de VirtualBox: Kernel Driver Not Installed (rc=-1908) publicado el octubre 21, 2022 | en Herramientas
  • Visualización de datos categóricos en Seaborn publicado el agosto 1, 2023 | en Python
  • Introducción a XGBoost: Instalación y primeros pasos publicado el abril 5, 2024 | en Ciencia de datos
  • Cerca La regresión logística publicado el julio 23, 2018 | en Ciencia de datos
  • Introducción al Análisis de Componentes Principales (PCA) publicado el mayo 3, 2024 | en Ciencia de datos

Publicidad

Lo mejor valorado

4.9 (24)

Seleccionar filas y columnas en Pandas con iloc y loc

4.6 (16)

Archivos JSON con Python: lectura y escritura

4.4 (14)

Ordenación de diccionarios en Python mediante clave o valor

4.7 (13)

Operaciones de filtrado de DataFrame con Pandas en base a los valores de las columnas

4.1 (11)

Aplicar el método D’Hondt en Excel

Comentarios recientes

  • bif en JSON en bases de datos: cuándo es buena idea y cuándo no
  • bif en Cómo desinstalar Oracle Database 19c en Windows
  • M. Pilar en Cómo eliminar las noticias en Windows 11 y recuperar tu concentración
  • Daniel Rodríguez en Probabilidad básica: cómo entender el azar en nuestra vida diaria
  • Pepe en Probabilidad básica: cómo entender el azar en nuestra vida diaria

Publicidad


Footer

Analytics Lane

  • Acerca de Analytics Lane
  • Boletín de noticias
  • Contacto
  • Libros
  • Lo más popular
  • Noticias
  • Tienda
  • Tiendas afiliadas

Secciones

  • Ciencia de datos
  • Criptografía
  • Herramientas
  • Machine Learning
  • Opinión
  • Productividad
  • Programación
  • Reseñas

Sobre de Analytics Lane

En Analytics Lane tratamos de explicar los principales conceptos de la ciencia e ingeniería de datos con un enfoque práctico. Los principales temas tratados son ciencia de datos, ingeniería de datos, inteligencia artificial, machine learning, deep learning y criptografía. Además, también se habla de los principales lenguajes de programación y herramientas utilizadas por los científicos e ingenieros de datos.

Copyright © 2018-2026 Analytics Lane ·Términos y condiciones ·Política de Cookies ·Política de Privacidad ·Herramientas de privacidad ·Contacto