• Saltar al contenido principal
  • Skip to secondary menu
  • Saltar a la barra lateral principal
  • Saltar al pie de página
  • Inicio
  • Secciones
    • Ciencia de datos
    • Criptografía
    • Herramientas
    • Machine Learning
    • Noticias
    • Opinión
    • Productividad
    • Programación
      • JavaScript
      • Julia
      • Matlab
      • Python
      • R
  • Programación
    • JavaScript
    • Julia
    • Matlab
    • Python
    • R
  • Laboratorio
    • Estadística
      • Calculadora del Tamaño Muestral en Encuestas
      • Calculadora de estadísticos descriptivos
      • Test de normalidad
      • Calculadora de contrastes de hipotesis
      • Calculadora de tamano del efecto
      • Simulador de Regresión Lineal con Ruido
      • Visualizador de PCA
      • Visualizador de Series Temporales
      • Simulador de Regresión Logística
      • Simulador de K-Means
      • Simulador de DBSCAN
      • Detector de la Ley de Benford
      • Ajuste de Curvas
      • Calculadora de Matrices
    • Probabilidad
      • Calculadora de Probabilidad de Distribuciones
      • Calculadora de Probabilidades de Lotería
      • Simulador del Problema de Monty Hall
      • Simulador de la Estrategia Martingala
    • Finanzas
      • Calculadora de Préstamos e Hipotecas
      • Conversor TIN ↔ TAE
      • Calculadora DCA con ajuste por inflación
      • Calculadora XIRR con Flujos Irregulares
      • Simulador FIRE (Financial Independence, Retire Early)
    • Negocios
      • CLV
      • Scoring
    • Herramientas
      • Formateador / Minificador de JSON
      • Conversor CSV ↔ JSON
      • Comparador y Formateador de Texto y JSON
      • Formateador y Tester de Expresiones Regulares
      • Inspector de JWT
      • Generador y verificador de hashes
      • Codificador / Decodificador Base64 y URL
      • Conversor de bases numericas
      • Conversor de Timestamp Unix
      • Conversor de colores
      • Generador de UUIDs
    • Juegos
      • Tres en Raya
      • Nim con Q-Learning
    • Más
      • Método D’Hondt
      • Generador de Contraseñas Seguras
  • Noticias
  • Boletín
  • Contacto
  • Tienda
    • Libros
    • Equipamiento de oficina
    • Equipamiento en movilidad

Analytics Lane

Ciencia e ingeniería de datos aplicada

  • Ciencia de datos
  • Machine Learning
  • IA Generativa
  • Python
  • Pandas
  • NumPy
  • R
  • Excel

Ciencia de datos

La ciencia de datos es un área de conocimiento interdisciplinar en el cual se utilizan procesos para recopilar, preparar, analizar, visualizar y modelar datos para extraer todo su valor. Pudiéndose emplear tanto con conjuntos de datos estructurados como no estructurados. Los científicos de datos, los profesionales de esta área deben poseer grandes conocimientos de estadística e informática. Además de conocimiento de los procesos que están modelando.

Con la ciencia de datos es posible revelar tendencias y obtener información para que tanto las empresas como las instituciones puedan tomar mejores decisiones. Basando estas así en conocimiento validado no en intuiciones.

Las publicaciones de esta sección abarca diferentes temas de áreas como la estadística, la minería de datos, el aprendizaje automático y la analítica predictiva.

Curiosidad: ¿Por qué se llama “regresión” lineal?

noviembre 20, 2025 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 3 minutos

Un nombre que suena a retroceso… pero que usamos para predecir el futuro: la regresión lineal.Es una de las herramientas más conocidas en estadística y ciencia de datos. Sirve para modelar relaciones entre variables, anticipar resultados y entender tendencias. Pero si te detienes un momento… su nombre parece contradictorio.¿Por qué se llama “regresión”? ¿No se supone … [Leer más...] acerca de Curiosidad: ¿Por qué se llama “regresión” lineal?

Cómo crear un Data Lake en Azure paso a paso

noviembre 13, 2025 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 9 minutos

El volumen de datos que las organizaciones generan y deben manejar crece día a día: transacciones, registros de acceso, dispositivos IoT, interacciones en redes sociales o simplemente los logs de las aplicaciones. Para poder extraer valor de toda esta información es necesario contar con sistemas capaces de almacenar, organizar y procesar grandes volúmenes de datos de forma … [Leer más...] acerca de Cómo crear un Data Lake en Azure paso a paso

Curiosidad: ¿Por qué los datos “raros” son tan valiosos?

noviembre 6, 2025 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 3 minutos

En estadística, los valores atípicos —también llamados outliers— son esos datos que se alejan “demasiado” del resto. Son los números que no encajan, los casos extremos, los que te hacen fruncir el ceño y preguntarte: ¿esto estará mal medido?Durante años se nos ha enseñado a sospechar de los outliers. A corregirlos, suavizarlos o, directamente, eliminarlos del … [Leer más...] acerca de Curiosidad: ¿Por qué los datos “raros” son tan valiosos?

¿Media, mediana o moda en variables ordinales? Guía práctica para el análisis de datos

octubre 28, 2025 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 7 minutos

Cuando comenzamos un análisis de datos, uno de los primeros pasos suele ser resumir las variables mediante medidas de tendencia central: la media, la mediana y la moda. Estas estadísticas nos ayudan a identificar el valor "típico" o más representativo de un conjunto de datos. Sin embargo, no todas las variables son iguales, y la elección de la medida más adecuada depende de la … [Leer más...] acerca de ¿Media, mediana o moda en variables ordinales? Guía práctica para el análisis de datos

Data Lake y Data Warehouse: diferencias, usos y cómo se complementan en la era del dato

octubre 23, 2025 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 10 minutos

Los datos se han convertido en uno de los activos más valiosos para las organizaciones. Su correcta gestión, custodia y acceso son factores clave para mantener la competitividad. Cada interacción digital, cada transacción y cada sensor conectado a Internet generan cantidades ingentes de información. Este fenómeno, conocido como Big Data, ha transformado la forma en que las … [Leer más...] acerca de Data Lake y Data Warehouse: diferencias, usos y cómo se complementan en la era del dato

Curiosidad: ¿Por qué usamos p < 0.05? Un umbral que cambió la historia de la ciencia

octubre 2, 2025 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 3 minutos

En casi cualquier análisis estadístico —ya sea en medicina, psicología, economía o ciencia de datos— hay un valor que aparece como juez supremo: el famoso p < 0.05.Si el valor p es menor que 0.05, decimos que el resultado es ”estadísticamente significativo”. Pero… ¿por qué ese número y no otro como 0.01 o 0.10? ¿Tiene algún fundamento teórico o fue elegido al azar?La … [Leer más...] acerca de Curiosidad: ¿Por qué usamos p < 0.05? Un umbral que cambió la historia de la ciencia

¿Está concentrado el MSCI World? Un análisis con Gini, Lorenz y leyes de potencia

septiembre 30, 2025 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 8 minutos

El MSCI World Index suele presentarse como “la ventana al mundo” para quienes invierten en bolsa. Es uno de los índices más seguidos por inversores y gestores de fondos porque, en teoría, ofrece una exposición global a los mercados desarrollados. Reúne en torno a 1500 empresas de gran y mediana capitalización repartidas en 23 países, desde Estados Unidos hasta Europa y … [Leer más...] acerca de ¿Está concentrado el MSCI World? Un análisis con Gini, Lorenz y leyes de potencia

Curiosidad: La maldición de la dimensionalidad, o por qué añadir más datos puede empeorar tu modelo

septiembre 25, 2025 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 3 minutos

En el mundo del análisis de datos solemos escuchar una idea poderosa: cuantos más datos, mejor. Más variables, más columnas, más información… ¿qué podría salir mal?Pues bien, existe un fenómeno conocido como la maldición de la dimensionalidad que demuestra que añadir más dimensiones (variables) a un conjunto de datos puede complicarlo todo: desde la visualización hasta el … [Leer más...] acerca de Curiosidad: La maldición de la dimensionalidad, o por qué añadir más datos puede empeorar tu modelo

Curiosidad: La Paradoja de Simpson, o por qué no siempre debes fiarte de los promedios

septiembre 18, 2025 Por Daniel Rodríguez 2 comentarios
Tiempo de lectura: 3 minutos

En ciencia de datos y estadística, los promedios y porcentajes son herramientas fundamentales para resumir información… pero a veces pueden jugarte una mala pasada. La Paradoja de Simpson es uno de esos casos fascinantes donde los datos nos muestran una verdad a medias, o incluso directamente equivocada, dependiendo de cómo los agrupamos.Se trata de un fenómeno en el que … [Leer más...] acerca de Curiosidad: La Paradoja de Simpson, o por qué no siempre debes fiarte de los promedios

Curiosidad: La Ley de Twyman y la trampa de los datos “interesantes”

septiembre 11, 2025 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 3 minutos

En ciencia de datos, pocas cosas llaman más la atención de los científicos de datos que un valor inesperado, un pico extraño o una correlación sorprendente. Pero cuidado: según la Ley de Twyman (Twyman's law), esos datos que parecen más interesantes… ¡suelen estar mal!Formulada de manera informal por el experto en visualización Tony Twyman, esta regla no escrita … [Leer más...] acerca de Curiosidad: La Ley de Twyman y la trampa de los datos “interesantes”

Cómo calcular el tamaño de la muestra para encuestas

septiembre 9, 2025 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 10 minutos

Calcular adecuadamente el tamaño de la muestra es una parte esencial en el diseño de cualquier encuesta seria. Este paso es fundamental para garantizar que los resultados obtenidos no solo reflejan de forma representativa la realidad de la población, sino que también sean estadísticamente significativos y confiables. Una muestra bien calculada permite optimizar el uso de … [Leer más...] acerca de Cómo calcular el tamaño de la muestra para encuestas

Curiosidad: El origen del análisis exploratorio de datos y el papel de John Tukey

septiembre 4, 2025 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 2 minutos

Hoy en día, cuando pensamos en ciencia de datos, lo primero que nos viene a la mente suelen ser modelos predictivos complejos, redes neuronales o algoritmos de machine learning que toman decisiones casi mágicas. Sin embargo, uno de los pilares más importantes de esta disciplina moderna tiene raíces mucho más sencillas y humanas: observar, explorar y dejar que los datos hablen … [Leer más...] acerca de Curiosidad: El origen del análisis exploratorio de datos y el papel de John Tukey

  • « Ir a la página anterior
  • Página 1
  • Página 2
  • Página 3
  • Página 4
  • Página 5
  • Página 6
  • Páginas intermedias omitidas …
  • Página 20
  • Ir a la página siguiente »

Barra lateral principal

Suscríbete a nuestro boletín

Suscríbete al boletín semanal para estar al día de todas las publicaciones.

Política de Privacidad

Analytics Lane en redes sociales

  • Amazon
  • Bluesky
  • Facebook
  • GitHub
  • Instagram
  • Mastodon
  • Pinterest
  • RSS
  • Telegram
  • Tumblr
  • Twitter
  • YouTube

Publicidad

Entradas recientes

Por qué migrar tus proyectos TypeScript a ES Modules en 2026

septiembre 17, 2026 Por Daniel Rodríguez

Método del codo: interpretación correcta y limitaciones

septiembre 15, 2026 Por Daniel Rodríguez

Errores comunes al interpretar resultados estadísticos

septiembre 10, 2026 Por Daniel Rodríguez

Publicidad

Es tendencia

  • Método del codo (Elbow method) para seleccionar el número óptimo de clústeres en K-means publicado el junio 9, 2023 | en Ciencia de datos
  • Gini, KS y AUC: Cómo Medir la Calidad de un Modelo de Credit Scoring publicado el agosto 18, 2026 | en Ciencia de datos
  • Curiosidad: La Paradoja de Simpson, o por qué no siempre debes fiarte de los promedios publicado el septiembre 18, 2025 | en Ciencia de datos, Opinión
  • Operaciones de filtrado de DataFrame con Pandas en base a los valores de las columnas publicado el mayo 10, 2019 | en Python
  • Julia en Jupyter Notebook publicado el septiembre 20, 2019 | en Julia

Publicidad

Lo mejor valorado

4.9 (24)

Seleccionar filas y columnas en Pandas con iloc y loc

4.6 (16)

Archivos JSON con Python: lectura y escritura

4.4 (14)

Ordenación de diccionarios en Python mediante clave o valor

4.7 (13)

Operaciones de filtrado de DataFrame con Pandas en base a los valores de las columnas

4.1 (11)

Aplicar el método D’Hondt en Excel

Comentarios recientes

  • Daniel Rodríguez en Curiosidad: La Paradoja de Simpson, o por qué no siempre debes fiarte de los promedios
  • Hatepi en Curiosidad: La Paradoja de Simpson, o por qué no siempre debes fiarte de los promedios
  • Daniel Rodríguez en Los récords con asterisco, o la épica del titular sin contexto – El bestiario de los indicadores económicos absurdos (parte 8 y final)
  • Juan en Los récords con asterisco, o la épica del titular sin contexto – El bestiario de los indicadores económicos absurdos (parte 8 y final)
  • bif en JSON en bases de datos: cuándo es buena idea y cuándo no

Publicidad


Footer

Analytics Lane

  • Acerca de Analytics Lane
  • Boletín de noticias
  • Contacto
  • Libros
  • Lo más popular
  • Noticias
  • Tienda
  • Tiendas afiliadas

Secciones

  • Ciencia de datos
  • Criptografía
  • Herramientas
  • Machine Learning
  • Opinión
  • Productividad
  • Programación
  • Reseñas

Sobre de Analytics Lane

En Analytics Lane tratamos de explicar los principales conceptos de la ciencia e ingeniería de datos con un enfoque práctico. Los principales temas tratados son ciencia de datos, ingeniería de datos, inteligencia artificial, machine learning, deep learning y criptografía. Además, también se habla de los principales lenguajes de programación y herramientas utilizadas por los científicos e ingenieros de datos.

Copyright © 2018-2026 Analytics Lane ·Términos y condiciones ·Política de Cookies ·Política de Privacidad ·Herramientas de privacidad ·Contacto