• Saltar al contenido principal
  • Skip to secondary menu
  • Saltar a la barra lateral principal
  • Saltar al pie de página
  • Inicio
  • Secciones
    • Ciencia de datos
    • Criptografía
    • Herramientas
    • Machine Learning
    • Noticias
    • Opinión
    • Productividad
    • Programación
      • JavaScript
      • Julia
      • Matlab
      • Python
      • R
  • Programación
    • JavaScript
    • Julia
    • Matlab
    • Python
    • R
  • Laboratorio
    • Estadística
      • Calculadora del Tamaño Muestral en Encuestas
      • Calculadora de estadísticos descriptivos
      • Test de normalidad
      • Calculadora de contrastes de hipotesis
      • Calculadora de tamano del efecto
      • Simulador de Regresión Lineal con Ruido
      • Visualizador de PCA
      • Visualizador de Series Temporales
      • Simulador de Regresión Logística
      • Simulador de K-Means
      • Simulador de DBSCAN
      • Detector de la Ley de Benford
      • Ajuste de Curvas
      • Calculadora de Matrices
    • Probabilidad
      • Calculadora de Probabilidad de Distribuciones
      • Calculadora de Probabilidades de Lotería
      • Simulador del Problema de Monty Hall
      • Simulador de la Estrategia Martingala
    • Finanzas
      • Calculadora de Préstamos e Hipotecas
      • Conversor TIN ↔ TAE
      • Calculadora DCA con ajuste por inflación
      • Calculadora XIRR con Flujos Irregulares
      • Simulador FIRE (Financial Independence, Retire Early)
    • Negocios
      • CLV
      • Scoring
    • Herramientas
      • Formateador / Minificador de JSON
      • Conversor CSV ↔ JSON
      • Comparador y Formateador de Texto y JSON
      • Formateador y Tester de Expresiones Regulares
      • Inspector de JWT
      • Generador y verificador de hashes
      • Codificador / Decodificador Base64 y URL
      • Conversor de bases numericas
      • Conversor de Timestamp Unix
      • Conversor de colores
      • Generador de UUIDs
    • Juegos
      • Tres en Raya
      • Nim con Q-Learning
    • Más
      • Método D’Hondt
      • Generador de Contraseñas Seguras
  • Noticias
  • Boletín
  • Contacto
  • Tienda
    • Libros
    • Equipamiento de oficina
    • Equipamiento en movilidad

Analytics Lane

Ciencia e ingeniería de datos aplicada

  • Ciencia de datos
  • Machine Learning
  • IA Generativa
  • Python
  • Pandas
  • NumPy
  • R
  • Excel

Pandas

Pandas es una librería para Python la cual extiende las funcionalidades que ofrece NumPy para el tratamiento y análisis de conjuntos de datos. Poniendo a disposición de los usuarios dos nuevas estructuras de datos (Series y DataFrame) que facilitan la manipulación de series temporales y tablas.

La estructura de datos básica de Pandas es el objeto Series. Un vector etiquetado capaz de contener cualquier tipo de dato (enteros, reales, cadenas de texto, fechas, objetos de Python, …) con etiquetas que se denominan índices.

La otra estructura de datos, el DataFrame, es una colección ordenada de columnas con nombres y tipos, similar a las tablas de las bases de datos, donde las filas son un registro y las columnas son los atributos. Siendo cada una de las columnas de este tipo de datos un objeto Series.

Importar solamente algunas columnas de un archivo con Pandas

octubre 3, 2022 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 3 minutos

pandas

Una de las formas más habituales para importar los datos para un análisis es mediante el uso de archivos. Los cuales, debido a que los conjuntos de datos no se generan específicamente para un análisis en concreto, generalmente contienen más información de la que es necesaria para el estudio que se necesita realizar. Siendo necesaria más memoria para trabajar con ellos. En … [Leer más...] acerca de Importar solamente algunas columnas de un archivo con Pandas

Obtener los primeros registros ordenados de un DataFrame Pandas

septiembre 5, 2022 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 3 minutos

pandas

Los objetos DataFrame de Pandas cuentan con un par de métodos mediante los cuales se puede ordenar los registros en base a los valores de una o varias columnas y obtener como resultado los n primeros. Una funcionalidad con la que se puede simplificar algunos análisis. En concreto, el método df.nlargest() ordena de mayor a menor los registros de un conjunto de datos y devuelve … [Leer más...] acerca de Obtener los primeros registros ordenados de un DataFrame Pandas

Unir múltiples archivos CSV en uno con Pandas

junio 27, 2022 Por Daniel Rodríguez 2 comentarios
Tiempo de lectura: 4 minutos

Por múltiples motivos es bastante habitual que un conjunto de datos llegue en varios archivos CSV en lugar de uno único. Algo que generalmente obliga unirlo en uno antes de poder realizar los análisis. Aunque es una tarea sencilla, puede ser tediosa si se repite de forma habitual. Para solucionar esto, se puede crear una función con Pandas para unir múltiples archivos CSV en … [Leer más...] acerca de Unir múltiples archivos CSV en uno con Pandas

Truco: reemplazar los valores NaN en los DataFrame Pandas

mayo 30, 2022 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 2 minutos

La existencia de valores NaN es un conjunto de datos puede ser una molestia ya que no es posible realizar muchas operaciones con ellos. Por eso conocer un método para reemplazar los valores NaN en los DataFrame por cualquier otro puede solucionar algunos problemas. Afortunadamente para ello existe el método fillna() en Pandas, con el que se puede reemplazar todas las … [Leer más...] acerca de Truco: reemplazar los valores NaN en los DataFrame Pandas

Uso de Pandas Query para filtrar datos de forma sencilla

mayo 2, 2022 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 6 minutos

En los DataFrames de Pandas se puede emplear vectores lógicos para seleccionar las filas que cumplen una o varias condiciones. Algo que se puede utilizar para realizar operaciones de filtrado de datos. Aunque esta característica es muy poderosa, existe otra opción con la que generalmente se puede conseguir filtrar los datos de una manera mucho más sencilla: Pandas Query. Un … [Leer más...] acerca de Uso de Pandas Query para filtrar datos de forma sencilla

Importar automáticamente las dependencias en Python con una línea

abril 25, 2022 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 2 minutos

Python es uno de los mejores entornos de trabajo que existen actualmente para los científicos de datos. Existen múltiples librerías con las que realizar de una forma sencilla y eficiente una gran cantidad de tareas, como pueden ser NumPy, Pandas, Matplotlib, Seaborn o Scikit-Learn. Aunque la importación de todas las dependencias necesarias en un proyecto puede llegar a ser una … [Leer más...] acerca de Importar automáticamente las dependencias en Python con una línea

Selección condicional con Pandas

abril 4, 2022 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 5 minutos

Al importar un conjunto de datos en una sesión de Python no todos los registros de este tienen porque ser de interés para el análisis que se pretende realizar. Por lo que saber seleccionar los elementos necesarios de una forma rápida es de gran ayuda a la hora de realizar casi cualquier trabajo. Siendo esta una tarea que se puede realizar fácilmente si se aprovechan … [Leer más...] acerca de Selección condicional con Pandas

Pandas: Eliminar filas en base a sus valores con Pandas

febrero 21, 2022 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 3 minutos

pandas

Al trabajar con conjuntos de datos es posible que sea necesario eliminar algunas de las filas o columnas en base a los valores de estas. Seleccionado solamente aquellas cuyos valores cumplen alguna condición. Esto es algo que se puede conseguir fácilmente el Pandas gracias a las posibilidades que ofrecen el uso de vectores booleanos en loc. Pudiéndose construir estos vectores … [Leer más...] acerca de Pandas: Eliminar filas en base a sus valores con Pandas

Almacenar archivos CSV 10 veces más rápido en Python con PyArrow

febrero 14, 2022 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 3 minutos

Hace un tiempo publiqué una entrada en la que comparaba las ventajas de usar el formato de archivo Apache Arrow frente al tradicional CSV. Suponiendo grandes ahorros tanto en el tamaño de los archivos como el tiempo de carga. Usando para ello la librería PyArrow. Es posible que por temas de compatibilidad entre sistemas en algunas situaciones no podamos usar Apache Arrow, … [Leer más...] acerca de Almacenar archivos CSV 10 veces más rápido en Python con PyArrow

Pandas: estadísticas de subconjuntos de datos en DataFrame

enero 31, 2022 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 4 minutos

pandas

A partir de un conjunto de datos en memoria puede ser interesante obtener estadísticas de subconjuntos de datos. Información que puede ser de gran utilidad para detectar patrones. Por ejemplo, si tenemos los registros de ventas con el día de la semana puede ser interesante obtener los valores medios y totales en función del día. En Python esto se puede hacer gracias al método … [Leer más...] acerca de Pandas: estadísticas de subconjuntos de datos en DataFrame

Combinar dos columnas de texto en Pandas

enero 24, 2022 Por Daniel Rodríguez 1 comentario
Tiempo de lectura: 3 minutos

pandas

Al trabajar con conjuntos de datos en los que algunas características son cadenas de texto es habitual encontrarse con registros que no están en el formato deseado. Tanto valores que estas juntos como separados. Para solucionar el primer problema es necesario separar el texto de una característica en varias, lo que se explicó en una entrada anterior. Por otro lado, la solución … [Leer más...] acerca de Combinar dos columnas de texto en Pandas

Uso de Parquet para guardar los conjuntos de datos de forma eficiente en Pandas

diciembre 20, 2021 Por Daniel Rodríguez Deja un comentario
Tiempo de lectura: 5 minutos

Los formatos de archivo para el intercambio de datos más populares actualmente son CSV y Microsoft Excel. Resultando ambos poco eficientes a la hora trabajar con grandes conjuntos de datos. CSV es un formato basado en archivos de texto plano, lo que permite su edición con cualquier editor de texto, sin la necesidad de emplear un programa específico. Aunque esto también se … [Leer más...] acerca de Uso de Parquet para guardar los conjuntos de datos de forma eficiente en Pandas

  • « Ir a la página anterior
  • Página 1
  • Páginas intermedias omitidas …
  • Página 3
  • Página 4
  • Página 5
  • Página 6
  • Página 7
  • Páginas intermedias omitidas …
  • Página 11
  • Ir a la página siguiente »

Barra lateral principal

Suscríbete a nuestro boletín

Suscríbete al boletín semanal para estar al día de todas las publicaciones.

Política de Privacidad

Analytics Lane en redes sociales

  • Amazon
  • Bluesky
  • Facebook
  • GitHub
  • Instagram
  • Mastodon
  • Pinterest
  • RSS
  • Telegram
  • Tumblr
  • Twitter
  • YouTube

Publicidad

Entradas recientes

BG/BB: el modelo de CLV para compras en períodos discretos

agosto 25, 2026 Por Daniel Rodríguez

Por Qué las Contraseñas Largas son más Seguras que las Complejas

agosto 20, 2026 Por Daniel Rodríguez

Gini, KS y AUC: Cómo Medir la Calidad de un Modelo de Credit Scoring

agosto 18, 2026 Por Daniel Rodríguez

Publicidad

Es tendencia

  • Blockchain Creación de una criptomoneda (1º Parte) publicado el mayo 7, 2018 | en Criptografía
  • Hoja de cálculo para repartir los escaños en base al método D’Hont Aplicar el método D’Hondt en Excel publicado el abril 14, 2021 | en Herramientas
  • pandas Pandas: Obtener el nombre de las columnas y filas en Pandas publicado el diciembre 7, 2020 | en Python
  • Comparar archivos en Visual Studio Code publicado el enero 10, 2024 | en Herramientas
  • Gini, KS y AUC: Cómo Medir la Calidad de un Modelo de Credit Scoring publicado el agosto 18, 2026 | en Ciencia de datos

Publicidad

Lo mejor valorado

4.9 (24)

Seleccionar filas y columnas en Pandas con iloc y loc

4.6 (16)

Archivos JSON con Python: lectura y escritura

4.4 (14)

Ordenación de diccionarios en Python mediante clave o valor

4.7 (13)

Operaciones de filtrado de DataFrame con Pandas en base a los valores de las columnas

4.9 (11)

Pandas: Cambiar los tipos de datos en los DataFrames

Comentarios recientes

  • Daniel Rodríguez en Los récords con asterisco, o la épica del titular sin contexto – El bestiario de los indicadores económicos absurdos (parte 8 y final)
  • Juan en Los récords con asterisco, o la épica del titular sin contexto – El bestiario de los indicadores económicos absurdos (parte 8 y final)
  • bif en JSON en bases de datos: cuándo es buena idea y cuándo no
  • bif en Cómo desinstalar Oracle Database 19c en Windows
  • M. Pilar en Cómo eliminar las noticias en Windows 11 y recuperar tu concentración

Publicidad


Footer

Analytics Lane

  • Acerca de Analytics Lane
  • Boletín de noticias
  • Contacto
  • Libros
  • Lo más popular
  • Noticias
  • Tienda
  • Tiendas afiliadas

Secciones

  • Ciencia de datos
  • Criptografía
  • Herramientas
  • Machine Learning
  • Opinión
  • Productividad
  • Programación
  • Reseñas

Sobre de Analytics Lane

En Analytics Lane tratamos de explicar los principales conceptos de la ciencia e ingeniería de datos con un enfoque práctico. Los principales temas tratados son ciencia de datos, ingeniería de datos, inteligencia artificial, machine learning, deep learning y criptografía. Además, también se habla de los principales lenguajes de programación y herramientas utilizadas por los científicos e ingenieros de datos.

Copyright © 2018-2026 Analytics Lane ·Términos y condiciones ·Política de Cookies ·Política de Privacidad ·Herramientas de privacidad ·Contacto