Noticias

Publicación de nuevos conjuntos de datos de Microsoft Research

Microsoft Research acaba de publicar un nuevo conjunto de datos abiertos y los ha puesto a disposición para su descarga en Microsoft Research Open Data.

Los conjuntos de datos de Microsoft Research se encuentran categorizados por área de investigación, entre las que se encuentran: física, ciencias sociales, ciencias ambientales y ciencias de la información. La mayoría de los conjuntos de datos publicados no se encontraban disponibles públicamente previamente. Estos conjuntos de datos son útiles para la investigación en técnicas de inteligencia artificial y aprendizaje automático.

Entre los conjuntos de datos publicados se puede encontrar:

  • 38 millones de tweets relacionados con las elecciones estadounidenses de 2012
  • Datos de captura 3-D de personas que realizan diferentes gestos con las manos
  • Infer.NET, un framework para inferencia bayesiana en modelos gráficos
  • Un millón de imágenes de celebridades etiquetas
  • MS MARCO, es un nuevo conjunto de datos a gran escala para comprensión de lectura y preguntas y respuestas
  • Un corpus de 2,7 millones de palabras provenientes de búsquedas de Bing.

La mayoría de los conjuntos de datos se encuentran en archivos de texto sin formato, por lo que son adecuados para trabajar con cualquier herramienta de análisis de datos.

Imágenes: Pixabay

Daniel Rodríguez

Share
Published by
Daniel Rodríguez

Recent Posts

Cómo construir tu primer scorecard paso a paso

En los artículos anteriores de esta serie vimos la teoría detrás del credit scoring: qué…

20 horas ago

Actualizar expresslanets a ES Modules con tsx y Vitest

expresslanets es la plantilla de API REST con Express y TypeScript que empezó como una…

6 días ago

Pareto/NBD: cuando el abandono silencioso cambia el CLV

En el artículo del Dashboard vimos que Pareto/NBD aparecía junto a BG/NBD con un ajuste…

1 semana ago

Por qué migrar tus proyectos TypeScript a ES Modules en 2026

Durante años, CommonJS (require/module.exports) ha sido la forma por defecto de organizar módulos en Node.js,…

2 semanas ago

Método del codo: interpretación correcta y limitaciones

Cuando usas k-means tienes que decidir algo incómodo de entrada: cuántos grupos, , vas a…

2 semanas ago

Errores comunes al interpretar resultados estadísticos

La estadística no suele fallar en los cálculos: falla en la interpretación. El test está…

3 semanas ago

This website uses cookies.