Contenido Exclusivo

¡Ya está aquí la Revista Digital “Los Mejores 20 CISO de México 2025”!

CIO Ediworld lo invita a sumergirse en el contenido de la...

¡Descarga la Revista Digital “Los Mejores 100 CIO de México 2025”!

Descarga la revista digital CIO Ediworld Edición Especial "Los...

HP extiende al Big Data el uso del lenguaje R de programación

HP descubrió una forma para hacer funcionar los programas escritos en lenguaje estadístico R en los conjuntos de datos que se alojan en más de un servidor, preparando el camino hacia el análisis predictivo en tiempo real y a gran escala.

“Historicamente el uso del Big Data se ha focalizado siempre en el pasado”, afirmó Jeff Veis, vicepresidente de Marketing para la unidad de negocio de Big Data en HP. El nuevo software permitiría a las organizaciones “anticiparse a las nuevas tendencias” usando grandes conjuntos de datos, agregó.

En efecto, mientras que varios paquetes comerciales ofrecen diversas maneras de utilizar R en los clúster de computadoras, el nuevo Distributed R de HP es el primero en ofrecer esta capacidad en un paquete de código abierto, según el directivo.

Con millones de usuarios en todo el mundo, la fuente de código abierto R es uno de los lenguajes de programación más extendidos, al ser especialmente diseñado para análisis estadísticos y predictivos, junto a SAS, MatLab, Mathematica y un número de librerías Pynthon. La ejecución de R con grandes conjuntos de datos ha sido, sin embargo, un desafío, ya que funciona como una sola secuencia en las computadoras.

Esta aproximación limita la cantidad de datos que pueden ser analizados. Es por ello que, con frecuencia, los científicos de datos analizan sólo una muestra de los datos, y no la muestra entera, lo que potencialmente reduce la precisión del resultado.

El nuevo paquete de HP incluye un conjunto de algoritmos creados por los Laboratorios HP para la ejecución de R en múltiples computadoras a la vez, permitiendo el análisis de miles de millones de filas de datos. Tal aproximación permite analizar todo el conjunto de datos.

¿En qué consiste la solución?

En primer lugar, HP creó Distributed R para ser ejecutado en el sistema de bases de datos orientados en columnas de Vertica, creado para facilitar el análisis de terabytes de datos.

Distributed R ha sido lanzado bajo la versión 2 de la licencia de código abierto GPL y puede funcionar con otras bases de datos y plataformas de proceso añadidas a Vertica, como Hadoop. Además, es compatible con las herramientas de desarrollo R Studio y R console.

-Joab Jackson, IDG News Service

Lo Más Reciente

¿Por qué los endpoints son el nuevo epicentro del riesgo?

El panorama de la ciberseguridad en México atraviesa una...

Yucatech Festival 2026 rompe paradigmas de la IA y ciberseguridad

Yucatech Festival 2026 exploró temas estratégicos como la inteligencia...

Yucatech Festival 2026: IA ¿aliada o enemiga?

Mérida, Yucatán. En tan solo tres años los ciberataques...

Tecnología y cumplimiento normativo: el nuevo campo de batalla para las empresas en México

En México, el cumplimiento normativo se ha convertido en...

Newsletter

Recibe lo último en noticias e información exclusiva.

¿Por qué los endpoints son el nuevo epicentro del riesgo?

El panorama de la ciberseguridad en México atraviesa una fase crítica donde la transformación digital ha redefinido los puntos de riesgo, desplazando el foco...

Yucatech Festival 2026 rompe paradigmas de la IA y ciberseguridad

Yucatech Festival 2026 exploró temas estratégicos como la inteligencia artificial y ciberseguridad donde destacados divulgadores de YouTube y expertos reconocidos internacionales se encargaron de...

Yucatech Festival 2026: IA ¿aliada o enemiga?

Mérida, Yucatán. En tan solo tres años los ciberataques se han quintuplicado por la inteligencia artificial, mientras que el costo  global que las empresas...