Geeky Theory

Análisis de sentimientos en Twitter con Python y Apache Spark Streaming

Apache Spark es una de las herramientas más utilizadas para procesar Big Data y en este caso se usará para analizar el sentimiento de Tweets en tiempo real con Python.

Cómo crear un clúster de servidores con Apache Spark

Apache Spark tiene un potencial impresionante. Como ya dije en el artículo de introducción a Spark [http://geekytheory.com/apache-spark-que-es-y-como-funciona/], es una herramienta muy utilizada actualmente en Big Data y machine learning y que a lo largo de estos años será mejorada. En este tutorial vamos a aprender a montar

Apache Spark: qué es y cómo funciona

Apache Spark combina un sistema de computación distribuida a través de clusters de ordenadores con una manera sencilla y elegante de escribir programas. Fue creado en la Universidad de Berkeley en California y es considerado el primer software de código abierto que hace la programación distribuida realmente accesible a los

Geeky Theory © 2026