Apache Spark es un framework de programación para procesamiento de datos distribuidos diseñado para ser rápido y de propósito general. Como su propio nombre indica, ha sido desarrollada en el marco del proyecto Apache, lo que garantiza su licencia Open Source.Además, podremos contar con que su mantenimiento y evolución se llevarán a cabo por grupos de trabajo de gran prestigio, y existirá una gran flexibilidad e interconexión con otros módulos de Apache como Hadoop, Hive o Kafka.
Desde hace muchos años, recién titulados y profesionales nos hemos ido formando en diferentes ámbitos con la finalidad de especializarnos bien sea, para profundizar en los conocimientos adquiridos o bien, para optar a diferentes puestos de trabajo. Los másters Big Data son un buen ejemplo de ello.
El concepto de “contratos inteligentes” (smart contracts en inglés) lo definió por primera vez el ingeniero informático y jurista norteamericano Nick Szabo ya en 1994 como “un protocolo informático capaz de ejecutar cláusulas de un contrato”.
A estas alturas y con la variable velocidad de adopción como aspecto clave en el mundo tecnológico en el que nos movemos, no merece la pena dedicar una palabra más, adicional a lo ya escrito, a la importancia de los datos en los proyectos. Sin embargo, hay figuras que es conveniente explorar, como la del Data Manager.