Program to explore a set of 100,000 Wikipedia documents

Program to explore a set of 100,000 Wikipedia documents

• Configured latest release of Apache Hadoop in a pseudo-distributed mode. • Developed a MapReduce-based approach in Hadoop system implemented on instances