hadoop是一个可实现大规模分布式计算的开源软件平台,广泛应用于云计算领域。本文从hadoo分布式文件系统架构的整体入手,对其分布式数据存储、分布式任务分配、分布式并行计算和分布式数据库四方面进行了分析。