猿问

如果我想学大数据,有啥好的路线?

我姐是女神
浏览 1331回答 2
2回答

皮县豆福脑

大数据的应用场景特征:1. 数据量大,TB->PB2. 数据类型繁多,结构化、非结构化文本、日志、视频、图片、地理位置等;3. 商业价值高,但是这种价值需要在海量数据之上,通过数据分析与机器学习更快速的挖掘出来;4. 处理时效性高,海量数据的处理需求不再局限在离线计算当中。Hadoop作为大数据框架被广泛使用,Hadoop生态圈:文件存储:Hadoop HDFS、Tachyon、KFS离线计算:Hadoop MapReduce、Spark流式、实时计算:Storm、Spark Streaming、S4、HeronK-V、NOSQL数据库:HBase、Redis、MongoDB资源管理:YARN、Mesos日志收集:Flume、Scribe、Logstash、Kibana消息系统:Kafka、StormMQ、ZeroMQ、RabbitMQ查询分析:Hive、Impala、Pig、Presto、Phoenix、SparkSQL、Drill、Flink、Kylin、Druid分布式协调服务:Zookeeper集群管理与监控:Ambari、Ganglia、Nagios、Cloudera Manager数据挖掘、机器学习:Mahout、Spark MLLib数据同步:Sqoop任务调度:Oozie这么多技术,取决于自己喜欢研究哪个方向,自己决定吧。
随时随地看视频慕课网APP

相关分类

大数据
我要回答