网页资讯视频图片知道文库贴吧地图采购
进入贴吧全吧搜索

 
 
 
日一二三四五六
       
       
       
       
       
       

签到排名:今日本吧第个签到,

本吧因你更精彩,明天继续来努力!

本吧签到人数:0

一键签到
成为超级会员,使用一键签到
一键签到
本月漏签0次!
0
成为超级会员,赠送8张补签卡
如何使用?
点击日历上漏签日期,即可进行补签。
连续签到:天  累计签到:天
0
超级会员单次开通12个月以上,赠送连续签到卡3张
使用连续签到卡
02月12日漏签0天
大数据交流吧 关注:2,633贴子:68
  • 看贴

  • 图片

  • 吧主推荐

  • 游戏

  • 0回复贴,共1页
<<返回大数据交流吧
>0< 加载中...

1、什么是大数据

  • 只看楼主
  • 收藏

  • 回复
  • 快乐加油8
  • 武林新贵
    8
该楼层疑似违规已被系统折叠 隐藏此楼查看此楼
基本概念
《数据处理》
在互联网技术发展到现今阶段,大量日常、工作等事务产生的数据都已经信息化,人类产生的数据量相比以前有了爆炸式的增长,以前的传统的数据处理技术已经无法胜任,需求催生技术,一套用来处理海量数据的软件工具应运而生,这就是大数据!
欢迎加入大数据交流群:645891271
处理海量数据的核心技术:
海量数据存储:分布式
海量数据运算:分布式
这些核心技术的实现是不需要用户从零开始造轮子的
存储和运算,都已经有大量的成熟的框架来用
存储框架:
HDFS——分布式文件存储系统(HADOOP中的存储框架)
HBASE——分布式数据库系统
KAFKA——分布式消息缓存系统(实时流式数据处理场景中应用广泛)
运算框架:(要解决的核心问题就是帮用户将处理逻辑在很多机器上并行)
MAPREDUCE—— 离线批处理/HADOOP中的运算框架
SPARK ——离线批处理/实时流式计算
STORM —— 实时流式计算
辅助类的工具(解放大数据工程师的一些繁琐工作):
HIVE ——数据仓库工具:可以接收sql,翻译成mapreduce或者spark程序运行
FLUME——数据采集
SQOOP——数据迁移
ELASTIC SEARCH —— 分布式的搜索引擎
.......
换个角度说,大数据是:
1、有海量的数据
2、有对海量数据进行挖掘的需求
有对海量数据进行挖掘的软件工具(hadoop、spark、storm、flink、tez、impala......)


登录百度账号

扫二维码下载贴吧客户端

下载贴吧APP
看高清直播、视频!
  • 贴吧页面意见反馈
  • 违规贴吧举报反馈通道
  • 贴吧违规信息处理公示
  • 0回复贴,共1页
<<返回大数据交流吧
分享到:
©2026 Baidu贴吧协议|隐私政策|吧主制度|意见反馈|网络谣言警示