1. 首页
  2. 数据库
  3. 其它
  4. 海量数据处理常用思路和方法

海量数据处理常用思路和方法

上传者: 2021-02-07 23:54:45上传 PDF文件 103.79KB 热度 13次
大数据量的问题是很多面试笔试中经常出现的问题,比如google、淘宝、百度、腾讯这样的一些涉及到海量数据的公司经常会问到。下面的方法是我对海量数据的处理方法进行了一个一般性的总结,当然这些方法可能并不能完全覆盖所有的问题,但是这样的一些方法也基本可以处理绝大多数遇到的问题。下面的一些问题基本直接来源于公司的面试笔试题目,方法不一定最优,如果你有更好的处理方法,欢迎与我讨论。适用范围:可以用来实现数据字典,进行数据的判重,或者集合求交集基本原理及要点:对于原理来说很简单,位数组+k个独立hash函数。将hash函数对应的值的位数组置
用户评论