0x05-近似算法HyperLogLog
近似算法HyperLogLog 本篇是《大数据算法与UDF系列》的第5篇,讲解大数据中的基数估计神器——HyperLogLog(HLL),它可以用极小的空间计算亿级UV数据。 1. 什么是基数估计? 1.1 问题背景 在数据分析中,经常需要...
近似算法HyperLogLog 本篇是《大数据算法与UDF系列》的第5篇,讲解大数据中的基数估计神器——HyperLogLog(HLL),它可以用极小的空间计算亿级UV数据。 1. 什么是基数估计? 1.1 问题背景 在数据分析中,经常需要...