题目:
如果有一个20g的日志文件,日志文件记录着用户访问过的url,每一行为一个url,给你一台512M的主机,找出出现次数最多的10个url
参考答案及思路:
1. Top K算法:使用堆排序算法+大顶堆+10个元素的数组。
2.