`

微软面试题 -- 计算在线人数曲线图

阅读更多
求一个论坛的在线人数,假设有一个论坛,其注册ID有两亿个,每个ID从登陆到退出会向一个日志文件中记下登陆时间和退出时间,要求写一个算法统计一天中论坛的用户在线分布,取样粒度为秒。


----------------------------------------------------------------------
这道题 微软和腾讯都出过

答案是在下面的博客中找到的
http://hi.baidu.com/mianshiti/blog/item/104589c07641ed5eb319a897.html

一天总共有 3600*24 = 86400秒。
定义一个长度为86400的整数数组int delta[86400],每个整数对应这一秒的人数变化值,可能为正也可能为负。开始时将数组元素都初始化为0。
然后依次读入每个用户的登录时间和退出时间,将与登录时间对应的整数值加1,将与退出时间对应的整数值减1。
这样处理一遍后数组中存储了每秒中的人数变化情况。
定义另外一个长度为86400的整数数组int online_num[86400],每个整数对应这一秒的论坛在线人数。
假设一天开始时论坛在线人数为0,则第1秒的人数online_num[0] = delta[0]。第n+1秒的人数online_num[n] = online_num[n-1] + delta[n]。
这样我们就获得了一天中任意时间的在线人数。


本人还有一个建立树的算法,就是按时间粒度每层逐渐细化,相对于上面的方法时间和空间东很浪费


分享到:
评论

相关推荐

Global site tag (gtag.js) - Google Analytics