数据挖掘面试题总结

数据挖掘面试题总结 1. 给定a、b两个文件,各存放50亿个url,每个url各占64字节,内存限制是4G,让你找出a、b文件共同的url? 方案1:可以估计每个文件安的大小为50G×64=320G,

腾讯文库数据挖掘面试题总结数据挖掘面试题总结