找出一堆数据中最小的K个数问题

来源:互联网 发布:linux命令大全 mv 编辑:程序博客网 时间:2024/06/02 21:12

题目:输入n个整数,输出其中最小的k个。

例如输入123456788个数字,则最小的4个数字为1234

分析:这道题最简单的思路莫过于把输入的n个整数排序,这样排在最前面的k个数就是最小的k个数。只是这种思路的时间复杂度为O(nlogn)。我们试着寻找更快的解决思路。

我们可以开辟一个长度为k的数组。每次从输入的n个整数中读入一个数。如果数组中已经插入的元素少于k个,则将读入的整数直接放到数组中。否则长度为k的数组已经满了,不能再往数组里插入元素,只能替换了。如果读入的这个整数比数组中已有k个整数的最大值要小,则用读入的这个整数替换这个最大值;如果读入的整数比数组中已有k个整数的最大值还要大,则读入的这个整数不可能是最小的k个整数之一,抛弃这个整数。这种思路相当于只要排序k个整数,因此时间复杂可以降到O(n+nlogk)通常情况下k要远小于n,所以这种办法要优于前面的思路。

这是我能够想出来的最快的解决方案。不过从给面试官留下更好印象的角度出发,我们可以进一步把代码写得更漂亮一些。从上面的分析,当长度为k的数组已经满了之后,如果需要替换,每次替换的都是数组中的最大值。在常用的数据结构中,能够在O(1)时间里得到最大值的数据结构为最大堆。因此我们可以用堆(heap)来代替数组。

另外,自己重头开始写一个最大堆需要一定量的代码。我们现在不需要重新去发明车轮,因为前人早就发明出来了。同样,STL中的set和multiset为我们做了很好的堆的实现,我们可以拿过来用。既偷了懒,又给面试官留下熟悉STL的好印象,何乐而不为之?

参考代码:

[cpp] view plaincopy
  1. #include <set>  
  2. #include <vector>  
  3. #include <iostream>  
  4.   
  5. using namespace std;  
  6.   
  7. typedef multiset<int, greater<int> > IntHeap;  
  8.   
  9. ///////////////////////////////////////////////////////////////////////  
  10. // find k least numbers in a vector  
  11. ///////////////////////////////////////////////////////////////////////  
  12. void FindKLeastNumbers  
  13. (  
  14.       const vector<int>& data,               // a vector of data  
  15.       IntHeap& leastNumbers,                 // k least numbers, output  
  16.       unsigned int k                                
  17. )  
  18. {  
  19.       leastNumbers.clear();  
  20.   
  21.       if(k == 0 || data.size() < k)  
  22.             return;  
  23.   
  24.       vector<int>::const_iterator iter = data.begin();  
  25.       for(; iter != data.end(); ++ iter)  
  26.       {  
  27.             // if less than k numbers was inserted into leastNumbers  
  28.             if((leastNumbers.size()) < k)  
  29.                   leastNumbers.insert(*iter);  
  30.   
  31.             // leastNumbers contains k numbers and it's full now  
  32.             else  
  33.             {  
  34.                   // first number in leastNumbers is the greatest one  
  35.                   IntHeap::iterator iterFirst = leastNumbers.begin();  
  36.   
  37.                   // if is less than the previous greatest number   
  38.                   if(*iter < *(leastNumbers.begin()))  
  39.                   {  
  40.                         // replace the previous greatest number  
  41.                         leastNumbers.erase(iterFirst);  
  42.                         leastNumbers.insert(*iter);  
  43.                   }  
  44.             }  
  45.       }  
  46. }  

//补充的代码

[cpp] view plaincopy
  1. /* 
  2. 解题报告: 
  3. 1、最简单的办法,给所有数据按升序或降序排序,从中取出相应的k个就可以了,最快的时间复杂度为nlog(n) 
  4. 2、可以考虑维护一个堆,这个堆的中元素的个数为k,然后遍历元素,这时有两种情况: 
  5.     1、堆中元素的个数小于k,这时直接插入即可 
  6.     2、元素的个数为k,这时如果遍历到的元素小于堆中最大的那个元素就将堆中的这个元素删除,将遍历到的元素插入即可  
  7. */  
  8.   
  9. #include <iostream>  
  10. #include <set>  
  11. #include <vector>  
  12. using namespace std;  
  13.   
  14. typedef multiset<int, greater<int> > intHeap;  
  15.   
  16. void FindNumbers(vector<int> &data, int k, intHeap &numbers)  
  17. {  
  18.     numbers.clear();  
  19.     if (0==k || data.size()<k)  
  20.         return ;  
  21.     vector<int>::const_iterator iter = data.begin();  
  22.     for (; iter!=data.end(); iter++)  
  23.     {  
  24.         if (numbers.size() < k)  
  25.         {  
  26.             numbers.insert(*iter);  
  27.         }  
  28.         else  
  29.         {  
  30.             intHeap::iterator heapIter = numbers.begin();  
  31.             if (*iter < *(numbers.begin()))  
  32.             {  
  33.                 numbers.erase(heapIter);  
  34.                 numbers.insert(*iter);  
  35.             }  
  36.         }  
  37.     }  
  38. }  
  39.   
  40. int main()  
  41. {  
  42.     int n;  
  43.     vector<int> data;  
  44.     intHeap numbers;  
  45.     while (cin>>n)  
  46.     {  
  47.         for (int i=0; i<n; ++i)  
  48.         {  
  49.             int nTemp;  
  50.             cin>>nTemp;  
  51.             data.push_back(nTemp);  
  52.         }  
  53.         FindNumbers(data, 4, numbers);  
  54.         intHeap::const_iterator iter = numbers.begin();  
  55.         for (; iter!=numbers.end(); ++iter)  
  56.         {  
  57.             cout<<*iter<<" ";  
  58.         }  
  59.         cout<<endl;  
  60.     }  
  61.     return 0;  
  62. }  
//我的借鉴方法

[cpp] view plaincopy
  1. #include <iostream>  
  2. #include <algorithm>  
  3. #include <vector>  
  4. #include <cmath>  
  5. #include <set>  
  6.   
  7. using namespace std;  
  8.   
  9. //print an array of int  
  10. inline void print(int *arr, //the array of int  
  11.                   int n //the length of array  
  12.                  )  
  13. {  
  14.     for(int i=0;i<n;i++)  
  15.         cout<<arr[i]<<"\t";  
  16.     cout<<endl;  
  17.   
  18. }  
  19. typedef multiset<int, greater<int> > IntHeap;  
  20.   
  21.   
  22. ///////////////////////////////////////////////////////////////////////  
  23. // find k least numbers in a vector  
  24. ///////////////////////////////////////////////////////////////////////  
  25. void FindKLeastNumbers(  
  26.    //   vector<int>& data,             // a vector of data  
  27.       int *array,  
  28.       unsigned int len,  
  29.       IntHeap& leastNumbers,                 // k least numbers, output  
  30.       unsigned int k )  
  31. {  
  32.   
  33.       std::vector <int> data(array, array + len);  
  34.   
  35.       leastNumbers.clear();  
  36.   
  37.       if(k == 0 || data.size() < k)  
  38.             return;  
  39.   
  40.       vector<int>::const_iterator iter = data.begin();  
  41.       for(; iter != data.end(); ++ iter)  
  42.       {  
  43.             // if less than k numbers was inserted into leastNumbers  
  44.             if((leastNumbers.size()) < k)  
  45.                   leastNumbers.insert(*iter);  
  46.   
  47.             // leastNumbers contains k numbers and it's full now  
  48.             else  
  49.             {  
  50.                   // first number in leastNumbers is the greatest one  
  51.                   IntHeap::iterator iterFirst = leastNumbers.begin();  
  52.   
  53.                   // if is less than the previous greatest number   
  54.                   if(*iter < *(leastNumbers.begin()))  
  55.                   {  
  56.                         // replace the previous greatest number  
  57.                         leastNumbers.erase(iterFirst);  
  58.                         leastNumbers.insert(*iter);  
  59.                   }  
  60.             }  
  61.       }  
  62. }  
  63.   
  64.   
  65. void main()  
  66. {  
  67.     int arr[ 10 ] = {3, 4, 8, 6, 0, 1, 5, 7, 2, 9};  
  68.   
  69.     int len = sizeof(arr) / sizeof(int);  
  70.   
  71.     int LeastNumers = 5;  
  72.   
  73.     IntHeap numbers;  
  74.       
  75.     FindKLeastNumbers(arr,len,numbers,LeastNumers);  
  76.   
  77.     IntHeap::const_iterator iter = numbers.begin();  
  78.     for (; iter != numbers.end(); ++iter)  
  79.     {  
  80.             cout<<*iter<<" ";  
  81.     }  
  82.     cout<<endl;  
  83. }
原创粉丝点击