|
|
1
2
为了提高应用程序的性能,您将 全部的 设计时考虑到高效的数据操作 数据集。
|
|
2
0
我会看看 http://lucene.apache.org 它应该很适合你所描述的。 |
|
|
3
0
我对一个拥有超过一百万数据的表也有同样的问题,有一个客户想要导出所有这些数据。我的解决办法很简单我就这么做了
Question
. 但是有一个小问题是有超过10万条记录进入堆空间。所以我就用
|
|
4
0
现在,这个表已经发展到无法将其全部加载到内存中的地步。我预计,由于每个文档中要查找的单词较多,因此每个文档的处理速度也会减慢。
为了优化这一点,在不将整个表加载到内存中的情况下,您需要实现某种内存缓存。当您为每个单词查询数据库时,数据库服务器实际上会自动为您实现此功能;此方法的效果将取决于数据库服务器的硬件和配置,以及与您的单词查找相竞争的其他查询。 还可以实现表中最常用部分的内存缓存。您将根据能够提供多少内存来限制缓存的大小。需要通过查询数据库来检查您查找的所有不在缓存中的单词。缓存可能使用最近使用最少的逐出策略,以便在缓存中保留最常用的单词。
Java中有几个非常好的开放源码内存缓存实现,这将最小化实现缓存解决方案所需的代码量。 |