|
1
2
我相信两列索引将提供最快的访问路径,因为它将是最紧凑的索引。 但是,它将是一个附加索引(因为您已经有了不使用的ID索引),所以前两个选项很好,因为它们消除了额外的索引。 填充字符串比复杂对象解决方案更短,更短意味着内存使用更少,因此扫描速度更快。如果不能展平/填充,我只会选择复杂对象。 另外,由于复杂的对象键需要编码到索引中(而不是其他索引的情况),所以选择较短的键名(C和P)。 所以,我将使用两列索引(如果您不介意“浪费”ID索引)或填充字符串。您甚至可以使用填充二进制(在编码整数时节省几个字节),但这可能不值得麻烦。 |
|
|
Max · 用两列中的特定值对识别R中的数据帧行 1 年前 |
|
|
Dasi · Pandas.loc返回序列或浮点数不一致 1 年前 |
|
climsaver · 首次连续查找两个相同值的索引 2 年前 |
|
|
babipsylon · 在C中创建div_t类型结构元素的数组++ 2 年前 |
|
|
Martin AJ · 如何在庞大的数据集上快速执行COUNT(*)? 2 年前 |