|
|
1
0
编译器的优化器会在幕后为您做很多工作。这一次,将展开迭代次数恒定的循环。这可能就是为什么您的代码比库快的原因。 我建议看一下优化后生成的程序集,以真正了解可以在哪里进行优化,以及程序编译后的真实外观。 当然,您可以考虑在CPU(多线程)或GPU(cuda、OpenCL、OpenAcc等)上进行并行实现。 至于奖金问题,如果您考虑将其写为两个嵌套循环,我建议重新排列表达式,使a\u km项位于两个和之间。无需在内部和内执行乘法,因为它不依赖于n。虽然这在现代CPU中可能只会带来轻微的性能优势。。。 |
|
|
P_B · 如何从矩阵中减去均值向量 1 年前 |
|
|
Lionnel104 · 特征矩阵与向量之间的元素运算 1 年前 |
|
|
Kota · 使用-O2编译时,特征::Vector2f未正确初始化 2 年前 |
|
|
Riobaldo Tatarana · Eigen映射的奇异行为 2 年前 |
|
|
atb · 生成具有特征的矩阵的列运算的无循环和 2 年前 |
|
|
avgn · 为什么我的特征代码不能扩展到更多线程 8 年前 |
|
|
avgn · 特征稠密稀疏矩阵积是线程化的吗? 8 年前 |