changed "higher" to "lower". If I have less vectors in RAM, less RAM is used and more available for concurrent search => latency is lower, QPS is higher.