Skip to content

PQ→KMeansでは誤差が大きくなる #11

Description

@atksh

annax/src/annax/index.py

Lines 177 to 180 in 566aa3e

codebooks = pq(data, self.sub_dim, n_iter=self.n_iter, batch_size=self.batch_size, k=self.k)
prod_tables = calc_prod_table(codebooks)
encoded_data = encode(prep(data, self.sub_dim), codebooks)
codebook = kmeans(data, self.nlist, n_iter=self.n_iter, batch_size=self.batch_size)

kmeansかけて、そのあと、そのセントロイドからかくデータ点の距離 (residual) をquantizeするのが定石らしい。

Metadata

Metadata

Assignees

Labels

No labels
No labels

Projects

No projects

Milestone

No milestone

Relationships

None yet

Development

No branches or pull requests

Issue actions