Skip to content

About

This project focuses on developing a scalable vector database system optimized for dense passage retrieval, leveraging the MS-MARCO v2 dataset containing 8.84 million passages. Using advanced big data technologies and vector indexing algorithms, the system addresses challenges of retrieval latency and accuracy in large-scale datasets.

Topics

Resources

Stars

0 stars

Watchers

1 watching

Forks

Latest commit

 

History

7 Commits

Folders and files

Repository files navigation

Large-Scale-Vector-DB

About

This project focuses on developing a scalable vector database system optimized for dense passage retrieval, leveraging the MS-MARCO v2 dataset containing 8.84 million passages. Using advanced big data technologies and vector indexing algorithms, the system addresses challenges of retrieval latency and accuracy in large-scale datasets.

Topics

Resources

Stars

0 stars

Watchers

1 watching

Forks

Releases

Packages

Used by

Contributors

Languages