兄弟们 这个牛P 👍🏻
Upstash Vector:将1100万篇维基百科索引成1.44亿向量数据,支持包括中文在内的11种语言。
你可以用它轻松构建搜索引擎和RAG机器人
Upstash Vector,一个支持可扩展相似性搜索的向量数据库,对整个维基百科文章进行了向量化。
使得你可以针对维基百科基于语义进行搜索,提高搜索的准确性。
他们还开源了一个工具你可以基于该数据库轻松创建基于维基百科搜索和RAG机器人。
Upstash Vector 还能够处理和理解多种语言的内容,并在不同语言之间进行相似性搜索。
这意味着它支持跨语言的语义搜索。用户可以用一种语言进行查询,并在其他语言的数据中找到相应的结果。
比如你用中文搜索“世界最高的山”,它也能找到英文里关于“Mount Everest”的信息。
详细介绍:http://t.cn/A6Rvyf2e
GitHub:http://t.cn/A6Rvyf2d
在线体验:http://t.cn/A6Rvyf2g http://t.cn/A6RvyxXZ
发布于 安徽
