首页
学习
活动
专区
工具
TVP
发布
精选内容/技术社群/优惠产品,尽在小程序
立即前往

开源推荐 | 万物皆可问,企业级本地知识库问答解决方案,支持任意格式文件或数据库的问答

一、项目简介

QAnything (Question and Answer based on Anything) 是致力于支持任意格式文件或数据库的本地知识库问答系统,可断网安装使用。

您的任何格式的本地文件都可以往里扔,即可获得准确、快速、靠谱的问答体验。

目前已支持格式: PDF(pdf),Word(docx),PPT(pptx),XLS(xlsx),Markdown(md),电子邮件(eml),TXT(txt),图片(jpg,jpeg,png),CSV(csv),网页链接(html),更多格式,敬请期待...

二、开源协议

QAnything 依照 Apache 2.0 协议开源。

三、主要特点

数据安全,支持全程拔网线安装使用。

支持跨语种问答,中英文问答随意切换,无所谓文件是什么语种。

支持海量数据问答,两阶段向量排序,解决了大规模数据检索退化的问题,数据越多,效果越好。

高性能生产级系统,可直接部署企业应用。

易用性,无需繁琐的配置,一键安装部署,拿来就用。

支持选择多知识库问答。

四、Qanything框架图

为什么是两阶段检索?

知识库数据量大的场景下两阶段优势非常明显,如果只用一阶段embedding检索,随着数据量增大会出现检索退化的问题,如下图中绿线所示,二阶段rerank重排后能实现准确率稳定增长,即数据越多,效果越好

QAnything使用的检索组件BCEmbedding有非常强悍的双语和跨语种能力,能消除语义检索里面的中英语言之间的差异,从而实现:

强大的双语和跨语种语义表征能力【基于MTEB的语义表征评测指标】。

基于LlamaIndex的RAG评测,表现SOTA【基于LlamaIndex的RAG评测指标】。

五、演示展示

六、代码仓库

主源码仓库:

https://gitee.com/netease-youdao/QAnything

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OXo_UoSjQ6ZySedESxZVulIQ0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

扫码

添加站长 进交流群

领取专属 10元无门槛券

私享最新 技术干货

扫码加入开发者社群
领券