赞
踩
一、什么是QAnything
QAnything (Question and Answer based on Anything) 是致力于支持任意格式文件或数据库的本地知识库问答系统,可断网安装使用。
您的任何格式的本地文件都可以往里扔,即可获得准确、快速、靠谱的问答体验。
目前已支持格式: PDF(pdf),Word(docx),PPT(pptx),XLS(xlsx),Markdown(md),电子邮件(eml),TXT(txt),图片(jpg,jpeg,png),CSV(csv),网页链接(html),更多格式,敬请期待…
二、特点
三、架构图
以下是官网提供的架构图:
为什么是两阶段检索?
知识库数据量大的场景下两阶段优势非常明显,如果只用一阶段embedding检索,随着数据量增大会出现检索退化的问题,如下图中绿线所示,二阶段rerank重排后能实现准确率稳定增长,即数据越多,效果越好。
QAnything使用的检索组件BCEmbedding有非常强悍的双语和跨语种能力,能消除语义检索里面的中英语言之间的差异,从而实现:
一阶段检索(embedding)
以下是官网提供的性能压测图:
二阶段检索(rerank)
以上就是QAnything的相关介绍,后续会继续更新关于QAnything的部署、使用等场景,喜欢的朋友可以点赞加关注。
资料参考:
https://github.com/netease-youdao/QAnything/tree/master
Copyright © 2003-2013 www.wpsshop.cn 版权所有,并保留所有权利。