久等了各位!时隔一个多月,我们在4月26日和5月20日接连发布了v1.4.0和v1.4.1两个版本,带来了问答性能,解析效果等多方面的改进,并新增了大量的新功能和新特性
最新特性表

开发背景:
在v1.0.x->v1.3.x的版本迭代过程中,通过分析用户反馈,我们发现绝大部分的问题都是在使用本地大模型时产生的,因此我们把相当一部分工作重心放在了本地大模型的适配上
在这个目标下做了一系列的工作:
-
自动检测显卡的型号,计算能力和内存大小,并根据情况自动调整默认启动参数,以提供用户最佳体验,并给予相关提示。
-
支持Nvidia下全系列显卡,并根据用户硬件条件推荐本地大模型Size(3B,7B等)。
-
提供3种LLM推理运行后端:包括FasterTransformer(默认)、huggingface和vllm,通过FastChat Server API支持加载各种开源大模型。
-
提供纯python版本,自动根据运行环境切换本地大模型,模型自动下载等。
确实解决了一部分问题,但是随后我们发现这种做法类似于打地鼠,我们写的自动化逻辑本意是帮助用户减少手动操作的时间,尽量自动化运行QAnything,这个过程中添加了繁杂的检测和判断逻辑,但是相比用户使用场景的复杂性还远远不够,截止至v1.3.3版本发布,最多的问题仍然是本地模型运行过程中与系统软硬件环境产生的冲突,同时我们还发现大量用户存在使用自定义模型的需求,并不需要我们内置本地大模型(我们考虑到大部分个人用户的硬件条件,内置大模型主要是3B和7B的,实际使用效果欠佳),因此我们及时改变策略,将大模型这块独立出来,仅提供基础的本地大模型,同时提供更方便的使用其他开源大模型的接口,把工作重心放在增加更多的大模型衍生功能,同时进一步降低用户使用门槛上。
新发布的V1.4.0&V1.4.1将新增如下新特性:
-
新增联网检索
-
支持FAQ问答
-
支持自定义Bot
-
支持语音文件
-
支持文件溯源
-
支持问答日志检索
-
支持国产OS(OpenCloudOS)
-
支持所有与OpenAI-API兼容的大模型服务(包含ollama,通义千问DashScope等)
-
支持多卡推理
-
PDF文件解析效果优化(包含表格效果)
以及部分使用上的改进,包括服务启动时间优化,资源占用优化,修复已知问题等
联网检索
注意:联网检索依赖于第三方库:GitHub - deedy5/duckduckgo_search
duckduckgo_search使用依赖外网VPN,如无法获取外网VPN请在前端页面关闭联网检索功能,防止报错。
未开启联网检索:

开启联网检索:

import sys
import requests
import time
def send_request():
url = 'http://{your_host}:8777/api/local_doc_qa/local_doc_chat'
headers = {
'content-t

1935

被折叠的 条评论
为什么被折叠?



