首页
学习
活动
专区
圈层
工具
发布
技术百科首页 >端侧大模型 >端侧大模型如何与本地知识库结合使用?

端侧大模型如何与本地知识库结合使用?

词条归属:端侧大模型

端侧大模型可结合本地向量数据库RAG(检索增强生成)技术,在完全离线的条件下实现知识库问答能力。典型架构是:使用量化嵌入模型(如 nomic-embed-text、mxbai-embed-large)在本地将文档分块并生成向量索引,存入本地向量数据库;查询时,嵌入模型将用户问题向量化,检索相关文档片段,与端侧大模型结合生成回答。

1. 端侧 RAG 的优势

整个流程无需网络传输,数据全程不出设备,适合处理敏感文档(如医疗病历、法律文件、财务报表等)。嵌入模型体积通常在 100MB—800MB,可在消费级设备上流畅运行。

2. 性能约束

端侧 RAG 的检索效率受本地向量数据库性能限制,通常适用于 1 万条以内的文档集合。对于更大规模的知识库,可采用混合模式:本地完成初步检索和摘要,复杂查询路由至云端处理。

相关文章
苹果AI手机发布后,端侧AI大模型前景如何?
9月10日凌晨1点,被称为“科技春晚”的苹果发布会拉开序幕。其中苹果介绍了其第一台AI手机:iPhone 16。这是第一台搭载了AI大模型的手机,能够依据用户的输入进行但不限于AI消图、总结文本、邮件回复等等。
算法一只狗
2024-09-26
1.5K0
端侧大模型浪潮奔涌而至:态势、影响与建议
10月10日,Vivo推出蓝心端侧大模型 3B,其AI能力已覆盖60多个国家和地区,服务超5亿手机用户,大模型token输出量超过3万亿;随后,字节发布首款AI智能体耳机Ola Friend,与豆包深度集成;18日,荣耀同期发布了Magic OS 9.0 ,打造AI OS,其上的YOYO智慧助手已经打通了多款APP,可以实现一句话充值、一句话点外卖等服务。中国信通院与荣耀等企业还共同发布了《终端智能化分级研究报告》,推出了行业首个终端智能化分级体系。
小腾资讯君
2024-10-31
1.3K0
端到端语音翻译系统结合ASR与印度语大模型
本文介绍了针对IWSLT 2025印度语赛道的端到端语音到文本翻译系统,专注于英语-印度语及印度语-英语的双向翻译任务。为提升低资源场景下的翻译质量,提出了一种集成预训练Whisper自动语音识别(ASR)模型与印度语专用大语言模型(LLM)Krutrim的端到端系统。
用户11764306
2025-08-23
2240
端侧 AI 新战场:MoE 大模型压缩与移动芯片适配
在人工智能领域的浩瀚星河中,端侧 AI 正冉冉升起,成为备受瞩目的新星。随着技术的不断演进,人们对 AI 的需求已不再局限于云端服务器的强大算力,而是逐渐向移动设备等端侧延伸。从智能手机中智能语音助手的实时响应,到智能摄像头对画面的精准识别,端侧 AI 正在悄无声息地改变着我们的生活方式。
二一年冬末
2025-07-03
1.2K0
大模型开发实战:(二)使用 LangChain 构建本地知识库应用
检索增强生成(Retrieval-Augmented Generation,RAG)是一种优化大型语言模型输出的方法,允许模型在生成回答前,从外部知识库中检索相关信息,而非仅依赖模型内部训练的知识。通过引用外部知识库的信息来生成更准确、实时且可靠的内容,并解决知识过时和幻觉的问题。下面将介绍使用 LangChain 和 Ollama 实现一个本地知识库应用。
张高兴
2025-05-21
3.6K0
点击加载更多
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档
领券