首页
学习
活动
专区
圈层
工具
发布
首页标签全文检索

#全文检索

从文本或数据库中,不限定数据字段,自由地萃取出消息的技术

IM全文检索技术(五):vivo敏感词匹配系统的技术实践

JackJiang

编者注:本文虽不是专门的全文检索技术文章,但文中涉及到的字词匹配算法等等都是一脉相承,所以也同样收录到了“IM全文检索技术”技术专题中,希望能给你启发。

6210

快手基于 Apache Doris 千亿多模态检索的实践

SelectDB技术团队

导读:大模型和 AI Agent 落地之后,多模态内容向量化与相似度检索逐渐成为大数据分析的基础能力。在快手,基于 Apache Doris 深度定制的 Ble...

17010

同义不等于同路:我在2万+条GEO优化采样里看到的Query敏感性

GEO实战经验分享

当用户表达的是同一个需求时,为什么有时候 AI 会想到一个品牌,有时候却完全不会?

9000

搜不到想要的信息?让大模型帮你想检索词,覆盖率翻倍

用户12653707

你有没有过这种体验:明知道网上肯定有答案,换了七八个关键词就是搜不出来。这不是搜索技术问题,是人的词汇量限制——我们很难一次性想出某个概念的所有同义词、上下游术...

16500

统一全文检索与 SQL 分析:Apache Doris 日志分析实践

SelectDB技术团队

这两类工作看似属于同一个分析流程,但长期以来通常由不同系统完成:Elasticsearch 等搜索引擎负责全文检索,Apache Doris 等 OLAP 数据...

7210

用 WorkBuddy 半天搭好本地政府采购检索系统:爬虫+SQLite+FastAPI 全记录

用户12731171

标签:#WorkBuddy# #积分攻略# #实操教程# #Python# #全文检索# 分类建议:开发工具 / 人工智能 原创声明:本文系作者原创,首发于腾讯...

20310

向量检索不准怎么办:混合检索与 Rerank 重排序召回优化实战

程序员天天困

上一篇聊向量数据库原理,咱们把「文档切块 → Embedding 向量化 → HNSW/IVF 近邻检索」这条链路走通了。但向量库解决的是「存得下、搜得快」,真...

21210

TOOM舆情监测系统如何让舆情报告可复核:搜索、证据留存与企业交付工作台

用户10882375

企业使用舆情系统,最终往往不是为了看一张热度曲线,而是为了在会议、客服、法务或管理决策中快速回答:发生了什么、依据在哪里、结论能否复核。本文以 TOOM 舆情监...

20010

一文搞懂全文检索的根基: 标记化(Tokenization)原理详解

用户4035096

全文检索相信大家不陌生, 例如在PG中有存储文本经过分词处理后的tsvector类型(里面存储了词元/标记(tokens), 位置等关键信息)、用于全文检索的查...

22210

2025,我的“All in Rust”战略失败了

架构师部落

2025年最大的意难平是rust至今没有一个杀手级的gui框架出现或者能做到很成熟。

28510

主流信创数据库横向对比与应用场景解析

匙亮旭

代表性产品:KingbaseES,基于PostgreSQL深度开发,兼容Oracle特性(PL/SQL、存储过程等)

91210

邮件全文检索与搜索优化

TurboEx技术分享

邮件全文检索的 90% 以上线上故障,既不是倒排索引本身的问题,也不是分布式集群的容量问题,而是邮件特有的 MIME 结构、多语言混合文本与强时间局部性特征,与...

23710

MySQL LIKE查询太慢?手把手搭建Elasticsearch站内搜索

数据库小学妹

📌 今日关键词:全文检索、Elasticsearch、MySQL LIKE、倒排索引、数据同步、Logstash、Canal

26510

WorkBuddy 在企业内部审计中的实战:从法规检索到报告撰写,效率翻倍的四个场景

YU老师

作者是一名企业内部审计从业者,日常工作中需要处理大量法规检索、数据分析、文书撰写和风险研判任务。在试用 WorkBuddy 一个月后,总结了四个高频使用场景,希...

1.2K10
领券