温馨提示:文本由机器自动转译,部分词句存在误差,以视频为准
00:01
你的每一个字段,Elastic search都悄悄给它存了两份,一份道牌索引用来搜索,一份dock values, 用来聚合和排序。可在日志场景里,Do牌索引基本派不上用场,却照样占一份存储,照样要花成本去构建。9.5引入列式索引模式,字段只存一次,默认不在见索引,这就是logx BB cor. 问题来了,没有倒排索引,凭什么还查的快?靠两件事,第一,批量度,Dock values不再一个一个取值,而是一批一批往下扫。第二,Duck values跳跃器,它记着每段的最小值和最大值范围,查询的时候就能直接跳过大篇不匹配的文档。
01:01
跳跃器很挑数据摆放的顺序,所以索引排序要照着你真实的查询方式来调。字符串字段还有个讲究,低基数用字典加序数,高基数用块压缩。9.5技术预览阶段统一走块压缩,后续会按技术一值自动选择。实操上有三个新开关,Multi value、强制单值,No ability, 要求必须有值,少一份兜底的偏移记账就少一份开销。目前只在劣势模式下生效,违反会让文档写入失败,它是可选的。同一集群里7种索引模式能混着跑,企业搜索走文档模式,日志走劣势模式。我是点火三周关注我,下期接着往下拆。
我来说两句