帮你快速理解、总结文档立即下载

调用原子服务推理

最近更新时间:2026-08-10 15:22:01
我的收藏
腾讯云 ES 提供了丰富的原子服务(参阅这里),在 ES 控制台左侧导航栏的“智能搜索开发”下,点击“原子服务”即可看到,它们可以通过 API 直接调用。
其中 Embedding,Rerank,LLM 等类型的原子服务可以通过 ES 的 inference 创建为推理端点。


通过原子服务创建推理端点

您可以将原子服务创建为一个 ES 的 inference 推理端点,这样在 ES 中需要通过 inference API 调用时(例如通过 ingest pipeline 写入、通过 knn 或者 semantic 方式搜索)可以直接调用。
Kibana Dev Tools
PUT _inference/text_embedding/tencent-embedding
{
"service": "custom",
"service_settings": {
"url": "http://bj.aisearch.tencentelasticsearch.com/v1/embeddings",
"headers": {
"Authorization": "Bearer ${api_key}",
"Content-Type": "application/json"
},
"request": "{\\"model\\": \\"bge-m3\\", \\"input\\": ${input}}",
"response": {
"json_parser": {
"text_embeddings": "$.data[*].embedding[*]"
}
},
"secret_parameters": {
"api_key": "sk-****"
}
}
}

相关文档