本文适用于腾讯云数据仓库 TCHouse-X。介绍 AI Function 的产品能力,以及在控制台完成模型接入、治理、观测的完整操作流程。
功能介绍
TCHouse AI Function 是 TCHouse-X 内置的 AI 函数层,将大语言模型能力直接下沉到数据仓库。数据分析师无需编写 Python 代码、无需维护推理环境、无需把数据搬出数仓,只用标准 SQL 即可调用大模型完成文本生成、语义理解、信息抽取、向量化等任务,实现对海量数据的批量智能化处理。
核心概念
概念 | 说明 |
AI Function | 数仓内核内置的 AI 标量 / 聚合 / 表函数集合,可在 SQL 中直接调用,如 AI_GENERATE、AI_CLASSIFY、AI_EMBED。 |
Model Endpoint(模型接入点) | TCHouse-X 内的 Model Serving 抽象对象,一次注册、各处可用。Endpoint 屏蔽了 BaseURL、API Key 等连接细节,在 SQL 中以名称引用。 Model Endpoint 按照来源,可区分为托管模型及外部模型: 托管模型:TCHouse-X 账号下,由 TCHouse-X 采购 MaaS 后转售,模型收费方为 TCHouse-X ,BaseURL / API Key 由 TCHouse-X 提供。TCHouse-X 已在实例内预置若干托管模型 Endpoint,实例创建后即可直接调用, 外部模型(待上线):用户账号下,用户自行采购 MaaS,模型收费方为 MaaS ,BaseURL / API Key 由用户提供,TCHouse-X 代为调用消费模型。 |
AI Gateway(AI 网关) | 模型调用的治理层,承担转发、限流、计量与监控职责。所有经由 Endpoint 的调用都会通过 AI Gateway 统一处理。 |
API Key | 外部应用通过 OpenAI 兼容 API 直接消费 Model Endpoint 时使用的访问凭证,与 Endpoint 解耦、独立管理。 |
控制台入口
模块 | 用途 |
模型管理 > 模型连接 | Endpoint 的注册、编辑、测试、详情与监控 |
模型管理 > API Key | 外部应用调用模型所需凭证的管理 |
用量与配额(待上线) | 实例级 AI 调用计量大盘、配额水位与明细 |
函数列表 | 内置 AI 函数的 SQL Reference 字典 |
模型管理
Endpoint 列表
“模型连接”页默认展示 Endpoint 列表,列表中包含平台预置的开箱即用 Endpoint 与用户自行创建的 Endpoint,二者在使用方式上无差别。
页面顶部提供三张实例级指标卡:
Endpoint 数:当前实例下配置的模型连接总数。
本月 AI 函数调用次数:当前自然月内 AI 函数的累计调用次数。
本月 Token 消耗:当前自然月内消耗的 Token 总量(单位 M)。
列表字段如下:
字段 | 说明 |
Endpoint 名称 | Endpoint 的唯一标识,同时作为 SQL 中的引用参数;实例内唯一,不支持中文。列表中同时展示创建时间。 |
厂商 | 模型所属厂商。 |
模型 / 版本 | 具体模型及其支持的版本号。 |
分类 | 当前支持 LLM(文本生成与理解)、Embedding(向量化)等类型。 |
本月配额水位 | 以进度条展示已消耗 Token 与总配额占比,超过阈值(默认 80%)时进度条转为告警色。 |
状态 | 正常 / 异常。 |
负责人 | Endpoint 的创建者。 |
Endpoint 列表支持以下操作:
操作 | 说明 |
详情 | 查看 Endpoint 完整信息与调用示例。 |
监控 | 打开该 Endpoint 的独立监控大盘。 |
编辑 | 修改模型配置、限流与配额。 |
测试连接 | 弹窗内实际发起一次 API 请求,用于测试 Endpoint 的连通性。 |
新建 Endpoint
在“模型连接”列表页单击 + 新建模型连接,进入 Endpoint 注册页面。
模型来源:当前版本提供平台托管模型。由 TCHouse-X 统一采购并托管,Token 账单由 TCHouse-X 出单,用户无需准备 BaseURL 与 API Key。
模型配置:选择 模型厂商、模型分类、模型及版本
基本信息:需填写 Endpoint 名称(用于唯一标识该模型,并在 SQL 中作为函数参数引用。实例内唯一,不支持中文)及说明(一句话备注,如“主推的文本交互模型”)
调用治理:
模块 | 字段 | 必填 | 说明 |
访问限流 | TPM | 是 | 每分钟 Token 数,超限请求被拒绝。 |
访问限流 | RPM | 是 | 每分钟请求数,超限请求被拒绝。 |
访问限流 | 并发 | 否 | 最大并发请求数。 |
访问配额 | 配额周期 | 是 | 选择周期,触顶后停止该 Endpoint 的调用,至下一周期复位。 |
访问配额 | Token 配额 | 条件必填 | 具体 Token 额度;当配额周期为“不限制”时置灰不可填。 |
底部操作按钮
取消:关闭面板,放弃本次配置。
测试连接:按上方配置的凭证与地址发起一次真实请求,验证连通性。
保存:提交并创建 Endpoint。需测试连接通过后方可保存。
Endpoint 详情
详情页包含四个版块:
1. 基本信息:连接名称、来源、厂商、模型 / 版本、分类、状态(含最近连通性测试时间)、负责人及说明。
2. 访问限流:该 Endpoint 配置的 TPM、RPM 及并发限制。
3. 配额水位:可视化进度条 + “已消耗量 / 总配额”数值。
4. 调用示例:
SQL 调用示例:在数仓内通过内置函数调用该 Endpoint 的基础 SQL。
模型调用示例:外部应用通过 OpenAI 兼容 API 调用该 Endpoint 的代码片段,支持 cURL / Python requests 切换。
所有代码块支持一键复制。
SQL 调用示例参考(Chat 类 Endpoint):
SELECT AI_GENERATE(endpoint 'endpoint-minimax-m3','为 AI 产品发布会写一段开场白');
API 调用示例参考(Chat 类 Endpoint):
API Key 可在模型管理 > API Key 页获取。
curl -i 'https://<地域>.modelservice.tchousex.cloud.tencent.com/<实例ID>/<Endpoint名>/v1/chat/completions' \\--header 'Content-Type: application/json' \\--header 'Authorization: Bearer <your-api-key>' \\--data '{"model": "deepseek-v4-flash","messages": [{"role": "user","content": "hello"}]}'
API Key 管理
API Key 是外部应用通过 OpenAI 兼容 API 直接调用模型时使用的访问凭证,与 Endpoint 解耦,独立增删改查。
列表字段:名称、API Key(脱敏展示)、状态、创建时间、负责人。
操作:查看、复制、禁用、删除(仅已禁用的 Key 可删除)。
筛选 / 搜索:按状态筛选,按 Key 名称搜索。
状态:已就绪 / 已禁用。
函数列表
“函数列表” 是内置 AI 函数的 SQL Reference 字典,支持按分类筛选及搜索能力。
列表展示函数名、分类、用途简介与返回类型;展开行可查看参数规格、SQL 调用示例与预期输出等,并提供“复制”与“到 SQL 工作区执行”两个快捷操作。
完整函数说明请参见 AI Function 函数列表。