首批通过分布式安全可靠测评,为关键业务系统打造
CREATE_AI_MODEL_ENDPOINT
更新时间:2026-07-29 10:39:51
CREATE_AI_MODEL_ENDPOINT 过程用于创建 AI 模型对象的访问端点,需指定端点的地址、访问密钥、模型供应商等属性。
语法
PROCEDURE create_ai_model_endpoint(
IN name VARCHAR(128),
IN params JSON);
参数说明
| 参数 | 描述 | 类型 | 取值范围 | 是否可空 |
|---|---|---|---|---|
| name | AI 模型对象的访问端点的名称。 | VARCHAR(128) | NO | |
| params | ai_model_name,表示由 CREATE_AI_MODEL 过程创建的 AI 模型对象的名称 |
JSON STRING | NO | |
url,表示 AI 模型服务访问端点的完整 URL,即聊天、嵌入或重排序等功能的具体接口地址,而非基础 URL |
JSON STRING | NO | ||
access_key,表示访问端点的访问密钥 |
JSON STRING | NO | ||
request_model_name,表示用户自定义的模型名称,例如 big-m3-custom,放在请求消息体里面 |
JSON STRING | YES,可以为空或不指定 | ||
provider,表示模型供应商 |
JSON STRING |
|
NO | |
parameters,表示端点的扩展参数,用于配置 AI_COMPLETE 和 AI_EMBED 函数处理多行数据时的并发批处理行为。该字段的值是 JSON 字符串(不是 JSON 对象),推荐使用 JSON_OBJECT() 函数构建参数,避免复杂的转义问题。支持的子参数见下文 parameters 参数说明。
说明该参数从 V5.0.1 版本开始引入。不配置时使用默认并发范围 10~100。 |
JSON STRING | YES,可以为空或不指定 |
url 参数取值范围
| 厂商 | 类型 | 说明/示例 |
|---|---|---|
| 阿里云 (兼容 OpenAI 格式) |
complete | https://dashscope.aliyuncs.com/compatible-mode/v1/chat/completions |
| embedding | https://dashscope.aliyuncs.com/compatible-mode/v1/embeddings | |
| 阿里云 DashScope (非兼容 OpenAI 格式) |
complete | https://dashscope.aliyuncs.com/api/v1/services/aigc/text-generation/generation |
| embed | https://dashscope.aliyuncs.com/api/v1/services/embeddings/text-embedding/text-embedding | |
| rerank | https://dashscope.aliyuncs.com/api/v1/services/rerank/text-rerank/text-rerank | |
| deepseek (兼容 OpenAI 格式) |
complete | https://api.deepseek.com/chat/completions |
| 硅基流动 (兼容 OpenAI 格式) |
complete | https://api.siliconflow.cn/v1/chat/completions |
| embedding | https://api.siliconflow.cn/v1/embeddings | |
| rerank | https://api.siliconflow.cn/v1/rerank | |
| 腾讯混元大模型 (兼容 OpenAI 接口) |
complete | https://api.hunyuan.cloud.tencent.com/v1/chat/completions |
| embedding | https://api.hunyuan.cloud.tencent.com/v1/embeddings |
parameters 参数说明
parameters 字段用于配置并发批处理参数。系统采用 AIMD 自适应算法,根据模型服务响应动态调整并发数,在吞吐量和稳定性之间取得平衡。
| 参数 | 描述 | 类型 | 默认值 | 是否可空 |
|---|---|---|---|---|
min_concurrency |
并发数下限。AIMD 自适应降速时不低于此值。 | int | 10 | YES,可以为空、不指定或设为 0(表示使用默认值) |
max_concurrency |
并发数上限。初始并发数等于此值。 | int | 100 | YES,可以为空、不指定或设为 0(表示使用默认值) |
参数调优说明如下:
- 公有云 API(如 OpenAI/DeepSeek 等)建议
max_concurrency不超过 50,避免触发限流。 - 自建模型服务可根据算力适当放大。
- 如果频繁出现 429 限流日志,说明
max_concurrency偏高,应调低或依赖自适应降速。
示例
创建 AI 模型访问端点,类型为 dense_embedding,大模型为 text-embedding-v2。不配置 parameters,使用默认并发范围 10~100。
CALL DBMS_AI_SERVICE.CREATE_AI_MODEL_ENDPOINT (
'my_model_endpoint1', '{
"ai_model_name": "my_model1",
"url": "https://api.deepseek.com/chat/completions",
"access_key": "sk-xxxxxxxxxxxx",
"request_model_name": "deepseek-chat",
"provider": "deepseek"
}');
创建 AI 模型访问端点,并通过 JSON 对象方式(推荐使用) 配置并发批处理参数。
CALL DBMS_AI_SERVICE.CREATE_AI_MODEL_ENDPOINT('my_model_endpoint2',
JSON_OBJECT(
"ai_model_name", "my_model1",
"url", "https://api.deepseek.com/chat/completions",
"access_key", "sk-xxxxxxxxxxxx",
"provider", "deepseek",
"request_model_name", "deepseek-chat",
"parameters", '{"min_concurrency": 5, "max_concurrency": 50}'
)
);
创建 AI 模型访问端点,并通过纯 JSON 字符串方式配置并发批处理参数,需要双重转义 \\\"。
CALL DBMS_AI_SERVICE.CREATE_AI_MODEL_ENDPOINT('my_model_endpoint3', '{
"ai_model_name": "my_model1",
"url": "https://api.deepseek.com",
"access_key": "sk-xxxx",
"provider": "deepseek",
"request_model_name": "deepseek-chat",
"parameters": "{\\\"min_concurrency\\\": 5, \\\"max_concurrency\\\": 50}"
}');