首批通过分布式安全可靠测评,为关键业务系统打造
ALTER_AI_MODEL_ENDPOINT
更新时间:2026-07-29 10:39:51
ALTER_AI_MODEL_ENDPOINT 过程用于修改 AI 模型对象的访问端点。
语法
PROCEDURE alter_ai_model_endpoint(
IN name VARCHAR(128),
IN params JSON);
参数说明
| 参数 | 描述 | 类型 | 取值范围 | 是否可空 |
|---|---|---|---|---|
| name | AI 模型对象的访问端点的名称。 | VARCHAR(128) | NO | |
| params | ai_model_name,表示由 CREATE_AI_MODEL 过程创建的 AI 模型对象的名称 |
JSON STRING | NO | |
url,表示 AI 模型服务访问端点的完整 URL,即聊天、嵌入或重排序等功能的具体接口地址,而非基础 URL |
JSON STRING | NO | ||
access_key,表示访问端点的访问密钥 |
JSON STRING | NO | ||
request_model_name,表示用户自定义的模型名称,例如 big-m3-custom,放在请求消息体里面 |
JSON STRING | YES,可以为空或不指定 | ||
provider,表示模型供应商 |
JSON STRING |
|
NO | |
parameters,表示端点的扩展参数,用于配置 AI_COMPLETE 和 AI_EMBED 函数处理多行数据时的并发批处理行为。该字段的值是 JSON 字符串(不是 JSON 对象),推荐使用 JSON_OBJECT() 函数构建参数,避免复杂的转义问题。支持的子参数见下文 parameters 参数说明。
说明该参数从 V5.0.1 版本开始引入。不配置时使用默认并发范围 10~100。 |
JSON STRING | YES,可以为空或不指定 |
parameters 参数说明
parameters 字段用于配置并发批处理参数。系统采用 AIMD 自适应算法,根据模型服务响应动态调整并发数,在吞吐量和稳定性之间取得平衡。
| 参数 | 描述 | 类型 | 默认值 | 是否可空 |
|---|---|---|---|---|
min_concurrency |
并发数下限。AIMD 自适应降速时不低于此值。 | int | 10 | YES,可以为空、不指定或设为 0(表示使用默认值) |
max_concurrency |
并发数上限。初始并发数等于此值。 | int | 100 | YES,可以为空、不指定或设为 0(表示使用默认值) |
参数调优说明如下:
- 公有云 API(如 OpenAI/DeepSeek 等)建议
max_concurrency不超过 50,避免触发限流。 - 自建模型服务可根据算力适当放大。
- 如果频繁出现 429 限流日志,说明
max_concurrency偏高,应调低或依赖自适应降速。
示例
修改 AI 模型对象的访问端点。
CALL DBMS_AI_SERVICE.ALTER_AI_MODEL_ENDPOINT (
'my_model_endpoint1', '{
"access_key" : "sk2-xxxxxxxxxxxx",
"url": "https://api.deepseek.com/chat/completions"
}');
修改已有端点的并发批处理参数,通过 JSON 对象方式(推荐使用) 配置。
CALL DBMS_AI_SERVICE.ALTER_AI_MODEL_ENDPOINT('my_model_endpoint1',
JSON_OBJECT("parameters", '{"min_concurrency": 10, "max_concurrency": 80}')
);
修改已有端点的并发批处理参数,通过纯 JSON 字符串方式配置,需要双重转义 \\\"。
CALL DBMS_AI_SERVICE.ALTER_AI_MODEL_ENDPOINT('my_model_endpoint1', '{
"parameters": "{\\\"min_concurrency\\\": 10, \\\"max_concurrency\\\": 80}"
}');