Class: TencentCloud::Tione::V20211111::ModifyModelServiceRequest

Inherits:
Common::AbstractModel
  • Object
show all
Defined in:
lib/v20211111/models.rb

Overview

ModifyModelService请求参数结构体

Instance Attribute Summary collapse

Instance Method Summary collapse

Constructor Details

#initialize(serviceid = nil, modelinfo = nil, imageinfo = nil, env = nil, resources = nil, instancetype = nil, scalemode = nil, replicas = nil, horizontalpodautoscaler = nil, logenable = nil, logconfig = nil, serviceaction = nil, servicedescription = nil, scalestrategy = nil, cronscalejobs = nil, hybridbillingprepaidreplicas = nil, modelhotupdateenable = nil, scheduledaction = nil, servicelimit = nil, volumemount = nil, modelturboenable = nil, command = nil, serviceeip = nil, commandbase64 = nil, serviceport = nil, instanceperreplicas = nil, terminationgraceperiodseconds = nil, prestopcommand = nil, grpcenable = nil, healthprobe = nil, rollingupdate = nil, sidecar = nil, resourcegroupid = nil, volumemounts = nil, schedulingstrategy = nil) ⇒ ModifyModelServiceRequest

Returns a new instance of ModifyModelServiceRequest.



5943
5944
5945
5946
5947
5948
5949
5950
5951
5952
5953
5954
5955
5956
5957
5958
5959
5960
5961
5962
5963
5964
5965
5966
5967
5968
5969
5970
5971
5972
5973
5974
5975
5976
5977
5978
5979
# File 'lib/v20211111/models.rb', line 5943

def initialize(serviceid=nil, modelinfo=nil, imageinfo=nil, env=nil, resources=nil, instancetype=nil, scalemode=nil, replicas=nil, horizontalpodautoscaler=nil, logenable=nil, logconfig=nil, serviceaction=nil, servicedescription=nil, scalestrategy=nil, cronscalejobs=nil, hybridbillingprepaidreplicas=nil, modelhotupdateenable=nil, scheduledaction=nil, servicelimit=nil, volumemount=nil, modelturboenable=nil, command=nil, serviceeip=nil, commandbase64=nil, serviceport=nil, instanceperreplicas=nil, terminationgraceperiodseconds=nil, prestopcommand=nil, grpcenable=nil, healthprobe=nil, rollingupdate=nil, sidecar=nil, resourcegroupid=nil, volumemounts=nil, schedulingstrategy=nil)
  @ServiceId = serviceid
  @ModelInfo = modelinfo
  @ImageInfo = imageinfo
  @Env = env
  @Resources = resources
  @InstanceType = instancetype
  @ScaleMode = scalemode
  @Replicas = replicas
  @HorizontalPodAutoscaler = horizontalpodautoscaler
  @LogEnable = logenable
  @LogConfig = logconfig
  @ServiceAction = serviceaction
  @ServiceDescription = servicedescription
  @ScaleStrategy = scalestrategy
  @CronScaleJobs = cronscalejobs
  @HybridBillingPrepaidReplicas = hybridbillingprepaidreplicas
  @ModelHotUpdateEnable = modelhotupdateenable
  @ScheduledAction = scheduledaction
  @ServiceLimit = servicelimit
  @VolumeMount = volumemount
  @ModelTurboEnable = modelturboenable
  @Command = command
  @ServiceEIP = serviceeip
  @CommandBase64 = commandbase64
  @ServicePort = serviceport
  @InstancePerReplicas = instanceperreplicas
  @TerminationGracePeriodSeconds = terminationgraceperiodseconds
  @PreStopCommand = prestopcommand
  @GrpcEnable = grpcenable
  @HealthProbe = healthprobe
  @RollingUpdate = rollingupdate
  @Sidecar = sidecar
  @ResourceGroupId = resourcegroupid
  @VolumeMounts = volumemounts
  @SchedulingStrategy = schedulingstrategy
end

Instance Attribute Details

#CommandObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def Command
  @Command
end

#CommandBase64Object

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def CommandBase64
  @CommandBase64
end

#CronScaleJobsObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def CronScaleJobs
  @CronScaleJobs
end

#EnvObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def Env
  @Env
end

#GrpcEnableObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def GrpcEnable
  @GrpcEnable
end

#HealthProbeObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def HealthProbe
  @HealthProbe
end

#HorizontalPodAutoscalerObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def HorizontalPodAutoscaler
  @HorizontalPodAutoscaler
end

#HybridBillingPrepaidReplicasObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def HybridBillingPrepaidReplicas
  @HybridBillingPrepaidReplicas
end

#ImageInfoObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def ImageInfo
  @ImageInfo
end

#InstancePerReplicasObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def InstancePerReplicas
  @InstancePerReplicas
end

#InstanceTypeObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def InstanceType
  @InstanceType
end

#LogConfigObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def LogConfig
  @LogConfig
end

#LogEnableObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def LogEnable
  @LogEnable
end

#ModelHotUpdateEnableObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def ModelHotUpdateEnable
  @ModelHotUpdateEnable
end

#ModelInfoObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def ModelInfo
  @ModelInfo
end

#ModelTurboEnableObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def ModelTurboEnable
  @ModelTurboEnable
end

#PreStopCommandObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def PreStopCommand
  @PreStopCommand
end

#ReplicasObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def Replicas
  @Replicas
end

#ResourceGroupIdObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def ResourceGroupId
  @ResourceGroupId
end

#ResourcesObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def Resources
  @Resources
end

#RollingUpdateObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def RollingUpdate
  @RollingUpdate
end

#ScaleModeObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def ScaleMode
  @ScaleMode
end

#ScaleStrategyObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def ScaleStrategy
  @ScaleStrategy
end

#ScheduledActionObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def ScheduledAction
  @ScheduledAction
end

#SchedulingStrategyObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def SchedulingStrategy
  @SchedulingStrategy
end

#ServiceActionObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def ServiceAction
  @ServiceAction
end

#ServiceDescriptionObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def ServiceDescription
  @ServiceDescription
end

#ServiceEIPObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def ServiceEIP
  @ServiceEIP
end

#ServiceIdObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def ServiceId
  @ServiceId
end

#ServiceLimitObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def ServiceLimit
  @ServiceLimit
end

#ServicePortObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def ServicePort
  @ServicePort
end

#SidecarObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def Sidecar
  @Sidecar
end

#TerminationGracePeriodSecondsObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def TerminationGracePeriodSeconds
  @TerminationGracePeriodSeconds
end

#VolumeMountObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def VolumeMount
  @VolumeMount
end

#VolumeMountsObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceId:

    服务id

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定预付费模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL"

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • ServiceAction:

    特殊更新行为: "STOP": 停止, "RESUME": 重启, "SCALE": 扩缩容, 存在这些特殊更新行为时,会忽略其他更新字段

  • ServiceDescription:

    服务的描述

  • ScaleStrategy:

    自动伸缩策略

  • CronScaleJobs:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数, 若不填则默认为1

  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • ServiceLimit:

    服务限速限流相关配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。默认不开启

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启动grpc端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • ResourceGroupId:

    资源组 id

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



5941
5942
5943
# File 'lib/v20211111/models.rb', line 5941

def VolumeMounts
  @VolumeMounts
end

Instance Method Details

#deserialize(params) ⇒ Object



5981
5982
5983
5984
5985
5986
5987
5988
5989
5990
5991
5992
5993
5994
5995
5996
5997
5998
5999
6000
6001
6002
6003
6004
6005
6006
6007
6008
6009
6010
6011
6012
6013
6014
6015
6016
6017
6018
6019
6020
6021
6022
6023
6024
6025
6026
6027
6028
6029
6030
6031
6032
6033
6034
6035
6036
6037
6038
6039
6040
6041
6042
6043
6044
6045
6046
6047
6048
6049
6050
6051
6052
6053
6054
6055
6056
6057
6058
6059
6060
6061
6062
6063
6064
6065
6066
6067
6068
6069
6070
6071
6072
6073
6074
# File 'lib/v20211111/models.rb', line 5981

def deserialize(params)
  @ServiceId = params['ServiceId']
  unless params['ModelInfo'].nil?
    @ModelInfo = ModelInfo.new
    @ModelInfo.deserialize(params['ModelInfo'])
  end
  unless params['ImageInfo'].nil?
    @ImageInfo = ImageInfo.new
    @ImageInfo.deserialize(params['ImageInfo'])
  end
  unless params['Env'].nil?
    @Env = []
    params['Env'].each do |i|
      envvar_tmp = EnvVar.new
      envvar_tmp.deserialize(i)
      @Env << envvar_tmp
    end
  end
  unless params['Resources'].nil?
    @Resources = ResourceInfo.new
    @Resources.deserialize(params['Resources'])
  end
  @InstanceType = params['InstanceType']
  @ScaleMode = params['ScaleMode']
  @Replicas = params['Replicas']
  unless params['HorizontalPodAutoscaler'].nil?
    @HorizontalPodAutoscaler = HorizontalPodAutoscaler.new
    @HorizontalPodAutoscaler.deserialize(params['HorizontalPodAutoscaler'])
  end
  @LogEnable = params['LogEnable']
  unless params['LogConfig'].nil?
    @LogConfig = LogConfig.new
    @LogConfig.deserialize(params['LogConfig'])
  end
  @ServiceAction = params['ServiceAction']
  @ServiceDescription = params['ServiceDescription']
  @ScaleStrategy = params['ScaleStrategy']
  unless params['CronScaleJobs'].nil?
    @CronScaleJobs = []
    params['CronScaleJobs'].each do |i|
      cronscalejob_tmp = CronScaleJob.new
      cronscalejob_tmp.deserialize(i)
      @CronScaleJobs << cronscalejob_tmp
    end
  end
  @HybridBillingPrepaidReplicas = params['HybridBillingPrepaidReplicas']
  @ModelHotUpdateEnable = params['ModelHotUpdateEnable']
  unless params['ScheduledAction'].nil?
    @ScheduledAction = ScheduledAction.new
    @ScheduledAction.deserialize(params['ScheduledAction'])
  end
  unless params['ServiceLimit'].nil?
    @ServiceLimit = ServiceLimit.new
    @ServiceLimit.deserialize(params['ServiceLimit'])
  end
  unless params['VolumeMount'].nil?
    @VolumeMount = VolumeMount.new
    @VolumeMount.deserialize(params['VolumeMount'])
  end
  @ModelTurboEnable = params['ModelTurboEnable']
  @Command = params['Command']
  unless params['ServiceEIP'].nil?
    @ServiceEIP = ServiceEIP.new
    @ServiceEIP.deserialize(params['ServiceEIP'])
  end
  @CommandBase64 = params['CommandBase64']
  @ServicePort = params['ServicePort']
  @InstancePerReplicas = params['InstancePerReplicas']
  @TerminationGracePeriodSeconds = params['TerminationGracePeriodSeconds']
  @PreStopCommand = params['PreStopCommand']
  @GrpcEnable = params['GrpcEnable']
  unless params['HealthProbe'].nil?
    @HealthProbe = HealthProbe.new
    @HealthProbe.deserialize(params['HealthProbe'])
  end
  unless params['RollingUpdate'].nil?
    @RollingUpdate = RollingUpdate.new
    @RollingUpdate.deserialize(params['RollingUpdate'])
  end
  unless params['Sidecar'].nil?
    @Sidecar = SidecarSpec.new
    @Sidecar.deserialize(params['Sidecar'])
  end
  @ResourceGroupId = params['ResourceGroupId']
  unless params['VolumeMounts'].nil?
    @VolumeMounts = []
    params['VolumeMounts'].each do |i|
      volumemount_tmp = VolumeMount.new
      volumemount_tmp.deserialize(i)
      @VolumeMounts << volumemount_tmp
    end
  end
  @SchedulingStrategy = params['SchedulingStrategy']
end