Class: TencentCloud::Tione::V20211111::CreateModelServiceRequest

Inherits:
Common::AbstractModel
  • Object
show all
Defined in:
lib/v20211111/models.rb

Overview

CreateModelService请求参数结构体

Instance Attribute Summary collapse

Instance Method Summary collapse

Constructor Details

#initialize(servicegroupid = nil, servicegroupname = nil, servicedescription = nil, chargetype = nil, resourcegroupid = nil, modelinfo = nil, imageinfo = nil, env = nil, resources = nil, instancetype = nil, scalemode = nil, replicas = nil, horizontalpodautoscaler = nil, logenable = nil, logconfig = nil, authorizationenable = nil, tags = nil, newversion = nil, cronscalejobs = nil, scalestrategy = nil, hybridbillingprepaidreplicas = nil, createsource = nil, modelhotupdateenable = nil, scheduledaction = nil, volumemount = nil, servicelimit = nil, callbackurl = nil, modelturboenable = nil, servicecategory = nil, command = nil, serviceeip = nil, commandbase64 = nil, serviceport = nil, deploytype = nil, instanceperreplicas = nil, terminationgraceperiodseconds = nil, prestopcommand = nil, grpcenable = nil, healthprobe = nil, rollingupdate = nil, sidecar = nil, volumemounts = nil, schedulingstrategy = nil) ⇒ CreateModelServiceRequest

Returns a new instance of CreateModelServiceRequest.



791
792
793
794
795
796
797
798
799
800
801
802
803
804
805
806
807
808
809
810
811
812
813
814
815
816
817
818
819
820
821
822
823
824
825
826
827
828
829
830
831
832
833
834
835
# File 'lib/v20211111/models.rb', line 791

def initialize(servicegroupid=nil, servicegroupname=nil, servicedescription=nil, chargetype=nil, resourcegroupid=nil, modelinfo=nil, imageinfo=nil, env=nil, resources=nil, instancetype=nil, scalemode=nil, replicas=nil, horizontalpodautoscaler=nil, logenable=nil, logconfig=nil, authorizationenable=nil, tags=nil, newversion=nil, cronscalejobs=nil, scalestrategy=nil, hybridbillingprepaidreplicas=nil, createsource=nil, modelhotupdateenable=nil, scheduledaction=nil, volumemount=nil, servicelimit=nil, callbackurl=nil, modelturboenable=nil, servicecategory=nil, command=nil, serviceeip=nil, commandbase64=nil, serviceport=nil, deploytype=nil, instanceperreplicas=nil, terminationgraceperiodseconds=nil, prestopcommand=nil, grpcenable=nil, healthprobe=nil, rollingupdate=nil, sidecar=nil, volumemounts=nil, schedulingstrategy=nil)
  @ServiceGroupId = servicegroupid
  @ServiceGroupName = servicegroupname
  @ServiceDescription = servicedescription
  @ChargeType = chargetype
  @ResourceGroupId = resourcegroupid
  @ModelInfo = modelinfo
  @ImageInfo = imageinfo
  @Env = env
  @Resources = resources
  @InstanceType = instancetype
  @ScaleMode = scalemode
  @Replicas = replicas
  @HorizontalPodAutoscaler = horizontalpodautoscaler
  @LogEnable = logenable
  @LogConfig = logconfig
  @AuthorizationEnable = authorizationenable
  @Tags = tags
  @NewVersion = newversion
  @CronScaleJobs = cronscalejobs
  @ScaleStrategy = scalestrategy
  @HybridBillingPrepaidReplicas = hybridbillingprepaidreplicas
  @CreateSource = createsource
  @ModelHotUpdateEnable = modelhotupdateenable
  @ScheduledAction = scheduledaction
  @VolumeMount = volumemount
  @ServiceLimit = servicelimit
  @CallbackUrl = callbackurl
  @ModelTurboEnable = modelturboenable
  @ServiceCategory = servicecategory
  @Command = command
  @ServiceEIP = serviceeip
  @CommandBase64 = commandbase64
  @ServicePort = serviceport
  @DeployType = deploytype
  @InstancePerReplicas = instanceperreplicas
  @TerminationGracePeriodSeconds = terminationgraceperiodseconds
  @PreStopCommand = prestopcommand
  @GrpcEnable = grpcenable
  @HealthProbe = healthprobe
  @RollingUpdate = rollingupdate
  @Sidecar = sidecar
  @VolumeMounts = volumemounts
  @SchedulingStrategy = schedulingstrategy
end

Instance Attribute Details

#AuthorizationEnableObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def AuthorizationEnable
  @AuthorizationEnable
end

#CallbackUrlObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def CallbackUrl
  @CallbackUrl
end

#ChargeTypeObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ChargeType
  @ChargeType
end

#CommandObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def Command
  @Command
end

#CommandBase64Object

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def CommandBase64
  @CommandBase64
end

#CreateSourceObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def CreateSource
  @CreateSource
end

#CronScaleJobsObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def CronScaleJobs
  @CronScaleJobs
end

#DeployTypeObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def DeployType
  @DeployType
end

#EnvObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def Env
  @Env
end

#GrpcEnableObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def GrpcEnable
  @GrpcEnable
end

#HealthProbeObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def HealthProbe
  @HealthProbe
end

#HorizontalPodAutoscalerObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def HorizontalPodAutoscaler
  @HorizontalPodAutoscaler
end

#HybridBillingPrepaidReplicasObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def HybridBillingPrepaidReplicas
  @HybridBillingPrepaidReplicas
end

#ImageInfoObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ImageInfo
  @ImageInfo
end

#InstancePerReplicasObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def InstancePerReplicas
  @InstancePerReplicas
end

#InstanceTypeObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def InstanceType
  @InstanceType
end

#LogConfigObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def LogConfig
  @LogConfig
end

#LogEnableObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def LogEnable
  @LogEnable
end

#ModelHotUpdateEnableObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ModelHotUpdateEnable
  @ModelHotUpdateEnable
end

#ModelInfoObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ModelInfo
  @ModelInfo
end

#ModelTurboEnableObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ModelTurboEnable
  @ModelTurboEnable
end

#NewVersionObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def NewVersion
  @NewVersion
end

#PreStopCommandObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def PreStopCommand
  @PreStopCommand
end

#ReplicasObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def Replicas
  @Replicas
end

#ResourceGroupIdObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ResourceGroupId
  @ResourceGroupId
end

#ResourcesObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def Resources
  @Resources
end

#RollingUpdateObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def RollingUpdate
  @RollingUpdate
end

#ScaleModeObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ScaleMode
  @ScaleMode
end

#ScaleStrategyObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ScaleStrategy
  @ScaleStrategy
end

#ScheduledActionObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ScheduledAction
  @ScheduledAction
end

#SchedulingStrategyObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def SchedulingStrategy
  @SchedulingStrategy
end

#ServiceCategoryObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ServiceCategory
  @ServiceCategory
end

#ServiceDescriptionObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ServiceDescription
  @ServiceDescription
end

#ServiceEIPObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ServiceEIP
  @ServiceEIP
end

#ServiceGroupIdObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ServiceGroupId
  @ServiceGroupId
end

#ServiceGroupNameObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ServiceGroupName
  @ServiceGroupName
end

#ServiceLimitObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ServiceLimit
  @ServiceLimit
end

#ServicePortObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def ServicePort
  @ServicePort
end

#SidecarObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def Sidecar
  @Sidecar
end

#TagsObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def Tags
  @Tags
end

#TerminationGracePeriodSecondsObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def TerminationGracePeriodSeconds
  @TerminationGracePeriodSeconds
end

#VolumeMountObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def VolumeMount
  @VolumeMount
end

#VolumeMountsObject

TI.S.MEDIUM.POST 2C4G TI.S.LARGE.POST 4C8G TI.S.2XLARGE16.POST 8C16G TI.S.2XLARGE32.POST 8C32G TI.S.4XLARGE32.POST 16C32G TI.S.4XLARGE64.POST 16C64G TI.S.6XLARGE48.POST 24C48G TI.S.6XLARGE96.POST 24C96G TI.S.8XLARGE64.POST 32C64G TI.S.8XLARGE128.POST 32C128G TI.GN7.LARGE20.POST 4C20G T41/4 TI.GN7.2XLARGE40.POST 10C40G T41/2 TI.GN7.2XLARGE32.POST 8C32G T41 TI.GN7.5XLARGE80.POST 20C80G T41 TI.GN7.8XLARGE128.POST 32C128G T41 TI.GN7.10XLARGE160.POST 40C160G T42 TI.GN7.20XLARGE320.POST 80C320G T4*4 PREPAID 和 POSTPAID_BY_HOUR: 手动调节模式下对应 实例数量 自动调节模式下对应 基于时间的默认策略的实例数量 HYBRID_PAID: 后付费实例手动调节模式下对应 实例数量 后付费实例自动调节模式下对应 时间策略的默认策略的实例数量

Parameters:

  • ServiceGroupId:

    新增版本时需要填写

  • ServiceGroupName:

    不超过60个字,仅支持英文、数字、下划线"_"、短横"-",只能以英文、数字开头

  • ServiceDescription:

    模型服务的描述

  • ChargeType:

    付费模式,有 PREPAID (包年包月)和 POSTPAID_BY_HOUR(按量付费)

  • ResourceGroupId:

    预付费模式下所属的资源组id,同服务组下唯一

  • ModelInfo:

    模型信息,需要挂载模型时填写

  • ImageInfo:

    镜像信息,配置服务运行所需的镜像地址等信息

  • Env:

    环境变量,可选参数,用于配置容器中的环境变量

  • Resources:

    资源描述,指定包年包月模式下的cpu,mem,gpu等信息,后付费无需填写

  • InstanceType:

    使用DescribeBillingSpecs接口返回的规格列表中的值,或者参考实例列表:

  • ScaleMode:

    扩缩容类型 支持:自动 - "AUTO", 手动 - "MANUAL",默认为MANUAL

  • Replicas:

    实例数量, 不同计费模式和调节模式下对应关系如下

  • HorizontalPodAutoscaler:

    自动伸缩信息

  • LogEnable:

    是否开启日志投递,开启后需填写配置投递到指定cls

  • LogConfig:

    日志配置,需要投递服务日志到指定cls时填写

  • AuthorizationEnable:

    是否开启接口鉴权,开启后自动生成token信息,访问需要token鉴权

  • Tags:

    腾讯云标签

  • NewVersion:

    是否新增版本

  • CronScaleJobs:

    定时任务配置,使用定时策略时填写

  • ScaleStrategy:

    自动伸缩策略配置 HPA : 通过HPA进行弹性伸缩 CRON 通过定时任务进行伸缩

  • HybridBillingPrepaidReplicas:

    计费模式[HYBRID_PAID]时生效, 用于标识混合计费模式下的预付费实例数

  • CreateSource: (AUTO_ML 自动学习,自动学习正式发布 AUTO_ML_FORMAL, DEFAULT 默认)
  • ModelHotUpdateEnable:

    是否开启模型的热更新。默认不开启

  • ScheduledAction:

    定时停止配置

  • VolumeMount:

    挂载配置,目前只支持CFS

  • ServiceLimit:

    服务限速限流相关配置

  • CallbackUrl:

    回调地址,用于回调创建服务状态信息,回调格式&内容详情见:TI-ONE 接口回调说明

  • ModelTurboEnable:

    是否开启模型的加速, 仅对StableDiffusion(动态加速)格式的模型有效。

  • ServiceCategory:

    服务分类

  • Command:

    服务的启动命令,如遇特殊字符导致配置失败,可使用CommandBase64参数

  • ServiceEIP:

    是否开启TIONE内网访问外部,此功能仅支持后付费机型与从TIONE平台购买的预付费机型;使用从CVM选择资源组时此配置不生效。

  • CommandBase64:

    服务的启动命令,以base64格式进行输入,与Command同时配置时,仅当前参数生效

  • ServicePort:

    服务端口,仅在非内置镜像时生效,默认8501。不支持输入8501-8510,6006,9092

  • DeployType:

    服务的部署类型 [STANDARD 标准部署,DIST 分布式多机部署] 默认STANDARD

  • InstancePerReplicas:

    单副本下的实例数,仅在部署类型为DIST时生效,默认1

  • TerminationGracePeriodSeconds:

    服务的优雅退出时限。单位为秒,默认值为30,最小为1

  • PreStopCommand:

    服务实例停止前执行的命令,执行完毕或执行时间超过优雅退出时限后实例结束

  • GrpcEnable:

    是否启用 grpc 端口

  • HealthProbe:

    健康探针

  • RollingUpdate:

    滚动更新策略

  • Sidecar:

    sidecar配置

  • VolumeMounts:

    数据盘批量挂载配置,当前仅支持CFS,仅针对“模型来源-腾讯云存储、模型来源-腾讯云容器镜像、模型来源-资源组、模型来源-数据源”。

  • SchedulingStrategy:

    调度策略 [binpack] 优先占满整机,尽量避免碎卡(默认值)[spread] 优先分散在各个节点,确保服务高可用



789
790
791
# File 'lib/v20211111/models.rb', line 789

def VolumeMounts
  @VolumeMounts
end

Instance Method Details

#deserialize(params) ⇒ Object



837
838
839
840
841
842
843
844
845
846
847
848
849
850
851
852
853
854
855
856
857
858
859
860
861
862
863
864
865
866
867
868
869
870
871
872
873
874
875
876
877
878
879
880
881
882
883
884
885
886
887
888
889
890
891
892
893
894
895
896
897
898
899
900
901
902
903
904
905
906
907
908
909
910
911
912
913
914
915
916
917
918
919
920
921
922
923
924
925
926
927
928
929
930
931
932
933
934
935
936
937
938
939
940
941
942
943
944
945
# File 'lib/v20211111/models.rb', line 837

def deserialize(params)
  @ServiceGroupId = params['ServiceGroupId']
  @ServiceGroupName = params['ServiceGroupName']
  @ServiceDescription = params['ServiceDescription']
  @ChargeType = params['ChargeType']
  @ResourceGroupId = params['ResourceGroupId']
  unless params['ModelInfo'].nil?
    @ModelInfo = ModelInfo.new
    @ModelInfo.deserialize(params['ModelInfo'])
  end
  unless params['ImageInfo'].nil?
    @ImageInfo = ImageInfo.new
    @ImageInfo.deserialize(params['ImageInfo'])
  end
  unless params['Env'].nil?
    @Env = []
    params['Env'].each do |i|
      envvar_tmp = EnvVar.new
      envvar_tmp.deserialize(i)
      @Env << envvar_tmp
    end
  end
  unless params['Resources'].nil?
    @Resources = ResourceInfo.new
    @Resources.deserialize(params['Resources'])
  end
  @InstanceType = params['InstanceType']
  @ScaleMode = params['ScaleMode']
  @Replicas = params['Replicas']
  unless params['HorizontalPodAutoscaler'].nil?
    @HorizontalPodAutoscaler = HorizontalPodAutoscaler.new
    @HorizontalPodAutoscaler.deserialize(params['HorizontalPodAutoscaler'])
  end
  @LogEnable = params['LogEnable']
  unless params['LogConfig'].nil?
    @LogConfig = LogConfig.new
    @LogConfig.deserialize(params['LogConfig'])
  end
  @AuthorizationEnable = params['AuthorizationEnable']
  unless params['Tags'].nil?
    @Tags = []
    params['Tags'].each do |i|
      tag_tmp = Tag.new
      tag_tmp.deserialize(i)
      @Tags << tag_tmp
    end
  end
  @NewVersion = params['NewVersion']
  unless params['CronScaleJobs'].nil?
    @CronScaleJobs = []
    params['CronScaleJobs'].each do |i|
      cronscalejob_tmp = CronScaleJob.new
      cronscalejob_tmp.deserialize(i)
      @CronScaleJobs << cronscalejob_tmp
    end
  end
  @ScaleStrategy = params['ScaleStrategy']
  @HybridBillingPrepaidReplicas = params['HybridBillingPrepaidReplicas']
  @CreateSource = params['CreateSource']
  @ModelHotUpdateEnable = params['ModelHotUpdateEnable']
  unless params['ScheduledAction'].nil?
    @ScheduledAction = ScheduledAction.new
    @ScheduledAction.deserialize(params['ScheduledAction'])
  end
  unless params['VolumeMount'].nil?
    @VolumeMount = VolumeMount.new
    @VolumeMount.deserialize(params['VolumeMount'])
  end
  unless params['ServiceLimit'].nil?
    @ServiceLimit = ServiceLimit.new
    @ServiceLimit.deserialize(params['ServiceLimit'])
  end
  @CallbackUrl = params['CallbackUrl']
  @ModelTurboEnable = params['ModelTurboEnable']
  @ServiceCategory = params['ServiceCategory']
  @Command = params['Command']
  unless params['ServiceEIP'].nil?
    @ServiceEIP = ServiceEIP.new
    @ServiceEIP.deserialize(params['ServiceEIP'])
  end
  @CommandBase64 = params['CommandBase64']
  @ServicePort = params['ServicePort']
  @DeployType = params['DeployType']
  @InstancePerReplicas = params['InstancePerReplicas']
  @TerminationGracePeriodSeconds = params['TerminationGracePeriodSeconds']
  @PreStopCommand = params['PreStopCommand']
  @GrpcEnable = params['GrpcEnable']
  unless params['HealthProbe'].nil?
    @HealthProbe = HealthProbe.new
    @HealthProbe.deserialize(params['HealthProbe'])
  end
  unless params['RollingUpdate'].nil?
    @RollingUpdate = RollingUpdate.new
    @RollingUpdate.deserialize(params['RollingUpdate'])
  end
  unless params['Sidecar'].nil?
    @Sidecar = SidecarSpec.new
    @Sidecar.deserialize(params['Sidecar'])
  end
  unless params['VolumeMounts'].nil?
    @VolumeMounts = []
    params['VolumeMounts'].each do |i|
      volumemount_tmp = VolumeMount.new
      volumemount_tmp.deserialize(i)
      @VolumeMounts << volumemount_tmp
    end
  end
  @SchedulingStrategy = params['SchedulingStrategy']
end