据CSDN、量子位7月28日报道,腾讯云宣布DeepSeek-V4原厂直供模型于7月中旬正式登陆腾讯云平台,同步引入”峰谷定价”机制。这是国内云厂商首次为大模型API引入电力行业峰谷定价模式。
腾讯云为DeepSeek-V4设计的峰谷定价机制:每日0:00-8:00谷时段API定价降低40%,20:00-24:00峰时段API定价上浮20%,其余时段按标准价计费。该机制旨在引导大模型调用方在低负载时段进行模型微调、批量推理等算力密集型任务。
腾讯云AI产品总经理李力表示,DeepSeek-V4作为目前国产大模型代表产品,原厂直供可避免中间环节降智。腾讯云已为DeepSeek-V4配置专属Ascend 950PR算力池,推理时延低于80ms。业内人士分析,峰谷定价机制代表大模型API从”按量计费”走向”按需调度”的新阶段。
腾讯云为DeepSeek-V4设计的峰谷定价机制借鉴了电力行业的成熟经验。0:00-8:00谷时段API定价降低40%,20:00-24:00峰时段API定价上浮20%,这种「分时电价」模式可有效平滑大模型推理算力的供需波动,提升整体资源利用效率。
腾讯云AI产品总经理李力介绍,谷时段大模型调用量已占平台总调用量的35%,主要是模型微调、批量推理、数据预处理等可异步执行的任务。峰谷定价机制推出后,预计可将平台整体GPU利用率从65%提升至85%以上,相当于在不增加物理算力的情况下提升30%的服务能力。腾讯云同步开放DeepSeek-V4专属算力池配置,推理时延低于80ms,并支持QPM(每分钟请求数)弹性扩容。
腾讯云同步推出DeepSeek-V4企业级解决方案,集成专享算力池、定制微调服务、私有化部署三大能力。专享算力池支持单客户独占8-256张昇腾950PR;定制微调服务支持LoRA、QLoRA、全参数微调三种模式;私有化部署支持专有云、本地数据中心、混合云三种形态。已签约客户包括招商银行、中国移动、宁德时代等头部企业。
若您对人工智能感兴趣或为人工智能创始人,可添加数智化转型网小助手思思微信加入人工智能交流群。若您在寻找人工智能供应商,可联系数智化转型网小助手思思(17757154048,微信同号)

若您为人工智能服务商,可添加数智化转型网小助手Jasper,加入人工智能行业交流群。

声明:本文来自数智化转型网,版权归作者所有。文章内容仅代表作者独立观点,不代表数智化转型网立场,转载目的在于传递更多信息。如有侵权,请联系我们。

本文由数智化转型网(www.szhzxw.cn)转载,编辑/翻译:数智化转型网(Professionalism Achieves Leadership 专业造就领导者)白龙
