随着生成式AI模型不断拓宽AI应用的场景边界,模型在线服务的数量级快速增长,AI推理环节亟需精细化的资源管理。

近日,阿里云机器学习平台PAI宣布全面升级模型服务平台PAI-EAS,面向文图生成、大语言模型等各类模型提供弹性稳定的推理服务,并推出全新规格GU30,与传统规格相比价格平均优惠45%。

全新推理规格GU30问世,释放技术红利

在AI工程化链路中,推理服务是打通“模型到应用最后一公里”的重要环节,并持续伴随业务成长。

PAI-EAS是PAI推出的弹性推理服务平台,提供异构硬件 (CPU/GPU) 模型加载和服务部署,支撑达摩院、淘宝、高德等业务大量级模型服务,并广泛服务阿里云上企业客户。结合推理优化技术和云原生生态,PAI-EAS进一步提升异构资源集群整体利用率,规模化地实现服务效率与性能提升,扩大让利空间。

新推出的PAI-EAS GU30系列规格,专用于深度学习异构推理场景,较PAI-EAS同等性能的传统规格价格下降45%。

GU30可适配不同复杂程度的模型,支撑文图生成、大语言模型、多模态模型、NLP、CV、ASR等的推理需求。付费模式上,EAS同时支持预付费和灵活的按量付费,用户可以通过弹性扩缩容、弹性资源池等能力精细化地按需管控推理资源。

Serverless化覆盖多样推理场景

作为云上AI推理服务平台,PAI-EAS在基础设施层、容器调度层、模型部署层都提供丰富的产品功能,贴合不同场景的个性化需求。

  • 实时同步推理场景,例如个性化推荐或类ChatGPT对话应用等,用户可通过一键压测得到服务的QPS和时延阈值,并结合灰度发布和蓝绿部署功能,在不影响线上业务的情况下进行性能验证并顺滑切换。

  • 近实时异步推理场景,例如文图生成或视频处理等,涉及较为复杂模型的推理,单次推理时间从十几秒到几十分钟不等,PAI-EAS在推理服务内部集成服务维度的消息队列,并支持面向队列长度实现推理的自动弹性扩缩容,满足资源利用率提升及免运维需求。

  • 离线批量推理场景,例如语音数据批量文本转换等时延不敏感的场景,PAI-EAS可通过抢占型资源实例的方式帮助用户控制批量推理成本。

PAI-EAS最新活动

从2023年4月中旬起,阿里云产品试用中心将正式开放PAI-EAS同等算力的试用规格,提供最长3个月的模型在线服务免费体验包。点击PAI-EAS产品页官网(链接:https://www.aliyun.com/activity/bigdata/pai/eas),可在PAI-EAS产品官网获得最新活动信息。

AI推理服务平台升级,阿里云机器学习PAI推出新规格相关推荐

  1. 阿里云机器学习PAI构建AI集团军作战,联手Intel在AI软硬件领域发力

    第一届"英特尔创新大师杯"深度学习挑战赛已在阿里云天池平台如火如荼的进行中.本次大赛由英特尔主办,阿里云计算平台机器学习 PAI 联合达摩院以及中文信息协会等组织机构联合承办,共有 ...

  2. 阿里云机器学习PAI介绍

    机器学习大致可以分三类: 有监督学习:指每个样本都有对应的期望值,通过模型搭建,完成从输入的特征向量到目标值的映射,典型的例子是回归和分类问题,例如:逻辑回归.随机森林.决策树. 无监督学习:指在所有 ...

  3. 重庆打造公共停车智能化管理服务平台,阿里云ET大脑牵手重庆

    阿里云的人工智能正在加速川渝腾飞.8月24日云栖大会·重庆峰会上,重庆市城市管理委员会与重庆江北机场分别宣布正与阿里云进行合作,将人工智能运用到城市交通管理及智慧机场建设上. 据悉,重庆市城管委在停车 ...

  4. 阿里云机器学习PAI开源中文NLP算法框架EasyNLP,助力NLP大模型落地

    作者:临在.岑鸣.熊兮 一 导读 随着 BERT.Megatron.GPT-3 等预训练模型在NLP领域取得瞩目的成果,越来越多团队投身到超大规模训练中,这使得训练模型的规模从亿级别发展到了千亿甚至万 ...

  5. 阿里云机器学习PAI发布基于HLO的全自动分布式系统 TePDist,并宣布开源!

    作者:品曲,宗雁,佀畅,侠雕,伟林 导读 一直以来,大模型在模型效果上被证明具有显著优势.而ChatGPT的出现,证明了其在工业生产工具方面具有巨大潜力.毫无疑问,大模型的训练需要巨大的算力,这对分布 ...

  6. 阿里云机器学习平台PAI论文高效大模型训练框架Whale入选USENIX ATC‘22

    近日,阿里云机器学习PAI关于深度学习模型高效的分布式训练框架的论文< Whale: Efficient Giant Model Training over Heterogeneous GPUs ...

  7. 云端IDE:阿里云机器学习与PAI-DSW | 《阿里云机器学习PAI-DSW入门指南》

    经过20年的快速发展,阿里经济体已经组建了一个庞大的商业生态圈,并在支付.云计算.本地生活服务等行业保持互联网巨头地位.2020财年交易额突破1万亿美元,全球第一家:阿里云支撑了2019年双11 期间 ...

  8. PAI-Diffusion模型来了!阿里云机器学习团队带您徜徉中文艺术海洋

    作者:汪诚愚.段忠杰.朱祥茹.黄俊 导读 近年来,随着海量多模态数据在互联网的爆炸性增长和训练深度学习大模型的算力大幅提升,AI生成内容(AI Generated Content,AIGC)的应用呈现 ...

  9. 阿里云机器学习PAI-快速上手指南

    阿里云机器学习PAI-快速上手指南 What is 机器学习 机器学习指的是机器通过统计学算法,对大量的历史数据进行学习从而生成经验模型,利用经验模型指导业务.目前机器学习主要在以下一些方面发挥作用: ...

最新文章

  1. 两步改动CentOS主机名称
  2. LBP特征的理论介绍
  3. Codeforces Round #374 (Div. 2) A. One-dimensional Japanese Crosswor 水题
  4. ASP.NET Core 3.x - Endpoint Routing 路由体系的内部机制
  5. 惠普打印机136w硒鼓芯片怎么清零_关于惠普彩激升级后无法识别硒鼓的处理方案...
  6. 巨额流量费其实可以避免
  7. 极大似然估计的渐进正态性
  8. 广告流量分析之评价指标的选择(二)
  9. 红帽企业linux 6.4 64位上实现mysql 5.6主从复制_红帽企业Linux 6.4 64位上实现MySQL 5.6主从复制...
  10. java分布性_java大型分布系统性能优化实战教程
  11. Qt QBoxLayout QVBoxLayout QGridLayout 清空布局内widget的正确做法
  12. gdiPlus 显示图片缩放不正确的可能解决方案
  13. Unity实现安卓虚拟摇杆多点触控
  14. 不用社保也可以办理深圳居住证(全程网上办理) 解决提交后一直暂存状态
  15. 《团队-科学计算器-项目总结》
  16. 【目标流畅阅读文献】kick off
  17. Android本地数据持久化:内部存储和外部存储
  18. Swift4.2 Xcode10 日记心情追踪APP
  19. 素描画人物模特应该怎样观察?美术集网校整理知识点,记得收藏~
  20. c# 将数据导出到EXCEL文件(一)

热门文章

  1. Linux下Subclipse的JavaHL
  2. 光谱预处理方法综述及分析策略选择
  3. 华为模拟器eNSP安装初体验
  4. 20190713 关于session串号问题的记录
  5. k8s存储+storageclass自动创建pv+StatefulSet自动创建pvc
  6. 免费个人网站制作离不开参考
  7. 3GPP TS 23501-g51 中英文对照 | 4.4.4 Location services
  8. 数据库连接池的优点和原理
  9. Fortran基础编程(3)——格式化输出
  10. 2C+1A(JD6621*2PCS+FP6601A)智能退功率实现方案