写点什么

AI 推理服务平台升级,阿里云机器学习 PAI 推出新规格

  • 2023-04-04
    浙江
  • 本文字数:942 字

    阅读完需:约 3 分钟

AI推理服务平台升级,阿里云机器学习PAI推出新规格

随着生成式 AI 模型不断拓宽 AI 应用的场景边界,模型在线服务的数量级快速增长,AI 推理环节亟需精细化的资源管理。


近日,阿里云机器学习平台 PAI 宣布全面升级模型服务平台 PAI-EAS,面向文图生成、大语言模型等各类模型提供弹性稳定的推理服务,并推出全新规格 GU30,与传统规格相比价格平均优惠 45%。

全新推理规格 GU30 问世,释放技术红利

在 AI 工程化链路中,推理服务是打通“模型到应用最后一公里”的重要环节,并持续伴随业务成长。


PAI-EAS 是 PAI 推出的弹性推理服务平台,提供异构硬件 (CPU/GPU) 模型加载和服务部署,支撑达摩院、淘宝、高德等业务大量级模型服务,并广泛服务阿里云上企业客户。结合推理优化技术和云原生生态,PAI-EAS 进一步提升异构资源集群整体利用率,规模化地实现服务效率与性能提升,扩大让利空间。


新推出的 PAI-EAS GU30 系列规格,专用于深度学习异构推理场景,较 PAI-EAS 同等性能的传统规格价格下降 45%。


GU30 可适配不同复杂程度的模型,支撑文图生成、大语言模型、多模态模型、NLP、CV、ASR 等的推理需求。付费模式上,EAS 同时支持预付费和灵活的按量付费,用户可以通过弹性扩缩容、弹性资源池等能力精细化地按需管控推理资源。


Serverless 化覆盖多样推理场景

作为云上 AI 推理服务平台,PAI-EAS 在基础设施层、容器调度层、模型部署层都提供丰富的产品功能,贴合不同场景的个性化需求。


  • 实时同步推理场景,例如个性化推荐或类 ChatGPT 对话应用等,用户可通过一键压测得到服务的 QPS 和时延阈值,并结合灰度发布和蓝绿部署功能,在不影响线上业务的情况下进行性能验证并顺滑切换。

  • 近实时异步推理场景,例如文图生成或视频处理等,涉及较为复杂模型的推理,单次推理时间从十几秒到几十分钟不等,PAI-EAS 在推理服务内部集成服务维度的消息队列,并支持面向队列长度实现推理的自动弹性扩缩容,满足资源利用率提升及免运维需求。

  • 离线批量推理场景,例如语音数据批量文本转换等时延不敏感的场景,PAI-EAS 可通过抢占型资源实例的方式帮助用户控制批量推理成本。



PAI-EAS 最新活动

从 2023 年 4 月中旬起,阿里云产品试用中心将正式开放 PAI-EAS 同等算力的试用规格,提供最长 3 个月的模型在线服务免费体验包。点击 PAI-EAS 产品页官网(链接:https://www.aliyun.com/activity/bigdata/pai/eas),可在 PAI-EAS 产品官网获得最新活动信息。

发布于: 刚刚阅读数: 3
用户头像

还未添加个人签名 2020-10-15 加入

分享阿里云计算平台的大数据和AI方向的技术创新和趋势、实战案例、经验总结。

评论

发布
暂无评论
AI推理服务平台升级,阿里云机器学习PAI推出新规格_人工智能_阿里云大数据AI技术_InfoQ写作社区