写点什么

【新模型速递】PAI-Model Gallery 云上一键部署 gpt-oss 系列模型

  • 2025-08-12
    陕西
  • 本文字数:957 字

    阅读完需:约 3 分钟

模型介绍

近期,OpenAI 开源了 gpt-oss 系列模型,包含 2 个尺寸,gpt-oss-120b 和 gpt-oss-20b。


  • gpt-oss-120b 适用于生产环境、通用目的、高推理需求(117B 参数,5.1B 激活参数)

  • gpt-oss-20b 适用于低延迟、本地或特定用途(21B 参数,3.6B 激活参数)


本次开源使用了宽松的 Apache 2.0 License,非常适合实验、定制和商业部署。


阿里云 PAI-Model Gallery 已同步接入 gpt-oss 系列模型,提供企业级部署方案。

PAI-Model Gallery 简介

PAI-Model Gallery 是阿里云人工智能平台 PAI 的产品组件,它集成了国内外 AI 开源社区中优质的预训练模型,涵盖了 LLM、AIGC、CV、NLP 等各个领域。通过 PAI 对这些模型的适配,用户可以以零代码方式实现从训练到部署再到推理的全过程,简化了模型的开发流程,为开发者和企业用户带来了更快、更高效、更便捷的 AI 开发和应用体验。


PAI-Model Gallery 访问地址:https://pai.console.aliyun.com/#/quick-start/models


✅ 零代码一键部署


✅ 自动适配云资源


✅ 部署后开箱即用 API


✅ 全流程运维托管


✅ 企业级安全 数据不出域


一键部署 gpt-oss 模型

  1. 在 PAI-Model Gallery 模型广场找到 gpt-oss-120b 模型,或通过链接直达该模型:https://pai.console.aliyun.com/#/quick-start/models/gpt-oss-120b/intro



  1. 在模型详情页右上角点击「部署」,在选择计算资源后,即可一键完成模型的云上部署。



  1. 部署成功后,在服务页面可以点击“查看调用信息”获取调用的 Endpoint 和 Token,想了解服务调用方式可以点击预训练模型链接,返回模型介绍页查看调用方式说明。



  1. 使用推理服务:您可以使用 API 调用模型服务,也可以使用 PAI 平台提供的在线调试功能,此外您还可以使用 PAI 平台提供的 WebUI 界面与模型进行交互。



更多模型支持

PAI-Model Gallery 持续提供开源社区热门模型快速部署、训练、评测实践。



用户头像

还未添加个人签名 2020-10-15 加入

分享阿里云计算平台的大数据和AI方向的技术创新和趋势、实战案例、经验总结。

评论

发布
暂无评论
【新模型速递】PAI-Model Gallery云上一键部署gpt-oss系列模型_人工智能_阿里云大数据AI技术_InfoQ写作社区