我们开源啦!一键部署免费使用!Kubernetes 上直接运行大数据平台!
导语:市场上首个 K8s 上的大数据平台,开源了!
智领云自主研发的首个完全基于 Kubernetes 的容器化大数据平台
Kubernetes Data Platform (简称 KDP)
开源啦!
开发者只要准备好命令行工具,一键部署
Hadoop,Hive,Spark,Kafka, Flink, MinIO ...
就可以创建以前要花几十万甚至几百万才可以买到的大数据平台
无需再花大量的时间和经费去做重复的研发
高度集成,单机即可体验大数据平台
在高级安装模式下
用户可在现有的 K8s 集群上集成运行大数据组件
不用额外单独建设大数据集群
项目地址:
https://github.com/linktimecloud/kubernetes-data-platform
辛辛苦苦研究出来的成果,为什么要开源?
这波格局开大,老板有话说
问题 1:我们为什么要开源?
我们的产品一直是基于大数据开源生态体系建设的。之前就一直有开源回馈社区的计划,但是因为之前 Kubernetes 对于大数据组件的支持还不够成熟,我们也一直在迭代与 Kubernetes 的适配。现在我们的企业版已经在很多头部客户落地并且在生产环境下高效运行,觉得这个版本已经可以达到大部分生产级项目的需求,集成度以及可用性是能够帮到有类似需求的用户的,希望这次开源能够降低在 Kubernetes 上集成大数据组件的门槛,让更多 Kuberenetes 和 big data 社区的同行们可以使用。
问题 2:开源版本的 KDP,能干啥?
KDP 可以很方便的在 Kubenetes 上安装和管理常用的大数据组件,Hadoop,Hive,Spark,Kafka, Flink, MinIO 等等,不需要自己一个一个去适配,可以直接开始使用。然后 KDP 也提供集成的运维管理界面,用户可以从界面管理所有组件的安装配置,运行状况,资源使用情况,修改配置。而且 KDP 会将一个大数据组件的所有负载(容器,pod)作为一个整体管理,用户不需要在 Kubernetes 的控制平面上去管理单独的负载。
问题 3:最大的亮点是?
只要你已经在使用 Kubernetes,那么在现有集群上十几分钟就可以启动一个完整的大数据集群,马上开始使用,极大的降低了大数据平台的使用门槛。因为我们这个流程是高度集成的,整个安装过程在一个单机环境下也都能启动(例如使用单机 kind 虚拟集群都可以),所以在测试和实验环境下都可以高效使用。当然,启动之后 Day 2 的很多好处,例如资源的高效利用和集成的运维管理,也是 KDP 提供的重要功能。
KDP,即在 Kubernetes 上使用原生的分布式功能搭建及管理大数据平台。
将多套大数据组件集成在 Kubernetes 之上,同时提供一个整体的管理及运维工具体系,形成一个完全基于 Kubernetes 的大数据平台。企业级 KDP 更是支持在同一个 Kubernetes 集群中同时运行多个大数据平台以及多租户管理的能力,充分发挥 Kubernetes 云原生体系的优势。
KDP,通过对开源大数据组件的扩展和集成,实现了传统大数据平台到 K8s 大数据平台的平稳迁移。
作为市场上首个可完全在 Kubernetes 上部署的容器化云原生大数据平台,智领云自主研发的 KDP,深度整合云原生架构优势,将大数据组件、数据应用及资源调度混排,纳入 Kubernetes 管理体系,从而带你真正玩转云原生!
总体框架
简单来讲,KDP 可以允许客户在 Kubernetes 上运行它所有的大数据组件,并把它们作为一个整体管理起来。
在 Kubernetes 上运行大数据平台有三个好处:
第一,更高效的大数据组件集成:KDP 提供标准化自动化的大数据组件部署和配置,极大地缩短了大数据项目开发和上线时间;
第二,更高效的大数据集群运管:KDP 通过大数据组件与 K8s 的集成,在 K8s 之上搭建了一个大数据组件管理抽象层,标准化大数据组件生命周期管理,并提供 UI 界面进一步提升了部署、升级等操作的效率;
第三,更高的集群资源利用率:利用 K8s 的资源管理和配额机制,与其它系统共享 K8s 资源池,精细化资源管理,对比传统大数据平台约 30%左右的资源利用率,KDP 可大幅提升至 60%以上。
社区
我们期待您的贡献和建议!最简单的贡献方式是参与 Github 议题/讨论的讨论。 如果您有任何问题,请与我们联系,我们将确保尽快为您解答。
微信群:添加小助手微信拉您进入交流群
钉钉群:搜索公开群组号 82250000662
贡献
参考开发者指南,了解如何开发及贡献 KDP。
评论