400-050-5198
数据开发平台

数据开发平台

面向多角色协同的数据作业集成开发环境

支持数据作业开发、测试、生产、运维、数据挖掘分析,是数据开发、测试、运维和分析人员的一站式工作台。

一站式开发DAG 工作流实时处理协同开发
90%清洗方式

预置清洗组件支撑多数清洗过程拖拉组合配置完成

秒级处理时效

实时数据从产生、治理到使用可达到秒级

浏览器开发开发形态

无需安装客户端,通过浏览器即可使用

全HA可靠架构

分布式架构下所有服务支持 HA 部署

数据开发平台是为满足用户在大数据环境下多用户协同进行数据作业程序开发、测试、生产运维需求而推出的大数据集成开发环境。

平台支持数据作业开发、测试、生产、运维、数据挖掘分析,是数据开发人员、数据测试人员、数据运维管理人员和数据挖掘分析人员的一站式工作台。

平台采用分布式架构和 Web 技术实现,由用户层、功能层、支撑层和资源层组成,提供数据处理相关能力。

能力链路

以资源为核心组织数据流

数据开发平台数据导入数据清洗数据加工数据导出

功能架构

平台由用户层、功能层、支撑层和资源层组成,提供数据开发、实时处理和数据处理相关能力。

数据开发平台 功能架构图
数据开发平台 功能架构
优势特点

核心优势覆盖数据服务全流程

一站式

支持数据开发、测试、生产、运维和数据挖掘分析,支持丰富的数据库类型、存储类型和计算框架。

SQLSparkMLLIB工作流调度

易用性

基于 Web 技术实现,无需本地安装客户端;支持图形化拖拽创建工作流和算法实验。

浏览器访问可视化拖拽语法高亮

协同开发

支持工作空间进行资源和权限隔离,支持开发工作空间、生产工作空间和代码编辑权锁。

工作空间权限隔离编辑权锁

“零”编码数据清洗

通过预置数据清洗组件,实现多数清洗过程通过拖拉组合配置完成,清洗加工过程更加清晰直接。

可视化清洗无需编码组件化配置

实时开发

支持处理 Kafka 源数据,支持向 Oracle、华为 GaussDB 等实时性数据库输出结果数据。

KafkaFlink SQL实时运维

安全性与可靠性

提供节点加密、备份恢复、回收站、版本管理和全 HA 部署能力,保障代码与服务可靠。

代码可用不可见备份恢复版本回滚
典型应用场景

面向跨层级协同与数据流通的落地场景

实时数据处理

通过实时任务消费服务总线上报数据,结合 EMR Flink 流式计算引擎完成数据标准化、去重等规则后推送到实时分析数据库和比对订阅服务。

多角色协同开发

开发、测试、运维和分析人员通过工作空间协同完成数据作业开发、测试、生产和运维管理。

核心能力

核心能力清单

开发能力

数据导入数据清洗数据加工数据导出SQL 编辑

调度运维

DAG 工作流调度策略运行监控故障通知历史记录

安全协同

工作空间代码锁资源文件管理UDF 管理版本回滚

让数据开发、运维与分析进入统一工作台

以一站式开发、实时处理和协同运维能力支撑大数据作业生产全流程。