400-050-5198
大数据计算平台

大数据计算平台

面向政企行业的湖仓一体化计算平台

支撑百万级高吞吐、PB 级海量数据加工和毫秒级低延时业务需求,具备多模存储、存算分离、流批协同、弹性伸缩等能力。

湖仓一体存算分离流批协同弹性伸缩
PB级数据规模

面向 TB/PB 级别数据提供离线和实时处理能力

三副本存储架构

所有数据三副本存储,保障数据高可靠性

多引擎计算模式

支持 Spark、Flink、Presto 等多种计算引擎

云原生部署能力

支持虚拟机、容器化和多种国产化环境部署

大数据计算平台是数美科技面向政企行业研发的湖仓一体化平台,支撑百万级高吞吐、PB 级海量数据加工、毫秒级低延时业务需求。

平台具备多模存储、存算分离、流批协同、弹性伸缩等能力,并通过多源异构数据高性能集成、多模态数据管理、湖仓一体化数据治理和 AI 驱动的数据处理能力,支撑面向场景的多种数据服务。

平台可帮助用户实现结构化、半结构化、非结构化数据的统一存储和处理,通过融合分析、文档解析、空间计算等能力支撑专业非结构化数据处理。

能力链路

以资源为核心组织数据流

大数据计算平台SparkFlinkPresto融合分析

功能架构

平台以分布式架构实现存储能力和计算能力独立横向扩展,为 TB/PB 级数据提供离线和实时处理能力。

大数据计算平台 功能架构图
大数据计算平台 功能架构
优势特点

核心优势覆盖数据服务全流程

统一存储、存算分离

数据统一存储,团队和部门通过多租户方式共用平台,计算能力共享,减少数据搬移并降低综合成本。

资源统一调配开放式架构多引擎支持

多种计算引擎

提供 Spark、Flink、Presto 等计算能力,覆盖内存迭代计算、实时计算和跨数据源联邦查询。

SparkSQLFlinkSQL联邦查询

数据灵活入湖

支持按照原始格式入湖,最大限度还原业务时序状态,并在查询使用过程中规范 schema。

原始格式入湖秒级查询GB 到 PB 支撑

高可靠和国产化支持

服务全 HA、无单点故障,支持鲲鹏、飞腾、国产操作系统和国产数据库等环境。

服务全 HA三副本存储国产化适配
典型应用场景

面向跨层级协同与数据流通的落地场景

大型数据仓库

借助 EMR 强大的数据吞吐、数据存储和数据计算能力,打造高性能大型数据仓库。

日志分析与数据挖掘

面向日志分析、数据挖掘、商业智能等领域,提供离线和实时计算处理能力。

多源异构统一查询

通过标准 SQL 支持低延时查询,并支持 MySQL、Hive、Oracle、Postgre 等跨数据源联邦查询。

核心能力

核心能力清单

计算能力

SparkFlinkPresto融合分析空间计算文档解析

平台管控

服务健康状态集群监控集群告警引擎配置任务鉴权

部署与可靠性

弹性伸缩虚拟机部署容器化部署全 HA三副本存储

构建高性能湖仓一体计算底座

以统一存储、多引擎计算和弹性伸缩能力,支撑政企数据服务场景。