求友们帮助,每天亿级数据怎么储存
项目是 GPS 业务,每天有约 2w+台车传数据到我们这里储存。每天数据量大概在 1 亿左右。
数据主要用于做报表,查询历史轨迹(查询频率高,基本上每次查出过万的数据)
没做过这么大数据量的业务场景,想问下这场景应该怎么做?感谢
项目是 GPS 业务,每天有约 2w+台车传数据到我们这里储存。每天数据量大概在 1 亿左右。
数据主要用于做报表,查询历史轨迹(查询频率高,基本上每次查出过万的数据)
没做过这么大数据量的业务场景,想问下这场景应该怎么做?感谢
2w 台车,数据量一亿,那看来单位是请求数? 给你往大了说,一个请求按 10 KB 算, 算下来一天也就 1T 左右,正常的大数据仓库都能 hold 住的吧
具体怎么实施看情况而定,一方面看已有痛点在哪,一方面估计会有的瓶颈,一方面平衡开发的复杂度
测试硬件:单机 AMD EPYC 7702P 64-Core Processor 64 核,256G 内存,SSD
希望对主有帮助
直接进大数据服务 EMR,要么数据湖,简单查询,直接来 Athena 查 s3 也没问题啊
实时处理分析? aws 有 kinesis 啊,各种并行实时处理,本来就是很适合搭配 IoT / GPS 业务场景的
非实时分析,还有 redshift 数据仓库服务可以用,更可以联合查询,操作型关系数据库。
跨一个或多个 Amazon RDS 和 Aurora PostgreSQL 数据库查询实时数据,支持大规模并行数据处理。
有兴趣欢迎继续交流~
58516 rows in set. Elapsed: 19.415 sec. Processed 23.93 million rows, 2.17 GB (1.23 million rows/s., 111.70 MB/s.)
这个查询时间属于正常的吗?