怎么进行大数据测试?我们需要具备怎样的测试能力?「建议收藏」

怎么进行大数据测试?我们需要具备怎样的测试能力?「建议收藏」前言:现在大数据这么火,那么作为测试人员,我们应该怎么进行大数据测试?需要具备怎样的测试能力?一、大数据测试实现被分成三个步骤(1):数据阶段验证大数据测试的第一步,也称作pre-hadoop阶段该过程包括如下验证:1、来自各方面的数据资源应该被验证,来确保正确的数据被加载进系统2、将源数据与推送到Hadoop系统中的数据进行比较,以确保它们匹配3、验证正确的数据被提取并被加载到HDFS正确的位置该阶段可以使用工具Talend或Datameer,进行数据阶段验证。(2):”MapReduc

大家好,又见面了,我是你们的朋友全栈君。

前言:现在大数据这么火,那么作为测试人员,我们应该怎么进行大数据测试?需要具备怎样的测试能力?

一、大数据测试实现被分成三个步骤

在这里插入图片描述

(1):数据阶段验证

大数据测试的第一步,也称作pre-hadoop阶段该过程包括如下验证:
1、来自各方面的数据资源应该被验证,来确保正确的数据被加载进系统
2、将源数据与推送到Hadoop系统中的数据进行比较,以确保它们匹配
3、验证正确的数据被提取并被加载到HDFS正确的位置
该阶段可以使用工具Talend或Datameer,进行数据阶段验证。

(2):”MapReduce”验证

大数据测试的第二步是MapReduce的验证。在这个阶段,测试者在每个节点上进行业务逻辑验证,然后在运行多个节点后验证它们,确保如下操作的正确性:
1、Map与Reduce进程正常工作
2、在数据上实施数据聚合或隔离规则
3、生成键值对
4、在执行Map和Reduce进程后验证数据

(3):输出阶段验证

大数据测试的最后或第三阶段是输出验证过程。生成输出数据文件,同时把文件移到一个EDW(Enterprise Data Warehouse:企业数据仓库)中或着把文件移动到任何其他基于需求的系统中。在第三阶段的活动包括:
1、检查转换(Transformation)规则被正确应用
2、检查数据完整性和成功的数据加载到目标系统中
3、通过将目标数据与HDFS文件系统数据进行比较来检查没有数据损坏

二、架构测试

Hadoop处理大量的数据,并且是非常耗费资源的。因此,架构测试对于确保您的大数据项目的成功至关重要。系统设计不当或设计不当可能导致性能下降,系统不能满足要求。至少,性能和故障转移测试服务应该在Hadoop环境中完成。

性能测试包括测试作业完成时间,内存使用率,数据吞吐量和类似的系统指标。而故障转移测试服务的动机是为了验证在数据节点发生故障的情况下数据处理是否无缝地发生

三、性能测试

大数据性能测试包括两个主要的行动
数据采集​​和整个过程:在这个阶段,测试人员验证快速系统如何消耗来自各种数据源的数据。测试涉及识别队列在给定时间框架内可以处理的不同消息。它还包括如何快速将数据插入到底层数据存储中,例如插入到Mongo和Cassandra数据库中。

数据处理:它涉及验证执行查询或映射缩减作业的速度。它还包括在底层数据存储填充到数据集中时独立测试数据处理。例如,在底层HDFS上运行Map Reduce作业

子组件性能:这些系统由多个组件组成,而且必须单独测试每个组件。例如,消息的索引和消费速度有多快,mapreduce作业,查询性能,搜索等

四、性能测试方法

大数据应用性能测试涉及大量结构化和非结构化数据的测试,并且需要特定的测试方法来测试这些海量数据。

五、性能测试按此顺序执行

在这里插入图片描述

1、过程从设置要测试性能的大数据群集开始
2、确定和设计相应的工作量
3、准备个人客户(自定义脚本创建)
4、执行测试并分析结果(如果不满足目标,则调整组件并重新执行)
5、最佳配置(性能测试的参数)

六、性能测试需要验证的各种参数

1、数据存储:数据如何存储在不同的节点中
2、提交日志:允许增长的提交日志有多大
3、并发性:有多少个线程可以执行写入和读取操作
4、缓存:调整缓存设置“行缓存”和“键缓存”。
5、超时:连接超时值,查询超时值等
6、JVM参数:堆大小,GC收集算法等
7、地图降低性能:排序,合并等
8、消息队列:消息速率,大小等

七、测试环境需求

测试环境需求取决于您正在测试的应用程序的类型。对于大数据测试,测试环境应该包含
1、它应该有足够的空间来存储和处理大量的数据
2、它应该有分布式节点和数据的集群
3、它应该有最低的CPU和内存利用率,以保持高性能

八、大数据测试面临的挑战

(1)、自动化

大数据的自动化测试需要具有技术专长的人员。另外,自动化工具不具备处理测试过程中出现的意外问题的能力

(2)、虚拟化

这是测试的一个不可缺少的阶段。虚拟机延迟会在实时大数据测试中造成计时问题。在大数据中管理图像也是一件麻烦事。

(3)、大数据集

1、需要验证更多的数据,并需要更快地完成
2、需要自动化测试工作
3、需要能够跨不同的平台进行测试

九、性能测试挑战

1、多种技术组合:每个子组件属于不同的技术,需要单独测试
2、不可用的特定工具:没有一个工具可以执行端到端的测试。例如,NoSQL可能不适合消息队列
3、测试脚本:需要高度的脚本来设计测试场景和测试用例
4、测试环境:数据量大,需要特殊的测试环境
5、监控解决方案:存在有限的解决方案,可以监控整个环境
6、诊断解决方案:需要定制解决方案来深入了解性能瓶颈区域

十、最后奉上微服务中台架构图和基于AI驱动的数据中台架构图

1、微服务中台架构图

在这里插入图片描述

2、基于AI驱动的数据中台架构图

在这里插入图片描述

十一、大数据资源汇总

相关大数据资源下载链接:资料下载
资源包含内容:

1、大数据测试方法

2、大数据测试工具

3、大数据测试质量

4、大数据测试总结

5、接口自动化框架设计思想

十二、疑问解答与加群学习交流

在这里插入图片描述

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请联系我们举报,一经查实,本站将立刻删除。

发布者:全栈程序员-站长,转载请注明出处:https://javaforall.net/136096.html原文链接:https://javaforall.net

(0)
全栈程序员-站长的头像全栈程序员-站长


相关推荐

  • 影视3D建模和游戏3D建模对比,哪个更有发展前景

    影视3D建模和游戏3D建模对比,哪个更有发展前景影视3D建模和游戏3D建模,两者之间最大和最明显的差异是:游戏开发永远有多边形建模预算。影视建模方面,对于多边形数量都没有限制。对于电影来说,唯一限制是时间,按时,按预算生产合格的模型。游戏建模设计不能随意增加多边形面数,必须依靠纹理细节提升模型的质量。由于多边形数量必须很低,需要其他方法将更多细节放入模型中,目前最好的方法当然是使用纹理。游戏建模设计技术游戏中经常使用的技术是细节层次。意味单个游戏会有几个不同的细节级别。玩家离模型越远,资产的细节就越少。随着玩家越来越近,较低分辨率模型将被.

    2022年5月19日
    54
  • pycharm激活码【2021最新】

    (pycharm激活码)最近有小伙伴私信我,问我这边有没有免费的intellijIdea的激活码,然后我将全栈君台教程分享给他了。激活成功之后他一直表示感谢,哈哈~IntelliJ2021最新激活注册码,破解教程可免费永久激活,亲测有效,下面是详细链接哦~https://javaforall.net/100143.htmlML…

    2022年3月21日
    54
  • python元组下标_python获取数组下标

    python元组下标_python获取数组下标广告关闭腾讯云11.11云上盛惠,精选热门产品助力上云,云服务器首年88元起,买的越多返的越多,最高返5000元!也不是所有的高级程序语言都是如此,比如python数组下标就支持负数。原因一:历史原因语言出现顺序从早到晚c、java、javascript。c语言数组下标是从0开始->java也是->javascript也是。降低额外的学习和理解成本。原因二:减少cpu指令运算…

    2022年8月13日
    9
  • SQL语法(五) 多表联合查询

    SQL语法(五) 多表联合查询前言当需要获取的数据分布在多张中,考虑使用联合查询,本章将学习两种查询方式(sql92/sql99)范例1.笛卡儿积将多个表的数据进行一一对应,所得到结果为多表的笛卡尔积。结果的数量为所有表的数量的乘积。–SQL92方式–表名以逗号隔开实现多表查询–SQL99方式–使用crossjoin关键字2.等值连接筛选&不等…

    2022年6月12日
    24
  • 运行jar包的命令_命令行打jar包

    运行jar包的命令_命令行打jar包使用cmd运行jar包使用命令行运行iar包使用windows运行jar包怎么在命令行工具中运行jar包呢?找到jar包的位置选中文件所在位置导航栏并输入cmd此时进入命令行工具输入Java-jarHelloWord.jar(注意空格)输入完Java-jar之后可以按tab键找到jar包名字enter…

    2022年10月4日
    2
  • nginx 静态文件配置(nginx常用配置)

    Nginx的配置文件nginx.conf配置详解如下:usernginxnginx;Nginx用户及组:用户组。window下不指定worker_processes8;工作进程:数目。根据硬件调整,通常等于CPU数量或者2倍于CPU。error_loglogs/error.log;error_loglogs/error.logno

    2022年4月14日
    72

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

关注全栈程序员社区公众号