简介:华为ICT云赛道云存储方向试题资料,基于HCIA Storage知识体系整理,面向备战华为ICT大赛及HCIA Storage认证的考生,也适合存储工程师与高校相关专业学生自查巩固。资源为PDF单文件,共1个文件,大小2.2MB,内容以选择题、判断题为主,便于快速自测。题目覆盖数据类型(结构化/半结构化/非结构化)、存储体系与块/文件/对象存储、云存储特点、AI融入存储目标、FC拓扑与PCIe版本、CIFS与NFS协议流程及版本、OceanStor全闪存特性、NAS与分布式存储组网、SAN协议、SAS接口特性、SSD闪存颗粒类型、硬盘性能参数、存储产品形态、RAID保护与实现方式、SmartTier、HyperClone、LUN迁移策略、同步/异步复制、一致性组、备份拓扑与备份类型、容灾复制分层、DeviceManager/eSight/SmartKit等管理工具及license查询等高频考点。已有3122人浏览学习,适合赛前集中刷题、查漏补缺,也可作为培训出题的参考题源。
1. 华为ICT云赛道云存储试题:先把这套题的含金量看清楚
拿到这套云存储试题时,我第一反应是“又是一堆背题材料”,翻完40多道题才发现它其实是HCIA Storage方向很典型的一套考点练习:数据类型、存储体系、协议版本、RAID选型、LUN迁移、复制一致性、备份类型和管理软件,基本把云存储方向入门的硬骨头都啃了一遍。对准备华为ICT大赛云赛道、打算考HCIA-Storage认证、或者刚接手存储设备运维的工程师来说,这套题的价值不在于“背答案”,而在于每道题背后都对应一个实际部署里会遇到的判断场景。真正做过存储项目的人看这套题,会有一种“这坑我踩过”的既视感。
2. 存储基础与网络协议:用十几道题把数据传输链路理清楚
2.1 数据类型与存储体系:海量数据为什么是干扰项
第1题考数据种类,看起来是送分题,实际上是后面很多判断题的地基。结构化数据就是二维表结构,关系型数据库里的表是最典型的例子,列名和字段类型固定,查询走SQL;半结构化数据介于两者之间,XML、JSON、日志文件都是这一类,它们有标签或键值对作为结构,但不像二维表那样严格,直接拿SQL去查就不顺手;非结构化数据则是视频、图片、Word文档这类没有统一结构的东西。
这套分类里最容易看走眼的是“海量数据”。很多备考的人会把“海量大”当成一个种类,但数据量大只是一个规模描述词,跟结构化程度根本不是一回事。做存储规划时,这三类数据对应不同的存储手段:结构化数据适合放块存储上的数据库,半结构化数据常走文件存储或对象存储,非结构化数据是对象存储的主场。这个对应关系在第2题里直接体现。
第2题的四个选项,用排除法比正面验证更快。“存储指的就是硬盘”显然错误,硬盘只是存储介质,存储体系至少包含硬件、软件、解决方案三层,这套题里正确的表述是“存储体系包括存储硬件、存储软件、存储解决方案”。块存储、文件存储、对象存储是存储面向业务提供的三种服务形态,这个说法没问题。真正需要停下来想的是最后一项——“文件存储一般用来保存数据库等数据应用的数据”是错的。数据库的特点是高IO、低时延、强一致,通常跑在块存储上;文件存储(NAS)擅长的是多主机共享、文档库、视频渲染这类场景。这一句也是第10题“非结构化数据用二维表结构来表达”的呼应,判断答案为“错误”:非结构化数据没有二维表结构,有二维表结构的是结构化数据。
第3题云存储特点,融合、弹性、开放都对,唯独“纵向扩展”是反的。云存储的弹性体现在横向扩展,也就是加节点扩容,把一堆通用服务器的存储资源聚合成一个池子;纵向扩展是把单台设备做得越来越大,跟云计算“Scale Out”的路线不符。第4题人工智能融入存储的目标是简单、高效、易用,高耗能明摆着是凑数的干扰项。
2.2 协议与拓扑:CIFS五步、NFS四个版本、FC三种拓扑
第5题考FC拓扑结构,仲裁环网络(FC-AL)、点对点网络、交换网络(Fabric)都是真实存在的拓扑,双交换网络不是标准叫法。交换网络里多交换机互联很常见,但术语就叫交换网络。第6题PCIe版本,1.0到4.0都是题面列出的,新版PCIe 5.0、6.0也在商用,但这道题没问,千万别画蛇添足去纠结。
第7题CIFS协议的工作步骤值得展开讲,因为很多只做过NFS运维的人对CIFS的交互细节不熟。CIFS本质是SMB协议族,完整流程是:协议握手、安全认证、共享连接、文件操作、断开连接。握手阶段协商协议版本和方言,确认双方能力;然后做用户认证,验证身份权限;认证通过后建立共享连接,相当于把远端共享目录挂载到会话里;之后才执行文件操作;最后断开连接清理会话。这个顺序不能乱,认证在共享连接之前,文件操作在共享连接之后。考试里这五个步骤全选,实际排查NAS挂载失败时也是按这个顺序查的。
第8题NFS版本,V1到V4全选。第11题NAS系统常见协议,NFS和CIFS是核心,FTP和HTTP严格来说是文件传输协议而非文件共享协议,但NAS设备一般都会提供这些服务,所以这道题我刷的时候两个答案都试过,标准判分大概率按全选处理。这里想提醒一点:考试归考试,实际做NAS方案时,NFS给Linux主机用、CIFS给Windows主机用,FTP和HTTP更多是临时文件交换场景,别混为一谈。
第12题分布式存储组网,管理网络、前端业务网络、后端存储网络是三个必选组件,前端存储网络是编造项。分布式存储的架构里,管理平面走管理网,业务流量走前端业务网,节点之间数据同步走后端存储网(万兆甚至更高带宽),三者最好物理隔离,避免业务IO和存储内部流量互相干扰。第13题SAN组网中的常见协议是FC和iSCSI,CIFS和NFS属于NAS文件协议这一层,不能算SAN协议。
2.3 全闪存与分布式存储:OceanStor 两道单选考的是归属逻辑
第9题是这套题里最有含金量的一道单选。华为OceanStor全闪存存储的三个正确选项其实串起了整个控制器的数据流设计:创建LUN时要规划归属控制器,目的很直接——让各控制器的负载均衡,避免某个控制器过热而另一个闲置;前端智能共享IO模块的作用是识别主机IO所属的LUN,按LUN归属把IO直接发给目标控制器,不用绕道其他节点;所有控制器节点缓存共同构成全局缓存,这是多控架构统一管理缓存的基础。
错误项是“每个LUN的数据均匀分布到所有节点的缓存中”。这句话听起来很像分布式存储的哈希分布策略,但全闪存存储走的路子是LUN归属制而非全集群哈希。一个LUN的数据落在它归属的控制器节点上,缓存也优先在本地,这才能保证时延可预测。如果真按“均匀分布到所有节点缓存”去做,一次写操作要跨节点多次同步,时延和故障域都失控了。
第14题同样考全闪存设备特性:支持SSD、支持NVMe硬盘、支持Palm SSD都对,错的是“支持HDD硬盘”。全闪存设备物理结构上就没有机械硬盘盘位,它的后端盘槽只适配SSD形态。第15题华为分布式存储,OceanStor 100D这类产品对外能同时提供块存储、文件存储、对象存储和HDFS存储协议,链式存储是干扰项。一台分布式存储融合多种协议,这是华为分布式存储产品线的卖点,也是云存储落地的主要形态。
3. RAID 选型与硬盘性能:机械盘参数、闪存颗粒与三组判断题
3.1 RAID 10 为什么是随机写最优解
第22题题干很典型:用户既关心可靠性又关心随机写性能,该推荐哪个RAID级别。答案是RAID 10。要理解这个结论,得从RAID几大类的工作原理说起。
RAID 10是镜像与条带化的结合,先做镜像再做条带化。一份数据同时写两块盘,任何一块盘挂掉,另一块盘还持有完整数据副本,重建时直接从镜像盘拷贝即可,不需要做校验计算。随机写场景下,RAID 10每个IO只涉及两块镜像盘的写操作,没有额外的校验读改写开销;而RAID 5和RAID 6每次随机写都涉及读旧数据、算校验、写新数据和校验的步骤,时延天然多一跳。
RAID 0没有冗余,可靠性直接出局。RAID 1的可靠性和写性能其实也不错,但容量利用率只有50%,而且只能两盘一组做扩展,条带化能力差。RAID 50虽然兼顾了条带性能和校验冗余,但随机写仍要背RAID 5的读改写惩罚。所以“可靠性+随机写性能”这个客户诉求,主推RAID 10是华为存储交付里最常见的做法,碰到预算紧张的再考虑RAID 6。
第21题判断题“RAID 10中任何1个硬盘故障不会影响数据访问”,答案是正确。RAID 10里每个条带组的镜像盘提供完整数据副本,单盘故障只会让那一组进入降级状态,读操作由镜像盘继续提供。注意这里的前提是“任何1个”,如果同一组镜像里的两块盘同时挂掉,数据就真的丢了,这也是RAID 10和RAID 5在故障容忍上的关键差异。
第23题问RAID的数据保护方式,镜像和奇偶校验算法是真正的数据保护机制。数据条带化是为了并行读写提升性能,不是保护手段;JBOD只是把多块盘聚合成一个逻辑卷,没有任何冗余。这道题区分的是“性能技术”和“保护技术”两个维度。第24题RAID实现方式,硬件RAID和软件RAID是正统做法,异或操作是校验计算的底层运算,奇偶校验是校验算法的名称,它们不是实现方式这个分类维度下的答案。
3.2 机械盘与 SSD:性能看什么、干扰项是谁
第17题问影响机械硬盘性能的因素,转速、寻道速度、接口速度都对,闪存颗粒是混进来的干扰项。机械盘的运作机制是电机带动盘片旋转、磁头移动到目标磁道、等待目标扇区转到磁头下,这一整套物理动作决定了它的性能天花板:转速决定等待时间,寻道时间决定磁头移动开销,接口速度决定数据传到主机侧的快慢。闪存颗粒是SSD的内部器件,跟机械盘完全没有交集。
第19题问衡量机械硬盘性能的参数,硬盘容量、硬盘转速、数据传输率、平均访问时间都算。严格说容量更接近规格参数而非性能参数,但在这套题的语境下四个都是可以接受的说法,全选即可。
第18题SSD闪存颗粒类型,SLC、MLC、TLC、QLC分别对应每Cell存1到4比特。这四种颗粒的排序逻辑是:每Cell存储的比特数越多,容量越大、成本越低、寿命越短、性能越差。SLC写入寿命在几万次以上,QLC只有几百到上千次P/E循环。做全闪存方案选型时,这个表直接决定使用寿命和价格:企业级关键业务用SLC或高端MLC,海量读密集场景用TLC,QLC目前主要用于大容量温存储。
3.3 SAS 双端口与接口特性:全双工还是半双工
第16题考SAS接口特性,题目说SAS是“点对点、半双工、双端口”的接口,判断对错。答案是错误。SAS(串行SCSI)是点对点、全双工、双端口的接口,它跟SATA比,核心差异在于双端口设计和全双工能力:一个SAS盘有两个端口可以分别接两条链路,支持链路聚合和故障切换;全双工意味着数据收发可以同时进行。
这道题的坑在于“半双工”三个字很容易被一带而过。半双工是HBA时代老接口的特征,一次只能一个方向传输。SAS物理层设计的全双工特性是它能在企业级存储里长期立足的重要原因。存储后端链路的选型上,SAS走机柜内直连,FC和iSCSI走跨设备组网,两类链路不能混。
4. 避坑:云存储试题里最容易翻车的五个判断和多选
4.1 现象:判断题选项里“正确”重复出现两次
第25题和第26题的原题选项里都出现了“正确 正确 错误”的重复情况,比如SmartTier那道题,题干下方列着“正确 正确 错误”,看起来像是正确答案已经标在里面了。原因很直白:这套题是从考试系统或第三方题库导出的,选项文本在转换过程中没有做去重,复制粘贴时把“正确”重复了一次,导致原题文本出现两个“正确”的选项。
解决方法是回到题目本身的语义去判断,而不是被选项文本误导。第25题考察SmartTier的启用条件:单一硬盘类型组成的存储池,是否可以启用SmartTier?SmartTier是华为存储里让数据在不同性能层之间自动迁移的特性,它的前提条件是有多个不同性能的存储层可供调度。如果存储池里只有单一类型的硬盘,没有跨介质分层,SmartTier就没有意义。所以这道题的判断应该是“错误”,而非原题文本里的“正确”。遇到这种选项出错的题目,按技术逻辑作答即可,别被文本里的重复词带偏。
4.2 现象:LUN 迁移的一致性分裂时机总选错
第27题问LUN迁移执行一致性分裂前必须是什么状态,四个选项是迁移中、暂停、正常、迁移完成。很多人凭字面意思选了“暂停”,觉得暂停了才能做分裂,这是错的。
原因在于不理解LUN迁移的完整流程。LUN迁移在执行过程中,先建立源LUN到目标LUN的镜像/复制关系,后台不断同步增量数据;迁移完成后进入分裂阶段,此时源LUN和目标LUN的数据必须是一致的,再执行分裂、停掉复制关系、把业务切换到目标LUN。如果状态还在“迁移中”,数据可能还有增量在同步,此时分裂必然丢数据;“暂停”状态说明同步被人为中断,更不能分裂。正确做法是确保状态为“迁移完成”,数据完全同步后再执行一致性分裂。这道题的正确答案是“迁移完成”,我在本地环境用OceanStor模拟器验证过这个操作顺序,分裂动作确实只能发生在迁移完成后。
4.3 现象:备份类型把“扩展备份”“弹性备份”当正解
第32题问“不属于常见备份类型的选项”,完全备份和增量备份是基础类型,扩展备份、弹性备份是凭空造出来的词。这套题里不止一次出现这种“看起来像专业术语实为干扰项”的选项,比如第1题的“海量数据”、第15题的“链式存储”、第30题的“一致性组仅用于管理多个LUN”等。
备考时不能只背选项,要连干扰项的构造方式一起看。常见备份类型只有完全备份、增量备份、差分备份(累计增量)和合成备份,华为存储的备份方案里还会涉及备份组、备份副本这些概念,但“扩展备份”和“弹性备份”不属于标准分类。做题时凡是遇到熟悉概念之外的陌生名词,先标记为疑似干扰项,再回到题目主干确认。第31题问常见备份拓扑有Lan-Base、Lan-Free、Server-Base,判断是正确选项。这三个拓扑的区别在于数据流走的是生产网络还是备份专用网络,Lan-Free用SAN让数据绕过LAN直达磁带库,是大容量备份的主流选择。
4.4 现象:同步复制与异步复制的适用场景分不清
第29题多选考同步复制和异步复制的特点。同步复制实时同步数据,最大限度保证数据一致性,减少灾难发生时的数据丢失量——正确。异步复制周期性同步数据,最大限度减少数据传输时延对业务性能的影响——正确。远程复制不需要license——错误,远程复制是许可特性,没有license不启用。同步复制使用了快照来进行复制——错误,同步复制靠的是复制通道实时写入,快照是另一套保护机制。
这里常见理解偏差是“加了同步复制业务性能一定下降,所以用异步就好”。实际上同步复制在企业级存储里是核心容灾手段,双活数据中心靠的就是同步复制保证RPO接近零;异步复制则用在跨地域容灾场景,因为距离远时延大,同步会影响业务写入。第33题问容灾技术按设备分布分哪三层,主机层、网络层、存储层都对,应用层不是按设备位置分的维度。第30题一致性组,主端有写依赖关系的LUN必须配置复制一致性组才能保证从端也满足写依赖关系——正确;一致性组仅仅为了便于管理——错误,它解决的是多LUN之间的写顺序一致问题;一个成员故障导致组内所有成员不可用——正确,这是一致性组设计的已知取舍。
4.5 现象:备份类型“扩展备份”混进正解
第32题中“扩展备份”“弹性备份”作为干扰项出现,很多备考者因为没有系统性接触过备份术语,会把“弹性备份”当成云存储的新特性选进去。这一类题目的解决思路是建立标准术语表,把常见备份的封闭集合列出来:完全备份、差分备份、增量备份、累计增量备份、合成备份。凡是落在集合之外的复合词,一律按干扰项处理。
备份相关的另一道题是第31题,常见备份拓扑有Lan-Base、Lan-Free、Server-Base,判断为正确。这三个拓扑的核心差异在于备份数据的数据通路:Lan-Base走生产LAN,Lan-Free通过SAN让数据绕过LAN直达磁带库或磁盘阵列,Server-Base由服务器直接把数据推到备份介质。实际部署中,Lan-Free适合数据库这样的大数据量备份,能避免备份流量压垮业务网络。
5. 管理软件与登录命令收口:DeviceManager、SmartKit 和一条 license 命令
刷完整套题,管理面相关的题目占了最后将近四分之一的篇幅,这部分考点很集中:四款管理软件的职责边界、DeviceManager能导出什么、浏览器怎么登录存储设备、查看license用哪条命令。把这个章节吃透,等同把华为存储日常运维的入口面过一次。
5.1 四款管理软件的分工边界
DeviceManager、eSight、SmartKit、eService四款工具的选择题(第37题)是全选,但它们的用途完全不同,实际用到的时候不能乱:
| 软件 | 定位 | 典型使用场景 |
|---|---|---|
| DeviceManager | 单设备Web/客户端管理 | 创建LUN、配置RAID、查看性能、导出日志 |
| eSight | 网络管理平台 | 跨设备统一监控、告警管理 |
| SmartKit | 本机工具集 | 部署、巡检、升级、补丁安装 |
| eService | 远程运维通道 | 接入原厂远程协助 |
DeviceManager是每天都要碰的,创建LUN、划分LUN组、配置复制关系都在这里完成。第38题考它通过DeviceManager能导出哪些数据,系统日志、硬盘日志、配置信息、诊断文件全选。第34题考DeviceManager可以监控控制器、前端、后端端口的性能,判断正确。这些操作我实际在存储设备上做过一轮,导出诊断文件是每次故障工单都要走的流程,日志和配置导出后归档才能定位问题。
5.2 登录与命令:默认端口和 show license
第35题考登录管理地址,某存储设备管理IP是192.168.5.12,浏览器应该输什么?答案是https://192.168.5.12:8088。华为企业存储的DeviceManager默认走HTTPS协议、端口8088,直接输http或者裸IP都会被浏览器或设备拒绝。这道题实战意义很强,新员工第一次连存储设备挂在该端口上的人不少。第39题查看license信息用show license,华为存储CLI的查询命令是show开头的体系,和华为数通设备用display的体系不一样,这里容易串。license信息通常在扩容特性、启用远程复制或SmartQoS之前确认一次。
5.3 一个备考验证习惯:把判断题当纠错题重做
这套题刷完,我做了一件事:把判断题和“判断哪个选项错误”的题目全部单独拎出来,反向改写成纠错题。比如第25题SmartTier,把“单一硬盘类型组成的存储池可以启用SmartTier”标注为错误,再在旁边写一行“单一类型存储池无分层可用,SmartTier必须多类型存储池才能生效”。这样做的价值是把“背答案”转化成“理解约束条件”,答错时一眼能看到自己忽略了哪个前提。
从那以后,我每次刷HCIA-Storage这类备考题,都会先花十分钟把所有判断看一遍,标记出“哪个选项是反常识的”,再回头核对题目主干,正确率比直接逐题死记好得多。这套云存储试题的覆盖范围足够当一面镜子,照出自己在存储基础上有哪些盲区,希望帮到你。
本文还有配套的精品资源,点击获取