
简介《华为S2600T维护手册》是一份面向存储运维人员与视频监控项目集成人员的实操型PDF文档聚焦华为OceanStor T系列S2600T存储设备的管理与日常维护尤其适合初次接触该型号的存储管理员对照执行。整包仅1个PDF文件大小约545KB篇幅紧凑却覆盖完整配置链路从ISM设备管理软件的安装、登录与设备发现到RAID6组划分、热备盘设置、8TB LUN创建再到主机组与主机建立、iSCSI启动器添加及LUN映射逐条给出菜单路径与参数取值并附有安全注意事项与告警管理说明可帮助读者理解每个操作背后的作用与风险点。目前已有516人学习下载可作为视频监控存储扩容、日常巡检与新手培训的参考底稿帮助读者快速建立从设备初始化到资源分配的完整认知减少现场试错成本。1. 视频监控 NVR 掉盘之后S2600T 存储维护的真实入手点半夜值班电话说回放调不出来登上 NVR 一看挂载的 LUN 没了——这类故障在 IP-SAN 后端存储上并不少见。华为 OceanStor S2600T 就是被大量塞进视频监控项目的型号NVR 通过 iSCSI 挂它的 LUN 当录像池中间隔着 RAID 组、热备盘、主机组、启动器一层层关系。这份《华为 S2600T 维护手册》PDF 把 ISM 界面里从设备发现到 RAID 组、热备盘、LUN、主机组、启动器映射的整套流程写成了流水账但真正让运维少走弯路的是每一步背后那几个非默认参数的选择逻辑和告警判读口径。下面按现场维护顺序把这条链路拆开讲一遍凡是手册里写保持默认的地方都补上它默认了什么、为什么这么默认。2. 从浏览器到 ISM 客户端S2600T 设备发现链路的建立2.1 ISM 客户端与浏览器两条入口的取舍华为给 OceanStor T 系列配的统一管理软件叫 ISMIntegrated Storage ManagerS2600T 的日常操作——设备发现、RAID 组、LUN、主机映射、告警查看——全部在它一个界面里完成。它有两层入口一是被访问设备管理 IP 时弹出来的网页安装页二是安装完成后桌面生成的 ISM 快捷方式。区别在于前者每次都要重新下载安装包后者是本地客户端装上之后长期复用。现场我的习惯是直接用一台固定的维护终端装一次 ISM后续所有操作都走快捷方式。原因是网页安装页依赖管理 IP 所在网段可达运维笔记本一旦换到别的办公室或接入别的 VLAN就得重新找一条能摸到存储管理口的链路而本机客户端只需要这台笔记本本身能 ping 通存储管理 IP 就行它不依赖设备侧再发一次安装包。2.2 自签证书告警的处理边界第一次在浏览器里敲进管理 IP会依次撞上两个提示先是安全警报对话框确认之后浏览器又跳到此网站的安全证书有问题页面。很多人第一反应是设备出事了其实这是 S2600T 默认使用自签证书导致的正常现象不是中间人劫持。处理办法就一句点继续浏览此网站链接浏览器转入 ISM 安装页。真正需要警惕的是反向情况——如果你此前已经信任过该设备的证书并正常访问过某天突然又弹证书告警且指纹变了那就应该停下来核对而不是无脑继续。这是判断有没有人在管理口上做了替换的最简单信号。2.3 设备发现IP、默认口令与连通性验证装好 ISM双击桌面快捷方式菜单栏选系统 → 发现设备在指定 IP 地址后面填存储管理 IP然后填用户名和密码。S2600T 出厂的默认值是admin/Adminstorage手册里特意强调用户名和密码不要透露给不相干人员——因为 ISM 里的删除操作是直接对生产存储生效的谁拿到口令谁就能删 LUN。写进 ISM 之前建议先在维护终端上把连通性确认掉省得反复在界面上填了删、删了填# 维护终端到存储管理口的连通性4 个包够判断丢包率 ping -c 4 192.168.10.20 # 确认 iSCSI 服务端口IANA 标准 3260是否在监听 nc -zv 192.168.10.20 3260 # Windows 维护终端查看本机已登录的 iSCSI 会话 iscsicli SessionListping 通但nc报 connection refused通常不是网络问题而是存储侧 iSCSI 目标口没启用或者你连的是管理口而不是业务口。这两个口在 S2600T 上是分开的管理口用来跑 ISM业务口才跑 iSCSI 数据。填错 IP 段能发现设备但后面映射完 LUNNVR 死活认不到盘就是踩在这个点上。发现进度跑到 100% 后ISM 导航树上会挂出设备节点这一步过了才算真的进入配置阶段。2.4 发现失败的常见原因设备发现这一步卡住的概率在首次部署里相当高按概率从高到低排管理网段不通最常见尤其跨 VLAN 场景没放行管理口口令被人改过但没交接设备管理 IP 被别的设备占用导致 ARP 冲突ISM 客户端版本与设备固件版本不匹配。前三种用上面的ping/nc加设备面板指示灯基本能定位第四种只能去华为技术支持网站按固件版本找对应 ISM 安装包。手册只写了输入默认账号密码没提版本匹配这是实操里最容易踩空的一条。现象大概率原因定位动作ping 不通管理 IP管理网段/VLAN 未放行换到管理口同网段终端再 pingping 通但 nc 3260 拒绝连的是管理口不是业务口核对业务口 IP 段发现进度卡在 0%账号被改或设备被占用面板登录或串口确认设备状态设备列表空但网络正常ISM 与固件版本不匹配按固件版本重装 ISM3. RAID6 阵列与热备盘盘位规划、校验开销与降级判读3.1 RAID6 在视频流场景下的取舍视频监控的 IO 模型是持续顺序写、几乎没有随机读单路码流不高但路数叠加后并发写入量很可观。这种场景下 RAID 组最怕的是重建窗口期——一块盘坏了要重建重建期间如果再坏一块整个 RAID 组就废了。RAID5 只能容忍单盘故障重建那几小时里业务是全裸奔的RAID6 用两组校验盘换来同时容忍两盘故障代价是写性能略降、可用容量少一块盘。手册里这个项目直接用 RAID6属于典型的监控存储选型。判断标准很简单盘数够一般 ≥ 8且业务不能中断的上 RAID6盘数少、容量优先、能接受短暂停机的可以退回 RAID5。RAID6 的容量损失可以预算清楚# RAID6 可用容量估算N 块盘1 块热备2 块校验 total_disks 12 # 整机盘位 spare 1 # 热备盘占用 member total_disks - spare disk_tb 4 # 单盘容量TB usable (member - 2) * disk_tb # 12 盘 4TB 场景下9 块成员盘 - 2 块校验 7 块有效 print(f成员盘 {member} 块可用容量约 {usable} TB)这个数字要在规划阶段就跟业务方对齐。监控项目常见的心跳是录像要存 90 天容量算错了后面扩容又是另一轮 LUN 切分和映射能一次算准就别返工。3.2 成员盘与热备盘的盘位分配手册里的做法写得很干脆选择可选硬盘列表中除开最后一个硬盘的所有硬盘来组成 RAID 组最后一个硬盘设置为热备盘。翻译成盘位逻辑就是整机 N 块盘第 N 块通常是最后一个槽位留作热备前 N-1 块进 RAID6 当成员盘。为什么把热备放在最后一块而不是分散因为热备盘不参与 RAID 组的读写它平时是空闲的只有在成员盘故障时被拉进来顶替。放在末尾槽位的好处是物理位置固定、机柜巡检时一眼能看出哪块是备盘。如果盘位充足更稳的做法是配两块热备一块本地、一块全局但 S2600T 这类中端机型槽位有限手册的做法是当前的合理妥协。盘位角色是否参与读写故障时行为槽位 1 ~ N-1RAID6 成员盘是降级运行等待热备接替槽位 N热备盘否自动顶替故障成员盘3.3 创建 RAID 组的具体路径在 ISM 导航树上依次展开所有设备 → 存储资源 → RAID选择创建 → RAID 组然后RAID 组名称填RAID01。命名建议带用途前缀比如RAID_VIDEO后面 LUN、主机的名字也顺着这个脉络命名出问题时一眼能对上业务。RAID 类型选RAID6。物理硬盘勾选除最后一块外的全部成员盘。如果盘列表里有已经被别的 RAID 组用过的盘它不会出现在可选列表里。单击确定。创建期间 UI 会有一段初始化提示视容量和盘数而定别在这个窗口反复点。创建完在存储资源 → 块存储池里能看到这个 RAID 组健康状态初始是正常。这一步完成后RAID 组就相当于一个由物理盘拼出来的大逻辑硬盘接下来切 LUN 就是从这个逻辑盘里再划分。3.4 热备盘设置与降级后的自动接管热备盘的设置在另一条路径里所有设备 → 设备信息 → 存储单元 → 硬盘在信息展示区选中最后一块盘然后热备盘 → 设置。这里容易出的错是选错盘——成员盘和热备盘在列表里长得一样选之前核对一下槽位号。设置完成后如果 RAID 组里某块成员盘故障ISM 会报警同时热备盘自动顶替并开始重建。判读的关键在 RAID 组健康状态降级表示还能跑但性能不达标、重建正在进行正常表示重建完成、数据已同步如果降到故障就说明同时坏盘数超过了 RAID6 的容忍上限这时候只能联系华为 24 小时服务热线走数据恢复流程别再自己折腾。手册里把降级、故障、休眠三个状态都列出来了实际巡检里最需要盯的就是降级——它很容易被忽略因为业务还在跑。4. LUN 切分、主机组与 iSCSI 映射让 NVR 认到 S2600T4.1 LUN 切分粒度与 NVR 识别上限LUN 是 NVR 能识别的最小存储单元相当于从 RAID 组里划出来的一块逻辑硬盘。手册里这个项目每个 LUN 切 8TB名称LUN001、LUN002依次排下去。8TB 这个粒度不是随便定的很多 NVR 平台对单个 LUN 有识别上限常见是 16TB 或 32TB切太大会出现能创建但 NVR 侧看不到的情况切太小又会造成 LUN 数量过多映射关系难以维护。我一般会先跟 NVR 厂家确认单卷上限和单卷建议值再决定切分粒度。监控场景里常见是 4TB 或 8TB 一档录满后 NVR 自动轮转覆盖单卷越小、轮转越快、单个卷损坏影响越小但卷数多了 iSCSI 会话也多交换机侧要留够会话数。4.2 主机组与主机的层级建模ISM 里主机映射是三层结构主机组 → 主机 → 启动器。手册里这个项目的建模思路是——多个看守所的监控服务器组成一个统一的监控平台对应到 ISM 上就是一个主机组监控平台每个看守所的监控服务器对应一个主机监控服务器。创建主机组导航树所有设备 → 映射 → 主机组点创建名称填监控平台。创建主机导航树所有设备 → 映射 → 主机点创建所属主机组选监控平台主机名称填监控服务器操作系统类型选Windows一路下一步到确定。操作系统类型这个字段很容易被随手跳过其实它影响的是多路径和驱动推荐。NVR 服务器整体跑 Windows 还是 Linux会决定 iSCSI 启动器的匹配策略和超时参数填错未必马上出问题但遇上链路抖动或重建窗口行为会不一样。现场建模时把主机组当业务域、主机当物理机、启动器当网卡三个概念的物理对应捋顺了后面排查挂载问题会简单很多。4.3 iSCSI 启动器绑定让存储认到 NVR手册里的项目是 IP-SAN 方式所以主机创建完还要给主机添加 iSCSI 启动器。启动器的本质是 NVR 侧那块 HBA 网卡在 iSCSI 协议里的名字标记ISM 上不绑定启动器主机和物理 NVR 之间就没有映射关系LUN 映射过去 NVR 也认不到。在 ISM 导航树所有设备 → 映射 → 主机里选中监控服务器点配置启动器 → 添加从列表里选中该 NVR 对应的启动器点确定。这里选中哪个启动器取决于 NVR 侧已经发起了 iSCSI 登录。Linux NVR 侧的动作是# 扫描目标存储暴露的 iSCSI 目标 iscsiadm -m discovery -t sendtargets -p 192.168.10.20:3260 # 登录全部发现到的目标节点 iscsiadm -m node --login # 登录后确认块设备是否就位 lsblk-t sendtargets是主动向目标端查询可用 target 列表-p后面跟的是业务口 IP 加 3260 端口。登录成功后lsblk能看到新的块设备节点此时 NVR 侧才算真正看到了存储。ISM 里之所以能选到启动器是因为 NVR 侧已经完成了 discovery 把 IQN 报上来了如果 NVR 侧还没跑过 discoveryISM 的启动器列表里就是空的这一步顺序不能反。4.4 LUN 映射到主机的顺序与验证最后一步是映射ISM 导航树所有设备 → 存储资源 → LUN选中LUN001点映射 → 映射给主机选择目标主机监控服务器点确定。映射完成后NVR 侧重新扫一下 SCSI 总线应该能看到对应容量的新盘。顺序上有讲究先绑定启动器再映射 LUN这样 NVR 侧看到的就是一块有权限、容量正确的盘反过来先映射后补启动器NVR 侧可能先把这块盘识别成一个无权限的 stale 设备需要手动清理再重扫。生产环境里映射完成后不要让 NVR 立刻开始写数据先在 NVR 侧做一次全盘写测试确认落盘和读回都正常再挂进录像池。手册给的是正经部署流程埋盘验证这一步得自己加。5. 告警事件管理到 LUN/RAID 组巡检故障定位的收口5.1 故障列表和事件列表先看哪个ISM 菜单栏事件 → 事件管理下面有两个页签对应两类信息用途完全不同。故障列表只放当前尚未修复的故障是第一时间要看的事件列表放提示级别的信息以及所有已经修复的故障用于回溯。同一条故障在清除后不会继续出现在故障列表里而是会转到事件列表里留下记录。巡检时的顺序是先刷故障列表、再看事件列表这个顺序反了会把已修复的陈年告警当成新问题处理。5.2 告警字段的解读口径点开任一条故障或事件的查看参数基本一致几个字段值得单独说清楚字段含义现场用法级别紧急 / 重要 / 警告 / 提示紧急和重要必须在当班处理事件来源发生故障的设备名定位到具体盘、控制器或端口ID故障的 16 进制唯一编号拿这个号去查华为技术支持或工单系统描述故障文本含产生模块位置判断是硬件还是业务层发生时间YYYY-MM-DD hh:mm:ss UTChh:mmUTC 偏移要核对跨时区项目易误判恢复时间仅事件列表有格式同上用来算故障持续时间流水号系统分配的编号默认隐藏右上角可开启报单时提供那种设备号 16 进制 ID的组合是最有价值的报工单或找华为服务时直接给 ID比描述一段模糊现象快得多。时间字段里的UTChh:mm是偏移量很多分布式部署里的时间对不上就是因为没看偏移。5.3 LUN 与 RAID 组巡检指标日常巡检两个入口LUN 看所有设备 → 存储资源 → LUN选中 LUN 看下侧详细信息健康状态只有正常/故障两档运行状态分在线、离线、未格式化、正在格式化。RAID 组看所有设备 → 存储资源 → 块存储池健康状态多一个降级运行状态只有在线/离线。把这两个状态组合起来能快速判断页面上要不要动手LUN正常在线就翻页RAID 组出现降级无论 LUN 什么状态都得停下来查盘列表看热备盘是否已经接替、重建进度如何一旦出现故障或离线先保现场日志再按手册提示联系华为 24 小时服务热线走后续流程。手册原文把热线号码写成了 99 开头的省略形式实际号码以设备保修卡或合同为准别照抄 PDF 里的残缺数字。本文还有配套的精品资源点击获取