简介:这份博科(Brocade Fabric)交换机培训文档与操作手册,面向数据中心存储网络运维人员、SAN 初学者及需要备考相关认证的工程师,帮助读者系统掌握光纤交换机的日常运维与配置方法。资源共 1 个 PDF 文件,压缩包约 3.28MB,内容以图文讲义形式呈现,便于打印或离线查阅。文档从 FC 交换机与以太网、FC 协议与 TCP/IP 协议的差异讲起,梳理 SFP+、QSFP+、Copper 等常见接口类型,再逐步展开交换机基本配置、通道业务配置与案例演示,涵盖连接交换机、修改账号密码与管理地址、会话超时与 NTP 配置、switchname 修改、端口启停,以及 Zone、VSAN、Port Channel 的创建与激活。FAQ 部分还整理了 show system、show port、show flogi 等日常巡检命令和日志收集排障思路。目前已有 1892 人学习,适合希望快速上手博科交换机运维、对照实操查漏补缺的读者。
1. 博科光纤交换机运维实战:从 OS 模块到 Zone 配置的完整拆解
数据中心里跑 SAN 存储网络的兄弟,大概率绕不开博科(Brocade Fabric)交换机。这套培训文档和操作手册一共 25 页,覆盖了博科交换机 OS 功能模块、基本管理配置、光纤通道业务配置、级联案例演示和日常巡检 FAQ,是一份从零上手到能独立做 Zone 变更的实操材料。它解决的核心问题是:当你面对一台博科光纤交换机,知道怎么连上去、怎么改配置、怎么划 Zone、怎么验证 FC 通信、出问题了看哪些命令。适合刚接触 SAN 存储网络的运维工程师,也适合从以太网交换机转过来、需要快速理解 FC 协议差异的从业者。下面按“是什么→怎么用→坑在哪”的节奏,把这份文档拆开讲透。
2. 博科 OS 功能模块与 FC 协议:为什么它跟以太网交换机不是一回事
2.1 FC 交换机与以太网交换机的本质差异
很多人第一次碰博科光纤交换机,会下意识拿华为、思科以太网交换机那套经验往上套,结果发现命令体系、业务逻辑完全对不上。根本原因在于 FC 和以太网是两套设计哲学。
从技术层面看,FC 交换机使用光纤作为传输介质,基于 FC 协议栈,专门为存储流量设计;以太网交换机可以用双绞线或光纤,跑 TCP/IP 协议栈,面向通用数据通信。可靠性方面,FC 协议在链路层就做了端到端 CRC 校验和序列管理,以太网则把可靠性交给上层 TCP 去保证。速率上,博科交换机常见 8G、16G、32G FC 端口,跟以太网的 1G/10G/25G 不是同一个演进路线。
应用场景的差异更明显:FC 交换机用来构建 SAN,承载的是块级存储流量,对时延和丢包极其敏感;以太网交换机跑的是文件级或应用级流量,容忍度更高。所以博科交换机的 Zone 配置、别名管理、级联授权这些概念,在以太网世界里没有直接对应物。
2.2 FC 协议栈与 TCP/IP 协议栈的关键区别
这份文档里有一段很关键的对比,值得单独拎出来说。TCP/IP 协议栈运行在主机端内核中,需要耗费主机 CPU 来运算。以太网卡每收到一个帧,都要送到主机 TCP/IP 协议栈,由 CPU 做 IP 地址分析、TCP 层数据段定界、校验、检测重传、包拼接,这一系列操作全是 CPU 在跑代码。
而 FC/SAS 的下四层,全部在 FC/SAS 控制器的硬件电路或固件里完成。传送到主机内存的数据,直接就是 FC/SAS 包里包含的上层 Payload。这意味着 FC 对主机 CPU 的耗费极小,时延也更低。TCP/IP 的话,每个以太网帧被拷贝到主机内存,再经过 CPU 逐层处理,整个流程时延更高,中间还有多次内存拷贝。
这个差异直接决定了:FC 适合对时延敏感的存储场景,而 iSCSI 这类基于以太网的存储方案,在主机侧的开销天然比 FC 大。文档还延伸提到了 FCIP 网关,就是把 FC 协议与 IP 协议融合的方案,用于远距离 FC 互联。
2.3 博科 OS 的七大功能模块
博科交换机 OS 不是单一进程,而是由多个服务模块组成。文档列出了七个核心模块:
| 模块名称 | 功能说明 |
|---|---|
| 登录服务 | 提供与其它交换机节点或服务交换数据的接口 |
| 目录服务 | 名称服务器,提供节点注册、查询和发现其它设备的功能 |
| 光纤控制器服务 | 提供节点的状态变更 |
| 时间服务 | 保持时间同步 |
| 管理服务 | 用户可配置管理的唯一服务,提供基本配置和通道业务配置 |
| 别名服务 | 通过管理服务管理,提供节点名称注册和分组 |
| 广播服务 | 发到这个地址的会广播出去 |
理解这些模块的意义在于:当你执行alishow、zoneshow、switchshow这些命令时,背后对应的是不同服务模块在响应。比如别名服务挂了,alicreate就会失败;目录服务异常,fabricshow可能看不到级联成员。
2.4 常见接口类型与连接方式
博科交换机常见接口包括 SFP+ 和 QSFP+,分别对应 10G/16G 和 40G/更高带宽的光纤链路。短距离场景也有 Copper 接口,用双绞线做低成本连接。
连接交换机有三种方式:Serial 串口连接、管理口连接、SSH/Web 方式。管理口默认地址是10.77.77.77,默认账户密码是admin/password。Web 方式访问https://172.16.254.73时,Brocade G6510 需要装 JAVA 7,Brocade G620 需要 JAVA 8。这个 JAVA 版本坑后面会细说。
3. 交换机基本配置:从连上去到改完管理地址
3.1 连接交换机与修改账号密码
第一次拿到一台博科交换机,最稳妥的方式是串口连接。用 Console 线接上,波特率一般 9600,就能进 CLI。如果管理口已经配好,也可以直接 SSH。
连上去之后第一件事是改密码:
# 修改当前用户密码 passwd # 修改指定用户密码 passwd [username]passwd不带参数改的是当前登录账户,带用户名则改指定账户。博科默认密码是password,生产环境必须改掉,这是基本安全要求。
3.2 修改管理地址与时间服务器
管理地址用ipaddrset命令,即刻生效:
# 进入 IP 配置模式,按提示输入新地址 ipaddrset # 查看当前管理接口地址 ipaddrshowipaddrset是交互式的,会依次问你以太网 IP、子网掩码、网关。改完立刻生效,不需要重启。这里有个坑:如果你是通过 SSH 连的,改完 IP 当前会话会断,得用新地址重连。
时间服务器配置用tsclockserver:
# 配置 NTP 时间服务器 tsclockserver "10.31.255.254" # 查看当前时间服务器配置 tsclockserver时间同步对 SAN 网络很重要,因为 Zone 配置变更、日志记录都依赖时间戳。如果多台交换机时间不一致,排障时日志对不上,会很头疼。
会话超时用timeout命令:
# 设置会话超时时间为 30 分钟 timeout 30 # 值为 0 表示无限制 timeout 0生产环境不建议设 0,无限制会话容易被遗忘的终端占着,存在安全风险。
3.3 修改 switchname 与禁用启用操作
交换机名称用switchname改:
# 修改交换机名称 switchname [newname]名称在 Fabric 内要唯一,级联时如果两台交换机重名,会出问题。
禁用和启用交换机、端口:
# 禁用整个交换机 switchdisable # 启用整个交换机 switchenable # 禁用指定端口 portdisable 端口号 # 启用指定端口 portenable 端口号关闭交换机用sysshutdown:
# 安全关闭交换机 sysshutdown注意:sysshutdown是安全关机,会先停业务再断电。直接拔电源是血泪教训,可能导致配置文件损坏。
3.4 查询基本信息:日常巡检必用命令
文档里列了一大批查询命令,我按使用频率和重要性整理成表:
| 命令 | 用途 | 重要程度 |
|---|---|---|
clihistory | 查询历史命令 | 中 |
ipaddrshow | 查询管理接口地址 | 高 |
uptime | 显示系统运行时间 | 中 |
alishow | 显示设备别名信息 | 高 |
cfgactvshow | 查看已生效的配置文件 | 高 |
chassisShow | 查看主板信息 | 低 |
configshow | 查看系统参数配置 | 中 |
dlsShow | 查看负载均衡配置 | 中 |
fabricShow | 查看级联交换机成员 | 高 |
fabStatsShow | 查看系统统计信息 | 中 |
fanshow | 查看风扇状态 | 高 |
memshow | 查看内存使用 | 中 |
portbuffershow | 查看端口缓存 | 高 |
portcfgshow | 查看端口配置 | 高 |
porterrshow | 查看端口传输错误概览 | 高 |
sfpshow 端口号 | 查看光功率/光衰 | 高 |
portperfshow | 查看端口吞吐量 | 高 |
portshow | 查看端口状态和配置 | 高 |
supportshow | 查看故障排除详细信息 | 高 |
switchshow | 查看交换机和端口状态 | 高 |
zoneshow | 查看已生效和已定义的 zone | 高 |
其中porterrshow有个关键判断逻辑:如果Enc_Out报错单独产生,很可能是光纤线问题;如果Enc_Out和Crc_Err一起产生,很大可能是 GBIC/SFP 问题。sfpshow看光功率,大于 398uw 为正常值。
supportshow是排障时的黑匣子,输出信息量极大,一般收集日志时直接跑这个,把输出保存下来给厂商分析。
4. 通道业务配置:Zone 创建、修改与生效的完整流程
4.1 新建配置文件、别名和 Zone
通道业务配置是博科交换机最核心的日常操作。整个逻辑链条是:先建配置文件(cfg),再建别名(alias),再建 Zone,把 Zone 加到配置文件里,保存,生效。
新建配置文件:
# 新建一个空的配置文件 cfgCreate "xxxxxxj_idc" # 新建配置文件并同时加入一个 zone cfgCreate "xxxxxxj_idc","zonename"新建别名:
# 创建单个成员的别名 AliCreate "HyLocal_ESXi112222_p1","51:40:2E:c0:15:54:F5:14" # 创建多成员别名,成员用分号分隔 Alicreate "H3C_C650_1","member1;member2;member3"别名的作用是给 WWN 起个人能看懂的名字。WWN 是 16 位十六进制,直接记根本不现实。别名可以按主机名、端口、用途来命名,比如HyLocal_ESXi112222_p1一看就是某台 ESXi 主机的第一个端口。
新建 Zone:
# 创建 zone,成员可以是 Domain,Port、WWN 或 Alias zonecreate "testzonename", "zonemember1;zonemember2;zone"Zone 成员有三种写法:Domain,Port格式、直接写 WWN、或者引用别名。推荐用别名,可读性好,后续维护方便。
4.2 将 Zone 加入配置文件并生效
Zone 建好不会自动生效,必须加到配置文件里,再保存、启用:
# 将 zone 添加到配置文件 cfgAdd "xxxxxxj_idc", "testzonename" # 保存自定义配置 cfgsave # 生效配置文件 cfgEnable testzonename这里有个关键限制:同时只能有一个配置文件生效。cfgEnable的时候,如果已有其他配置文件在生效状态,会切换过去。
cfgsave和cfgEnable的区别要搞清楚:cfgsave是把配置写入非易失存储,cfgEnable是让配置在 Fabric 内生效。只 save 不 enable,配置不会起作用;只 enable 不 save,重启后配置丢失。
4.3 重命名、增加成员、移除成员
重命名别名和 Zone:
# 重命名 zone zoneObjectRename "testzonename", "newzonename" # 重命名别名 zoneObjectRename "HyLocal_ESXi112222_p1", "newaliname"zoneObjectRename也适用于 cfg 重命名。重命名后需要cfgsave和cfgEnable来使修改生效。文档里特别提了一个问题:重命名别名后,相应的 zone 信息会不会跟着变更?答案是会。因为 zone 里引用的是别名,别名改名后 zone 里的引用自动更新。
增加和移除成员:
# 别名增加成员 aliadd "aliName", "member[; member...]" # Zone 增加成员 zoneadd "zoneName", "member[;member...]" # 别名移除成员 aliremove "aliName", "member[; member...]" # Zone 移除成员 zoneremove "zonename", "member[;member...]"文档里留了一个思考题:如果一个 alias 中只有一个成员,且这个成员 WWN 错误,如何修改最便捷?常见做法是直接用zoneobjectreplace替换,而不是先删再加。
4.4 替换与删除操作
替换别名和 Zone 成员:
# 替换 zone 成员 zoneobjectreplace "oldZonemember" "newZonemember" # 替换别名成员 zoneobjectreplace "oldAliasmember" "newAliasmember"删除操作:
# 删除别名 alidelete "aliname" # 删除 zone zonedelete "zonename" # 删除配置文件 cfgdelete "cfgname"注意:以上命令都需要cfgsave和cfgEnable来写入非易失存储并生效。删除是全局删除,不是只删除当前配置文件里的 zone 或 alias。但大多数时候一个 zone 只存在于一个配置文件里,所以实际影响不大。
5. 级联配置与案例演示:Domain ID 冲突、Trunk 口和长距离参数
5.1 FC 交换机级联配置流程
级联是把两台 FC 交换机连起来,扩展 Fabric。文档里的案例演示了完整流程。
第一步是基本配置,管理地址、switchname 这些按前面章节操作。
第二步是添加级联授权:
# 添加 license licenseadd XXXXXXXX # 查看级联 license licenseshow # 查看交换机状态 switchshow级联 License 是必须的,无论距离长短,两台交换机连接都需要购买级联授权。EF License(Extended Fabric)是远距离连接授权,超过 10Km 就需要。
第三步是修改 Domain ID。光纤交换机默认 Domain ID 均为 1,级联前必须将其中一台改为其他值,否则会冲突。操作步骤:
# 禁用交换机 switchdisable # 进入配置模式 configure # 在 Fabric parameters 提示处输入 y # 在 Domain ID 处输入唯一域 ID,范围 1 到 239 # 重新启用交换机 switchenableDomain ID 冲突是级联翻车的高频原因。两台都是默认 1,连上线后 Fabric 直接分裂,业务中断。
第四步是配置 Trunk 口:
# 配置 trunk 口 portcfgtrunkport 端口号 # 查看端口缓存 portbuffershow第五步是配置长距离参数:
# 手动模式:LS 模式,距离 63 portcfglongdistance 47 LS 1 -distance 63 # 自动模式:LD 模式,距离 10 portcfglongdistance 47 LD 1 -distance 10LD 是自动远距离连接模式,buffer 值会根据连接速率和距离自动分配,支持最大 500km 的 1Gbps。
第六步是关闭 FEC:
# 关闭 FEC portcfgfec --disable -FEC 47 # 永久启用端口 portcfgpersistentenable 47第七步是查看级联状态:
# 查看级联状态 islshow fabricshow switchshow如果级联成功,端口状态会变成 E-Port,主交换机后面标有 (UPstream),下级交换机显示 (downstream)。
5.2 验证 FC 通信与测试传输带宽
级联配好后要验证通信:
# FC ping,源 WWN 到目的 WWN fcping 源wwn 目的wwn # 只 ping 目的 WWN,增加 ping 包数量 fcping --number 5000 wwnfcping类似 IP 网络的 ping,用来验证 FC 链路连通性。--number参数指定 ping 包数量,默认可能只有几个,加大数量能更好观察丢包情况。
测试传输带宽:
# 在 C650-1 上启动服务器端 checkrclink serverstart 2:4:1 # 在 C650-2 上测试连接带宽 checkrclink startclient 3:4:1 fe80::2341:2:ac02:6523 60checkrclink是博科自带的链路测试工具,serverstart 在一边起服务端,startclient 在另一边发起测试,最后的 60 是测试时长(秒)。
5.3 SNMP 监控配置
文档提到 SNMP 监控配置,这是把博科交换机接入现有监控体系的关键。常见做法是配置 SNMP 团体名和 trap 接收地址,让交换机把端口状态变化、错误计数等上报到监控平台。具体命令文档里没展开,但一般用snmpconfig系列命令,设置snmpconfig --set snmpv1或snmpv3,再配snmpconfig --set traphost。
6. 避坑与排查:博科交换机日常运维的五个血泪教训
6.1 坑一:Web 管理页面打不开,JAVA 版本不对
现象:浏览器访问https://172.16.254.73,页面加载失败或功能按钮点不动。
原因:博科 Web 管理工具依赖 JAVA 插件,不同型号要求的 JAVA 版本不同。Brocade G6510 需要 JAVA 7,Brocade G620 需要 JAVA 8。装错版本或者系统里同时有多个 JAVA 版本,就会出问题。
解决:确认交换机型号,装对应 JAVA 版本。如果已经装了多个版本,在 JAVA 控制面板里把对应版本设为默认。生产环境更推荐用 SSH,Web 方式只做临时查看。
6.2 坑二:级联后 Fabric 分裂,Domain ID 冲突
现象:两台交换机级联,fabricshow看不到对方,或者看到两个独立 Fabric。
原因:两台交换机 Domain ID 都是默认值 1,级联后冲突。
解决:级联前先把其中一台的 Domain ID 改掉。按 5.1 节的步骤,switchdisable→configure→ 改 Domain ID →switchenable。改完再连线。
6.3 坑三:Zone 配置改了不生效,忘了 cfgsave 或 cfgEnable
现象:zonecreate、cfgadd都执行成功了,但业务还是不通。
原因:配置只在内存里,没保存到非易失存储,或者没在 Fabric 内生效。
解决:每次改完 Zone 相关配置,必须执行cfgsave和cfgEnable。养成习惯:改完就 save,确认无误再 enable。cfgactvshow可以查看当前生效的配置,跟zoneshow对比能发现差异。
6.4 坑四:端口报错分不清是线的问题还是 SFP 的问题
现象:porterrshow看到Enc_Out或Crc_Err计数增长,业务时断时续。
原因:光纤线缆故障或 SFP 光模块故障,都会导致端口错误。
解决:文档给了明确判断逻辑——Enc_Out单独产生,很可能是光纤线问题;Enc_Out和Crc_Err一起产生,很大可能是 GBIC/SFP 问题。再用sfpshow 端口号看光功率,大于 398uw 为正常。光功率偏低先换线,换线无效再换 SFP。
6.5 坑五:sysshutdown 之前没确认业务已停
现象:执行sysshutdown后,主机侧存储链路断开,业务受影响。
原因:sysshutdown是安全关机,但不会帮你判断业务是否已经切换或停止。
解决:关机前先确认主机侧多路径软件已经把流量切到其他路径,或者业务已经停止。switchshow看端口状态,fabricshow看级联成员,确认没有单点依赖后再关机。直接拔电源更是大忌,可能导致配置文件损坏,下次开机配置丢失。
7. 日常巡检与日志收集:把排障前置成例行操作
日常巡检是博科交换机运维里最容易被忽视、但收益最高的环节。文档 FAQ 部分列了巡检命令和日志收集方法,我结合自己的习惯补充一下。
巡检的核心命令组合是:switchshow看整体状态,porterrshow看错误计数,sfpshow看光功率,fanshow看风扇,memshow看内存,fabricshow看级联。这六个命令跑一遍,基本能覆盖 80% 的潜在问题。
我一般会把这些命令的输出定期保存下来,跟上次对比。比如porterrshow的错误计数,如果某个端口Crc_Err从 0 涨到几百,即使业务还没断,也要提前查线查 SFP。等业务断了再查,就是事故了。
日志收集用supportshow,这个命令输出信息量极大,包含交换机所有关键状态。排障时直接跑supportshow,把输出重定向到文件:
# 收集 supportshow 输出到文件 supportshow > /tmp/supportshow_$(date +%Y%m%d).txt如果交换机支持 FTP 或 SCP,可以把文件传出来。文档里提到收集交换机排障日志信息,常见做法就是supportshow加errshow、portlogshow这些命令的组合。
还有一个容易被忽略的点:clihistory可以看历史命令。多人运维同一台交换机时,出问题后查clihistory能快速定位是谁在什么时候改了什么。这个习惯我是在一次 Zone 误删事故后养成的,从那以后每次上机操作前先clihistory看一眼,操作完再确认一遍。
验证 Zone 配置是否正确的终极方法是fcping。配完 Zone,别急着说搞定了,用fcping从源 WWN ping 目的 WWN,通了才算数。fcping --number 5000加大包量,能发现偶发丢包。这个步骤我每次 Zone 变更后都强制走一遍,宁可多花两分钟,也不想半夜被业务电话叫醒。
希望帮到你。
本文还有配套的精品资源,点击获取