首页/新闻资讯/正文详情

联想服务器RAID配置与Ubuntu安装全流程指南

发布时间:2026/9/24 18:34:56 来源:云帆数科 栏目:资讯中心
联想服务器RAID配置与Ubuntu安装全流程指南
上个月给客户部署一台联想 ThinkSystem SR650对方要求 Ubuntu 系统装完就直接跑数据库还得保证数据别因为单盘故障直接凉凉。装到一半发现 RAID 卡配置界面和文档里对不上折腾了一晚上才搞清楚是 BIOS 引导模式没切对。后来想想这种问题在网上其实特别常见——很多人卡在的不是 RAID 概念而是联想服务器这套配置路径太隐蔽了。这篇文章就是冲着这个痛点去的。我会先讲清楚 RAID 0/1/5/10 到底各自解决什么问题、代价是什么再手把手带你把联想服务器从开机到 RAID 配置完成、装上 Ubuntu 全套流程走一遍。涉及的机型以 ThinkSystem SR650 / SR550 / SR590 这类主流联想机架服务器为主RAID 卡以最常见的 Lenovo ThinkSystem RAID 530-8i / 930-8i 为例适配大多数联想塔式服务器和机架服务器。1. 动手之前先把 RAID 这几个档位搞清楚很多教程上来就让你选 RAID 级别但如果你不理解这几个模式背后的取舍配置完才发现选错了数据迁移和重配的成本非常高。我尽量用大白话把 RAID 0/1/5/10 讲明白顺便把适合的场景也列出来你配置的时候心里就有底了。1.1 RAID 0把数据拆开并行写快是真的快险也是真的险RAID 0 的原理很简单把两块或更多硬盘组合成一个逻辑盘数据被切成一段一段的分别写到不同物理盘上。写入时多个盘同时工作性能几乎可以线性叠加。打个比方就好比你让一个人抄写一本书和把书拆成几份让几个人同时抄后者的速度肯定快得多。RAID 0 就是这个思路所以在所有 RAID 级别里它的读写性能是最高的磁盘空间利用率也是 100%。但它有一个致命的点没有冗余。RAID 0 阵列里任何一块盘坏了整个阵列的数据全部丢失连恢复的余地都没有。因为每一段数据只存在一块物理盘上坏一块等于整个数据链断了。所以这个东西适合哪些场景呢我自己的判断是临时计算集群的节点、游戏服务器、视频渲染缓存盘、对速度要求极高但数据丢了也不心疼的场合。如果你打算在上面跑数据库或者存业务文件我的建议非常明确别用 RAID 0。1.2 RAID 1一模一样的双写安全到位但空间砍半RAID 1 必须至少两块盘原理是把同一份数据同时写到两块盘上。两块盘的内容完全一样互为镜像。还是拿抄书打比方RAID 1 就是两个人同时抄同一本书每人手里有一份完整的内容。其中一个人把书弄丢了另外一个人手里还有完整的副本不影响你继续阅读。这个模式最大的价值是安全性。阵列里坏一块盘系统照常运行数据一点不丢。你把坏盘拔下来换一块新盘上去阵列会自动把好盘的数据重建到新盘上整个过程业务可以不停。代价也一样明显磁盘利用率只有 50%。两块 1TB 盘组 RAID 1实际可用空间只有 1TB。RAID 1 适合什么场景系统盘、存储重要配置文件的盘、小容量但要求高可靠性的业务数据。很多生产环境会把 RAID 1 用作操作系统盘。我见过不少客户两块 600GB SAS 盘组 RAID 1 装系统数据盘另外用 RAID 5 或 RAID 10这个组合在实际项目中非常常见。1.3 RAID 5兼顾性能、容量和安全性最经典的选择RAID 5 最少需要三块盘。它的核心机制是把数据和校验信息分散存储在所有磁盘上。任何一个盘坏了都可以利用其他盘上的数据和校验信息把丢失的数据算回来。这怎么理解呢你可以把它想象成一个简单的数学题假设我们想让三个人各自记住一个数字同时还要保证任意一个人缺席时其他人能推算出他记的数字那我们可以让其中一部分人记原始数字另一个人记总和。只要知道总和和其他原始数字缺失的那个数字就能反推出来。现实中 RAID 5 的校验算法比这个复杂得多但思想是一样的。RAID 5 阵列坏一块盘时不会丢数据系统在降级模式下继续运行直到你换上新盘完成重建。空间利用率上RAID 5 用 n 块盘实际可用 n-1 块盘的容量。比如四块 4TB 盘组 RAID 5可用 12TB比 RAID 1 的利用效率高太多了。那 RAID 5 有什么需要注意的点首先是重建时间。大容量硬盘组 RAID 5坏盘之后重建往往需要十几个小时甚至更长重建期间如果又坏一块盘数据还是有丢失风险的。另外RAID 5 的随机写入性能不如 RAID 10因为每次写入不仅要写数据本身还要更新校验信息这个额外的计算和写入开销是逃不掉的。适合场景大多数业务服务器的数据盘文件服务器、数据库服务器并发量不是极端的场景、虚拟化存储。这是目前数据中心里最常见的 RAID 级别之一。1.4 RAID 10先镜像再条带性能和安全都要RAID 10 是 RAID 1 和 RAID 0 的结合体先把磁盘两两配对做成 RAID 1 镜像对然后再在多个镜像对之间做 RAID 0 条带化。最少需要四块盘。结构上是这样的盘 1 和盘 2 组成一个镜像对盘 3 和盘 4 组成另一个镜像对然后这两个镜像对之间做条带。写入时数据被拆开写到两个镜像对上每个镜像对内部又同时写一份到两个物理盘。这样既获得了 RAID 0 的并行写入性能又获得了 RAID 1 的冗余保护。RAID 10 允许坏盘但每个镜像对里最多只能坏一块。如果同一个镜像对里两块盘都坏了数据照样丢。RAID 10 的空间利用率是 50%跟 RAID 1 一样。但它的性能远好于 RAID 5尤其是在随机写入场景下因为不需要计算校验信息。适合场景对性能和可靠性都有高要求的数据库尤其是 OLTP 场景、虚拟化平台、生产环境的关键业务系统。缺点就是贵同样的可用容量需要更多物理盘。1.5 RAID 级别选型结合联想服务器常见配置给出的建议光知道原理还不够最后选哪个还是要看你的业务场景和预算。根据我这几年给客户做联想服务器配置的经验总结一下系统盘 重要配置数据两块盘组 RAID 1稳如老狗。联想服务器主板板载的 RAID 卡基本都支持。文件存储 / Web 服务器 / 中小型业务系统四块盘组 RAID 5兼顾容量和安全性性价比最高。数据库 / 虚拟化 / 高并发业务四块或更多盘组 RAID 10性能和安全都到位。缓存 / 临时计算两块盘 RAID 0 可以考虑但我会反复提醒你数据安全的风险。有一个常见问题如果服务器只有三块盘还要跑数据库选 RAID 5 还是 RAID 10答案很简单——RAID 10 最少四块盘三块盘只能选 RAID 5。这种情况下的权衡也很清晰随机写性能比 RAID 10 弱一些但三块盘组 RAID 5 的可用容量是 2/3算是不错的中庸方案。另外提醒一句如果你用的是联想入门级服务器自带的板载 RAID可能只支持 RAID 0/1/10不支持 RAID 5。这个在你规划存储方案之前就必须确认清楚否则硬件不支持软件层面再怎么折腾也没用。建议直接查官网对应机型的 RAID 卡规格或者进 RAID 配置界面看一眼支持的 RAID 级别两分钟就能确认。2. 联想服务器进 RAID 配置界面最常见的卡点在这里很多人在这一步就被卡住了。联想 ThinkSystem 服务器默认的启动时间窗口非常短稍微手慢一点就进不了 RAID 配置界面。另外不同引导模式下进 RAID 配置的方式也不一样这个特别坑。2.1 开机自检阶段怎么进 RAID 配置界面联想 ThinkSystem 服务器开机后显示器会出现 Lenovo 的 Logo 界面这时候需要重点关注画面右上角或下方的提示信息。通常会显示类似Press CtrlH for RAID Configuration或Press F1 for Setup之类的字样。进 RAID 配置界面的具体方法开机后立刻连续按 F1 进 BIOS 设置界面在里面找到 RAID 相关的配置项。这种方式适合通过 BIOS 间接管理 RAID。开机自检时看到提示后按 CtrlH直接进入 RAID 卡的 BIOS 配置界面。这种方式适用于大部分 MegaRAID 芯片方案的联想 RAID 卡比如 530-8i / 930-8i。部分较新的联想服务器使用 UEFI 模式时进入 F1 BIOS 设置界面后在System Settings - Storage里也可以看到 RAID 卡的配置入口。实际操作中我发现一个规律默认 UEFI 引导模式下按 F1 进入 BIOS 再找 RAID 配置入口的成功率更高而传统的 Legacy 引导模式下按 CtrlH 直接进 RAID 卡 BIOS 更顺滑。如果你两种方式都试了还是进不去大概率是引导模式的问题下一节细说。2.2 Legacy 引导模式和 UEFI 引导模式对配置路径的影响联想 ThinkSystem 服务器的引导模式有 Legacy BIOS 和 UEFI 两种。这个设置直接决定了你后续所有配置的路径这一点很多教程都不会讲。Legacy 模式下RAID 卡拥有独立的 Option ROM开机自检阶段会加载 RAID 卡固件的配置程序所以你按 CtrlH 就能直接进入 RAID 配置界面。操作路径最短传统经验主义都推荐这种方式。UEFI 模式下RAID 卡的 Option ROM 默认可能被禁用RAID 卡的配置入口被集成到 UEFI 的驱动里。开机时你按 CtrlH 往往没反应必须通过 F1 进入 Setup 界面再依次进入System Settings - Storage - 对应的 RAID 控制器才能打开 RAID 配置界面。很多人在网上搜到教程说按 CtrlH结果在联想服务器上怎么按都没反应多半就是 UEFI 模式导致的。如果你是组 RAID 装 Ubuntu我建议直接改成 Legacy 模式操作最简单。但要注意如果你打算用 UEFI 方式安装 Ubuntu 并支持安全启动那还是维持 UEFI 模式然后走 BIOS 路径进 RAID 配置否则后面启动时会遇到引导问题。修改引导模式的方法是开机按 F1 进入 Setup在Boot Manager或Boot Configuration里找到Boot Mode从 UEFI 切换成 Legacy BIOS保存重启。改模式不影响硬盘数据可以放心操作。2.3 WebBIOS 配置界面各区域说明当你成功进入 RAID 卡配置界面后以 Lenovo ThinkSystem RAID 530-8i 的 WebBIOS 界面为例你会看到一个类似 BIOS 风格的图形界面。这个界面核心区域有这几个左侧是虚拟驱动器列表Virtual Drive可以理解为逻辑盘也就是操作系统看到的那块盘。右侧是物理磁盘列表Physical Drive显示机器里安装了哪些物理硬盘。顶部是功能菜单包括 Configuration Wizard配置向导、Virtual Drive Management虚拟盘管理、Physical Drive Management物理盘管理等。底部是操作区通常有 Accept、Cancel、Initialize、FastPath 等按钮。我没法贴截图上来但你可以把这个界面想象成一个浅蓝色的全屏程序用方向键操作回车确认ESC 返回上一级。关键选项基本都集中在Configuration Wizard里下一节详细讲。3. 联想服务器 RAID 配置完整实操530-8i / 930-8i 为例这一节直接进入实操。我会按照从开机到配置完成的完整顺序走一遍你手头有机器的话可以跟着点没有的话也能完整理解整个过程。3.1 创建 RAID 0 / RAID 1 的详细步骤开机按 CtrlH 进入 WebBIOS 主界面后选择Configuration Wizard回车确认。这里会出现三个选项Clear Configuration清空现有配置、New Configuration全新配置、Add Configuration在保留现有配置的基础上添加新阵列。如果是第一次配置或想重配建议选 New Configuration。这里要提醒一下New Configuration 会清掉所有已有阵列配置操作前务必确认盘上没有需要保留的数据。进入配置向导后选择Manual Configuration手动配置而不是Automatic Configuration。为什么自动配置会把所有识别到的硬盘一次性全部添加到阵列里选择权很少。手动配置可以自由选择哪些盘组阵列更符合精细化管理的需求。Manual 模式下左侧会列出所有物理硬盘。你要用方向键高亮需要的硬盘然后按 F2 或选择Add to Array把它加到右边的硬盘组里。RAID 1 的操作选择两块容量相同或接近的硬盘添加到同一个磁盘组Drive Group。然后选择该磁盘组进入Virtual Drive Definition界面RAID Level 下拉框里选择 RAID 1。虚拟盘名称可以自定义比如 System。初始化方式推荐选择Fast Init因为完全初始化一块大容量的盘要等太久了快速初始化几秒钟就能完成。最后 Accept 保存配置即可。RAID 0 的操作流程完全一样只是在 RAID Level 里选择 RAID 0硬盘选择至少两块。配置完成后回到 WebBIOS 主界面你应该能看到刚才创建的虚拟驱动器。按 ESC 退出时系统会提示是否保存配置选择 Save 保存并重启服务器。到这里 RAID 1 或 RAID 0 的创建就完成了。3.2 创建 RAID 5 的详细步骤RAID 5 的创建流程跟上面类似区别在于需要至少三块硬盘以及可能要多设置一个参数。在 Manual Configuration 里选择至少三块硬盘加入磁盘组进入虚拟盘定义界面RAID Level 选择 RAID 5。这里需要注意几个参数条带大小Strip Size默认通常为 256KB。如果是数据库存储建议选择 64KB 或 128KB随机读写性能更好如果是视频存储、大文件顺序读写用默认 256KB 甚至 512KB 都可以。读取策略Read PolicyRead Ahead 适合顺序读Normal 适合随机读。拿不准就保持默认。写策略Write PolicyWrite Back回写性能好但有掉电丢数据的风险Write Through直写更安全但速度稍慢。服务器如果接了 UPS 或使用了带电池/电容的 RAID 卡建议用 Write Back。联想 530-8i 这类入门级 RAID 卡没有缓存电池为了数据安全我一般建议用 Write Through或者根据实际业务风险接受程度来取舍。初始化方式RAID 5 我建议选 Fast Init 先把虚拟盘建起来然后系统空闲时再做后台初始化。这样你不需要在配置界面干等几个小时的初始化了。RAID 5 配置完成后同样保存退出系统重启后就能看到一块逻辑盘了。3.3 创建 RAID 10 的详细步骤与驱动器组选择逻辑RAID 10 是很多人配置时最容易出错的一个级别难点在于硬盘组Drive Group的组织方式。进入 Manual Configuration 后先选择两块硬盘加入 Drive Group 0然后在这一个磁盘组里把它定义为一个 RAID 1 虚拟盘。然后不要退出继续创建新的 Drive Group 1把另外两块硬盘加入定义为另一个 RAID 1 虚拟盘。创建完成后再创建一个跨这两个 RAID 1 虚拟盘的阵列RAID Level 选择 RAID 10。但实际操作中大部分联想 RAID 卡提供了更智能的方式直接选择四块磁盘加入同一个磁盘组然后 RAID Level 选 RAID 10RAID 卡会自动把四块盘按两两镜像再条带化的方式组织。不同固件版本的 RAID 卡 WebBIOS 界面会有细微区别但核心逻辑是一致的RAID 10 最少四块盘系统会自动把盘对分成镜像组再做条带化。你只需要在 RAID Level 里选择 RAID 10其他交给 RAID 卡即可。选盘的时候有一点特别重要四块盘最好是同一型号、同一容量、同一转速。混用不同容量的盘组 RAID 10 时可用容量会按最小的盘计算且性能受限于最慢的那块盘。这个问题在 RAID 5 里同样存在。3.4 全局热备盘Hot Spare设置方法热备盘这个概念很多人刚开始不重视但生产环境里它是非常有价值的配置。它的作用是阵列里某块盘坏了之后热备盘会被自动顶替上去RAID 卡自动开始重建数据全程不需要人工干预。在 WebBIOS 主界面进入 Physical Drive 管理找到你预留的那块硬盘容量应不少于阵列中最小盘的容量最好是同型号同容量选中它并设置为全局热备盘Global Hot Spare或专用热备盘Dedicated Hot Spare。专用热备盘只服务于指定的虚拟驱动器全局热备盘可以自动接管任意阵列中故障的磁盘。我个人的建议是如果机器有富余盘位一定要配一块热备盘。尤其对于 RAID 5 这种重建时间长的阵列热备盘的存在能显著降低坏第二块盘导致全阵列数据丢失的概率。以前遇到过一台存储服务器从报警到现场更换备件花了两天热备盘在半夜就已经自动完成重建了业务几乎没受影响。4. Ubuntu 安装过程与 RAID 驱动的那些坑RAID 配置完成后进入 Ubuntu 安装阶段。这个阶段同样有不少坑尤其是驱动识别问题今天一并说清楚。4.1 引导方式与启动项设置重启服务器后插入 Ubuntu Server 安装 U 盘。这里有个关键点如果你之前把引导模式改成了 Legacy那安装 U 盘也建议用 Legacy 方式引导如果是 UEFI就用 UEFI 方式。两者的安装启动项名称不一样如果在启动菜单里看不到你的 U 盘多半是引导模式不匹配。开机按 F12 可以进入一次性启动菜单直接选择你的 U 盘启动项。联想服务器通常显示为USB Drive或UEFI: USB Device。选错了会直接进不了安装程序黑屏或提示找不到引导设备这时候别慌回到 F12 菜单换另一个启动项就行。4.2 Ubuntu 安装过程中是否识别 RAID 阵列绝大多数情况下只要 RAID 配置正确Ubuntu 安装程序会自动识别 RAID 卡创建的虚拟磁盘。因为联想 530-8i / 930-8i 等 RAID 卡在 Linux 内核里都有默认驱动megaraid_sasUbuntu 内核默认就编译了这个驱动模块所以安装时你会看到一个容量等于 RAID 虚拟盘的磁盘设备。进入分区步骤时如果看到一块未分区的磁盘容量跟你的 RAID 阵列容量一致那说明 RAID 卡工作正常可以直接进入分区操作。但如果安装界面里看不到任何磁盘或者只有物理硬盘而看不到 RAID 逻辑盘说明 RAID 驱动没有正确加载。此时有两条路可以走确认 RAID 配置是否真的保存成功重启再进 WebBIOS 看一眼虚拟盘状态。手动加载 RAID 驱动模块。在安装界面按 CtrlAltF2 进入终端执行 modprobe megaraid_sas然后切回安装界面重新扫描磁盘。对于联想 ThinkSystem 服务器搭载的绝大多数 RAID 卡megaraid_sas 驱动都能解决问题。如果你用的是新款 RAID 卡或者特定型号Ubuntu 默认内核里可能没有对应驱动那就需要从联想官网下载驱动放到 U 盘里在安装时选择Load driver手动加载。这个情况在较老的 Ubuntu 版本上更常见比如 Ubuntu 18.04 安装时遇到一些较新的 RAID 控制器就会缺驱动。建议直接用 Ubuntu 22.04 LTS 或更新的版本缺驱动的概率会小很多。4.3 安装 Ubuntu 时的分区建议与文件系统选择RAID 阵列在 Ubuntu 里看起来就是一块普通磁盘分区可以按你的需求做。但有几个建议值得记住引导分区如果是 Legacy 引导建议在磁盘头部划分一个 1MB 的 BIOS Boot Partition或者直接让安装程序自动处理。如果是 UEFI 引导需要有一个 ESPEFI System Partition分区安装程序通常会帮你创建。Swap 分区如果是机械盘阵列swap 建议单独分区如果是 SSD 阵列可以用 swap 文件。服务器内存够大的话swap 可以直接分配 32GB 左右没有太大讲究。根分区直接用 Ext4 就行这个文件系统和绝大多数应用场景兼容性最好。ZFS 或者 XFS 对于特定场景有优势但普通业务系统没必要折腾。数据盘如果 RAID 阵列是独立的数据盘比如单独建了一个 RAID 5 的逻辑盘建议在安装时先不挂载装完系统后用 parted 或 fdisk 手动分区并格式化成 XFS 或 Ext4然后配置 /etc/fstab 自动挂载。我见过新手常犯的一个错误把整个 RAID 阵列不分青红皂白全部划分给根分区后来想扩数据目录时发现空间被系统占满了非常被动。建议至少把系统盘和数据盘分开物理上分不开就逻辑上做 LVM方便后续扩展。4.4 安装完成后升级内核与 RAID 工具链系统装完别急着部署业务先把基础工具链补全。这一步很多人忽略等到 RAID 卡报警了才发现连查看阵列状态的命令都没有。安装必要的 RAID 管理工具sudo apt update sudo apt install megacli storcli -y如果 apt 源里没有 storcli可以去联想官网或 Broadcom 官网下载 StorCLI 工具。这个是命令行下查看 RAID 状态最得力的工具比进 WebBIOS 快多了。查看阵列状态sudo storcli /c0 show sudo storcli /c0 /vall show sudo storcli /c0/eall/sall show查看物理磁盘状态sudo storcli /c0/eall/sall show查看阵列重建进度sudo storcli /c0/eall/sall show rebuild这些命令在服务器日常运维里非常有用。比如怀疑某块盘有坏道可以先跑一下 storcli 看 SMART 信息再决定是不是要换盘。不用每次都重启进 RAID 卡界面省很多事。另外建议装好系统后立刻做一遍系统更新把内核和 mega raid 驱动升级到最新。有些旧内核版本对某些 RAID 卡固件的兼容性有 bug更新内核后会有明显改善。Ubuntu 22.04 上的 apt update apt upgrade 就是常规操作不用赘述。5. 装机后必做的 RAID 健康检查与常见问题排错装完系统只是第一步确认 RAID 阵列工作正常、掌握基本的排错手段才算真正交付一台可用服务器。5.1 检查 RAID 阵列状态和重建进度用 storcli 检查是最直接的方式。执行 storcli /c0 show 后会输出一大段信息重点看这几个指标RAID Level 是否正确State 是否为 OptlOptimal正常Size 是否符合预期是否有 Drive 处于 Failed 或 Rebuild 状态下面这行命令可以看更详细的状态sudo storcli /c0 /vall show all输出里会显示每个虚拟磁盘的读写策略、当前状态、是否有缓存等。正常情况下每个 VD 的 State 都应该是 Optl。如果看到 Degraded说明阵列里有一块盘挂了或掉线了需要立即处理。物理盘状态用sudo storcli /c0/eall/sall show all重点看 Firmware State正常应为 Online。如果看到 Failed、Rebuild、Offline 等状态就得注意了。Linux 系统层面也可以看看有没有相关内核日志sudo dmesg | grep -i raid sudo journalctl | grep -i megaraid -n 50通常 RAID 卡出问题会在系统日志里留下明确线索。有了 storcli 和 dmesg 两个工具一个阵列出了什么情况基本都能查清楚。5.2 常见报错和对应的排查思路问题一开机后系统进不去提示找不到启动设备排查思路先进 WebBIOS 确认 RAID 虚拟盘状态是否为 Optimal。如果虚拟盘存在且状态正常那就是引导管理器配置问题。检查 BIOS 的启动顺序确保 RAID 虚拟盘在启动项列表里且 U 盘或光盘没有排在硬盘前面。另外确认引导模式是 Legacy 还是 UEFI这个必须跟系统安装时保持一致。改完保存重启一般能解决。问题二storcli 命令找不到控制器排查思路先确认 Ubuntu 是否识别到了 RAID 卡执行 lspci | grep -i raid如果能看到一个 LSI / Broadcom / Lenovo 的 RAID 控制器说明硬件被系统识别。然后确认 megaraid_sas 驱动是否加载执行 lsmod | grep megaraid。如果驱动没有加载执行 modprobe megaraid_sas。都正常但 storcli 还是找不到控制器可能是 storcli 版本和 RAID 卡固件不兼容换个新版本的 storcli 试试。问题三RAID 5 阵列报 Degraded排查思路Degraded 意味着有物理盘掉线或出现故障。用 storcli 找出是哪块盘出了问题检查它的 Firmware State。接着在系统日志里搜一下这块盘相关的 I/O 错误。如果盘还在线但状态不好可以考虑备份数据后做磁盘巡检如果盘已经 Failed直接热插拔换新盘RAID 卡会自动开始重建。要特别注意的是如果是 RAID 5千万不要在重建完成前把另外一块盘也弄掉线否则整个阵列的数据就没了。问题四RAID 性能明显偏低排查思路先看写策略是不是被设成了 Write Through如果是改成 Write Back 会有明显提升前提是 RAID 卡有电池/电容或者你能接受极端情况下掉电丢缓存数据的风险。再看条带大小是否和业务匹配数据库场景用 64KB 或 128KB大文件存储用 256KB 或 512KB。还可以检查是不是有磁盘在后台做重建或一致性检查这会占到不少 IO 资源跑完了性能自然恢复。5.3 日常巡检建议与阵列维护经验服务器装完不是结束而是运维的开始。我自己的操作习惯是每月做一次 storcli 状态巡检记录阵列状态、物理盘健康状态。关注系统日志里的磁盘错误特别是 mpt 或 megaraid 关键字。定期查看 RAID 卡温度尤其是夏天机房空调不给力的时候RAID 卡过热会导致性能下降甚至掉盘。建议配置邮件告警。storcli 可以配合脚本监控状态异常时自动发邮件避免阵列降级了你都不知道。最简单的方式是写一个 cron 脚本每天执行 storcli 检查状态如果 State 不是 Optl 就发一封邮件给你的运维邮箱。这个巡检习惯看起来简单但真的能避免不少大事故。我见过不止一位客户阵列降级跑了一两个月没发现等到第二块盘也挂了整个阵列数据全丢才追悔莫及。所以巡检这件事再怎么强调都不过分。6. 联想服务器 Ubuntu 环境的进阶调优技巧RAID 配置完成、系统装好只是把地基打好了。如果你想这台联想服务器在实际业务里表现稳定下面这些细节值得掌握。6.1 调整 RAID 卡读写策略提升数据库场景性能前面简单提过写策略的问题这里展开讲一下。联想 530-8i 这类 RAID 卡的默认策略有时候偏保守Write Through 的随机写性能比 Write Back 差出一大截。数据库这类对随机写redo log、binlog压力很大的应用Write Through 可能成为明显的性能瓶颈。怎么改进 RAID 卡的 WebBIOS 界面找到对应的 Virtual Drive在属性里把 Write Policy 从 Write Through 改成 Write Back。保存后重启系统生效。但这里有一个前提Write Back 意味着数据先写入 RAID 卡缓存再异步写回磁盘速度快但如果中途突然断电且 RAID 卡自身没有电池/电容保护缓存里的数据可能丢失。所以如果你给服务器配了 UPS或者 RAID 卡本身带电池用 Write Back 是完全合理的。如果没有 UPS 也没有电池我会建议还是 Write Through安全优先别为了性能赌数据安全。6.2 针对 SSD 阵列的优化参数如果你用的是 SSD 组阵列有些参数值得注意。RAID 卡上的 SSD 通常不需要开启 Read Ahead预读因为 SSD 随机读本身就很快预读反而可能浪费带宽。另外SSD 阵列在创建虚拟盘时部分 RAID 卡提供了 SSD 专用优化选项比如开启 FastPath 或设置固态硬盘专用缓存策略。如果 WebBIOS 里能看到类似选项可以打开。对数据库这类随机小 IO 密集的场景来说提升明显。Trim 命令这里要单独说硬件 RAID 卡阵列里的 SSDRAID 卡未必会把 TRIM 命令透传给各物理盘。也就是说你在系统里对虚拟盘执行 fstrim物理盘可能根本没有收到。HP 和联想的一些较新 RAID 卡支持 SSD TRIM 透传但不是所有型号都支持。如果你的 Ubuntu 用了 ext4 或 xfs 文件系统并且希望 SSD 能被正常回收块建议先确认 RAID 卡的规格是否支持。如果确认不支持也别太纠结RAID 阵列的容量管理和寿命跟单盘使用还是不太一样的定期监控物理盘寿命即可。6.3 联想 XClarity Controller 联动通过 IPMI 查看 RAID 状态联想 ThinkSystem 服务器板载了 XClarity ControllerXCC相当于服务器带外管理系统支持远程管理、远程开关机、传感器监控等。这个是我认为联想服务器特别好用的功能也是装机运维时非常值得利用的利器。XCC 有一个独立的 IP 地址和 Web 管理界面即使操作系统挂了、服务器进不了系统你照样可以远程看 RAID 卡状态、看报警信息、甚至远程挂载镜像重装系统。配置方法开机按 F1 进 Setup找到 BMC 配置通常在BMC Network Configuration里设置固定 IP。保存重启后浏览器打开这个 IP 就能进入 XCC 管理界面默认账号密码印在服务器机箱的标签上首次登录后记得改掉。在 XCC 里可以查看 RAID 控制器的健康状态、物理盘状态、系统温度、风扇转速等信息。有些型号的 XCC 还支持事件日志导出RAID 卡有报警时会在 XCC 的事件日志里看到痕迹。这个功能对于无人值守机房的服务器来说非常重要——就算你人不在现场也能第一时间感知到服务器硬件异常。我自己管理远程服务器是习惯性把 XCC 接入专门的带外管理网段设置好邮件告警。这样阵列只要一降级XCC 的告警邮件马上就到不用等用户那边发现系统出问题了才来找你。6.4 系统层面的开机自动检查和告警最后再分享一个很实用的技巧在 Ubuntu 里配置开机自动检查 RAID 状态并记录日志。写一个简单的 systemd service 或者直接在 rc.local 里加上 storcli 状态查询每次开机自动把 RAID 状态输出到 /var/log/raid-status.log。这样你在日常巡检或者排查问题时即使系统已经重启过很多次也能找到开机当时的阵列状态快照。示例脚本非常简单#!/bin/bash # /usr/local/bin/raid-status-check.sh echo RAID Status $(date) /var/log/raid-status.log /usr/sbin/storcli /c0 show /var/log/raid-status.log 21 /usr/sbin/storcli /c0/eall/sall show /var/log/raid-status.log 21配一个 cron 定时任务0 6 * * * /usr/local/bin/raid-status-check.sh每天凌晨 6 点自动记录一次。这不会花多少资源但长期积累的数据对分析磁盘健康趋势很有价值。不小心布局一个脚本占用的时间很少但关键时刻能救命的。7. 写在最后的实践体会这次给联想 ThinkSystem SR650 装 Ubuntu 的经历让我最深的感受是RAID 配置本身并不复杂真正的复杂度在于你得理解每个级别背后的取舍还得熟悉联想服务器特有的配置路径。只要把引导模式确认好、进 WebBIOS 的时机把握好创建 RAID 阵列、装 Ubuntu 系统整个过程完全可以一次性走通。如果你现在手头就有一台联想服务器要装我给你的建议是先花十分钟搞清楚机器上的硬盘数量和你要跑的业务的可靠性要求再决定 RAID 级别。建议的默认选择是 RAID 1系统盘加 RAID 5数据盘这套方案在绝大多数中小心业务场景里都很稳。如果你的业务是数据库这类写入频繁的核心系统且预算允许加盘RAID 10 会是更让人省心的选择。安装完系统之后记得养成定期用 storcli 巡检阵列状态的习惯。同时把 XCC 带外管理的告警配置好。这两件事做好一台服务器后续运维的省心程度会出现很大的差别。希望这篇联想服务器 Ubuntu 装机的全流程干货能帮你少走几次弯路。如果你在实际配置中遇到什么奇怪的问题或者有更好的经验欢迎在评论区跟我交流。

相关推荐

OpenClaw部署离不开Git:源码与Docker两条路径的实操详解
OpenClaw部署离不开Git:源码与Docker两条路径的实操详解

把 OpenClaw 的部署文档打开,第一行指令大概率就是git clone ...。很多人觉得 Git 这一步能有什么问题,但我在实际部署时发现,真正卡住人的恰恰是这一层——不是 clone 不下来,就是 clone 下来后不知道切到哪个分支;还… · 2026/9/24 18:34:56

移动端安全边距适配完全指南:从iPhone X到Android全面屏
移动端安全边距适配完全指南:从iPhone X到Android全面屏

做移动端开发的人,应该都对“移动端安全边距”这个词不陌生。从 iPhone X 那一年开始,手机屏幕就不再是一块简简单单的长方形:上面有刘海,下面有一条横着的小白条,四个角落还是大圆角。页面做得再好看,如果… · 2026/9/24 18:34:49

华为16700交换机端口镜像原理与配置实战
华为16700交换机端口镜像原理与配置实战

1. 为什么要在核心交换机上做端口镜像1.1 端口镜像到底解决了什么问题做网络运维的人,迟早会碰到这样一个需求:业务部门反馈某个应用特别慢,或者安全团队怀疑内网有异常流量,这时候你手里没有专业的流量分析设备,也没法… · 2026/9/24 18:34:49

Unity Addressables 异步操作句柄详解:加载、释放与内存管理实践
Unity Addressables 异步操作句柄详解:加载、释放与内存管理实践

从 AssetBundle 时代靠手写加载流程、自己维护依赖树和引用计数,到切到 Addressables 之后只需要对着一个异步句柄操作,这个过渡期最容易让人懵掉的就是“Handle”到底是个什么东西。AssetBundle 那套逻辑里,我们习惯了“先加载 bundle&#… · 2026/9/24 19:07:53

地面油污水渍检测数据集:2093张图与2563个框的YOLO训练实战
地面油污水渍检测数据集:2093张图与2563个框的YOLO训练实战

简介:这份目标检测数据集面向环境监控、工业现场安全检测方向的研究者与算法工程师,聚焦地面油污水渍的识别与定位任务。数据包共2000个文件,以1999个VOC格式xml标注文件和1个说明txt为主,压缩包约70.05MB,图片为jpg格… · 2026/9/24 19:07:53

蓝牙耳机排行榜水太深?拆解六大品牌与选购避坑指南
蓝牙耳机排行榜水太深?拆解六大品牌与选购避坑指南

排行榜这东西,我劝你别只看名次。尤其是“蓝牙耳机排行榜10强”这类标题,隔三差五就刷屏一次,点进去要么是电商销量汇总,要么是小编按自己的喜好排的。真正的问题在于:销量高和口碑好,很多时候是两拨不同的… · 2026/9/24 19:07:53

XSS攻击原理与防御:从信任边界到三层防护体系
XSS攻击原理与防御:从信任边界到三层防护体系

1. XSS 攻击的本质:这不是一个注入问题,而是一个信任边界问题做前端这几年,我见过太多把 XSS 当"小事"的团队。问起来都是"我们做了输入过滤呀",结果呢?攻击者在 URL 参数里塞一段 payload&#x… · 2026/9/24 19:07:53

全色影像水体提取:阈值分割实战指南与精度验证
全色影像水体提取:阈值分割实战指南与精度验证

简介:这份资源面向遥感图像处理、地理信息系统与环境监测方向的初学者和工程实践者,聚焦如何利用阈值分割技术从全色影像中快速识别并提取水体区域。全色影像空间分辨率高、地表细节丰富,是水体检测的重要数据源,而阈值分割作为最… · 2026/9/24 19:07:53

彻底卸载流氓软件:从识别、清理到卡顿优化全攻略
彻底卸载流氓软件:从识别、清理到卡顿优化全攻略

弄电脑这些年,我见过太多人因为"卸不干净"而重装系统,也有人愁眉苦脸地问"怎么我装了杀毒软件电脑还这么卡"——结果我过去一看,系统里躺着七八个全家桶软件,光启动项就有十几个,能不卡吗。今天这… · 2026/9/24 19:07:46

基于YOLOv8的渔船作业监控系统:从环境搭建到边缘部署全流程
基于YOLOv8的渔船作业监控系统:从环境搭建到边缘部署全流程

简介:这是一套面向计算机、人工智能、自动化等专业学生与教师的毕业设计级项目资源,围绕YOLOv8实现渔船作业监控系统,可用于毕设、课程设计、大作业或项目立项演示。压缩包共97个文件,约24.21MB,以70个Python源码文件为… · 2026/9/24 0:00:13

1D-CNN时间序列建模实战:从Conv1d原理到工业落地
1D-CNN时间序列建模实战:从Conv1d原理到工业落地

简介:面向时间序列数据建模的一维卷积神经网络完整实现,适合深度学习入门者及需要快速验证时序模型的研究者,能够从音频、文本、传感器或股价等序列中挖掘局部特征与时间依赖。压缩包体积很小,只有3KB,内含3个Python脚… · 2026/9/24 0:00:26

柔软的L:汉语语流中被忽视的舌肌张力控制
柔软的L:汉语语流中被忽视的舌肌张力控制

1. 这个“L”不是字母表里的L,而是舌尖上的L最近在几个方言群和语音教学社群里,反复看到有人发一句:“也说字母L:柔软的长舌”。初看以为是英语发音课笔记,点开才发现全是方言爱好者、播音系学生、语言康复师甚至戏曲演… · 2026/9/24 0:00:44

了解更多?预约专属演示

我们的顾问将为您一对一讲解产品与方案

企业微信二维码