Icon Icon Icon

Tin Tức

Những lỗi thường gặp khi sử dụng Máy chủ HPE ProLiant DL360 Gen11

14 03/09/2026

Máy chủ HPE ProLiant DL360 Gen11 được trang bị hệ thống giám sát phần cứng, Integrated Management Log, Active Health System và nền tảng quản trị HPE iLO 6. Tuy nhiên, trong quá trình triển khai và vận hành, quản trị viên vẫn có thể gặp các sự cố liên quan đến nguồn, quá trình POST và boot, RAM, storage, RAID, nhiệt độ, network hoặc iLO.

Khi DL360 Gen11 xuất hiện cảnh báo, không nên bắt đầu bằng việc tháo linh kiện và thay thử từng thành phần. HPE khuyến nghị thu thập thông tin triệu chứng, IML, POST error, log hệ điều hành và Active Health System Log trước khi thay đổi cấu hình phần cứng.

Bài viết dưới đây tổng hợp những lỗi thường gặp khi sử dụng Máy chủ HPE ProLiant DL360 Gen11 và trình tự kiểm tra giúp đội IT khoanh vùng nguyên nhân hiệu quả hơn.

Dấu hiệu nào cho thấy HPE DL360 Gen11 đang gặp sự cố?

Những lỗi thường gặp khi sử dụng Máy chủ HPE ProLiant DL360 Gen11
Lỗi thường gặp trên DL360 Gen11 và cách xử lý. Hướng dẫn sử dụng Máy chủ HPE ProLiant DL360 Gen11 đúng cách

Không phải lỗi nào cũng khiến server dừng hoạt động ngay. Một DIMM có lỗi ECC, một drive trong RAID bị degraded hoặc fan hoạt động không đúng có thể xuất hiện dưới dạng cảnh báo trước khi ảnh hưởng nghiêm trọng đến hệ thống.

Một số dấu hiệu thường cần kiểm tra gồm:

Dấu hiệuNhóm cần kiểm tra
Server hoàn toàn không lên nguồnAC, PDU, dây nguồn, PSU, power allocation
Server lên nguồn nhưng không hoàn thành POSTRAM, firmware, PCIe, system board
Server POST nhưng không boot OSBoot order, logical drive, controller, firmware
Dung lượng RAM nhận thiếuDIMM, memory population, CPU tương ứng
RAM báo ECC hoặc cảnh báo màu vàngDIMM hoặc System ROM
Ổ đĩa báo lỗiDrive, backplane, cable, controller
RAID degradedThành viên array, drive hoặc controller
Fan chạy mạnh bất thườngFan, airflow, nhiệt độ, cấu hình cooling
Health LED màu amber hoặc đỏKiểm tra IML/iLO để xác định thành phần
NIC không có linkCable, switch, driver, adapter
Không truy cập được iLO 6IP/VLAN, management port, Shared Network Port hoặc iLO
Server chậm bất thườngStorage, RAID recovery, dung lượng ổ hoặc workload

Trên các hệ thống HPE ProLiant Gen11, Health LED nhấp nháy màu amber thể hiện hệ thống đang ở trạng thái degraded; nhấp nháy đỏ thể hiện trạng thái critical. LED chỉ giúp xác định mức độ cảnh báo, còn nguyên nhân cụ thể nên được kiểm tra trong iLO và IML.

Quy trình kiểm tra HPE DL360 Gen11 trước khi thay linh kiện

Quy trình kiểm tra lỗi HPE ProLiant DL360 Gen11
Quy trình kiểm tra những lỗi thường gặp khi sử dụng DL360 Gen11. Doanh nghiệp có nên nâng cấp lên máy chủ HPE Proliant DL360 Gen12

Khi server xuất hiện lỗi, nên kiểm tra theo thứ tự:

LED → POST → iLO → IML → AHS Log → thay đổi gần nhất → phần cứng liên quan.

HPE khuyến nghị thu thập Active Health System Log trước khi thay đổi cấu hình. Khi server vẫn hoạt động, quản trị viên có thể kiểm tra thêm thông tin tại Overview, System Information và Diagnostics trong iLO.

Quy trình thực tế có thể thực hiện như sau:

  1. Kiểm tra Health LED, Power LED, NIC LED và LED trên ổ đĩa.
  2. Ghi lại toàn bộ thông báo POST.
  3. Đăng nhập HPE iLO 6.
  4. Kiểm tra Integrated Management Log.
  5. Kiểm tra trạng thái CPU, DIMM, storage, PSU, fan và nhiệt độ.
  6. Tải Active Health System Log.
  7. Xác định server có vừa nâng RAM, thay drive, lắp NIC, cập nhật firmware hoặc thay đổi BIOS hay không.
  8. Chỉ bắt đầu reseat hoặc thay linh kiện sau khi đã xác định được nhóm nghi vấn.

Cách này giúp tránh việc thay đổi quá nhiều yếu tố cùng lúc khiến nguyên nhân ban đầu khó xác định hơn.

HPE DL360 Gen11 không lên nguồn

Dấu hiệu

Server không phản hồi khi nhấn nút Power On/Standby hoặc không bắt đầu quá trình khởi động.

Nguyên nhân nên kiểm tra

Theo tài liệu troubleshooting của HPE, nguyên nhân có thể bao gồm:

  • dây nguồn hoặc thành phần chưa kết nối đúng;
  • ổ điện hoặc PDU không hoạt động;
  • dây nguồn gặp lỗi;
  • circuit breaker đang tắt;
  • điện áp đầu vào không đủ;
  • nguồn điện được phân bổ cho server không đủ.

Cách kiểm tra

Trước tiên kiểm tra Power LED trên từng PSU.

Sau đó kiểm tra theo đường:

Nguồn AC → PDU/UPS → dây nguồn → PSU → server

Có thể thử dây nguồn hoặc outlet đã xác nhận hoạt động để loại trừ lỗi từ hạ tầng điện.

Nếu vừa bổ sung CPU, GPU, nhiều DIMM, ổ đĩa hoặc card PCIe, cần kiểm tra lại công suất PSU và power budget của toàn bộ cấu hình.

DL360 Gen11 lên nguồn nhưng không boot được

Cần phân biệt hai trường hợp:

Không hoàn thành POSThoàn thành POST nhưng không tìm thấy hệ điều hành.

Đây là hai hướng troubleshooting khác nhau.

Khi server không hoàn thành POST

Kiểm tra:

  • POST error;
  • Health LED;
  • IML;
  • DIMM;
  • card PCIe mới lắp;
  • storage controller;
  • firmware;
  • thay đổi phần cứng gần nhất.

Nếu lỗi xuất hiện ngay sau khi nâng RAM, thay NIC hoặc bổ sung controller, hãy ưu tiên kiểm tra thay đổi đó trước.

Khi POST thành công nhưng OS không boot

HPE liệt kê một số nguyên nhân gồm:

  • logical drive chưa được cấu hình;
  • controller boot order không đúng;
  • chưa chọn đúng boot logical drive;
  • firmware không hợp lệ hoặc bị lỗi;
  • System ROM gặp vấn đề.

Có thể kiểm tra:

F9 → UEFI System Utilities → Boot Options

và kiểm tra controller/storage bằng công cụ phù hợp.

Không nên cài lại hệ điều hành ngay khi chưa xác nhận logical drive và boot order. Nếu storage vẫn hoạt động bình thường nhưng thứ tự boot bị thay đổi, việc cài lại OS không giải quyết nguyên nhân gốc.

DL360 Gen11 không nhận đủ RAM hoặc báo lỗi DIMM

RAM là một trong những nhóm cần kiểm tra đầu tiên khi server:

  • nhận thiếu dung lượng;
  • báo lỗi trong POST;
  • Health LED chuyển trạng thái;
  • xuất hiện ECC warning;
  • hoạt động không ổn định sau khi nâng RAM.

Vì sao RAM mới lắp không được nhận?

HPE liệt kê các khả năng gồm:

  • DIMM không được server hỗ trợ;
  • memory population không đúng;
  • vượt giới hạn bộ nhớ;
  • DIMM chưa được lắp đúng;
  • xảy ra xung đột với cấu hình memory hiện có.

DL360 Gen11 là nền tảng sử dụng DDR5 và cách bố trí DIMM phụ thuộc processor cũng như quy tắc population. Vì vậy không nên chỉ kiểm tra tổng dung lượng RAM mà bỏ qua vị trí DIMM và CPU tương ứng.

Ổ đĩa báo lỗi hoặc RAID bị degraded

Đây là nhóm lỗi cần ưu tiên xử lý vì liên quan trực tiếp tới dữ liệu.

Các thành phần cần kiểm tra không chỉ gồm ổ đĩa mà còn có:

  • storage controller;
  • backplane;
  • cable;
  • firmware controller;
  • firmware drive;
  • cấu hình RAID.

HPE hướng dẫn khi drive báo failed cần kiểm tra kết nối, firmware của controller/HBA/backplane/System ROM, cable và tình trạng drive trong HPE Smart Storage Administrator.

Khi một ổ trong RAID bị lỗi

Thứ tự xử lý nên là:

Xác định đúng drive → kiểm tra RAID state → xác nhận backup → kiểm tra controller → chuẩn bị drive thay thế → rebuild → theo dõi

Không nên rút ổ chỉ dựa trên vị trí suy đoán.

Cần xác nhận chính xác:

  • bay number;
  • serial;
  • drive state;
  • logical drive;
  • array;
  • RAID level.

Với HPE SR controller có thể sử dụng HPE Smart Storage Administrator. Với HPE MR controller, HPE cung cấp HPE MR Storage Administrator và event log tương ứng. iLO cũng có khả năng giám sát controller và ghi failure event vào IML.

RAID degraded có tiếp tục chạy được không?

Điều này phụ thuộc RAID level và số lượng drive lỗi.

Một array đang degraded không đồng nghĩa dữ liệu đã mất, nhưng redundancy có thể đã giảm. Vì vậy không nên coi trạng thái degraded là trạng thái vận hành bình thường.

Trước khi thay ổ cần kiểm tra backup và xác định chắc chắn drive lỗi.

DL360 Gen11 quạt chạy mạnh hoặc báo nhiệt độ cao

DL360 Gen11 sử dụng chassis rack 1U nên airflow và cấu hình cooling đặc biệt quan trọng.

Quạt chạy nhanh không phải lúc nào cũng có nghĩa fan bị hỏng. Hệ thống có thể tăng tốc quạt khi nhiệt độ hoặc cấu hình phần cứng yêu cầu mức cooling cao hơn.

Khi nào cần kiểm tra?

Nếu xuất hiện:

  • Health warning;
  • fan warning;
  • temperature warning;
  • quạt duy trì tốc độ cao bất thường;
  • server shutdown liên quan nhiệt độ;
  • IML ghi nhận thermal event.

HPE nêu các nguyên nhân có thể dẫn đến critical temperature gồm:

  • fan chưa được seating đúng;
  • cấu hình fan không đáp ứng yêu cầu;
  • server không được thông gió đúng;
  • thiếu fan bắt buộc;
  • thiếu fan blank;
  • một hoặc nhiều fan không hoạt động.

Cách xử lý

Kiểm tra lần lượt:

Nhiệt độ phòng → airflow rack → mặt trước/sau server → fan → fan blank → heatsink/cooling requirement → IML

Nếu vấn đề xuất hiện sau khi nâng CPU, DIMM, NIC tốc độ cao hoặc các option khác, cần đối chiếu lại BOM với yêu cầu cooling của HPE.

QuickSpecs DL360 Gen11 có những giới hạn cấu hình liên quan tới CPU, DIMM dung lượng cao, network adapter và loại fan/cooling. Vì vậy không nên mặc định mọi option được hỗ trợ riêng lẻ đều có thể kết hợp tùy ý trong cùng một server.

Card mạng không hoạt động hoặc mất kết nối

Nếu NIC không có link hoặc kết nối mạng ngừng hoạt động, trước tiên cần xác định lỗi nằm ở:

NIC → driver → cable/DAC/transceiver → switch → VLAN/network configuration

HPE khuyến nghị kiểm tra LED trên controller, driver, kết nối vật lý, cable và tình trạng của network adapter khi controller ngừng hoạt động.

Nếu lỗi bắt đầu sau khi thêm expansion card, cũng cần kiểm tra compatibility và PCIe configuration.

Không truy cập được HPE iLO 6

Nhóm lỗi phần cứng HPE DL360 Gen11
Các nhóm lỗi nguồn RAM RAID nhiệt độ network và iLO trên HPE DL360 Gen11. Ưu nhược điểm của Máy chủ HPE ProLiant DL360 Gen11 là gì? có đáng đầu tư ở hiện tại

HPE iLO 6 là thành phần rất quan trọng khi troubleshooting DL360 Gen11 vì cho phép kiểm tra trạng thái server ngay cả khi hệ điều hành gặp vấn đề.

HPE có tài liệu troubleshooting riêng cho nhiều tình huống như:

  • không mở được trang đăng nhập;
  • không truy cập được IP iLO;
  • lỗi sau khi thay đổi network setting;
  • kết nối lỗi sau firmware update;
  • lỗi authentication;
  • iLO không phản hồi.

HPE khuyến nghị sử dụng Dedicated Management Network cho iLO. Shared Network Port có thể có một số giới hạn và trong lúc server startup hoặc NIC driver được load/unload, kết nối iLO có thể bị gián đoạn trong thời gian ngắn.

Nếu iLO không phản hồi với browser nhưng hệ thống vẫn hoạt động, HPE iLO Diagnostics có chức năng reset iLO. Reset iLO sẽ kết thúc các phiên kết nối đang hoạt động nhưng không thay đổi cấu hình iLO.

Không nên factory reset iLO ngay từ bước đầu vì thao tác này khác với việc reboot/reset iLO thông thường.

Khi nào nên cập nhật firmware?

Firmware là một phần quan trọng của troubleshooting HPE Gen11. HPE cho biết nhiều vấn đề phổ biến có thể được xử lý thông qua firmware update và cung cấp các phương án như Service Pack for ProLiant hoặc firmware riêng từ HPE Support Center.

Tuy nhiên, không nên áp dụng nguyên tắc:

Có lỗi → cập nhật tất cả firmware ngay.

Đối với production server, quy trình phù hợp hơn là:

Thu thập log → xác định component → kiểm tra advisory/release note → backup → lập maintenance window → update → kiểm tra lại

Đặc biệt cần lưu ý dependencies giữa System ROM, iLO, storage controller, NIC, drive firmware, driver và hypervisor/OS.

Những lỗi vận hành nào có thể phòng ngừa từ đầu?

Không thể loại bỏ hoàn toàn lỗi phần cứng, nhưng có thể giảm đáng kể rủi ro vận hành bằng cách chuẩn hóa hệ thống ngay từ lúc triển khai.

Doanh nghiệp nên duy trì:

  • monitoring qua iLO;
  • cảnh báo IML;
  • backup và kiểm thử restore;
  • kiểm tra RAID;
  • kiểm tra drive health;
  • giám sát nhiệt độ;
  • kiểm tra PSU và fan;
  • quản lý firmware/driver;
  • tài liệu BOM;
  • sơ đồ RAM và storage;
  • thông tin serial của linh kiện;
  • change log;
  • maintenance window;
  • management network riêng cho iLO khi phù hợp.

Đặc biệt, nên tải Active Health System Log trước những lần can thiệp lớn để lưu lại trạng thái hệ thống.

Checklist troubleshooting HPE DL360 Gen11

Checklist phòng ngừa lỗi máy chủ HPE ProLiant DL360 Gen11
Checklist phòng ngừa lỗi DL360 Gen11

Khi có sự cố, đội IT có thể sử dụng trình tự sau:

Xác định triệu chứng
Server mất nguồn, không POST, không boot, mất RAM, lỗi storage, nhiệt độ hay network?

Kiểm tra LED
Health, Power, NIC, drive và PSU.

Đọc POST error

Không bỏ qua mã lỗi hoặc warning trong quá trình khởi động.

Kiểm tra iLO 6

Xem server health, component status và Diagnostics.

Kiểm tra Integrated Management Log

Xác định thời điểm và thành phần xảy ra lỗi.

Tải Active Health System Log

Thực hiện trước khi thay đổi nhiều thành phần.

Kiểm tra thay đổi gần nhất

RAM, drive, NIC, PCIe, firmware, BIOS, OS hoặc network.

Khoanh vùng thành phần

Không thay nhiều linh kiện cùng lúc.

Kiểm tra compatibility

Đặc biệt với RAM, CPU, controller, NIC, riser, drive và cooling.

Sau khi xử lý

Xác nhận IML, Health Status, RAID, nhiệt độ, network và workload trở lại bình thường.

NSTECH hỗ trợ kiểm tra và cấu hình HPE ProLiant DL360 Gen11

Khi máy chủ HPE ProLiant DL360 Gen11 gặp lỗi, việc thay linh kiện ngay không phải lúc nào cũng là hướng xử lý phù hợp. Một cảnh báo RAM có thể liên quan đến cách population hoặc firmware; lỗi storage có thể đến từ drive, controller, backplane hoặc cable; tình trạng quạt chạy mạnh có thể liên quan tới cấu hình cooling thay vì bản thân fan.

Doanh nghiệp nên bắt đầu bằng việc kiểm tra LED, POST, iLO 6, IML và Active Health System Log để xác định đúng nhóm lỗi.

Nếu hệ thống DL360 Gen11 đang gặp cảnh báo phần cứng, cần nâng RAM, thay ổ đĩa, cấu hình RAID, nâng cấp NIC hoặc kiểm tra lại BOM, doanh nghiệp có thể gửi cấu hình hiện tại, ảnh cảnh báo và log cho NSTECH để được hỗ trợ xác định phương án xử lý và linh kiện phù hợp.

NSTECH – CÔNG TY CỔ PHẦN NSTECH VIỆT NAM
Website: https://nstech.vn/
Hotline: 09 3333 5554
Email: ducnh@nstech.vn
Văn Phòng TPHCM: 419/2N Phan Xích Long, Phường Đức Nhuận, Tp.Hồ Chí Minh
Văn Phòng Hà Nội: Tầng 6 Số 95 Phố Hoàng Cầu, Phường Đống Đa, Thành phố Hà Nội
Văn Phòng Đà Nẵng: Số 36 đường Nguyễn Cư Trinh, Phường Hòa Cường, TP Đà Nẵng
Văn Phòng Quảng Ngãi: Số 02 Võ Thị Sáu, Phường Cẩm Thành, TP Quảng Ngãi

CHIA SẺ BÀI VIẾT

Icon Icon Icon
Gửi Liên Hệ (24/24h)
Chat Facebook (8h-24h)
Chat Zalo (8h-24h)
0933335554 (8h-24h)

Yêu Cầu Báo Giá

Họ và tên*

Số điện thoại*

Email*

Ghi chú

Đã gửi thành công!