SSD cũ có nên mua không? Đọc SMART, TBW và kiểm tra sức khỏe ổ
Mua một chiếc ổ cứng SSD cũ là giải pháp kinh tế tuyệt vời giúp bạn tối ưu chi phí khi nâng cấp máy tính, nâng cao tốc độ khởi động và truyền tải dữ liệu. Tuy nhiên, linh kiện lưu trữ đã qua sử dụng luôn tiềm ẩn nhiều rủi ro về độ hao mòn vật lý của chip nhớ và nguy cơ mất mát dữ liệu đột ngột. Để đưa ra quyết định mua sắm sáng suốt, bạn cần giải mã được các thông số kỹ thuật cốt lõi về độ bền, nhật ký sức khỏe hệ thống SMART và các công cụ tự chẩn đoán lỗi ổ đĩa.
Mục lục bài viết1. Hiểu về độ bền SSD theo phân khúc và chỉ số TBW2. Giải mã nhật ký sức khỏe NVMe qua các thông số SMART3. Kích hoạt tính năng tự kiểm tra lỗi ổ đĩa (Device Self-test)4. Những lưu ý cuối cùng khi mua SSD cũ
1. Hiểu về độ bền SSD theo phân khúc và chỉ số TBW
Khi cân nhắc mua SSD cũ, yếu tố đầu tiên bạn cần đánh giá là tuổi thọ thiết kế của ổ đĩa dựa trên các tiêu chuẩn công nghiệp quốc tế. Theo tiêu chuẩn JEDEC JESD218 và JESD219, độ bền của ổ SSD được phân chia rõ rệt thành hai phân khúc ứng dụng: Client (người dùng cá nhân) và Enterprise (doanh nghiệp).
Để định lượng độ bền này, tiêu chuẩn đưa ra chỉ số TBW (Terabytes Written), đại diện cho lượng dữ liệu tối đa tính bằng Terabyte mà máy chủ có thể ghi lên ổ cứng trong suốt vòng đời của nó. Một chiếc ổ SSD đạt chuẩn TBW của JEDEC phải đảm bảo đồng thời 4 điều kiện kỹ thuật nghiêm ngặt:
- Duy trì đúng dung lượng lưu trữ quảng cáo được công bố.
- Duy trì tỷ lệ lỗi bit không thể khôi phục (UBER) theo đúng yêu cầu của từng phân khúc.
- Đáp ứng yêu cầu về tỷ lệ lỗi chức năng hoạt động (FFR).
Đáp ứng thời hạn bảo toàn dữ liệu an toàn khi ổ đĩa hoàn toàn không cắm điện (Data Retention).
Mỗi phân khúc sẽ có các thông số kỹ thuật và điều kiện vận hành rất khác nhau mà bạn cần lưu ý:
- Phân khúc Client: Được thiết kế cho môi trường máy tính cá nhân hoạt động trung bình 8 giờ/ngày ở nhiệt độ hoạt động 40°C. Khi không cắm điện, ổ đĩa phải bảo toàn dữ liệu an toàn ở nhiệt độ 30°C trong thời gian tối thiểu là 1 năm. Tỷ lệ lỗi chức năng FFR bắt buộc phải nhỏ hơn hoặc bằng 3% và tỷ lệ lỗi bit UBER tối đa là 10⁻¹⁵.
Phân khúc Enterprise: Thiết kế riêng cho môi trường máy chủ chạy liên tục 24 giờ/ngày ở nhiệt độ hoạt động cao 55°C. Khi tắt nguồn điện, ổ đĩa chỉ cần giữ an toàn dữ liệu ở nhiệt độ 40°C trong thời gian 3 tháng. Tỷ lệ lỗi chức năng FFR vẫn ở mức dưới hoặc bằng 3% nhưng tỷ lệ lỗi bit UBER được thắt chặt hơn, chỉ được phép tối đa là 10⁻¹⁶.
Lưu ý: Các tài liệu kỹ thuật tiêu chuẩn không quy định mức giá bán cũ cụ thể cho từng dung lượng ổ đĩa hay thương hiệu nào có tỷ lệ hỏng hóc thực tế thấp nhất tại thị trường Việt Nam. Người mua cần tự tra cứu giá cả và kiểm tra nguồn gốc xuất xứ của chiếc SSD cũ định mua để tránh hàng nhái, hàng kém chất lượng.
2. Giải mã nhật ký sức khỏe NVMe qua các thông số SMART
Nếu bạn lựa chọn mua một chiếc SSD cũ sử dụng giao thức NVMe, việc đọc hiểu trang dữ liệu nhật ký chẩn đoán lỗi SMART là vô cùng quan trọng. Hệ điều hành Windows hỗ trợ truy vấn trực tiếp trang nhật ký này thông qua cấu trúc dữ liệu NVME_HEALTH_INFO_LOG. Cấu trúc này lưu trữ toàn bộ lịch sử chẩn đoán lỗi và các chỉ số sức khỏe tích lũy của bộ điều khiển, vốn được lưu giữ xuyên suốt qua các chu kỳ tắt bật nguồn.

Kiểm tra chỉ số SMART trực quan thông qua CrystalDiskInfo
Khi chạy các công cụ đọc thông tin ổ đĩa, bạn hãy đối chiếu kỹ các trường thông tin cốt lõi sau:
- Percentage Used (Phần trăm tuổi thọ đã dùng): Đây là chỉ số ước tính mức độ hao mòn vật lý của ổ đĩa dựa trên thực tế sử dụng và dự báo tuổi thọ từ nhà sản xuất. Chỉ số này được cập nhật định kỳ mỗi giờ hoạt động một lần (khi ổ đĩa không ở trạng thái ngủ). Đặc biệt, Percentage Used được phép vượt quá mức 100% khi ổ đã chạy quá tuổi thọ dự kiến mà chưa hỏng. Mọi giá trị hao mòn lớn hơn 254 sẽ được hiển thị mặc định là 255.
- Critical Warning (Cảnh báo nghiêm trọng): Lưu trữ các cờ báo động 1-bit phản ánh trạng thái nguy hiểm hiện thời của thiết bị. Bạn cần đảm bảo các cờ này đều bằng 0. Nếu AvailableSpaceLow bằng 1, dung lượng ô nhớ dự phòng đã tụt xuống dưới ngưỡng an toàn. Nếu ReadOnly bằng 1, ổ đã bị khóa ở chế độ chỉ đọc để bảo vệ dữ liệu. Nếu ReliabilityDegraded bằng 1, độ tin cậy của ổ đĩa đã bị suy giảm nghiêm trọng do lỗi vật lý hoặc lỗi chip nhớ nội bộ.
- Composite Temperature: Nhiệt độ tổng hợp thời gian thực tính theo độ Kelvin của toàn bộ thiết bị, bao gồm bộ điều khiển và các chip nhớ.
- Unsafe Shutdowns (Tắt nguồn không an toàn): Đếm số lần thiết bị bị ngắt điện đột ngột hoặc sập nguồn mà không nhận được tín hiệu thông báo shutdown an toàn từ máy chủ. Số lần unsafe shutdown quá lớn sẽ là nguy cơ tiềm ẩn gây hỏng phân vùng dữ liệu.
- Media Errors (Lỗi lưu trữ): Số lần bộ điều khiển phát hiện lỗi toàn vẹn dữ liệu không thể khôi phục, bao gồm lỗi ECC không thể sửa, lỗi kiểm tra CRC checksum thất bại hoặc sai lệch tag LBA. Nếu con số này lớn hơn 0, tuyệt đối không nên mua chiếc ổ đó.
Data Units Written (Đơn vị dữ liệu đã ghi): Thể hiện tổng lượng dữ liệu mà máy chủ đã ghi lên ổ đĩa từ trước đến nay, được báo cáo theo đơn vị hàng nghìn khối dữ liệu có kích thước 512 byte (tương đương khoảng 500 KB mỗi đơn vị). Bạn có thể lấy chỉ số này nhân với 512.000 byte để tự tính ra tổng dung lượng đã ghi thực tế rồi đối chiếu với thông số TBW của nhà sản xuất.
Lưu ý: Để xem các chỉ số SMART một cách trực quan, bạn cần tự cài đặt các phần mềm có giao diện đồ họa của bên thứ ba như CrystalDiskInfo hay Hard Disk Sentinel trên máy tính của mình.
3. Kích hoạt tính năng tự kiểm tra lỗi ổ đĩa (Device Self-test)
Để chắc chắn chiếc SSD cũ hoạt động hoàn hảo mà không có lỗi ẩn, đặc tả kỹ thuật NVM Express cung cấp cho bạn một giải pháp kiểm tra chủ động gọi là Device Self-test (Tự kiểm tra thiết bị). Đây là một chuỗi các diagnostic kiểm tra tính toàn vẹn và chức năng hoạt động của cả bộ điều khiển lẫn các khối chip nhớ vật lý bên trong.
Khi thực hiện chẩn đoán lỗi, bạn có thể lựa chọn hai chế độ test tiêu chuẩn:
- Short Device Self-test (Tự kiểm tra ngắn): Chu trình này được tối ưu hóa để hoàn thành cực kỳ nhanh chóng trong vòng 2 phút hoặc ít hơn.
Extended Device Self-test (Tự kiểm tra mở rộng): Thời gian hoàn thành danh định tính bằng phút được hiển thị trong trường EDSTT của cấu trúc dữ liệu Identify Controller. Điểm ưu việt của chế độ test mở rộng là nó được thiết kế để duy trì trạng thái hoạt động xuyên suốt qua các chu kỳ reset hoặc mất nguồn hệ thống; bộ điều khiển sẽ tự động tiếp tục bài test ngay tại phân đoạn đang chạy dở dang sau khi nguồn điện được khôi phục.
Quy trình tự kiểm tra của NVMe sẽ lần lượt chạy qua các bài test nghiêm ngặt bao gồm: kiểm tra RAM nội bộ của bộ điều khiển, kiểm tra trạng thái các cờ lỗi SMART, đo đạc hiệu suất nguồn dự phòng volatile memory backup, xác minh siêu dữ liệu hệ thống metadata, kiểm tra tính toàn vẹn dữ liệu ghi/đọc của chip nhớ và đánh giá mức độ hết tuổi thọ của ổ đĩa (Drive Life End-of-life condition) để xem ổ đĩa có còn đủ an toàn để tiếp tục ghi dữ liệu hay không. Nếu có bất kỳ bài test nào thất bại, thiết bị sẽ lưu lại kết quả lỗi vào một cấu trúc dữ liệu Self-test Result bao gồm mã lỗi cụ thể, phân đoạn bị lỗi và số giờ hoạt động POH tại thời điểm xảy ra sự cố.

Ví dụ về Short Device Self-test (Tự kiểm tra ngắn)
Lưu ý: Phương pháp gõ lệnh cụ thể (như sử dụng công cụ dòng lệnh smartctl trên Linux hay PowerShell trên Windows) là phần bạn phải tự tìm hiểu và thực thi thủ công tùy thuộc vào hệ điều hành đang sử dụng. Đồng thời, bạn cũng cần tự kiểm tra ngoại quan vật lý xem chiếc SSD cũ có bị sứt mẻ góc, trầy xước chân cắm PCIe hay tem bảo hành của nhà phân phối có còn nguyên vẹn hay không.
4. Những lưu ý cuối cùng khi mua SSD cũ
Việc mua SSD cũ là một quyết định cần cân nhắc kỹ lưỡng giữa chi phí tiết kiệm và rủi ro về độ bền. Hãy ghi nhớ những điểm then chốt sau trước khi xuống tiền:
- Luôn yêu cầu người bán cung cấp ảnh chụp màn hình thông số SMART, đặc biệt là chỉ số Percentage Used, Media Errors (phải bằng 0) và Critical Warning (phải toàn bộ bằng 0).
- Đối chiếu chỉ số Data Units Written với thông số TBW công bố của nhà sản xuất để ước tính lượng tuổi thọ còn lại.
- Nếu có điều kiện, hãy chạy bài Extended Device Self-test để phát hiện các lỗi ẩn mà thông số SMART chưa kịp phản ánh.
Kiểm tra kỹ ngoại quan vật lý và tem bảo hành của ổ đĩa trước khi nhận hàng.
Với những kiến thức về TBW, SMART và Device Self-test đã được trang bị trong bài viết này, bạn hoàn toàn có thể tự tin đánh giá chất lượng một chiếc SSD cũ và đưa ra quyết định mua sắm an toàn, tránh được những rủi ro không đáng có.
