Đánh Giá MSI XpertStation WS300: 748GB Dùng Được Bao Nhiêu?
36 token mỗi giây. Đó là tốc độ một luồng khi chuyên trang công nghệ StorageReview nạp mô hình GLM-5.2 bản NVFP4 nặng 433GB lên cỗ máy MSI XpertStation WS300 — được quảng cáo với 748GB bộ nhớ thống nhất và hiệu năng tính toán lý thuyết lên tới 20 PFLOPS. Cũng trên chính cỗ máy đó, khi nạp mô hình MiniMax M2.7 bản 125GB, tốc độ lại đạt tới 193 token/giây ở một luồng đơn và chạm mốc 15.684 token/giây tổng thông lượng đỉnh. Sự chênh lệch khổng lồ này bắt nguồn từ một nút thắt vật lý duy nhất: 252GB HBM3e trên GPU chạy ở tốc độ 7,1 TB/s, trong khi 496GB LPDDR5X gắn với CPU Grace chỉ đạt băng thông 396 GB/s. Mô hình nằm gọn trong HBM3e thì tốc độ bay kịch trần; nhưng hễ tràn sang bộ nhớ Grace thì tốc độ lập tức rơi tự do. Sicomp sẽ phân tích số liệu đo dưới góc nhìn của người ra quyết định chi tiền tại Việt Nam: Con số nào chỉ là chiêu trò marketing in trên vỏ hộp và ở quy mô mô hình nào thì nền tảng DGX Station GB300 mới thực sự đáng mua hơn một PC trạm trang bị card rời RTX PRO 6000 Blackwell?

I. MSI XPERTSTATION WS300 LÀ GÌ, VÀ KHÁC GÌ BẢN CỦA ASUS, GIGABYTE, SUPERMICRO?
MSI XpertStation WS300 là hệ thống máy trạm AI để bàn cao cấp được xây dựng trên nền tảng kiến trúc chuẩn NVIDIA DGX Station trang bị siêu chip NVIDIA GB300 Grace Blackwell Ultra. Trái tim của hệ thống là sự kết hợp nguyên khối giữa một GPU Blackwell Ultra sở hữu 252GB bộ nhớ HBM3e và một vi xử lý CPU Grace 72 nhân kiến trúc Arm Neoverse V2, liên kết hai chiều với nhau qua đường bus siêu tốc NVLink-C2C đạt băng thông 900 GB/s.
MSI chính thức mở đặt hàng dòng máy này từ ngày 16/03/2026. Trong mô hình hợp tác OEM của NVIDIA, hãng cung cấp toàn bộ bo mạch chủ mang siêu chip GB300 tích hợp sẵn. Phần việc mà các đối tác OEM tự tùy biến tập trung vào khung vỏ case, giải pháp cấp nguồn và hệ thống tản nhiệt:
- MSI XpertStation WS300: Trang bị bộ nguồn 1.600W chuẩn 80 PLUS Platinum, cụm tản nhiệt nước khép kín công suất giải nhiệt 1.400W với hai két làm mát Radiator 360mm dày bản, đi kèm sẵn đường dây cáp 16-pin (12V-2x6 / 12VHPWR) chờ sẵn cho nhu cầu cắm thêm một card đồ họa VGA Workstation rời.
- Gigabyte W775-V10-L01: Sử dụng cùng mức công suất nguồn 1.600W Platinum và cấu hình bộ nhớ 748GB tương tự.
- Supermicro ARS-511GD-NB-LCC: Trang bị bộ nguồn chuẩn 80 PLUS Titanium đạt hiệu suất chuyển đổi điện năng lên tới 94%.
- ASUS ExpertCenter Pro ET900N G3: Mở bán thương mại trên toàn cầu từ ngày 15/06/2026.
Bản chất cốt lõi: Cả bốn cỗ máy trên đều dùng chung một nền tảng bo mạch và siêu chip từ NVIDIA; sự khác biệt chỉ nằm ở vỏ case, hiệu suất quạt tản nhiệt nước và chính sách bảo hành sau bán hàng của từng thương hiệu.
II. 748GB BỘ NHỚ COHERENT GỒM NHỮNG GÌ, VÀ VÌ SAO CHỈ CÓ 252GB LÀ BỘ NHỚ NHANH?
Con số 748GB thực chất là tổng hợp của hai tầng bộ nhớ vật lý hoàn toàn khác biệt nhau về bản chất và tốc độ:
- Tầng 1 — Bộ nhớ siêu tốc GPU: 252GB HBM3e hàn trực tiếp trên đế GPU Blackwell Ultra, cung cấp băng thông truyền tải cực đại đạt 7,1 TB/s (7.100 GB/s).
- Tầng 2 — Bộ nhớ hệ thống CPU: 496GB LPDDR5X chia trên bốn thanh mô-đun SOCAMM gắn quanh CPU Grace, cung cấp băng thông truyền tải chỉ đạt 396 GB/s.
BĂNG THÔNG CHÊNH LỆCH GẦN 18 LẦN!
Lấy băng thông 7.100 GB/s chia cho 396 GB/s, tốc độ truy xuất của HBM3e nhanh gấp gần 18 lần so với bộ nhớ LPDDR5X của Grace. Trong bài đo thực tế của StorageReview, tốc độ truyền dữ liệu từ phía CPU Grace sang HBM chỉ đạt 390 GB/s, và chiều ngược lại từ HBM sang Grace chỉ đạt 382 GB/s.
Hệ quả thực tế: Toàn bộ trọng số mô hình đang tính toán, bộ đệm KV Cache và buffer bắt buộc phải nằm trong 252GB HBM3e thì cỗ máy mới phát huy được sức mạnh tính toán. 496GB LPDDR5X còn lại thực chất chỉ đóng vai trò là tầng lưu trữ đệm (Storage Tier), không thể coi là VRAM tốc độ cao tương đương.
Chi tiết cần lưu ý khi so sánh tại Việt Nam: Tại sự kiện GTC tháng 03/2025, NVIDIA từng công bố cấu hình ý tưởng là 288GB HBM3e và 784GB tổng bộ nhớ (ServeTheHome, 26/03/2025). Tuy nhiên, các cấu hình thương mại bán ra chính thức trong năm 2026 của MSI, Gigabyte và Supermicro đều chốt thông số thực tế là 252GB HBM3e và 748GB tổng bộ nhớ. Khi nhận báo giá từ các nhà cung ứng, người mua cần yêu cầu xác nhận chính xác con số 252GB HBM3e này trên hợp đồng giao hàng.

III. BẢNG THÔNG SỐ KỸ THUẬT VÀ Ý NGHĨA THỰC TẾ
Dưới đây là bảng đặc tả cấu hình của MSI XpertStation WS300 (mã WS300T60L) đối chiếu trực tiếp với tác động thực tế trong công việc hàng ngày của đội ngũ kỹ sư phần mềm:
| Hạng mục phần cứng | Thông số kỹ thuật | Ý nghĩa thực chiến đối với đội ngũ phát triển |
|---|---|---|
| Bộ vi xử lý (CPU) | NVIDIA Grace 72 nhân Arm Neoverse V2 | Chạy trên Ubuntu 24.04 LTS (aarch64). Các công cụ cũ chỉ hỗ trợ x86 bắt buộc phải biên dịch lại hoặc chạy qua container Arm. |
| Bộ xử lý đồ họa (GPU) | Blackwell Ultra B300 (160 SM, 640 Tensor Cores) | Con số 20 PFLOPS NVFP4 là số lý thuyết có Sparsity; ở định dạng Dense đạt 15 PFLOPS; ma trận MatMul thực đo đạt khoảng 6,1 PFLOPS. |
| Bộ nhớ nhanh (HBM3e) | 252GB HBM3e (Băng thông 7,1 TB/s) | Tổng trọng số mô hình cộng với kích thước KV Cache bắt buộc phải nằm dưới mốc 252GB thì tốc độ sinh token mới đạt đỉnh. |
| Bộ nhớ hệ thống (LPDDR5X) | 496GB LPDDR5X (Băng thông 396 GB/s) | Dành để chứa phần mô hình bị tràn, bộ dataset và file checkpoint; băng thông chỉ bằng 1/18 so với HBM3e. |
| Hạ tầng lưu trữ (SSD) | 2x Micron 4600 2TB PCIe 5.0 (RAID 1) + 2 khe M.2 trống | Dung lượng 4TB phục vụ cài đặt hệ điều hành. Nếu cần lưu nhiều bản checkpoint kích thước 400GB, bắt buộc phải cắm thêm ổ cứng SSD NVMe mở rộng. |
| Giao tiếp mạng chuyên dụng | ConnectX-8 (2x 400GbE) + 1x 10GbE LAN + 1x 1GbE BMC | Băng thông 400GbE chỉ cần kích hoạt khi ghép nối máy thứ hai thành cluster hoặc kết nối với hệ thống Storage Server tập trung. |
| Khe cắm mở rộng PCIe | 3 khe PCIe 5.0 x16 (1 khe full x16, 2 khe chạy tín hiệu x8) | Đủ không gian cắm thêm một chiếc card đồ họa chuyên nghiệp để xuất hình; 2 khe còn lại chỉ nhận nửa băng thông tín hiệu. |
| Bộ nguồn cấp điện (PSU) | 1.600W 80 PLUS Platinum (Điện áp 115V–240V, dòng 8–15A) | Tại lưới điện 220V ở Việt Nam, dòng điện tối đa của máy chỉ xấp xỉ 7,3A (1.600W / 220V), cắm an toàn vào các ổ cắm điện dân dụng 10A–16A thông thường. |
| Giải pháp tản nhiệt | Vòng tản nhiệt nước khép kín 1.400W (Hai két tản 360mm) | Khi kéo tải đỉnh 1.292W, nhiệt độ GPU duy trì ở mức 71°C, CPU Grace 65°C, xung nhịp GPU giữ phẳng ở mức 2,07 GHz. |
| Cổng xuất hình vật lý | Chỉ có 1 cổng Mini DisplayPort của chip BMC (Tối đa 1024×768) | Không có màn hình làm việc độ phân giải cao nếu không cắm thêm một chiếc card màn hình rời vào khe PCIe! |
IV. MSI XPERTSTATION WS300 CHẠY LLM NHANH HƠN RTX PRO 6000 VÀ DGX SPARK BAO NHIÊU?
Khi đặt cạnh nhau trên năm mô hình AI thử nghiệm tiêu chuẩn, cỗ máy MSI XpertStation WS300 đạt thông lượng gấp từ 2,3 đến 3 lần so với một chiếc card rời RTX PRO 6000 Blackwell 96GB, và nhanh gấp từ 14 đến 19 lần so với cỗ máy mini NVIDIA DGX Spark 128GB ở mức tải đồng thời 128 luồng truy vấn (Concurrency 128) theo số liệu đo đạc của StorageReview:
| Mô hình AI thử nghiệm | MSI WS300 (GB300 748GB) | RTX PRO 6000 96GB | DGX Spark 128GB |
|---|---|---|---|
| GPT-OSS-20B | 22.161 token/giây | 9.000 token/giây | 1.469 token/giây |
| GPT-OSS-120B | 9.294 token/giây | 3.384 token/giây | 500 token/giây |
| Llama 3.1 8B NVFP4 | 28.698 token/giây | 12.269 token/giây | 2.009 token/giây |
| Mistral Small 24B FP8 | 11.157 token/giây | 3.779 token/giây | 585 token/giây |
| Qwen3 Coder 30B FP8 | 12.425 token/giây | 5.183 token/giây | 787 token/giây |
Điểm lưu ý khi chạy ở kịch bản một luồng đơn (Single-Stream): Khi chỉ phục vụ 1 người dùng duy nhất, khoảng cách hiệu năng thu hẹp lại rất nhiều. Ví dụ với mô hình GPT-OSS-20B, WS300 đạt 530 token/giây, RTX PRO 6000 đạt 244 token/giây, còn DGX Spark đạt 50 token/giây. Với một đội ngũ nhỏ chỉ có vài kỹ sư gọi mô hình tuần tự, một chiếc card 96GB đã cho tốc độ phản hồi nhanh hơn khả năng đọc của con người.
Sức mạnh thực sự của nền tảng GB300 chỉ bộc lộ khi hệ thống phải gánh hàng chục đến hàng trăm request gửi đến đồng thời, hoặc khi quy mô trọng số mô hình vượt quá ngưỡng 96GB VRAM của các card đồ họa rời thông thường.
V. ĐIỀU GÌ XẢY RA KHI MÔ HÌNH VƯỢT QUÁ 252GB HBM3E?
Tổng thông lượng xử lý của hệ thống rơi tự do từ 15.684 xuống còn 277 token/giây. Khi thử nghiệm nạp bốn mô hình ngôn ngữ lớn ở định dạng NVFP4 lên MSI XpertStation WS300, kết quả thực tế của StorageReview tách thành hai bức tranh đối lập hoàn toàn:
| Mô hình AI (NVFP4) | Dung lượng | Phần tràn sang Grace | Token/giây (1 luồng) | Tổng thông lượng đỉnh |
|---|---|---|---|---|
| MiniMax M2.7 | 125 GB | 0 GB (Nằm trọn HBM) | 193 token/s | 15.684 token/s (128 luồng) |
| MiniMax M3 | 233 GB | Tràn 21 GB sang Grace | 197 token/s | 2.082 token/s (32 luồng) |
| Nemotron-3-Ultra 550B | 307 GB | Tràn 114 GB sang Grace | 43 token/s | 336 token/s (32 luồng) |
| GLM-5.2 | 433 GB | Tràn 216 GB sang Grace | 36 token/s | 277 token/s (32 luồng) |
Phân tích kết quả thực tế:
- Mô hình MiniMax M3 nặng 233GB chỉ tràn nhẹ 21GB sang bộ nhớ Grace, tốc độ 1 luồng vẫn giữ ở mức 197 token/giây, nhưng tổng thông lượng tối đa của cả hệ thống đã bị tụt từ 15.684 xuống chỉ còn 2.082 token/giây (giảm tới 87%).
- Hai mô hình Nemotron 550B và GLM-5.2 tràn nhiều sang bộ nhớ Grace khiến thông lượng tổng tụt sâu xuống dưới 350 token/giây. Trong đó GLM-5.2 ở luồng đơn chỉ còn 36 token/giây.
- Cỗ máy vẫn chạy được mô hình 433GB: Máy vẫn nạp được mô hình, vẫn trả lời câu hỏi chính xác, dữ liệu vẫn bảo mật 100% tại chỗ mà không cần đưa lên Cloud. Tuy nhiên, kỳ vọng nó phục vụ mượt mà đồng thời cho cả một phòng ban cùng lúc ở quy mô mô hình này là điều bất khả thi về mặt vật lý.

VI. BỐN GIỚI HẠN VẬT LÝ CỦA MSI XPERTSTATION WS300 MÀ HÃNG ÍT NÓI TỚI
Bộ phận Mua hàng và IT Doanh nghiệp cần nắm rõ bốn rào cản phần cứng trước khi ký hợp đồng mua máy:
- Không có cổng xuất hình làm việc độ phân giải cao: Cổng Mini DisplayPort duy nhất phía sau thuộc về chip quản trị từ xa AST2600 BMC, chỉ hỗ trợ độ phân giải tối đa 1024×768. Muốn cắm màn hình 4K/8K để làm việc đồ họa trực tiếp, bạn bắt buộc phải gắn thêm một card đồ họa rời qua khe PCIe 5.0 x16.
- Gắn thêm card rời sẽ bị bóp công suất GPU chính: Card rời và siêu chip GB300 dùng chung tổng ngân sách điện 1.600W của bộ nguồn. Theo chính sách phân bổ điện năng mặc định, hệ thống ưu tiên cấp điện đầy đủ cho card PCIe gắn thêm trước, và tự động hạ bớt hạn mức công suất của chip GB300 khi cả hai cùng tải nặng.
- Hệ điều hành Host là kiến trúc Arm (aarch64): Máy chạy Ubuntu 24.04 LTS nền Arm với kernel 6.17 và CUDA 13.1. Tài liệu của NVIDIA dành riêng một chương hướng dẫn các nhà phát triển cách chuyển đổi (port) ứng dụng từ kiến trúc x86 sang Arm. Thêm vào đó, CPU Grace không thể so sánh ngang với các CPU x86 máy chủ đa nhân hàng đầu như AMD EPYC hay Threadripper PRO ở các tác vụ tính toán đơn thuần không dùng GPU.
- Hệ thống Single-Node đơn điểm: Máy chỉ sở hữu 1 nguồn điện, 1 CPU và 1 GPU nguyên khối. Thiết bị không có cơ chế nguồn kép dự phòng Redundant PSU và không hỗ trợ kết nối NVLink giữa các GPU rời bên trong cùng một máy để chạy Tensor Parallelism như các tủ rack máy chủ trung tâm dữ liệu.
VII. GIÁM ĐỐC DUYỆT NGÂN SÁCH CẦN HỎI GÌ TRƯỚC KHI KÝ MUA DGX STATION GB300?
Để tránh lãng phí tiền tỷ của doanh nghiệp, Giám đốc CNTT và Giám đốc Tài chính cần trả lời dứt khoát 3 câu hỏi:
- 1. Kích thước mô hình chính của đội ngũ là bao nhiêu GB?
Con số để ra quyết định mua là 252GB HBM3e, chứ không phải 748GB hay 20 PFLOPS. Nếu mô hình đội kỹ thuật định chạy hàng ngày cộng với dung lượng đệm KV Cache vượt quá 252GB, cỗ máy sẽ tụt thông lượng xuống mức vài trăm token/giây như kết quả đo GLM-5.2 433GB ở trên. - 2. Đội ngũ kỹ sư đã sẵn sàng làm việc trên môi trường Ubuntu Arm64 chưa?
Nếu toàn bộ workflow của công ty gắn chặt với hệ điều hành Windows, hãy cân nhắc đợi phiên bản DGX Station for Windows mà NVIDIA đã công bố tại Computex (dự kiến phát hành thương mại từ cuối năm 2026). - 3. Bài toán chi phí đầu tư ban đầu và tiền điện vận hành thực tế:
Mức giá niêm yết tham chiếu tại thị trường quốc tế dao động từ 84.999 USD đến 108.350 USD (khoảng 2,1 đến 2,8 tỷ VNĐ) tùy hãng và cấu hình phụ trợ.
BÀI TOÁN TIỀN ĐIỆN VẬN HÀNH THỰC TẾ TẠI VIỆT NAM (THEO QĐ 1279/QĐ-BCT):
Nhiều kế toán lo sợ cỗ máy 1.600W sẽ làm tăng vọt chi phí tiền điện. Thực tế tính toán:
- Giả sử máy chạy hết công suất 1.600W (1,6 kW) trong 8 giờ/ngày, 250 ngày làm việc/năm = 3.200 kWh điện/năm.
- Nhân với biểu giá điện kinh doanh hiện hành cấp điện áp dưới 6kV giờ bình thường (~3.152 ₫/kWh theo Quyết định 1279/QĐ-BCT), tổng tiền điện mỗi năm chỉ rơi vào khoảng:
3.200 × 3.152 ≈ 10.086.400 ₫/năm(~10,1 triệu đồng/năm).
Kết luận: Chi phí tiền điện vận hành hoàn toàn không đáng lo ngại. Rủi ro tài chính lớn nhất của doanh nghiệp nằm ở việc mua sai kích cỡ bộ nhớ mô hình!
VIII. NÊN MUA MSI XPERTSTATION WS300, WORKSTATION RTX PRO 6000, HAY CHƯA MUA GÌ?
| Kịch bản ứng dụng thực tế | Phương án phần cứng đề xuất | Căn cứ kỹ thuật và kinh tế |
|---|---|---|
| Mô hình AI dưới 96GB (Llama 8B, Qwen 30B, Mistral 24B) | Máy trạm Workstation 1x RTX PRO 6000 96GB | Đạt từ 3.384 đến 12.269 token/s ở 128 luồng; chi phí đầu tư rẻ hơn nhiều lần, chạy nền tảng x86 quen thuộc. |
| Mô hình AI từ 96GB đến 252GB (GPT-OSS-120B, MiniMax 125GB) | MSI XpertStation WS300 (DGX Station GB300) | Nằm trọn trong 252GB HBM3e (7,1 TB/s); giải pháp để bàn 1 GPU duy nhất không cần chia model phức tạp. |
| Mô hình AI trên 252GB chạy thường xuyên | Máy chủ Server Rackmount 4x hoặc 8x GPU | Chi phí mua nhiều tháp GB300 ngang ngửa đầu tư một hệ thống server 8 GPU B300 có dung lượng VRAM lớn hơn nhiều trên mỗi chip. |
| Dự án AI mới ở giai đoạn thử nghiệm ban đầu | Chưa cần mua phần cứng — Thuê GPU Cloud | Nếu dữ liệu được phép tải lên mạng và GPU chỉ chạy vài giờ mỗi tuần, thuê Cloud theo giờ mang lại hiệu quả chi phí tối ưu nhất. |
IX. TỔNG KẾT & CHÍNH SÁCH BẢO HÀNH B2B TẠI SICOMP
MSI XpertStation WS300 là một cỗ máy trạm AI để bàn xuất sắc nhưng có định vị kỹ thuật rất hẹp. Con số 748GB đúng trên danh nghĩa địa chỉ bộ nhớ coherent thống nhất, nhưng con số sống còn để doanh nghiệp lập kế hoạch mua sắm là 252GB HBM3e. Nếu mô hình AI của bạn nằm vừa trong mốc 252GB, đây là giải pháp để bàn có một GPU đơn lẻ gánh trọn vẹn mô hình mạnh mẽ nhất năm 2026.
Chính sách hậu mãi đặc quyền cho khối doanh nghiệp tại Sicomp: Khi đầu tư các dòng máy trạm AI giá trị cao tại Sicomp, khách hàng doanh nghiệp được áp dụng chính sách bảo hành 12 tháng tận nơi sử dụng trong bán kính 15km từ trụ sở (không giới hạn số lần), hỗ trợ cho mượn thiết bị thay thế tạm thời trong thời gian xử lý sự cố, phản hồi kỹ thuật trong 30 phút giờ hành chính và đề xuất phương án giải quyết trong 1 giờ. Riêng các dòng máy DGX Station GB300, điều khoản SLA của hãng sản xuất sẽ được thể hiện minh bạch trong hợp đồng để doanh nghiệp đối chiếu trước khi ký duyệt.
TƯ VẤN HẠ TẦNG MÁY TRẠM & MÁY CHỦ AI CHUYÊN NGHIỆP TẠI SICOMP!
Quý doanh nghiệp và viện nghiên cứu đang cần đo đạc kích thước mô hình AI, tính toán dung lượng VRAM thực tế hay tư vấn so sánh giữa DGX Station GB300 và PC Server & Workstation cắm card rời? Hãy liên hệ ngay với đội ngũ kỹ sư giải pháp của Sicomp qua hotline 0384.734.666 để nhận báo giá chi tiết và phương án triển khai tối ưu TCO nhất hôm nay!
Bài viết liên quan

Thị Trường PC Toàn Cầu Q3 2026 Sụt Giảm 20.1%: Áp Lực Tồn Kho Và Giá Linh Kiện
Báo cáo IDC Q3 2026: Sản lượng xuất xưởng PC toàn cầu giảm 20.1% xuống 62.7 triệu máy do dư âm ôm hàng nửa đầu năm và giá phần cứng tăng cao. HP và Dell giảm sâu.

LiquidJet Diamond: Tích Hợp Kim Cương Vào Tấm Làm Mát Tăng 35% Token/Watt Cho Chip AI
Frore Systems ra mắt LiquidJet Diamond tích hợp tấm kim cương cho phiến lạnh AI: giảm nhiệt thêm 10°C, tản điểm nóng tới 770 W/cm2, tăng 35% doanh thu Token/Watt.

Đánh giá Supermicro AOC-S100G-M2C-P: Khi nào nên chọn
Đánh giá card mạng Supermicro AOC-S100G-M2C-P hai cổng 100GbE: trần băng thông PCIe 3.0 x16, lịch hỗ trợ driver ConnectX-4 và khi nào nên chọn.

NVIDIA Ra Mắt DGX Station Chạy Windows: GB300, 748GB Bộ Nhớ, 20 PFLOPs
NVIDIA công bố phiên bản DGX Station chạy Windows trang bị siêu chip GB300 Blackwell Ultra, 20 PFLOPs AI compute, 748GB Unified Memory đối đầu Threadripper Halo Station.