Tuần trước tôi lướt Crypto Briefing, thấy bài giới thiệu rack 52U của MiTAC với 96 GPU AMD MI355X. Ấn tượng đầu là GPU mới – nhưng sau đó, tôi bắt đầu thấy một thứ quen thuộc: sự định giá thấp.
Không phải AI, mà là blockchain. Ai đang thực sự cần 96 GPU trên một rack? Chỉ có hai nhóm: một là các phòng thí nghiệm AI có ngân sách không giới hạn, hai là các mạng lưới phi tập trung đang chạy các tính toán ZK-proof và zk-rollup. Và news này không nói về cái thứ hai.
Khi tôi audit mô hình kinh tế của các L2, một trong những bottleneck lớn nhất là chi phí tính toán cho máy chứng minh (prover). Mỗi block cần hàng trăm giây GPU để tạo ra một proof có thể kiểm tra được. Giờ đây, với một rack chứa 96 GPU MI355X, mỗi GPU FP8 khoảng 300-400 TFLOPS, tổng lực tính toán một rack có thể đạt 28-38 PFLOPS. Con số này tương đương vài nghìn node máy chứng minh phân tán – nhưng gom lại trong một tủ.
Hãy nhìn vào bối cảnh giao thức: ngày nay, mạng Ethereum đã chấp nhận blob từ EIP-4844. Nhu cầu về dung lượng DA đang tăng nhanh, nhưng chi phí tạo proof mới là rào cản thực sự. Mỗi ZK-rollup mới ra mắt đều phải đối mặt với bài toán: làm sao giảm thời gian và chi phí GPU để duy trì throughput. Giải pháp hiện tại là chạy song song trên nhiều GPU tiêu chuẩn – nhưng độ trễ mạng giữa các máy sẽ giết chết hiệu suất.
Tại Comptex 2026 (theo bài báo), MiTAC công bố rack 52U với 96 GPU AMD MI355X, sử dụng làm mát trực tiếp (DLC) để giải quyết tản nhiệt. Tôi muốn phân tích sâu: rack này dùng 96 GPU - không phải 64 hay 128 - vì bus PCIe và network topology bị giới hạn bởi số lane. Mỗi GPU cần kết nối với nhau qua Infinity Fabric (AMD) hoặc InfiniBand. Với 96 GPU, số hop trung bình giữa hai GPU có thể là 2-3, tạo ra latency ~3-5μs. Đủ thấp để chạy song song tạo ZK-proof, nơi mỗi gate logic cần phối hợp đồng bộ.

Hãy so sánh: một rack tiêu chuẩn 42U với 8 GPU Nvidia H100 (DGX) chỉ có thể chạy 8 GPU song song. Với rack 52U này, bạn gom 96 GPU, dung lượng gấp 12 lần. Nhưng không đơn giản là gấp 12 lần: do latency giảm, hiệu suất phân mảnh (scaling efficiency) có thể đạt 85-90%, thay vì 60-70% khi chạy các node riêng rẽ. Điều này đồng nghĩa với giảm chi phí prover xuống 30-40% cho cùng một lượng giao dịch.
Nếu bạn cho rằng đây chỉ là tin tức về AI, bạn đã bỏ lỡ điểm mù. Thị trường đang đi ngang, các prover và sequencer đang âm thầm chuẩn bị hạ tầng. Rack này có thể biến một node sequencer phi tập trung thành một cluster mini có khả năng xử lý 50.000 TPS trên L2, với chi phí dưới 0,01 USD mỗi giao dịch. Hãy tưởng tượng: một mạng ZK-rollup chạy trên 10 rack như vậy, mỗi rack 96 GPU – tức 960 GPU AMD – có thể sản xuất proof cho toàn bộ hệ sinh thái L2. Điều này phá vỡ giới hạn hiện tại về chi phí và thời gian tạo proof.

Định giá thấp ở đây không phải giá cổ phiếu, mà là sự chú ý của cộng đồng crypto. Khi mọi người đang bận rộn phân tích airdrop hay TVL, tôi nhìn thấy một rack phần cứng có thể thay đổi cấu trúc phí của L2. Nếu điều này xảy ra, chi phí giao dịch trên L2 sẽ tiệm cận 0, và những L2 không đuổi kịp xu hướng dùng prover riêng sẽ chết.
Bạn có biết rằng đôi khi sai lầm lớn nhất lại là điều đúng đắn nhất? Sai lầm ở đây là cho rằng đây là tin tức AI, trong khi sự thật là một tín hiệu về tương lai phi tập trung của tính toán. Bức tường vô hình giữa phần cứng và blockchain đang sụp đổ, và chỉ những ai nhìn thấy nó mới kịp chuẩn bị cho làn sóng tiếp theo.
