NVIDIA công bố chip Rubin thế hệ sau Blackwell

NVIDIA công bố chip Rubin thế hệ sau Blackwell: Tổng quan kiến trúc mới

NVIDIA chính thức công bố Rubin — kiến trúc GPU thế hệ tiếp theo sau Blackwell. Rubin đánh dấu bước chuyển mình lớn của NVIDIA trong việc đẩy mạnh hiệu năng AI inference, training đa phương thức và xử lý edge.

Sơ đồ khối kiến trúc GPU hiện đại với các thành phần bộ nhớ, đơn vị tính toán và kết nối

Kiến trúc đột phá: GPU H200 + Rubin CPX

NVIDIA chia Rubin thành hai nhánh chính:

  • Rubin GPU (dòng chính): Tiếp nối H100/H200, tập trung training LLM khổng lồ (10B-1T parameters), hiệu năng FLOPS gấp 3-5x Blackwell
  • Rubin CPX (Compute Processing eXpert): Chip inference tối ưu cho latency thấp, throughput cao cho production deployment

Theo thông tin từ NVIDIA News và các bài thuyết trình tại GTC, Rubin dự kiến dùng tiến trình 3nm (thay vì 4nm của Blackwell), tích hợp HBM4 với băng thông 2.4 TB/s mỗi stack.

Tích hợp CPU ARM “Veritas”

Điểm đặc biệt của Rubin là NVIDIA tự thiết kế CPU ARM Veritas, loại bỏ phụ thuộc vào AMD EPYC như trước. Đây là bước quan trọng để tạo “full-stack AI factory” — từ silicon đến phần mềm.

Thông số Blackwell B200 Rubin (dự kiến)
Tiến trình 4nm TSMC 3nm TSMC
HBM HBM3e 288 GB HBM4 576 GB
Băng thông HBM 8 TB/s 16 TB/s
FP4 Performance ~10 PetaFLOPS ~50 PetaFLOPS
Interconnect NVLink 5.0 NVLink 6.0
CPU tích hợp AMD EPYC ARM Veritas

Phần mềm: CUDA 13 + Nemotron 4

Rubin đi kèm CUDA 13 với hỗ trợ chính thức cho C++20, Python bindings cải tiến và Nemo Framework 4 cho phát triển multi-modal LLM. NVIDIA cũng mở rộng TensorRT-LLM để tối ưu inference cho Rubin CPX.

Sơ đồ so sánh phương pháp học máy có giám sát và không giám sát

Thách thức cạnh tranh: AMD MI400, Intel Falcon Shores

Rubin ra mắt trong bối cảnh AMD MI400 (CDNA 4, 3nm) và Intel Falcon Shores cũng đang đuổi kịp. Tuy nhiên, ecosystem CUDA vẫn là rào cản lớn nhất để chuyển đổi.

Tác động đến thị trường Việt Nam

Với chuỗi AI Việt Nam đang phát triển, Rubin mang lại cơ hội:

  • Các công ty như VNG, Viettel AI, FPT có thể tiếp cận GPU hiệu năng cao hơn cho training local LLM
  • Chi phí inference giảm giúp startup Việt Nam triển khai AI chatbot, RAG chatbot, AI coding assistant
  • Data center tại Việt Nam có thể chuẩn bị hạ tầng tải nhiệt, điện năng cho Blackwell/Rubin

Kết luận

NVIDIA Rubin đại diện cho bước tiến quan trọng trong cuộc đua AI chip. Với kiến trúc 3nm, HBM4, CPU ARM tự thiết kế và ecosystem CUDA vững chắc, Rubin duy trì lợi thế của NVIDIA ít nhất đến 2027-2028. Nhà phát triển Việt Nam nên theo dõi NVIDIA AI platform để cập nhật toolchain mới nhất.

Nguồn: NVIDIA Newsroom, AnandTech, Tom’s Hardware, TechRadar

Tôi là một lập trình viên IOS. Code chính là IOS nhưng thỉnnh thoảng vẫn đá sang Android hoặc web. Mặc dù không quá thông thạo nhưng tôi sẽ chia sẻ những kiến thức mà mình đã tìm hiểu, áp dụng qua.

Bài viết liên quan

Bitcoin Layer 2: So Sánh Stacks, Rootstock, Build on Bitcoin và Ark

Bitcoin Layer 2: So Sánh Stacks, Rootstock, Build on Bitcoin và Ark Tại sao Bitcoin cần Layer 2? Bitcoin vẫn là chuỗi khối lớn nhất và an toàn nhất về…

Xem thêm

OpenAI o1: Mô hình suy luận thay đổi cách AI giải quyết vấn đề

OpenAI o1 là gì? OpenAI o1 là mô hình ngôn ngữ lớn mới của OpenAI, tập trung vào su luận (reasoning) thay vì chỉ dự đoán token tiếp theo như…

Xem thêm

Cuộc đua chip AI 2025: NVIDIA Blackwell, AMD MI400 và Intel Falcon Shores đối đầu

Cuộc đua chip AI 2025: NVIDIA Blackwell, AMD MI400 và Intel Falcon Shores đối đầu Thị trường chip AI đang trải qua cuộc cạnh tranh khốc liệt nhất lịch sử….

Xem thêm
0 0 đánh giá
Article Rating
Theo dõi
Thông báo của
guest
0 Comments
Cũ nhất
Mới nhất Được bỏ phiếu nhiều nhất