NVIDIA công bố chip Rubin thế hệ sau Blackwell

NVIDIA công bố chip Rubin thế hệ sau Blackwell: Tổng quan kiến trúc mới

NVIDIA chính thức công bố Rubin — kiến trúc GPU thế hệ tiếp theo sau Blackwell. Rubin đánh dấu bước chuyển mình lớn của NVIDIA trong việc đẩy mạnh hiệu năng AI inference, training đa phương thức và xử lý edge.

Sơ đồ khối kiến trúc GPU hiện đại với các thành phần bộ nhớ, đơn vị tính toán và kết nối

Kiến trúc đột phá: GPU H200 + Rubin CPX

NVIDIA chia Rubin thành hai nhánh chính:

  • Rubin GPU (dòng chính): Tiếp nối H100/H200, tập trung training LLM khổng lồ (10B-1T parameters), hiệu năng FLOPS gấp 3-5x Blackwell
  • Rubin CPX (Compute Processing eXpert): Chip inference tối ưu cho latency thấp, throughput cao cho production deployment

Theo thông tin từ NVIDIA News và các bài thuyết trình tại GTC, Rubin dự kiến dùng tiến trình 3nm (thay vì 4nm của Blackwell), tích hợp HBM4 với băng thông 2.4 TB/s mỗi stack.

Tích hợp CPU ARM “Veritas”

Điểm đặc biệt của Rubin là NVIDIA tự thiết kế CPU ARM Veritas, loại bỏ phụ thuộc vào AMD EPYC như trước. Đây là bước quan trọng để tạo “full-stack AI factory” — từ silicon đến phần mềm.

Thông số Blackwell B200 Rubin (dự kiến)
Tiến trình 4nm TSMC 3nm TSMC
HBM HBM3e 288 GB HBM4 576 GB
Băng thông HBM 8 TB/s 16 TB/s
FP4 Performance ~10 PetaFLOPS ~50 PetaFLOPS
Interconnect NVLink 5.0 NVLink 6.0
CPU tích hợp AMD EPYC ARM Veritas

Phần mềm: CUDA 13 + Nemotron 4

Rubin đi kèm CUDA 13 với hỗ trợ chính thức cho C++20, Python bindings cải tiến và Nemo Framework 4 cho phát triển multi-modal LLM. NVIDIA cũng mở rộng TensorRT-LLM để tối ưu inference cho Rubin CPX.

Sơ đồ so sánh phương pháp học máy có giám sát và không giám sát

Thách thức cạnh tranh: AMD MI400, Intel Falcon Shores

Rubin ra mắt trong bối cảnh AMD MI400 (CDNA 4, 3nm) và Intel Falcon Shores cũng đang đuổi kịp. Tuy nhiên, ecosystem CUDA vẫn là rào cản lớn nhất để chuyển đổi.

Tác động đến thị trường Việt Nam

Với chuỗi AI Việt Nam đang phát triển, Rubin mang lại cơ hội:

  • Các công ty như VNG, Viettel AI, FPT có thể tiếp cận GPU hiệu năng cao hơn cho training local LLM
  • Chi phí inference giảm giúp startup Việt Nam triển khai AI chatbot, RAG chatbot, AI coding assistant
  • Data center tại Việt Nam có thể chuẩn bị hạ tầng tải nhiệt, điện năng cho Blackwell/Rubin

Kết luận

NVIDIA Rubin đại diện cho bước tiến quan trọng trong cuộc đua AI chip. Với kiến trúc 3nm, HBM4, CPU ARM tự thiết kế và ecosystem CUDA vững chắc, Rubin duy trì lợi thế của NVIDIA ít nhất đến 2027-2028. Nhà phát triển Việt Nam nên theo dõi NVIDIA AI platform để cập nhật toolchain mới nhất.

Nguồn: NVIDIA Newsroom, AnandTech, Tom’s Hardware, TechRadar

Tôi là một lập trình viên IOS. Code chính là IOS nhưng thỉnnh thoảng vẫn đá sang Android hoặc web. Mặc dù không quá thông thạo nhưng tôi sẽ chia sẻ những kiến thức mà mình đã tìm hiểu, áp dụng qua.

Bài viết liên quan

Mã QR là gì: nguyên lý hoạt động và mức sửa lỗi Reed-Solomon

Mã QR (QR Code) là một dạng mã vạch hai chiều, nghĩa là dữ liệu được lưu cả theo chiều ngang lẫn chiều dọc, nhờ đó chứa được nhiều dữ…

Xem thêm
Sơ đồ so sánh kích thước các định dạng thẻ SIM: mini-SIM 2FF, micro-SIM 3FF, nano-SIM 4FF, eSIM và eUICC dạng MFF2

eSIM là gì? SIM điện tử và cách chuyển mạng không cần thẻ

eSIM (viết tắt của embedded SIM) là phiên bản SIM điện tử được gắn dẫn trực tiếp vào bo mạch chủ của thiết bị, thay vì là thẻ nhúng tháo…

Xem thêm
Đồ thị phản xạ phụ thuộc góc của gương đa lớp EUV cho thấy hiệu suất suy giảm khi lệch khỏi vùng độ mở số NA 0,33

Công nghệ in mạch EUV là gì? Vì sao chip 2nm cần ánh sáng 13,5nm

Công nghệ in mạch EUV: Ánh sáng 13,5nm tạo ra chip 2nm Công nghệ in mạch EUV (Extreme Ultraviolet Lithography) là công nghệ khắc mạch bán dẫn sử dụng ánh…

Xem thêm
0 0 đánh giá
Article Rating
Theo dõi
Thông báo của
guest
0 Comments
Cũ nhất
Mới nhất Được bỏ phiếu nhiều nhất