
NVIDIA GTC 2024: Đột phá Blackwell, Grace và AI toàn cầu
NVIDIA GTC 2024 (GPU Technology Conference) là một trong những hội nghị công nghệ quan trọng nhất năm, diễn ra tại San Jose, California vào tháng 3 năm 2024. Sự kiện này đánh dấu những bước tiến vượt bậc của NVIDIA trong kiến trúc GPU, CPU cho trung tâm dữ liệu, và nền tảng phần mềm AI. Dưới sự dẫn dắt của CEO Jensen Huang, NVIDIA đã giới thiệu kiến trúc Blackwell, CPU Grace, và nhiều công nghệ đột phá định hình tương lai của AI và high-performance computing.
Kiến trúc Blackwell – “Siêu vi xử lý” cho kỷ nguyên AI
Điểm nhấn lớn nhất của GTC 2024 là kiến trúc GPU Blackwell thế hệ mới, được đặt theo tên của David Blackwell – nhà thống kê học vĩ đại. Blackwell B200 là GPU lớn nhất và phức tạp nhất từng được NVIDIA xây dựng, với các đặc điểm kỹ thuật gây sốc:
- 208 tỷ transistor trên quy trình TSMC 4NP tùy chỉnh
- 20 petaFLOPS hiệu năng AI (FP4 tensor cores)
- 192 GB HBM3E memory với băng thông 8 TB/s
- NVLink 5.0 cung cấp băng thông 1.8 TB/s giữa các GPU
- Hỗ trợ các kiểu dữ liệu mới: FP4, FP6 cho inference hiệu quả hơn
So với kiến trúc Hopper (H100) trước đó, Blackwell mang lại hiệu năng AI tốt hơn 2.5 lần, hiệu năng HPC tốt hơn 2 lần, và hiệu suất năng lượng tốt hơn đáng kể.
GB200 Grace Blackwell Superchip – Kết hợp CPU và GPU
NVIDIA đã kết hợp 2 GPU B200 với 1 CPU Grace (72 nhân ARM Neoverse V2) thành GB200 Superchip. Thiết kế này giải quyết bài toán “memory wall” bằng cách cho phép GPU truy cập trực tiếp bộ nhớ CPU thông qua NVLink-C2C với băng thông 900 GB/s. Điều này giảm thiểu đáng kể việc di chuyển dữ liệu giữa CPU và GPU – một điểm nghẽn cổ điển trong hệ thống AI lớn.
Mỗi GB200 Superchip cung cấp:
- 40 petaFLOPS hiệu năng AI FP4
- 864 GB bộ nhớ liên hợp (HBM3E + LPDDR5X)
- Tích hợp NVLink Switch để mở rộng quy mô
NVLink Switch và NVLink 5.0 – Kết nối quy mô siêu máy tính
NVIDIA giới thiệu NVLink Switch chip, cho phép kết nối tới 576 GPU Blackwell trong một domain NVLink duy nhất với băng thông toàn duplex 1.8 TB/s. Đây là bước tiến lớn so với NVLink 4.0 (900 GB/s) và cho phép xây dựng các cụm GPU quy mô khổng lồ mà không bị giới hạn bởi băng thông kết nối.
Kết hợp với NVLink 5.0, NVIDIA có thể xây dựng các “AI factory” với hàng ngàn GPU hoạt động như một hệ thống thống nhất, quan trọng cho việc huấn luyện các mô hình LLM siêu lớn như GPT-5 hoặc Claude-Next.
CPU Grace và Grace Hopper Superchip
NVIDIA cũng khẳng định vị thế trong thị trường CPU trung tâm dữ liệu với Grace CPU – vi xử lý 72 nhân ARM Neoverse V2, thiết kế cho hiệu suất năng lượng tối ưu và băng thông bộ nhớ cực cao (500 GB/s qua LPDDR5X). Grace CPU không chỉ phục vụ AI mà còn xử lý tốt các workload truyền thống như web serving, database, và HPC.
Grace Hopper Superchip (GH200) kết hợp 1 Grace CPU với 1 GPU H100/H200, cung cấp giải pháp cân bằng cho các ứng dụng AI inference, recommendation system, và graph analytics.
Phần mềm AI: NIM, CUDA-X, và nền tảng Enterprise
Không chỉ phần cứng, NVIDIA đã tung ra bộ phần mềm AI toàn diện:
- NVIDIA NIM (Inference Microservices): Container hóa các mô hình AI phổ biến (Llama, Mistral, Gemma…) để triển khai production dễ dàng
- CUDA-X Libraries: Các thư viện tối ưu cho HPC, data science, và AI trên GPU
- NeMo Framework: Framework end-to-end cho việc xây dựng, tùy chỉnh, và triển khai mô hình AI generative
- Omniverse Cloud APIs: Mở rộng khả năng simulation và digital twin
Đặc biệt, NVIDIA AI Enterprise cung cấp nền tảng AI sản xuất sẵn sàng với hỗ trợ bảo mật, ổn định, và cập nhật định kỳ cho doanh nghiệp.
Độ tự động và Robotics: Project GR00T và DRIVE Thor
Trong lĩnh vực robotics, NVIDIA giới thiệu Project GR00T – mô hình nền tảng đa phương thức cho robot nhân hình, có thể hiểu ngôn ngữ tự nhiên, quan sát hành động, và học kĩ năng mới. Kết hợp với Isaac Robotics Platform, GR00T hứa hẹn đẩy nhanh phát triển robot thông minh.
Cho ngành ô tô, DRIVE Thor là SoC thế hệ tiếp theo sau Orin, cung cấp 2000 TOPS hiệu năng AI, thống nhất autonomous driving, cockpit, và infotainment trên một chip duy nhất.
Tác động đến ngành công nghiệp và thị trường Việt Nam
Các công nghệ được giới thiệu tại GTC 2024 sẽ có tác động sâu rộng:
- Chi phí AI giảm: Hiệu năng/watt tốt hơn giúp giảm chi phí vận hành mô hình lớn
- Triển khai local: Các giải pháp như DGX Spark (Project DIGITS) cho phép chạy mô hình lớn tại chỗ
- Hệ sinh thái phát triển: NVIDIA Inception program hỗ trợ startup AI Việt Nam truy cập công nghệ mới nhất
- Cơ hội đào tạo: Nhu cầu nhân lực am hiểu Blackwell, Grace, và NIM tăng cao
Nhiều doanh nghiệp Việt Nam đang đầu tư vào hạ tầng AI, và sự ra mắt của Blackwell sẽ đẩy nhanh quá trình hiện đại hóa trung tâm dữ liệu trong nước.
Kết luận
GTC 2024 không chỉ là buổi ra mắt sản phẩm mà là tuyên bố chiến lược của NVIDIA: từ “công ty GPU” trở thành “công ty platform AI toàn diện”. Kiến trúc Blackwell, CPU Grace, NVLink 5.0, và bộ phần mềm NIM tạo ra một hệ sinh thái hoàn chỉnh cho kỷ nguyên AI generative và reasoning.
Đối với các nhà phát triển, nhà nghiên cứu, và doanh nghiệp tại Việt Nam, việc nắm bắt và áp dụng sớm các công nghệ này sẽ tạo ra lợi thế cạnh tranh quan trọng trong cuộc đua AI đang diễn ra gay gắt trên toàn cầu.



