Knowledge Distillation là gì: Nén mô hình AI thông minh

Knowledge Distillation (cất giữ tri thức) là quá trình chuyển kiến thức từ một mô hình lớn sang một mô hình nhỏ hơn. Bất ngờ thay, người học nhỏ không…

Xem thêm

LoRA và QLoRA: Tinh chỉnh mô hình ngôn ngữ lớn tiết kiệm bộ nhớ

LoRA và QLoRA là hai kỹ thuật giúp bạn tinh chỉnh mô hình ngôn ngữ lớn (LLM) mà không cần toàn bộ bộ nhớ VRAM mà một con GPU thương…

Xem thêm

Vector database là gì: Cơ sở dữ liệu tìm kiếm ngữ nghĩa cho AI

Vector database là gì? Vector database là hệ quản trị dữ liệu được thiết kế riêng để lưu trữ, tìm kiếm và so sánh các vector đặc trưng (embedding) có…

Xem thêm
Mặt sau hàng server rack tại trung tâm dữ liệu với hệ thống cáp và thiết bị mạng

Speculative Decoding là gì: Tăng tốc suy luận LLM gấp nhiều lần

Speculative Decoding là gì: Tăng tốc suy luận LLM Speculative Decoding là kỹ thuật tối ưu nhằm tăng tốc quá trình suy luận (inference) của mô hình ngôn ngữ lớn…

Xem thêm
Sơ đồ kiến trúc Apache Kafka gồm producer, broker, topic, partition và consumer

Apache Kafka là gì: Nền tảng xử lý sự kiện thời gian thực

Apache Kafka là nền tảng xử lý sự kiện thời gian thực được thiết kế cho độ tin cậy cao, mở rộng ngang và lưu trữ lâu dài. Ban đầu…

Xem thêm
Sơ đồ kiến trúc Mixture of Experts với router điều phối token tới các chuyên gia

Mixture of Experts là gì: Kiến trúc MoE cho mô hình ngôn ngữ lớn

Mixture of Experts (MoE) là kiến trúc mô hình ngôn ngữ lớn cho phép tách một mạng nơ-ron thành nhiều “chuyên gia” nhỏ và chỉ kích hoạt một phần trong…

Xem thêm

Kiến trúc Transformer là gì: Cơ sở của LLM hiện đại

Kiến trúc Transformer là một mô hình mạng nơ ron sâu dựa trên cơ chế self-attention thay vì dùng các lớp lặp lại như RNN hay LSTM. Bởi vì khả…

Xem thêm

RAG là gì: Kỹ thuật Retrieval-Augmented Generation cho LLM

Retrieval-Augmented Generation (RAG) là kiến trúc dùng dữ liệu truy xuất từ nguồn bên ngoài để bổ sung kiến thức cho mô hình ngôn ngữ lớn (LLM) trước khi sinh…

Xem thêm

RISC-V là gì: Kiến trúc CPU mở thay thế ARM và x86

RISC-V là gì? RISC-V là một họ kiến trúc tập lệnh (Instruction Set Architecture – ISA) mã nguồn mở, được phát triển bởi dự án tại Đại học California, Berkeley…

Xem thêm

Go generics: Lập trình hàm generic thực tế từ A-Z

Go generics: Lập trình hàm generic thực tế từ A-Z Được ra mắt official trong Go 1.18 (-released February 2022), generics đã mang lại cáchปฏ cách khác cho lập trình…

Xem thêm