Ollama chạy LLM local trên Linux: Hướng dẫn cài đặt chi tiết
Ollama là nền tảng cho phép chạy các mô hình ngôn ngữ lớn (LLM) như Llama, Mistral, Gemma trực tiếp trên máy local mà không cần phụ thuộc vào dịch…
Xem thêm
Docker multi-stage builds: Cách thu nhỏ image xuống 90%
Docker multi-stage builds: Cách thu nhỏ image xuống 90% Một trong những thách thức lớn nhất khi dùng Docker là image size quá lớn. Một image Python đơn giản có…
Xem thêm
QUIC và HTTP/3: Tương lai web tốc cao thay thế TCP truyền thống
QUIC và HTTP/3: Tương lai web tốc cao thay thế TCP truyền thống Trong hơn 30 năm, mọi giao lượu trên internet đều dựa trên giao thức TCP (Transmission Control…
Xem thêm
Fine-tuning LLM với LoRA adapters: Tiết kiệm 90% chi phí
Fine-tuning LLM với LoRA adapters: Tiết kiệm 90% chi phí Fine-tuning mô hình ngôn ngữ lớn (LLM) truyền thống đòi hỏi cập nhật tất cả hàng tỷ tham số, tốn…
Xem thêm
Sao lưu Linux tự động với rsync và systemd timers: Hướng dẫn
Sao lưu Linux tự động với rsync và systemd timers: Hướng dẫn Tự động hóa sao lưu Linux với rsync và systemd timers được coi là phương pháp đáng tin…
Xem thêm
Jetpack Compose Kotlin: Xây dựng ứng dụng Android hiện đại
Jetpack Compose Kotlin: Xây dựng ứng dụng Android hiện đại Jetpack Compose Kotlin đang cách đẳng cách phát triển giao diện Android bằng cách thay thế XML bằng mã Kotlin…
Xem thêm
AI startup funding Southeast Asia 2024
AI startup funding Southeast Asia 2024: xu hướng đầu tư AI Năm 2024 chứng kiến hoạt động đầu tư vào các startup AI tại Đông Nam Á tăng mạnh, với…
Xem thêm
LLM quantization: Nén mô hình AI tiết kiệm GPU
LLM quantization: Kỹ thuật nén mô hình AI tiết kiệm GPU Quantization là kỹ thuật giảm độ chính xác số của các tham số trong mô hình học sâu, đặc…
Xem thêm
6G: Công nghệ mạng không dây thế hệ tiếp theo
6G: Công nghệ mạng không dây thế hệ tiếp theo 6G là công nghệ mạng di động thế hệ sáu đang được phát triển, được kỳ vọng là kế nhiệm…
Xem thêm
WebAssembly (WASM) cho backend: Từ Node.js đến Rust
WebAssembly (WASM) cho backend: Từ Node.js đến Rust WebAssembly (WASM) ban đầu được thiết kế để chạy mã ở tốc độ gần bằng bản địa trên trình duyệt web. Nhưng…
Xem thêm