LangGraph: Framework AI Agent trạng thái dựa trên đồ thị
LangGraph là gì? LangGraph là framework mã nguồn mở do LangChain AI phát triển, chuyên dụng để xây dựng các AI Agent có trạng thái phức tạp. Khác với các…
Xem thêm
LLM Inference Optimization: vLLM, TGI, llama.cpp, TensorRT-LLM so sánh chi tiết
LLM Inference Optimization: vLLM, TGI, llama.cpp, TensorRT-LLM so sánh chi tiết Sau khi huấn luyện xong LLM, phần tốn kém nhất là inference — chạy mô hình để sinh văn…
Xem thêm
Prompt Engineering Cơ Bản: Kỹ thuật tối ưu prompt cho LLM hiệu quả
Prompt Engineering Cơ Bản: Kỹ thuật tối ưu prompt cho LLM hiệu quả Prompt engineering là nghệ thuật viết hướng dẫn (prompt) để large language model (LLM) trả về kết…
Xem thêm
LoRA: Kỹ thuật fine-tuning LLM tiết kiệm 99% tham số
LoRA (Low-Rank Adaptation) là kỹ thuật điều chỉnh mô hình ngôn ngữ lớn (LLM) hiệu quả nhất hiện nay, cho phép fine-tuning các mô hình hàng tỷ tham số chỉ…
Xem thêm
Qwen-Agent: Framework AI Agent Đa Công Cụ Từ Alibaba Hỗ Trợ RAG Và Tool Calling
Qwen-Agent là gì? Qwen-Agent là framework mã nguồn mở để phát triển ứng dụng LLM (Large Language Model), được phát triển bởi đội ngũ Qwen thuộc Alibaba Group. Framework này…
Xem thêm
Ollama là gì? Chạy LLM nguồn mở cục bộ hoàn toàn miễn phí
Ollama là công cụ chạy mô hình ngôn ngữ lớn (LLM) trực tiếp trên máy tính cá nhân, hoàn toàn miễn phí, không cần GPU đắt tiền hay kết nối…
Xem thêm
AI Agent trong game: NPC thông minh thay thế kịch bản cũ
NPC truyền thống bị giới hạn bởi kịch bản cố định Trong game hiện đại, nhân vật không chơi thường chỉ phản ứng theo cây quyết định có sẵn. Người…
Xem thêm
AI trong y tế: Chẩn đoán bệnh từ hình ảnh y khoa và phát hiện thuốc mới
AI trong y tế đang thay đổi cách chẩn đoán và điều trị như thế nào AI trong y tế (Artificial Intelligence in Healthcare) đang trở thành một trong những…
Xem thêm
Vector Database cho RAG: So sánh Pinecone, Weaviate, Qdrant, Milvus
Vector Database là gì? Vector database (cơ sở dữ liệu vector) là loại database chuyên biệt được thiết kế để lưu trữ, quản lý và truy xuất các vector embedding…
Xem thêm
RAG là gì? Giải pháp Retrieval Augmented Generation cho LLM
RAG là gì? Retrieval-Augmented Generation (RAG) là kỹ thuật tiên tiến trong trí tuệ nhân tạo, kết hợp khả năng sinh văn bản của mô hình ngôn ngữ lớn (LLM)…
Xem thêm