LangGraph: Framework AI Agent trạng thái dựa trên đồ thị

LangGraph là gì? LangGraph là framework mã nguồn mở do LangChain AI phát triển, chuyên dụng để xây dựng các AI Agent có trạng thái phức tạp. Khác với các…

Xem thêm

LLM Inference Optimization: vLLM, TGI, llama.cpp, TensorRT-LLM so sánh chi tiết

LLM Inference Optimization: vLLM, TGI, llama.cpp, TensorRT-LLM so sánh chi tiết Sau khi huấn luyện xong LLM, phần tốn kém nhất là inference — chạy mô hình để sinh văn…

Xem thêm

Prompt Engineering Cơ Bản: Kỹ thuật tối ưu prompt cho LLM hiệu quả

Prompt Engineering Cơ Bản: Kỹ thuật tối ưu prompt cho LLM hiệu quả Prompt engineering là nghệ thuật viết hướng dẫn (prompt) để large language model (LLM) trả về kết…

Xem thêm

LoRA: Kỹ thuật fine-tuning LLM tiết kiệm 99% tham số

LoRA (Low-Rank Adaptation) là kỹ thuật điều chỉnh mô hình ngôn ngữ lớn (LLM) hiệu quả nhất hiện nay, cho phép fine-tuning các mô hình hàng tỷ tham số chỉ…

Xem thêm
Qwen-Agent featured

Qwen-Agent: Framework AI Agent Đa Công Cụ Từ Alibaba Hỗ Trợ RAG Và Tool Calling

Qwen-Agent là gì? Qwen-Agent là framework mã nguồn mở để phát triển ứng dụng LLM (Large Language Model), được phát triển bởi đội ngũ Qwen thuộc Alibaba Group. Framework này…

Xem thêm

Ollama là gì? Chạy LLM nguồn mở cục bộ hoàn toàn miễn phí

Ollama là công cụ chạy mô hình ngôn ngữ lớn (LLM) trực tiếp trên máy tính cá nhân, hoàn toàn miễn phí, không cần GPU đắt tiền hay kết nối…

Xem thêm

AI Agent trong game: NPC thông minh thay thế kịch bản cũ

NPC truyền thống bị giới hạn bởi kịch bản cố định Trong game hiện đại, nhân vật không chơi thường chỉ phản ứng theo cây quyết định có sẵn. Người…

Xem thêm

AI trong y tế: Chẩn đoán bệnh từ hình ảnh y khoa và phát hiện thuốc mới

AI trong y tế đang thay đổi cách chẩn đoán và điều trị như thế nào AI trong y tế (Artificial Intelligence in Healthcare) đang trở thành một trong những…

Xem thêm

Vector Database cho RAG: So sánh Pinecone, Weaviate, Qdrant, Milvus

Vector Database là gì? Vector database (cơ sở dữ liệu vector) là loại database chuyên biệt được thiết kế để lưu trữ, quản lý và truy xuất các vector embedding…

Xem thêm

RAG là gì? Giải pháp Retrieval Augmented Generation cho LLM

RAG là gì? Retrieval-Augmented Generation (RAG) là kỹ thuật tiên tiến trong trí tuệ nhân tạo, kết hợp khả năng sinh văn bản của mô hình ngôn ngữ lớn (LLM)…

Xem thêm