Ollama là gì? Chạy LLM nguồn mở cục bộ hoàn toàn miễn phí
Ollama là công cụ chạy mô hình ngôn ngữ lớn (LLM) trực tiếp trên máy tính cá nhân, hoàn toàn miễn phí, không cần GPU đắt tiền hay kết nối…
Xem thêm
AI Agent trong game: NPC thông minh thay thế kịch bản cũ
NPC truyền thống bị giới hạn bởi kịch bản cố định Trong game hiện đại, nhân vật không chơi thường chỉ phản ứng theo cây quyết định có sẵn. Người…
Xem thêm
AI trong y tế: Chẩn đoán bệnh từ hình ảnh y khoa và phát hiện thuốc mới
AI trong y tế đang thay đổi cách chẩn đoán và điều trị như thế nào AI trong y tế (Artificial Intelligence in Healthcare) đang trở thành một trong những…
Xem thêm
Vector Database cho RAG: So sánh Pinecone, Weaviate, Qdrant, Milvus
Vector Database là gì? Vector database (cơ sở dữ liệu vector) là loại database chuyên biệt được thiết kế để lưu trữ, quản lý và truy xuất các vector embedding…
Xem thêm
RAG là gì? Giải pháp Retrieval Augmented Generation cho LLM
RAG là gì? Retrieval-Augmented Generation (RAG) là kỹ thuật tiên tiến trong trí tuệ nhân tạo, kết hợp khả năng sinh văn bản của mô hình ngôn ngữ lớn (LLM)…
Xem thêm
Function Calling trong LLM: Cách AI gọi tool và thực thi hành động
Function Calling là gì? Function Calling là kỹ thuật cho phép mô hình ngôn ngữ lớn (LLM) gọi các hàm bên ngoài thay vì chỉ sinh văn bản thuần. Thay…
Xem thêm
Model Context Protocol là gì?
Model Context Protocol là gì? Model Context Protocol (MCP) là chuẩn mở do Anthropic đề xuất, cho phép AI models kết nối với nguồn dữ liệu bên ngoài và công…
Xem thêm
CrewAI: Framework xây dựng AI Agent đa vai trò tự động hóa quy trình
CrewAI là gì? CrewAI là framework Python mã nguồn mở cho phép xây dựng hệ thống multi-agent (đa tác nhân) nơi các AI agent làm việc cùng nhau như một…
Xem thêm
AutoGen: Microsoft Multi-Agent Framework
AutoGen: Microsoft Multi-Agent Framework Tự động hóa phức tạp với AutoGen — framework từ Microsoft Research giúp các AI Agent tự động trao đổi, hợp tác và giải quyết bài…
Xem thêm
Structured Output từ LLM: Enforce JSON Schema với Instructor, Outlines, Pydantic
Khi sử dụng LLM trong production, bạn không chỉ cần câu trả lời hay — bạn cần câu trả lời có cấu trúc, có kiểu, có thể chạy code tiếp….
Xem thêm