
Meta phát hành AI mã nguồn mở Muse Glimmer chạy ngay trên laptop
Meta vừa phát hành Muse Glimmer, mô hình AI 30 tỷ tham số được thiết kế để chạy trực tiếp trên laptop hoặc máy tính cá nhân, không cần kết nối internet. Toàn bộ weights của mô hình được công bố trên Hugging Face theo giấy phép Apache 2.0, cho phép tải về, chỉnh sửa và thương mại hóa tự do. Động thái này đánh dấu bước ngoặt chiến lược của Meta khi quay lại hướng đi open-weight, đối đầu trực tiếp với OpenAI và Anthropic đang giữ mô hình đóng.

Muse Glimmer là gì?
Muse Glimmer là mô hình AI 30B tham số xử lý cả văn bản và hình ảnh, được huấn luyện trên hơn 100 ngôn ngữ. Điểm khác biệt lớn nhất so với các mô hình đám mây là Glimmer chạy hoàn toàn cục bộ: thực hiện các tác vụ agent đa bước như gọi công cụ, viết và sửa code, thao tác file, chụp màn hình, hoạt động liên tục mà không cần internet. Đây là bản mở của Muse Spark 1.2, mô hình đóng mạnh nhất của Meta ra mắt hồi tháng 4, và Spark 1.2 cũng được mở weights trong cùng ngày công bố.
Theo bài viết trên TechCrunch, mô hình được phát triển bởi Meta Superintelligence Labs do Alexander Wang, cựu CEO Scale AI, dẫn dắt. Ngay sau công bố, cổ phiếu Meta tăng, cho thấy giới đầu tư đánh giá cao chiến lược mở này.
Thông số kỹ thuật nổi bật
- 30 tỷ tham số, hỗ trợ đa ngôn ngữ và đa phương thức văn bản + hình ảnh
- Weights mở theo giấy phép Apache 2.0 trên Hugging Face
- Bản nén 4-bit dưới 20GB, chạy được trên GPU 24-32GB như RTX 5090
- Kỹ thuật giải mã suy đoán DFlash giúp tăng tốc decode lên 233 token/giây trên RTX 5090, gấp 3,1 lần
- Điểm MCP Atlas 75,5, vượt Gemma4-31B (54,2) và Qwen3.6-27B (62,5)
- AIME 2026 đạt 94,7 và SWE-Bench Pro đạt 51,2
Điểm số benchmark trên do chính Meta công bố nên cần đối chiếu với các bài đánh giá độc lập trước khi kết luận. Tuy nhiên, con số 233 token/giây trên một GPU tiêu dùng cho thấy tiềm năng thực tế của kỹ thuật DFlash.

Vì sao Meta mở weights?
Cùng ngày công bố, Mark Zuckerberg đăng bài luận dài 6.500 chữ với tiêu đề “The Future Is for Everyone” trên Instagram. Bài luận kêu gọi Mỹ nới lỏng các rào cản về dữ liệu huấn luyện và distillation để cạnh tranh với DeepSeek và Alibaba Qwen của Trung Quốc. Zuckerberg lập luận rằng nếu Mỹ tiếp tục giữ mô hình đóng, các mô hình mã nguồn mở từ Trung Quốc sẽ chiếm lĩnh thị trường toàn cầu.
Động thái mở weights Muse Spark 1.2 – mô hình đóng mạnh nhất – cũng cho thấy Meta chấp nhận hy sinh lợi thế độc quyền để xây dựng hệ sinh thái và niềm tin của cộng đồng developer. Đây là chiến lược từng thành công với Llama, mô hình mã nguồn mở được tải về hàng trăm triệu lần.
Ý nghĩa với người dùng và lập trình viên

Với người dùng cá nhân, Muse Glimmer mở ra khả năng chạy trợ lý AI riêng tư trên chính chiếc laptop của mình mà không lo dữ liệu bị gửi lên đám mây. Dữ liệu nhạy cảm như tài liệu công việc, thông tin tài chính, mã nguồn dự án vẫn nằm trên máy cục bộ.
Với lập trình viên, giấy phép Apache 2.0 cho phép tích hợp Glimmer vào sản phẩm thương mại mà không cần trả phí hoặc xin phép. Khả năng chạy agent đa bước cục bộ giúp xây dựng các ứng dụng tự động hóa, công cụ hỗ trợ code, trợ lý viết lách hoạt động offline.
Một điểm đáng chú ý khác: Glimmer yêu cầu GPU 24-32GB, vẫn nằm ngoài tầm với của máy tính phổ thông chỉ có 8-16GB RAM tích hợp. Tuy nhiên, xu hướng nén 4-bit và tối ưu hóa mô hình đang giảm dần yêu cầu phần cứng mỗi năm, tương tự như cách Llama từng chạy được trên các máy tính tầm trung.
Kết luận
Muse Glimmer là minh chứng rõ ràng cho cuộc đua AI cá nhân hóa: thay vì chạy đua frontier model khổng lồ, Meta chọn hướng mô hình mở chạy tại nhà. Điều này tạo áp lực buộc OpenAI và Anthropic phải cân nhắc lại chiến lược đóng. Với người dùng cuối, tương lai gần là mỗi người một trợ lý AI riêng chạy trên chính thiết bị của mình.
Tham khảo thêm:
