HomeCông nghệ AIMeta ra mắt Muse Glimmer, AI chạy trên laptop 2026

Meta ra mắt Muse Glimmer, AI chạy trên laptop 2026

Meta vừa phát hành Muse Glimmer, mô hình AI mã nguồn mở 30 tỷ tham số có thể chạy trực tiếp trên một máy tính cá nhân chỉ cần một card đồ hoạ phổ thông, theo công bố ngày 10/8 của Meta Superintelligence Labs. Đây là bước đi mới nhất trong cuộc đua thu nhỏ mô hình AI mạnh để chạy ngay trên thiết bị cá nhân, thay vì phụ thuộc hoàn toàn vào máy chủ đám mây tốn kém.

Xu hướng AI “chạy tại chỗ” (on-device/local) đang nổi lên như một hướng đi song song với các mô hình khổng lồ chạy trên đám mây, khi doanh nghiệp và lập trình viên ngày càng để ý tới chi phí gọi API, độ trễ và quyền riêng tư dữ liệu. Muse Glimmer là câu trả lời mới nhất của Meta cho xu hướng này.

Muse Glimmer là gì và vì sao chạy gọn trên một chiếc laptop phổ thông

Muse Glimmer là mô hình ngôn ngữ dạng causal 30 tỷ tham số, được chưng cất (distill) từ mô hình Muse Spark lớn hơn và trang bị thêm một bộ mã hoá tri giác (perception encoder) riêng để xử lý đa phương thức. Mô hình được thiết kế chuyên cho các tác vụ agent tự động chạy liên tục trên phần cứng cá nhân, như trợ lý lập trình cục bộ, chấm điểm kết quả AI khác (LLM-as-judge) và các quy trình agent luôn bật (always-on).

Thông thường một mô hình 30 tỷ tham số cần khoảng 55GB RAM để chạy, vượt quá khả năng của hầu hết máy tính cá nhân. Đội ngũ kỹ sư Meta cho biết đã dùng loạt kỹ thuật tối ưu, trong đó có lượng tử hoá 4-bit, để nén dung lượng mô hình xuống dưới 20GB kèm tốc độ xử lý nhanh hơn khoảng 3,1 lần. Nhờ vậy, Muse Glimmer chạy được trên máy Mac hoặc PC cá nhân chỉ với một card đồ hoạ tiêu dùng thay vì cần cụm máy chủ GPU chuyên dụng.

Về năng lực, Meta công bố Muse Glimmer vượt trội hơn hai đối thủ cùng phân khúc là Gemma 4 bản 31 tỷ tham số của Google và Qwen 3.6 bản 27 tỷ tham số của Alibaba trên gần như mọi phép thử liên quan tới khả năng agent. Mô hình hỗ trợ cửa sổ ngữ cảnh 131.000 token và hơn 100 ngôn ngữ, được phát hành theo giấy phép Apache 2.0 cho phép sử dụng thương mại miễn phí, trọng số tải về công khai trên Hugging Face.

GPU tiêu dùng chạy Muse Glimmer
Card đồ hoạ tiêu dùng đủ sức chạy Muse Glimmer tại nhà

Ý nghĩa với lập trình viên và doanh nghiệp nhỏ tại Việt Nam

Với cộng đồng lập trình viên và các đội sản phẩm nhỏ tại Việt Nam, một mô hình mạnh nhưng chạy được ngay trên laptop cá nhân giúp giảm đáng kể chi phí gọi API mô hình đám mây, đặc biệt với các tác vụ chạy liên tục như trợ lý code cục bộ hay giám sát nội bộ không muốn gửi dữ liệu ra ngoài. Nhiều startup Việt Nam vốn nhạy cảm với chi phí hạ tầng có thể thử nghiệm Muse Glimmer trên máy trạm sẵn có trước khi cân nhắc đầu tư GPU chuyên dụng hoặc trả phí API.

Muse Glimmer cũng cho thấy cách tiếp cận khác của Meta so với OpenAI hay Anthropic, vốn tập trung vào các mô hình cực lớn chạy trên đám mây. Việc liên tục tung ra các mô hình mã nguồn mở cỡ vừa và nhỏ giúp Meta duy trì ảnh hưởng trong cộng đồng lập trình viên, nơi khả năng tự host và tuỳ biến mô hình thường được đánh giá cao hơn hiệu năng thô. Xu hướng nén mô hình để chạy trên phần cứng phổ thông, tương tự cách NVIDIA mở mã nguồn framework NOOA giúp lập trình viên tự xây AI agent, cho thấy cuộc đua AI năm 2026 không chỉ dừng ở việc ai có mô hình mạnh nhất, mà còn ở việc ai đưa được AI tới gần người dùng cuối nhất.

Người dùng quan tâm tìm hiểu thêm về các công cụ AI mã nguồn mở có thể tải trọng số Muse Glimmer trực tiếp từ Hugging Face để thử nghiệm trên máy cá nhân.

Nguồn: MarkTechPost.
Xem thêm: NOOA: NVIDIA biến AI agent thành 1 class Python

Hoàng Bích Ngọc
Hoàng Bích Ngọc
UX researcher tại Hà Nội, viết về AI product design. Quan tâm tới cách AI thay đổi hành vi người dùng và thiết kế trải nghiệm thông minh.
Bài viết liên quan

LEAVE A REPLY

Please enter your comment!
Please enter your name here

- Advertisment -
Google search engine

Xem nhiều nhất

Bình luận gần đây