Meta Muse: Giải thích về tính năng, cách hoạt động và khả năng của nó
Meta đã tham gia cuộc đua tác nhân AI một cách mạnh mẽ.
Meta Muse: Giải thích về sản phẩm, cách hoạt động và khả năng - KDnuggets
Ngày 8/9/2026, Meta đã ra mắt Muse, một tác nhân AI cá nhân được thiết kế để không chỉ trả lời câu hỏi. Muse có thể duyệt web, kết nối với các ứng dụng của người dùng, gửi email, thực hiện giao dịch mua hàng, điền biểu mẫu, quản lý các mục tiêu dài hạn và tiếp tục hoạt động ngay cả khi người dùng đóng ứng dụng.
Các chatbot như những phiên bản đầu tiên của ChatGPT chủ yếu tuân theo một mô hình đơn giản:
Người dùng hỏi — AI trả lời.
Muse được thiết kế dựa trên một mô hình khác:
Người dùng đưa ra mục tiêu — Muse lập kế hoạch — sử dụng công cụ — thực hiện hành động — giám sát tiến độ — quay lại khi cần người dùng.
Giám đốc điều hành Meta, Mark Zuckerberg, đã phát biểu khi công bố sản phẩm:
"Giới thiệu Muse, tác nhân cá nhân hiểu mục tiêu của bạn và làm việc 24/7 để hoàn thành công việc cho bạn."
Muse nhanh chóng leo lên các bảng xếp hạng của App Store Hoa Kỳ, trong khi khả năng thực hiện các hành động thực tế của nó cũng đặt ra những câu hỏi về quyền riêng tư, độ tin cậy, bảo mật và mức độ kiểm soát mà chúng ta nên giao cho các tác nhân AI.
Vậy, Meta Muse chính xác là gì? Và điều gì khiến nó khác biệt so với các trợ lý AI mà chúng ta đã có?
Meta Muse là gì và cách hoạt động?
Muse là tác nhân AI cá nhân của Meta.
Nó được xây dựng để hiểu mục tiêu của người dùng, ghi nhớ thông tin hữu ích về người dùng, kết nối với các dịch vụ người dùng sử dụng và thực hiện các tác vụ thay mặt người dùng. Người dùng có thể giao tiếp với Muse bằng giao diện trò chuyện thông thường, thông qua ứng dụng Muse hoặc qua WhatsApp.
Khi người dùng giao một tác vụ cho Muse, một số thành phần sẽ hoạt động cùng nhau ở hậu trường.
1. Người dùng đưa ra mục tiêu cho Muse
Giả sử người dùng nói:
Lên kế hoạch cho chuyến đi ba ngày đến New York vào tháng tới. Tìm chuyến bay phù hợp với lịch trình của tôi, chọn lọc các khách sạn gần Manhattan và giữ tổng chi phí trong ngân sách của tôi.
Một chatbot có thể đưa ra các đề xuất và liên kết.
Muse có thể tiến xa hơn.
Nó có thể điều tra các lựa chọn, duyệt web, so sánh kết quả, ghi nhớ các ràng buộc của người dùng, tiếp tục làm việc trong nền và yêu cầu phê duyệt khi một hành động cần xác nhận của người dùng.
2. Muse Spark lập kế hoạch tác vụ
Công cụ suy luận đằng sau Muse là Muse Spark 1.3.
Meta cho biết mô hình này đã được huấn luyện đặc biệt cho các quy trình làm việc tác nhân (agentic workflows) dài hạn. Thay vì xử lý từng lời nhắc một cách độc lập, nó có thể theo dõi thông tin đã được khám phá trước đó, hoạt động trên nhiều quy trình làm việc, sử dụng công cụ, xác định các lỗ hổng trong kế hoạch và tiếp tục làm việc hướng tới một mục tiêu lớn hơn.
Điều này quan trọng vì các tác vụ trong thế giới thực hiếm khi chỉ liên quan đến một lệnh gọi API duy nhất.
Ví dụ, việc đặt một chuyến đi có thể yêu cầu:
Hiểu các yêu cầu
↓
Tìm kiếm chuyến bay
↓
So sánh giá
↓
Tìm kiếm khách sạn
↓
Kiểm tra lịch
↓
Tạo lịch trình
↓
Yêu cầu người dùng phê duyệt
↓
Hoàn tất đặt chỗ
Muse cũng có thể tạo ra các tác nhân phụ (subagents) để xử lý đồng thời các phần của nhiệm vụ phức tạp. Meta cho biết họ đã huấn luyện hệ thống cơ bản cho việc phối hợp đa tác nhân, bên cạnh khả năng suy luận ngữ cảnh dài và gọi công cụ.
3. Muse Chạy Bên Trong Máy Tính Ảo Riêng
Đây có lẽ là phần thú vị nhất về mặt kỹ thuật của Muse.
Thay vì cấp cho mô hình quyền truy cập không hạn chế vào cơ sở hạ tầng của Meta, mỗi người dùng sẽ nhận được một máy ảo (VM) Linux được cách ly.
Máy ảo này chứa không gian làm việc, tệp, trình duyệt, công cụ và các tác vụ chạy dài của Muse.
Điều này có nghĩa là Muse có thể thực hiện các việc như:
Duyệt các trang web
Làm việc với các tệp
Chạy mã
Sử dụng các công cụ dòng lệnh
Quản lý một số tác nhân phụ
Lên lịch các công việc định kỳ
Duy trì trạng thái liên tục giữa các phiên
Do đó, Muse của bạn có một thứ gần giống với một máy tính cố định hơn là một phiên chatbot tạm thời.
4. Các Trình Kết Nối Cung Cấp Cho Muse Quyền Truy Cập Vào Các Ứng Dụng Khác
Muse trở nên hữu ích hơn khi bạn kết nối nó với các dịch vụ bên ngoài.
Các tích hợp này được gọi là trình kết nối (connectors).
Ví dụ, các trình kết nối có thể cho phép Muse tương tác với email, lịch, dịch vụ của Meta, dịch vụ mua sắm và các ứng dụng khác.
Phần thú vị là Muse không hoàn toàn bị giới hạn bởi các trình kết nối mà Meta đã tạo ra. Meta cho biết Muse cũng có thể viết các tích hợp tùy chỉnh cho các dịch vụ có giao diện lập trình ứng dụng (API) hoặc giao diện dòng lệnh (CLI) phù hợp.
Điều này có khả năng thay đổi cách chúng ta nghĩ về các ứng dụng.
Thay vì tự mình mở năm ứng dụng khác nhau, bạn có thể chỉ cần cho tác nhân biết kết quả mong muốn, trong khi nó sẽ xác định những dịch vụ nào cần được sử dụng.
5. Sentinel Giám Sát Những Gì Muse Được Phép Làm
Việc cấp cho một AI quyền truy cập vào email, hệ thống thanh toán và các trang web tạo ra một vấn đề rõ ràng:
Điều gì sẽ xảy ra nếu tác nhân mắc lỗi — hoặc bị thao túng bởi nội dung độc hại trên một trang web?
Câu trả lời của Meta là một tác nhân khác có tên Sentinel.
Sentinel được tách biệt khỏi Muse ở cấp độ hệ thống và hoạt động như một cơ quan cấp phép.
Muse có thể đề xuất một hành động, nhưng Sentinel sẽ quyết định liệu hành động đó nên:
Được phép
Bị chặn
Yêu cầu người dùng phê duyệt
Tất cả hoạt động mạng đi ra cũng phải thông qua các kiểm soát bảo mật này.
Về mặt khái niệm:
Muse muốn thực hiện một hành động
↓
Sentinel
/ | \
Cho phép Chặn Hỏi người dùng
Kiến trúc này đặc biệt quan trọng để phòng thủ chống lại tấn công tiêm nhiễm lời nhắc (prompt injection), nơi văn bản độc hại trên một trang web, email hoặc tài liệu cố gắng lừa tác nhân AI làm theo các hướng dẫn độc hại.
Meta kết hợp huấn luyện chống tiêm nhiễm lời nhắc ở cấp độ mô hình, nhãn nội dung không đáng tin cậy, bộ phân loại phát hiện, trình duyệt
Nguồn tin: KDnuggets — Tác giả: Kanwal Mehreen. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.