Bỏ qua tới nội dung chính
Quay lại tin tức

NVIDIA DGX Spark 64GB mang đến cho các nhà phát triển nhiều cách hơn để xây dựng và mở rộng AI cục bộ.

NVIDIA AI Blog· Allen Bourgoyne· 2/10/2026models

Trí tuệ nhân tạo (AI) cục bộ đang ngày càng trở nên hữu ích. Khi các tác nhân AI chuyển từ giai đoạn thử nghiệm sang phát triển hàng ngày, các mô hình mở ngày càng mạnh mẽ hơn đang được thu nhỏ để phù hợp với nhiều thiết bị hơn, mang lại cho các nhà phát triển nhiều khả năng chạy cục bộ hơn. Trong tháng này, NVIDIA DGX Spark sẽ có mặt trên thị trường với bộ nhớ hợp nhất 64GB từ các đối tác sản xuất hàng đầu – Acer, ASUS, Dell, Gigabyte, HP và MSI – cung cấp cho các nhà phát triển, nhà nghiên cứu và những người đam mê AI một cấu hình mới với DGX OS và bộ phần mềm NVIDIA AI sẵn sàng sử dụng ngay từ ngày đầu tiên. Mã sản phẩm (SKU) mới này chạy các tác nhân cục bộ mạnh mẽ trên thiết bị – một cách riêng tư, không phụ thuộc vào đám mây.

Trí tuệ nhân tạo (AI) cục bộ đang ngày càng trở nên hữu ích. Khi các tác nhân AI (AI agents) chuyển từ giai đoạn thử nghiệm sang phát triển hàng ngày, các mô hình mở ngày càng có năng lực đang được thu nhỏ để phù hợp với nhiều thiết bị hơn, mang lại cho các nhà phát triển nhiều khả năng chạy cục bộ hơn. Trong tháng này, NVIDIA DGX Spark sẽ có mặt trên thị trường với bộ nhớ hợp nhất 64GB từ các đối tác sản xuất hàng đầu – Acer, ASUS, Dell, Gigabyte, HP và MSI – cung cấp cho các nhà phát triển, nhà nghiên cứu và những người đam mê AI một cấu hình mới với DGX OS và bộ phần mềm NVIDIA AI sẵn sàng sử dụng ngay từ ngày đầu tiên. Mã sản phẩm (SKU) mới này chạy các tác nhân cục bộ có năng lực trên thiết bị – một cách riêng tư, không phụ thuộc vào đám mây. Khi khối lượng công việc tăng lên, hai thiết bị có thể kết nối thành cụm thông qua NVIDIA Sync Cluster Assistant mà không cần thiết lập bổ sung. Một khởi điểm mới cho siêu máy tính AI cá nhân DGX Spark kết hợp khả năng tính toán NVIDIA Grace Blackwell, bộ nhớ hợp nhất, mạng NVIDIA ConnectX-7 và bộ phần mềm AI tăng tốc NVIDIA CUDA trong một hệ thống. Đây là một nền tảng AI cục bộ hoàn chỉnh cho các tác nhân, suy luận, tinh chỉnh, khoa học dữ liệu và phát triển biên. Siêu máy tính AI cá nhân nhỏ gọn này cung cấp một không gian để thử nghiệm các mô hình và dữ liệu riêng của nhà phát triển mà không cần phải sử dụng một phiên bản đám mây cho mỗi tác vụ. Cấu hình 64GB mới, chỉ có sẵn từ các đối tác sản xuất, giữ cho nền tảng ở mức giá phải chăng trong khi vẫn duy trì siêu chip GB10 Grace Blackwell, DGX OS và bộ phần mềm NVIDIA AI đầy đủ – tương tự như mẫu 128GB. Nó hỗ trợ các mô hình lên đến 100 tỷ tham số và các ứng dụng tác nhân được xây dựng trên chúng, hoàn toàn trên thiết bị. Hai thiết bị 64GB được kết nối thành cụm không chỉ tăng gấp đôi bộ nhớ. Trong thử nghiệm Qwen 3.8 27B của NVIDIA, hai hệ thống 64GB được kết nối thành cụm mang lại hiệu suất cao hơn tới 1,7 lần so với một hệ thống đơn lẻ, với khả năng mở rộng khi khối lượng công việc yêu cầu. DGX Spark được xuất xưởng sẵn sàng cho việc phát triển tác nhân ngay từ ngày đầu tiên – NVIDIA Agent Toolkit, thư viện CUDA-X AI, mô hình mở Nemotron và các môi trường chạy phổ biến như Ollama, vLLM, và PyTorch với CUDA đều được hỗ trợ ngay lập tức. Các nhà phát triển có thể chuyển từ bật nguồn đến chạy mô hình chỉ trong vài phút. Blender là một trong những nhà cung cấp ứng dụng sáng tạo lớn đầu tiên hỗ trợ nền tảng này, với một trình cài đặt có sẵn để tải xuống sẽ sớm ra mắt. Mở rộng với NVIDIA Sync Cluster Assistant Các nhà phát triển có thể bắt đầu với dung lượng bộ nhớ mà dự án của họ cần hiện tại và xây dựng trên một nền tảng được thiết kế để mở rộng liền mạch các cụm đa nút cho khối lượng công việc lớn hơn khi quy trình của họ phát triển. Mỗi DGX Spark đều được trang bị sẵn một NIC NVIDIA ConnectX-7 tích hợp. Ngoài ra, hai thiết bị có thể kết nối trực tiếp bằng cáp QSFP, gộp bộ nhớ của chúng lên 128GB và mở rộng hỗ trợ mô hình lên đến 200 tỷ tham số, đồng thời cung cấp băng thông bộ nhớ gấp đôi và hiệu suất cao hơn tới 1,7 lần. Ứng dụng NVIDIA Sync cấu hình cụm đa nút này một cách liền mạch. Tính năng hỗ trợ cụm phát hiện các thiết bị được kết nối, xác thực cấu hình thiết bị và cấu hình mạng ConnectX-7, giúp các nhà phát triển tập trung vào công việc của họ thay vì cơ sở hạ tầng. Mỗi nút chạy cùng một bộ phần mềm NVIDIA, do đó không cần cấu hình lại bất cứ điều gì khi mở rộng từ một thiết bị lên hai. Vào cuối tháng này, NVIDIA Sync Model Launcher sẽ giúp việc chạy AI cục bộ trở nên đơn giản chỉ với vài cú nhấp chuột. Các nhà phát triển có thể tải xuống và khởi chạy Qwen3.8 27B trên một hệ thống DGX Spark đơn lẻ hoặc một cụm, với NVIDIA Sync cấu hình mô hình để chạy trên các thiết bị được kết nối và giúp mô hình có thể truy cập được từ máy tính xách tay của người dùng. Trình khởi chạy cũng sẽ thiết lập OpenCode để sử dụng mô hình, cho phép các nhà phát triển bắt đầu viết mã trong trình duyệt của họ. Các trường hợp sử dụng của nhà phát triển trên DGX Spark Cấu hình DGX Spark 64GB mới hỗ trợ công việc thực tế ngay từ ngày đầu tiên. Với các mô hình lên tới 100 tỷ tham số chạy hoàn toàn trên thiết bị, các nhà phát triển và những người đam mê có thể bắt đầu với một hệ thống duy nhất cho các mô hình phù hợp với bộ nhớ của nó, hoặc kết nối nhiều hệ thống DGX Spark với NVIDIA Sync Cluster Assistant cho các khối lượng công việc cần nhiều bộ nhớ và sức mạnh tính toán hơn. Dưới đây là ba ví dụ về quy trình làm việc: Chạy tác nhân AI liên tục: Duy trì một tác nhân viết mã hoặc nghiên cứu chạy trên DGX Spark, sẵn sàng xem xét mã, phân tích tài liệu hoặc thực hiện các tác vụ đa bước. Một cụm cung cấp thêm dung lượng cho các mô hình lớn hơn, cửa sổ ngữ cảnh dài hơn hoặc nhiều tác nhân hoạt động cùng lúc. Cung cấp năng lượng cho các ứng dụng AI trên PC hàng ngày của bạn: Chạy mô hình tạo ngôn ngữ hoặc hình ảnh trên DGX Spark trong khi sử dụng một tác nhân hoặc ứng dụng sáng tạo trên máy tính xách tay hoặc máy tính để bàn. DGX Spark xử lý suy luận mô hình, giải phóng PC cho các công việc khác. Mở rộng quy mô khi công việc phát triển: Khi một tác vụ đơn lẻ vượt quá một đơn vị – chạy một mô hình lớn hơn, một cửa sổ ngữ cảnh dài hơn hoặc các yêu cầu tác nhân đồng thời – hai hệ thống DGX Spark 64GB được kết nối qua mạng 200 GbE thông qua NVIDIA Sync Cluster Assistant sẽ gộp bộ nhớ của chúng lên 128GB. Quy trình làm việc tương tự đã chạy trên một đơn vị sẽ mở rộng lên hai đơn vị mà không cần cấu hình lại môi trường phần mềm. Bắt đầu với DGX Spark DGX Spark 64GB có sẵn từ Acer, ASUS, Dell, Gigabyte, HP và MSI vào thứ Sáu, ngày 23/10, với giá khởi điểm từ 4.999 USD. Để bắt đầu: Tải xuống một framework suy luận được hỗ trợ — llama.cpp, Ollama, vLLM hoặc LM Studio. Tải xuống mô hình cục bộ được khuyến nghị cho quy trình làm việc. Để mở rộng lên hai đơn vị, hãy kết nối chúng qua các cổng NVIDIA ConnectX-7 và khởi chạy NVIDIA Sync Cluster Assistant — nó sẽ cấu hình mạng và định tuyến khối lượng công việc tự động. Để biết các hướng dẫn AI tác nhân trên DGX Spark, hãy truy cập các trang NemoClaw, OpenClaw, Hermes Agent và OpenShell trên build.nvidia.com. #ICYMI: Thêm cập nhật từ NVIDIA Local AI Khám phá các hướng dẫn trên build.nvidia.com/spark cho DGX Spark. Các hướng dẫn sau sẽ sớm có mặt trên các thiết bị 64GB: Phục vụ LLM với vLLM Chạy OpenClaw với LLM cục bộ Kết nối nhiều DGX Spark cho các khối lượng công việc phân tán Các PC Windows mới được trang bị NVIDIA RTX Spark sẽ ra mắt trong tháng này từ Acer, ASUS, Dell, HP, Lenovo, Microsoft và MSI. Đăng ký nhận bản tin RTX Spark để nhận các cập nhật trong tương lai. Qwen-Image-2.1 của Alibaba kết hợp tạo và chỉnh sửa hình ảnh.

Nguồn tin: NVIDIA AI Blog — Tác giả: Allen Bourgoyne. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.