GEEKOM ra mắt cụm máy tính mini A9 Mega chuyên chạy AI cục bộ tại IFA 2026
Tại IFA 2026, GEEKOM đã trình diễn hệ thống siêu máy tính mini gồm 4 chiếc A9 Mega kết nối qua cổng USB4 để chạy AI cục bộ. Giải pháp này giúp xử lý các tác vụ AI bảo mật cao ngay trên bàn làm việc mà không cần đưa dữ liệu lên đám mây.

Tại IFA 2026, GEEKOM tiết lộ rằng công ty đã kết nối thành công nhiều máy tính mini thành một siêu máy tính cục bộ duy nhất có khả năng chạy suy luận (inference) một cách dễ dàng. Tại gian hàng của mình, GEEKOM đã trình diễn cách họ liên kết bốn chiếc máy tính mini A9 Mega thành một cụm suy luận cục bộ. Thiết lập GEEKOM Private AI này sử dụng kết nối USB4 để liên kết trực tiếp bốn máy tính mini lại với nhau, loại bỏ hoàn toàn nhu cầu về tủ rack chuyên dụng hay phần cứng mạng độc quyền. Kết quả là một dạng siêu máy tính thu nhỏ có thể đặt ngay trên bàn làm việc, giúp giữ các khối lượng công việc và dữ liệu AI hoàn toàn ở cục bộ.
Mỗi nút (node) trong hệ thống đều dựa trên vi xử lý Ryzen AI Max+ 395 của AMD, trang bị 16 nhân CPU "Zen 5" tích hợp đồ họa Radeon 8060S và bộ nhớ thống nhất LPDDR5X dung lượng lên tới 128 GB hoạt động ở tốc độ 8.000 MT/s. Khả năng lưu trữ được cung cấp bởi hai khe cắm M.2 PCIe 4.0 x4, hỗ trợ ổ cứng dung lượng tối đa 4 TB. Hệ thống nhỏ gọn với kích thước 171 x 171,1 x 70,1 mm này cũng tích hợp các kết nối gồm hai cổng 2.5 GbE, Wi-Fi 7, Bluetooth 5.4, USB4 và HDMI 2.1. Vi xử lý có mức TDP 140 W và NPU đạt hiệu năng lên tới 50 TOPS, đồng nghĩa với việc toàn bộ hệ thống tủ rack mini sẽ tiêu thụ chưa tới 1.000 W khi chạy ở tải đỉnh, giúp thiết lập này cực kỳ tiết kiệm điện năng.
GEEKOM hướng giải pháp này tới các doanh nghiệp, những người đam mê máy trạm, hoặc bất kỳ ai phải xử lý thông tin nhạy cảm bao gồm tài liệu nội bộ, mã nguồn, thông tin xác thực và tài liệu nghiên cứu. Cụm máy tính này chạy mô hình DeepSeek V4 Flash trên cả bốn nút, với hệ điều hành Ubuntu, bộ phần mềm ROCm của AMD và bản phân phối DwarfStar của GEEKOM để quản lý khối lượng công việc. GEEKOM tuyên bố hệ thống có thể xử lý cửa sổ ngữ cảnh lên tới 250.000 token trong khi đạt tốc độ khoảng 14,61 token mỗi giây ở mức đồng thời đơn. Một API tương thích với OpenAI cũng được tích hợp sẵn, cho phép hệ thống hoạt động với các tác nhân truy xuất, lập trình và tự động hóa mà không cần gửi dữ liệu tới bất kỳ dịch vụ đám mây nào.
🖥️ GEEKOM RA MẮT CỤM MÁY TÍNH MINI A9 MEGA CHUYÊN CHẠY AI CỤC BỘ TẠI IFA 2026 Tại IFA 2026, GEEKOM tiết lộ rằng công ty đã kết nối thành công nhiều máy tính mini thành một siêu máy tính cục bộ duy nhất có khả năng chạy suy luận (inference) một cách dễ dàng. Tại gian hàng của mình, GEEKOM đã trình diễn cách họ liên kết bốn chiếc máy tính mini A9 Mega thành một cụm suy luận cục bộ. Thiết lập GEEKOM Private AI này sử dụng kết nối USB4 để liên kết trực tiếp bốn máy tính mini lại với nhau, loại bỏ hoàn toàn nhu cầu về tủ rack chuyên dụng hay phần cứng mạng độc quyền. Kết quả là một dạng siêu máy tính thu nhỏ có thể đặt ngay trên bàn làm việc, giúp giữ các khối lượng công việc và dữ liệu AI hoàn toàn ở cục bộ. Mỗi nút (node) trong hệ thống đều dựa trên vi xử lý Ryzen AI Max+ 395 của AMD, trang bị 16 nhân CPU "Zen 5" tích hợp đồ họa Radeon 8060S và bộ nhớ thống nhất LPDDR5X dung lượng lên tới 128 GB hoạt động ở tốc độ 8.000 MT/s. Khả năng lưu trữ được cung cấp bởi hai khe cắm M.2 PCIe 4.0 x4, hỗ trợ ổ cứng dung lượng tối đa 4 TB. Hệ thống nhỏ gọn với kích thước 171 x 171,1 x 70,1 mm này cũng tích hợp các kết nối gồm hai cổng 2.5 GbE, Wi-Fi 7, Bluetooth 5.4, USB4 và HDMI 2.1. Vi xử lý có mức TDP 140 W và NPU đạt hiệu năng lên tới 50 TOPS, đồng nghĩa với việc toàn bộ hệ thống tủ rack mini sẽ tiêu thụ chưa tới 1.000 W khi chạy ở tải đỉnh, giúp thiết lập này cực kỳ tiết kiệm điện năng. GEEKOM hướng giải pháp này tới các doanh nghiệp, những người đam mê máy trạm, hoặc bất kỳ ai phải xử lý thông tin nhạy cảm bao gồm tài liệu nội bộ, mã nguồn, thông tin xác thực và tài liệu nghiên cứu. Cụm máy tính này chạy mô hình DeepSeek V4 Flash trên cả bốn nút, với hệ điều hành Ubuntu, bộ phần mềm ROCm của AMD và bản phân phối DwarfStar của GEEKOM để quản lý khối lượng công việc. GEEKOM tuyên bố hệ thống có thể xử lý cửa sổ ngữ cảnh lên tới 250.000 token trong khi đạt tốc độ khoảng 14,61 token mỗi giây ở mức đồng thời đơn. Một API tương thích với OpenAI cũng được tích hợp sẵn, cho phép hệ thống hoạt động với các tác nhân truy xuất, lập trình và tự động hóa mà không cần gửi dữ liệu tới bất kỳ dịch vụ đám mây nào. 🗞 Nguồn: TechPowerUp #vgsnews #vgs #tintuc
Nguồn: TechPowerUp