Bản tin công nghệ quốc tế · dịch tiếng Việt 11.09.2026 RSS
Phần cứng · Wccftech

Neural Engine kép 16 nhân trên A20 Pro mạnh hơn cả GPU 7 nhân trong các tác vụ AI

Neural Engine kép 16 nhân của chip A20 Pro sở hữu thông lượng tính toán đỉnh cao vượt trội hơn cả GPU 7 nhân của nó khi xử lý các khối lượng công việc chuyên biệt. Điều này giúp thiết bị chạy mượt mà các mô hình AI cục bộ nhỏ, tính năng nhận diện giọng nói và xử lý hình ảnh thời gian thực.

Wccftech11.09.20263 phút đọc1 lượt đọc
Ảnh: Wccftech

Không cần phải bàn cãi khi A20 Pro thực sự là một kỳ quan trong thế giới chipset điện thoại thông minh, với những điểm số đơn nhân và đa nhân mới nhất đã củng cố vững chắc danh tiếng của nó trong ngành công nghiệp. Tuy nhiên, chúng ta vẫn đang tiếp tục khám phá thêm những thành tựu ấn tượng của SoC này, với điểm mới nhất là Neural Engine kép 16 nhân của nó được cho là có khả năng tính toán đỉnh cao cao hơn cả GPU 7 nhân, với điều kiện các khối lượng công việc đó được thiết kế riêng cho NPU.

Chạy các mô hình AI 3B trên thiết bị và xử lý câu lệnh là nhiệm vụ chuyên biệt cho Neural Engine kép 16 nhân của A20 Pro, mang lại hiệu năng đỉnh cao vượt trội

Trên mạng xã hội X, Max Weinbach đã đề cập đến một chi tiết thú vị về cả A20 Pro và M6; mức tăng hiệu năng do Neural Engine kép 16 nhân mang lại có thể vượt qua cả GPU, giả định rằng các tác vụ đó tận dụng triệt để thành phần này. Đương nhiên, các tác vụ đòi hỏi đồ họa nặng hoặc các hiệu ứng chuyển động đặc biệt sẽ chậm như rùa bò nếu buộc Neural Engine phải đảm nhận.

Thay vào đó, các mô hình AI nhỏ với tham số 3B hoặc việc xử lý câu lệnh có thể được Neural Engine mới xử lý một cách dễ dàng, giúp giải phóng lượng lớn tài nguyên cho CPU và GPU. Thêm vào đó, quá trình xử lý câu lệnh trong giai đoạn prefill đối với các mô hình AI đã lượng tử hóa được ánh xạ trực tiếp vào các đường ống của Neural Engine, biến đây trở thành một tác vụ khác được thiết kế riêng cho linh kiện này.

Các tính năng nhận diện giọng nói trên thiết bị hoặc cải tiến âm thanh thời gian thực cũng được thiết kế “đo ni đóng giày” cho NPU, giống như các tính năng thị giác như ước tính độ sâu camera thời gian thực, làm mờ hậu cảnh, nhận diện văn bản và phân đoạn hình ảnh. Tuy nhiên, như bạn đã biết, nhiều tác vụ khác vẫn sẽ quay về xử lý trên CPU và GPU, chẳng hạn như các phép toán dấu phẩy động FP32 hoặc 64-bit chưa lượng tử hóa, hoặc các tensor thay đổi hình dạng liên tục.

Quay trở lại với AI trên thiết bị, việc tạo token đơn cho LLM có thể gặp tình trạng quá tải do độ trễ phân phối của Neural Engine, khiến CPU hoặc GPU trở nên phù hợp hơn với tác vụ này. Những lô hàng iPhone 18 Pro, iPhone 18 Pro Max và iPhone Duo đầu tiên vẫn chưa được phát hành, nhưng cuối cùng chúng ta cũng sẽ bắt gặp một số tác vụ được thiết kế đặc biệt cho Neural Engine kép 16 nhân, giúp minh họa rõ hơn những gì bản nâng cấp này thực sự có thể làm được, vì vậy hãy cùng đón chờ.


Cùng chuyên mục · Phần cứng
🚀 VGSNews
Phần cứng

Nhà sáng lập Furo rời Thung lũng Silicon để về Đức: Quyết định nước cờ thông minh

Startup phần mềm lưu trữ năng lượng công nghiệp Furo đã huy động thành công 4 triệu USD từ các nhà đầu tư Mỹ sau khi…

TechCrunch · 5 phút đọc
Phần cứng

OWC ra mắt hub USB4 40Gbps nhỏ gọn, hỗ trợ hai màn hình 4K và sạc 81W

OWC vừa công bố một mẫu hub USB4 nhỏ gọn với băng thông 40Gbps, hỗ trợ xuất hình tối đa hai màn hình 4K và cung cấp…

Notebookcheck · 3 phút đọc
Phần cứng

NVIDIA RTX 4090 giảm điện áp: Tiết kiệm 47W điện năng mà vẫn giữ nguyên hiệu năng DLSS 5

Một thử nghiệm mới cho thấy việc giảm điện áp (undervolt) cho card đồ họa NVIDIA GeForce RTX 4090 giúp cắt giảm tới 47W…

TechPowerUp · 2 phút đọc