NVIDIA lên kế hoạch trở lại Trung Quốc bằng chip suy luận LPU mới? (NVIDIA đã phủ nhận)
NVIDIA được cho là đang thiết kế một dòng chip suy luận mới dành riêng cho thị trường Trung Quốc, ứng dụng công nghệ LPU của Groq nhằm tuân thủ lệnh cấm vận của Mỹ. Tuy nhiên, phía NVIDIA đã nhanh chóng lên tiếng bác bỏ thông tin này.

NVIDIA đang phải đi trên dây khi đối phó với lượng khách hàng khổng lồ tại Trung Quốc, cố gắng cân bằng giữa hiệu suất của các sản phẩm dành riêng cho thị trường này và các hạn chế từ lệnh kiểm soát xuất khẩu ngặt nghèo của Mỹ.
Trong bối cảnh Bắc Kinh đang chủ động ngăn cản các doanh nghiệp nhập khẩu GPU H200 của NVIDIA - loại vốn được chính quyền Trump cho phép sử dụng tại Trung Quốc - NVIDIA dường như đang thử một con đường khác để mang lại giá trị cho khách hàng Trung Quốc mà vẫn nằm trong giới hạn kiểm soát xuất khẩu của Mỹ. Con đường hẹp này dường như tập trung vào các LPU của Groq.
NVIDIA được cho là đang thiết kế một con chip dành riêng cho Trung Quốc tận dụng LPU của Groq để cung cấp giải pháp hấp dẫn cho các tác vụ suy luận AI
The Information đưa tin rằng NVIDIA đang âm mưu quay trở lại Trung Quốc bằng cách thiết kế một con chip chuyên dụng cho suy luận mới tại đây. Con chip mới này dự kiến sẽ sẵn sàng vào cuối năm nay và sẽ trang bị Đơn vị Xử lý Ngôn ngữ (LPU) của Groq.
Đối với những ai chưa biết, NVIDIA đã ký kết thỏa thuận cấp phép công nghệ và chuyển giao tài sản/nhân sự với Groq vào tháng 12 năm 2025. Các LPU của Groq gom hàng trăm hoặc thậm chí hàng ngàn con chip chuyên dụng lại với nhau, trong đó mỗi con chip riêng lẻ chứa các khối lớn gồm các đơn vị Phân số Ma trận (MXM) và Vector (VXM) cũng như khoảng 230MB SRAM siêu nhanh. Ngoài ra, trọng số của mô hình AI được nướng cứng trực tiếp vào SRAM, hoàn toàn bỏ qua khái niệm bộ nhớ cache.
Quan trọng nhất, LPU không có bộ dự đoán nhánh hoặc bộ lập lịch phần cứng. Thay vào đó, trình biên dịch của Groq lên kế hoạch cho từng phép tính đến từng nano giây, đảm bảo rằng dữ liệu liên quan đến từ SRAM để xử lý theo nhịp độ vận hành liên tục, được lên kế hoạch tỉ mỉ, mang lại tốc độ suy luận cực nhanh.
Theo The Information, con chip mới của NVIDIA sẽ tuân thủ các quy định kiểm soát xuất khẩu của Mỹ, vốn chủ yếu vạch rõ giới hạn dung lượng HBM mà một bộ tăng tốc AI tập trung vào Trung Quốc được phép hỗ trợ, đồng thời hạn chế các công nghệ đóng gói tiên tiến như CoWoS.
Trung Quốc tìm ra các cách sáng tạo để lệnh kiểm soát xuất khẩu của Mỹ, và SMIC hiện đang chiếm thế độc quyền trên thực tế tại quốc gia này
Trong khi đó, các lệnh kiểm soát xuất khẩu của Mỹ đang mang lại lợi ích kinh doanh tốt cho SMIC của Trung Quốc. Đây là xưởng đúc cấp độ 7nm duy nhất của gã khổng lồ châu Á, với tỷ lệ sử dụng đạt 93,7%, doanh thu quý gần nhất đạt 3,01 tỷ USD (tăng 36,1% so với cùng kỳ năm ngoái) và lợi nhuận ròng tăng gần gấp ba lên tới 479,2 triệu nghìn USD.
Bên cạnh đó, các doanh nghiệp Trung Quốc đang áp dụng những giải pháp thay thế sáng tạo để đối phó với lệnh kiểm soát xuất khẩu của Mỹ. Ví dụ, Alibaba đã hé lộ XuanTie C950 vào tháng 3 năm 2026, quảng bá con chip này như một sản phẩm dựa trên kiến trúc RISC-V dành cho AI biên. Khác với các ASIC thông thường, XuanTie C950 không dựa vào GPU cho các tác vụ AI. Thay vào đó, con chip này thực chất là một bộ xử lý RISC-V 64-bit cấp máy chủ, gồm 64 lõi tính toán nằm trên một miếng silicon duy nhất, với xung nhịp có thể mở rộng lên tới 3,20GHz, và trong đó nhiều cụm - 8 lõi mỗi cụm - được liên kết với nhau nguyên bản bằng các cấu trúc AMBA CHI tốc độ cao. Hơn nữa, để xử lý các tác vụ AI nặng nhọc, các động cơ tăng tốc ma trận và vector được tích hợp trực tiếp vào con chip, loại bỏ nhu cầu sử dụng GPU.
Ở một chiều hướng khác, con chip DF1000 của DFSX được chế tạo bằng quy trình 14nm trưởng thành, nhưng mang kiến trúc tính toán cận bộ nhớ 3D mới lạ. Trong đó, bộ nhớ được xếp chồng trực tiếp lên trên lớp tính toán và kết nối thông qua liên kết lai cấp độ wafer 3D, giúp hợp nhất các đường dẫn đồng của hai lớp, loại bỏ hoàn toàn các mối hàn vi mô hoặc dây dẫn, hoạt động giống như hàng chục triệu thang máy dọc siêu nhanh thay vì một xa lộ ngang đơn lẻ.
Thêm vào đó, con chip DF2000, dự kiến ra mắt vào quý 4 năm 2026 trên tiến trình 14nm, còn tiến xa hơn nữa. Thay vì chỉ xếp chồng một lớp bộ nhớ đơn lẻ lên trên lớp tính toán, DF2000 kết hợp nhiều tháp tính toán-bộ nhớ xếp chồng cạnh nhau trên một nền móng cơ sở theo kỹ thuật mà DFSX gọi là bố cục Chiplet vô cực 3.5D. Con chip này thực chất thay thế các lớp lưu trữ cơ bản bằng bố cục Bộ nhớ Truy cập Ngẫu nhiên Động (DRAM) 3D được thiết kế riêng, làm tăng đáng kể lượng dữ liệu tạm thời có thể lưu giữ trực tiếp bên trong cấu trúc của nó.
Cuối cùng, cần lưu ý rằng một công ty bí mật có trụ sở tại Trung Quốc mang tên Shanghai Aishegna đã gia nhập thị trường quang khắc DUV, với kế hoạch sản xuất 5 máy DUV trong năm nay và thêm 20 máy nữa vào năm tới. Trong bối cảnh phát triển nhanh chóng này, có vẻ như NVIDIA cảm thấy cần phải có một cách tiếp cận mới để cố gắng duy trì sự hiện diện của mình tại Trung Quốc.
Cập nhật: NVIDIA phủ nhận việc theo đuổi con đường LPU tại Trung Quốc
NVIDIA đã gọi báo cáo của The Information về việc bán LPU tại Trung Quốc là "không chính xác". Tuy nhiên, chúng tôi lưu ý rằng phần lớn tuyên bố của NVIDIA tập trung vào trạng thái hiện tại của các kế hoạch liên quan đến LPU, để ngỏ một số dư địa cho các động thái trong tương lai.
⚡ NVIDIA LÊN KẾ HOẠCH TRỞ LẠI TRUNG QUỐC BẰNG CHIP SUY LUẬN LPU MỚI? (NVIDIA ĐÃ PHỦ NHẬN) NVIDIA đang phải đi trên dây khi đối phó với lượng khách hàng khổng lồ tại Trung Quốc, cố gắng cân bằng giữa hiệu suất của các sản phẩm dành riêng cho thị trường này và các hạn chế từ lệnh kiểm soát xuất khẩu ngặt nghèo của Mỹ. Trong bối cảnh Bắc Kinh đang chủ động ngăn cản các doanh nghiệp nhập khẩu GPU H200 của NVIDIA - loại vốn được chính quyền Trump cho phép sử dụng tại Trung Quốc - NVIDIA dường như đang thử một con đường khác để mang lại giá trị cho khách hàng Trung Quốc mà vẫn nằm trong giới hạn kiểm soát xuất khẩu của Mỹ. Con đường hẹp này dường như tập trung vào các LPU của Groq. NVIDIA được cho là đang thiết kế một con chip dành riêng cho Trung Quốc tận dụng LPU của Groq để cung cấp giải pháp hấp dẫn cho các tác vụ suy luận AI The Information đưa tin rằng NVIDIA đang âm mưu quay trở lại Trung Quốc bằng cách thiết kế một con chip chuyên dụng cho suy luận mới tại đây. Con chip mới này dự kiến sẽ sẵn sàng vào cuối năm nay và sẽ trang bị Đơn vị Xử lý Ngôn ngữ (LPU) của Groq. Đối với những ai chưa biết, NVIDIA đã ký kết thỏa thuận cấp phép công nghệ và chuyển giao tài sản/nhân sự với Groq vào tháng 12 năm 2025. Các LPU của Groq gom hàng trăm hoặc thậm chí hàng ngàn con chip chuyên dụng lại với nhau, trong đó mỗi con chip riêng lẻ chứa các khối lớn gồm các đơn vị Phân số Ma trận (MXM) và Vector (VXM) cũng như khoảng 230MB SRAM siêu nhanh. Ngoài ra, trọng số của mô hình AI được nướng cứng trực tiếp vào SRAM, hoàn toàn bỏ qua khái niệm bộ nhớ cache. Quan trọng nhất, LPU không có bộ dự đoán nhánh hoặc bộ lập lịch phần cứng. Thay vào đó, trình biên dịch của Groq lên kế hoạch cho từng phép tính đến từng nano giây, đảm bảo rằng dữ liệu liên quan đến từ SRAM để xử lý theo nhịp độ vận hành liên tục, được lên kế hoạch tỉ mỉ, mang lại tốc độ suy luận cực nhanh. Theo The Information, con chip mới của NVIDIA sẽ tuân thủ các quy định kiểm soát xuất khẩu của Mỹ, vốn chủ yếu vạch rõ giới hạn dung lượng HBM mà một bộ tăng tốc AI tập trung vào Trung Quốc được phép hỗ trợ, đồng thời hạn chế các công nghệ đóng gói tiên tiến như CoWoS. Trung Quốc tìm ra các cách sáng tạo để lệnh kiểm soát xuất khẩu của Mỹ, và SMIC hiện đang chiếm thế độc quyền trên thực tế tại quốc gia này Trong khi đó, các lệnh kiểm soát xuất khẩu của Mỹ đang mang lại lợi ích kinh doanh tốt cho SMIC của Trung Quốc. Đây là xưởng đúc cấp độ 7nm duy nhất của gã khổng lồ châu Á, với tỷ lệ sử dụng đạt 93,7%, doanh thu quý gần nhất đạt 3,01 tỷ USD (tăng 36,1% so với cùng kỳ năm ngoái) và lợi nhuận ròng tăng gần gấp ba lên tới 479,2 triệu nghìn USD. Bên cạnh đó, các doanh nghiệp Trung Quốc đang áp dụng những giải pháp thay thế sáng tạo để đối phó với lệnh kiểm soát xuất khẩu của Mỹ. Ví dụ, Alibaba đã hé lộ XuanTie C950 vào tháng 3 năm 2026, quảng bá con chip này như một sản phẩm dựa trên kiến trúc RISC-V dành cho AI biên. Khác với các ASIC thông thường, XuanTie C950 không dựa vào GPU cho các tác vụ AI. Thay vào đó, con chip này thực chất là một bộ xử lý RISC-V 64-bit cấp máy chủ, gồm 64 lõi tính toán nằm trên một miếng silicon duy nhất, với xung nhịp có thể mở rộng lên tới 3,20GHz, và trong đó nhiều cụm - 8 lõi mỗi cụm - được liên kết với nhau nguyên bản bằng các cấu trúc AMBA CHI tốc độ cao. Hơn nữa, để xử lý các tác vụ AI nặng nhọc, các động cơ tăng tốc ma trận và vector được tích hợp trực tiếp vào con chip, loại bỏ nhu cầu sử dụng GPU. Ở một chiều hướng khác, con chip DF1000 của DFSX được chế tạo bằng quy trình 14nm trưởng thành, nhưng mang kiến trúc tính toán cận bộ nhớ 3D mới lạ. Trong đó, bộ nhớ được xếp chồng trực tiếp lên trên lớp tính toán và kết nối thông qua liên kết lai cấp độ wafer 3D, giúp hợp nhất các đường dẫn đồng của hai lớp, loại bỏ hoàn toàn các mối hàn vi mô hoặc dây dẫn, hoạt động giống như hàng chục triệu thang máy dọc siêu nhanh thay vì một xa lộ ngang đơn lẻ. Thêm vào đó, con chip DF2000, dự kiến ra mắt vào quý 4 năm 2026 trên tiến trình 14nm, còn tiến xa hơn nữa. Thay vì chỉ xếp chồng một lớp bộ nhớ đơn lẻ lên trên lớp tính toán, DF2000 kết hợp nhiều tháp tính toán-bộ nhớ xếp chồng cạnh nhau trên một nền móng cơ sở theo kỹ thuật mà DFSX gọi là bố cục Chiplet vô cực 3.5D. Con chip này thực chất thay thế các lớp lưu trữ cơ bản bằng bố cục Bộ nhớ Truy cập Ngẫu nhiên Động (DRAM) 3D được thiết kế riêng, làm tăng đáng kể lượng dữ liệu tạm thời có thể lưu giữ trực tiếp bên trong cấu trúc của nó. Cuối cùng, cần lưu ý rằng một công ty bí mật có trụ sở tại Trung Quốc mang tên Shanghai Aishegna đã gia nhập thị trường quang khắc DUV, với kế hoạch sản xuất 5 máy DUV trong năm nay và thêm 20 máy nữa vào năm tới. Trong bối cảnh phát triển nhanh chóng này, có vẻ như NVIDIA cảm thấy cần phải có một cách tiếp cận mới để cố gắng duy trì sự hiện diện của mình tại Trung Quốc. Cập nhật: NVIDIA phủ nhận việc theo đuổi con đường LPU tại Trung Quốc NVIDIA đã gọi báo cáo của The Information về việc bán LPU tại Trung Quốc là "không chính xác". Tuy nhiên, chúng tôi lưu ý rằng phần lớn tuyên bố của NVIDIA tập trung vào trạng thái hiện tại của các kế hoạch liên quan đến LPU, để ngỏ một số dư địa cho các động thái trong tương lai. 🗞 Nguồn: Wccftech #vgsnews #vgs #tintuc