SpaceX ra mắt Grok 4.7 với nhiều cải tiến nhưng chưa gây được tiếng vang lớn, trong khi DeepSeek rục rịch hé lộ mô hình 8 nghìn tỷ tham số
SpaceX đã công bố mô hình AI Grok 4.7 với khả năng lập trình và xử lý tác vụ dài tốt hơn nhưng nhận về nhiều đánh giá trái chiều. Trong khi đó, DeepSeek đang khiến cộng đồng xôn xao khi chuẩn bị phát triển các mô hình quy mô lớn với hàng nghìn tỷ tham số.

SpaceX, hay chính xác hơn là công ty con SpaceXAI, vừa công bố mô hình AI mới nhất và tiên tiến nhất của mình - Grok 4.7 - với những đánh giá ở mức trung bình, trong khi DeepSeek đang làm say đắm trí tưởng tượng tập thể của cộng đồng LLM bằng một mô hình 8 nghìn tỷ tham số sắp ra mắt.
Điểm tốt, điểm xấu và điểm hạn chế của Grok 4.7 từ SpaceX
SpaceX ca ngợi Grok 4.7 sở hữu khả năng lập trình và xử lý công việc tri thức đạt tầm cỡ tiên tiến, với mức giá giữ nguyên như Grok 4.6: 2 USD cho mỗi 1 triệu token đầu vào và 6 USD cho mỗi 1 triệu token đầu ra. Mặc dù các mức giá này hấp dẫn hơn đáng kể so với Anthropic Fable 5.1 Max, nhưng GPT-5.6 Sol của OpenAI vẫn giữ lợi thế về giá đầu vào khi chỉ ở mức 4 USD cho mỗi 1 triệu token.
Theo SpaceX, Grok 4.7 đã được "đào tạo thông qua quá trình học tăng cường (reinforcement learning) kéo dài hơn trên tập hợp các tác vụ khó hơn, tập trung vào những bài toán mất nhiều giờ để hoàn thành". Điều này có nghĩa là mô hình có khả năng tự kiểm tra công việc tốt hơn và thể hiện vượt trội hơn hẳn trong các bài toán có ngữ cảnh dài.
Grok 4.7 đạt điểm số 46 trên Artificial Analysis Intelligence Index nhưng vẫn đứng sau Claude Fable 5.1 Max, Claude Fable 5, Claude Opus 5 của Anthropic, GPT-6 Astra và GPT-5.6 Sol (Max) của OpenAI, cùng Muse Spark 1.3 Max của Meta. Cần lưu ý rằng chỉ số này là một điểm chuẩn tổng hợp đo lường năng lực của mô hình ngôn ngữ lớn (LLM) trên các mặt suy luận, lập trình, tri thức, suy luận khoa học và hoàn thành tác vụ tác nhân nhiều bước.
Ngoài ra, theo bảng xếp hạng của Artificial Analysis Intelligence Index, Grok 4.7 (xhigh) sử dụng khoảng 81.000 token đầu ra cho mỗi tác vụ Intelligence Index, so với 36.000 của Grok 4.6 (high) và 27.000 của GPT-6 Astra (max). Điều này có nghĩa là mô hình có vẻ rẻ hơn về mặt bề nổi so với các dòng tiên tiến từ Anthropic và OpenAI, nhưng thực tế có thể sẽ tốn kém hơn trong các tác vụ thực tế.
Mặc dù vậy, trên Terminal-Bench 4.0, mô hình lại xếp sau cả mô hình mã nguồn mở DeepSeek V4.1 Flash! Dù vậy, hãy lưu ý rằng điểm chuẩn này bị Epoch AI đánh giá là "có nhiều thiếu sót".
Tuy nhiên, Grok 4.7 vẫn thể hiện sự cải tiến rõ rệt so với Grok 4.6:
- Lập trình, CursorBench 4.0: 46.3 phần trăm, tăng từ 40.4 phần trăm
- Lập trình, DeepSWE: 71.0 phần trăm, tăng từ 65.2 phần trăm
- Kỹ thuật điện, EEBench: 64.0 phần trăm, tăng từ 53.0 phần trăm
- Công việc Terminal, Terminal-Bench 4.0: 38.0 phần trăm, tăng từ 20.3 phần trăm
- Công việc pháp lý, Harvey: 19.6 phần trăm, tăng từ 15.8 phần trăm
- Suy luận lâm sàng, HealthBench: 56.7 phần trăm, tăng từ 48.5 phần trăm
Tất nhiên, với việc Elon Musk gần đây ca ngợi Grok 4.9 sắp ra mắt sẽ tương đương với các mô hình đẳng cấp Fable, kỳ vọng xung quanh Grok 4.7 vốn dĩ đã không quá cao từ đầu. Điều quan trọng là nếu SpaceX cần ít nhất hai phiên bản nữa mới có thể bắt kịp các mô hình đẳng cấp Fable của Anthropic và Astra của OpenAI, thì Grok có thể sẽ không bao giờ hoàn toàn bắt kịp năng lực của các mô hình thực sự ở đẳng cấp tiên tiến.
Theo The Information, DeepSeek hiện đang huấn luyện một mô hình với 2 nghìn tỷ tham số, kèm theo kế hoạch phát triển mô hình 8 nghìn tỷ tham số ngay sau đó! Để dễ hình dung, V4.1 Flash hiện chỉ có 552 tỷ tham số.
Như chúng tôi đã lưu ý gần đây, DeepSeek đã đặt một đơn hàng khổng lồ gồm 160.000 chip Ascend 950DT với Huawei để trang bị cho trung tâm dữ liệu 1GW của mình ở Nội Mông. Với giá thị trường của mỗi chip 950DT hiện dao động quanh mức 111.000 Nhân dân tệ tương đương khoảng 16.000 USD (so với 15.000 đến 25.000 USD cho GPU H20 của NVIDIA), tổng giá trị đơn hàng có thể lên tới khoảng 2,56 tỷ USD. Bên cạnh đó, CEO của công ty, Liang Wengfeng, đã tiết lộ vào tháng 7 năm 2026 rằng phòng thí nghiệm AI này sở hữu nguồn lực tính toán tương đương với 20.000 GPU NVIDIA H100, phần lớn trong số đó đã đến trong "tháng trước hoặc hai tháng gần đây".
Đáng chú ý, DeepSeek không sở hữu quy mô tính toán lên tới nhiều gigawatt như SpaceX. Thế nhưng, các mô hình mới nhất của phòng thí nghiệm AI đang bay cao này vẫn cạnh tranh vô cùng mạnh mẽ với Grok 4.7!
⚡ SPACEX RA MẮT GROK 4.7 VỚI NHIỀU CẢI TIẾN NHƯNG CHƯA GÂY ĐƯỢC TIẾNG VANG LỚN, TRONG KHI DEEPSEEK RỤC RỊCH HÉ LỘ MÔ HÌNH 8 NGHÌN TỶ THAM SỐ SpaceX, hay chính xác hơn là công ty con SpaceXAI, vừa công bố mô hình AI mới nhất và tiên tiến nhất của mình - Grok 4.7 - với những đánh giá ở mức trung bình, trong khi DeepSeek đang làm say đắm trí tưởng tượng tập thể của cộng đồng LLM bằng một mô hình 8 nghìn tỷ tham số sắp ra mắt. Điểm tốt, điểm xấu và điểm hạn chế của Grok 4.7 từ SpaceX SpaceX ca ngợi Grok 4.7 sở hữu khả năng lập trình và xử lý công việc tri thức đạt tầm cỡ tiên tiến, với mức giá giữ nguyên như Grok 4.6: 2 USD cho mỗi 1 triệu token đầu vào và 6 USD cho mỗi 1 triệu token đầu ra. Mặc dù các mức giá này hấp dẫn hơn đáng kể so với Anthropic Fable 5.1 Max, nhưng GPT-5.6 Sol của OpenAI vẫn giữ lợi thế về giá đầu vào khi chỉ ở mức 4 USD cho mỗi 1 triệu token. Theo SpaceX, Grok 4.7 đã được "đào tạo thông qua quá trình học tăng cường (reinforcement learning) kéo dài hơn trên tập hợp các tác vụ khó hơn, tập trung vào những bài toán mất nhiều giờ để hoàn thành". Điều này có nghĩa là mô hình có khả năng tự kiểm tra công việc tốt hơn và thể hiện vượt trội hơn hẳn trong các bài toán có ngữ cảnh dài. Grok 4.7 đạt điểm số 46 trên Artificial Analysis Intelligence Index nhưng vẫn đứng sau Claude Fable 5.1 Max, Claude Fable 5, Claude Opus 5 của Anthropic, GPT-6 Astra và GPT-5.6 Sol (Max) của OpenAI, cùng Muse Spark 1.3 Max của Meta. Cần lưu ý rằng chỉ số này là một điểm chuẩn tổng hợp đo lường năng lực của mô hình ngôn ngữ lớn (LLM) trên các mặt suy luận, lập trình, tri thức, suy luận khoa học và hoàn thành tác vụ tác nhân nhiều bước. Ngoài ra, theo bảng xếp hạng của Artificial Analysis Intelligence Index, Grok 4.7 (xhigh) sử dụng khoảng 81.000 token đầu ra cho mỗi tác vụ Intelligence Index, so với 36.000 của Grok 4.6 (high) và 27.000 của GPT-6 Astra (max). Điều này có nghĩa là mô hình có vẻ rẻ hơn về mặt bề nổi so với các dòng tiên tiến từ Anthropic và OpenAI, nhưng thực tế có thể sẽ tốn kém hơn trong các tác vụ thực tế. Mặc dù vậy, trên Terminal-Bench 4.0, mô hình lại xếp sau cả mô hình mã nguồn mở DeepSeek V4.1 Flash! Dù vậy, hãy lưu ý rằng điểm chuẩn này bị Epoch AI đánh giá là "có nhiều thiếu sót". Tuy nhiên, Grok 4.7 vẫn thể hiện sự cải tiến rõ rệt so với Grok 4.6: • Lập trình, CursorBench 4.0: 46.3 phần trăm, tăng từ 40.4 phần trăm • Lập trình, DeepSWE: 71.0 phần trăm, tăng từ 65.2 phần trăm • Kỹ thuật điện, EEBench: 64.0 phần trăm, tăng từ 53.0 phần trăm • Công việc Terminal, Terminal-Bench 4.0: 38.0 phần trăm, tăng từ 20.3 phần trăm • Công việc pháp lý, Harvey: 19.6 phần trăm, tăng từ 15.8 phần trăm • Suy luận lâm sàng, HealthBench: 56.7 phần trăm, tăng từ 48.5 phần trăm Tất nhiên, với việc Elon Musk gần đây ca ngợi Grok 4.9 sắp ra mắt sẽ tương đương với các mô hình đẳng cấp Fable, kỳ vọng xung quanh Grok 4.7 vốn dĩ đã không quá cao từ đầu. Điều quan trọng là nếu SpaceX cần ít nhất hai phiên bản nữa mới có thể bắt kịp các mô hình đẳng cấp Fable của Anthropic và Astra của OpenAI, thì Grok có thể sẽ không bao giờ hoàn toàn bắt kịp năng lực của các mô hình thực sự ở đẳng cấp tiên tiến. Theo The Information, DeepSeek hiện đang huấn luyện một mô hình với 2 nghìn tỷ tham số, kèm theo kế hoạch phát triển mô hình 8 nghìn tỷ tham số ngay sau đó! Để dễ hình dung, V4.1 Flash hiện chỉ có 552 tỷ tham số. Như chúng tôi đã lưu ý gần đây, DeepSeek đã đặt một đơn hàng khổng lồ gồm 160.000 chip Ascend 950DT với Huawei để trang bị cho trung tâm dữ liệu 1GW của mình ở Nội Mông. Với giá thị trường của mỗi chip 950DT hiện dao động quanh mức 111.000 Nhân dân tệ tương đương khoảng 16.000 USD (so với 15.000 đến 25.000 USD cho GPU H20 của NVIDIA), tổng giá trị đơn hàng có thể lên tới khoảng 2,56 tỷ USD. Bên cạnh đó, CEO của công ty, Liang Wengfeng, đã tiết lộ vào tháng 7 năm 2026 rằng phòng thí nghiệm AI này sở hữu nguồn lực tính toán tương đương với 20.000 GPU NVIDIA H100, phần lớn trong số đó đã đến trong "tháng trước hoặc hai tháng gần đây". Đáng chú ý, DeepSeek không sở hữu quy mô tính toán lên tới nhiều gigawatt như SpaceX. Thế nhưng, các mô hình mới nhất của phòng thí nghiệm AI đang bay cao này vẫn cạnh tranh vô cùng mạnh mẽ với Grok 4.7! 🗞 Nguồn: Wccftech #vgsnews #vgs #tintuc
Nguồn: Wccftech