Bản tin công nghệ quốc tế · dịch tiếng Việt 01.10.2026 RSS
AI & Dữ liệu · Tom's Hardware

Công ty tư vấn thử nghiệm thuê 4 GPU Nvidia H200 để kiểm chứng tuyên bố DeepSeek 'rẻ hơn 80 lần'

Công ty tư vấn The Call Center Doctors đã thuê một hệ thống 4 GPU Nvidia H200 để kiểm chứng hiệu năng và chi phí thực tế của mô hình DeepSeek. Kết quả cho thấy việc sử dụng API trực tiếp từ DeepSeek vẫn có kinh tế hơn so với việc tự dựng hạ tầng phần cứng riêng.

Tom's Hardware01.10.20261 phút đọc1 lượt đọc
Ảnh: Tom's Hardware

The Call Center Doctors, một công ty tư vấn chuyên xây dựng và vận hành tổng đài cho các doanh nghiệp khác, đã thuê một hệ thống 4 GPU H200 vào ngày 27/9 để phục vụ DeepSeek V4.1 Flash cho các tác nhân Claude Code của họ thay cho Opus 5.5, theo bài viết ghi nhận thử nghiệm của họ. Bài viết này nhắm đến bất kỳ ai từng nghe nói rằng DeepSeek "rẻ hơn 80 lần" so với Claude. Sử dụng hỗn hợp mã nguồn thực tế của mình, toàn bộ hệ thống của công ty đạt đỉnh khoảng 213 token được tạo ra mỗi giây với chi phí theo nhu cầu (on-demand) là 440,88 USD mỗi ngày, so với mức 184–223 USD mỗi ngày cho cùng công việc thông qua API của DeepSeek. Cuối cùng, công ty tổng đài đã quay lại sử dụng Opus 5.5 với mức giá thấp hơn chi phí thuê hệ thống theo giá on-demand. Giá API của DeepSeek được niêm yết ở mức 0,15 USD cho mỗi 1 triệu token đầu vào mới trong giờ thấp điểm, 0,003 USD cho token đầu vào được lưu trữ trong bộ nhớ đệm (cached), và 0,60 USD cho mỗi 1 triệu token đầu ra. Chi phí vào giờ cao điểm sẽ tăng gấp đôi. Để so sánh, Claude Opus 5.5 của Anthropic có giá niêm yết là 4 USD cho đầu vào và 20 USD cho đầu ra trên mỗi 1 triệu token, với giá đọc bộ nhớ đệm là 0,20 USD. Công ty tư vấn đã sử dụng dịch vụ thông qua các gói đăng ký thay vì qua API.

🔗 Bài gốc (tiếng Anh): Firm rents four Nvidia H200s to test '80x cheaper' DeepSeek claim
Nguồn: Tom's Hardware

Cùng chuyên mục · AI & Dữ liệu
AI & Dữ liệu

Mô hình AI mở của Trung Quốc GLM-5.3 tạo lỗ hổng khai thác Chrome chỉ với 20 USD

Anthropic đã kiểm tra kỹ năng hacking của mô hình mở GLM-5.3 từ Z.ai và phát hiện nó có khả năng tạo mã khai thác gần…

Notebookcheck · 1 phút đọc
AI & Dữ liệu

Google ra mắt Gemini 4 Argon: Vượt mặt GPT-6 Astra trên nhiều benchmark AI

Google vừa chính thức phát hành Gemini 4 Argon, mẫu AI mới nhất đang dẫn đầu hàng loạt bảng xếp hạng benchmark lớn.…

Wccftech · 3 phút đọc
🚀 VGSNews
AI & Dữ liệu

Google ra mắt Gemini 4 Argon, mẫu AI mạnh mẽ nhất từ trước đến nay

Google vừa công bố Gemini 4 Argon, một mô hình AI đa năng với khả năng vượt trội về lập trình, nghiên cứu và đặc biệt…

TechCrunch · 3 phút đọc