DeepSeek vượt bất lợi về chip nhờ chiến lược độc đáo
Tính đến tháng 5 năm nay, DeepSeek chỉ sở hữu khoảng 20.000 chip tương đương dòng Hopper của NVIDIA, trong khi các đối thủ như Microsoft hay Google có thể mua thêm số lượng tương tự trong vài tuần. Lệnh cấm xuất khẩu chip AI của Mỹ không chỉ ngăn DeepSeek tiếp cận dòng chip mới nhất mà còn giới hạn tốc độ mở rộng hạ tầng tính toán. Trên lý thuyết, đây là bất lợi gần như không thể bù đắp trong cuộc đua mà ai cũng cho rằng phần thắng thuộc về kẻ có nhiều GPU nhất.
Thế nhưng, theo ông Lương Văn Phong, CEO DeepSeek, khoảng cách giữa công ty và các hãng AI hàng đầu Mỹ hiện chỉ còn 6 đến 12 tháng. Biên lợi nhuận từ dịch vụ suy luận của DeepSeek đạt 85%, thời gian hoàn vốn phần cứng chỉ 10 tháng. Những con số này không đến từ việc có nhiều chip hơn mà từ triết lý vận hành mà ông Lương gọi tắt là ba điều công ty kiên quyết nói không.
Không tối đa hóa lợi nhuận: Giá rẻ là lợi thế kỹ thuật
Điều từ chối đầu tiên là không tối đa hóa lợi nhuận. Khi DeepSeek V4 ra mắt, công ty định giá cao ban đầu vì lo ngại nhu cầu quá lớn. Sau đó ông Lương quyết định giảm xuống còn một phần tư mức giá ban đầu. Phản ứng trong nội bộ không phải lo ngại mà là hoan nghênh, vì với DeepSeek, mục tiêu xây dựng model không phải tối đa hóa doanh thu mà là để nhiều người có thể dùng nó nhất có thể.
Ông Lương đặt trần lợi nhuận ở mức 6 lần chi phí, gọi đó là "lợi nhuận hợp lý". Chi phí suy luận thấp hơn đồng nghĩa với việc DeepSeek có thể huấn luyện các model lớn hơn với cùng lượng sức tính toán hạn chế, biến giá rẻ từ chiến lược kinh doanh thành lợi thế kỹ thuật.
Không làm thêm giờ và không KPI: Văn hóa thoải mái tạo đột phá
Điều từ chối thứ hai là không làm thêm giờ và không KPI. Trong ngành AI vốn có văn hóa làm việc cường độ cao, DeepSeek chọn hướng ngược lại. Ông Lương tin rằng nghiên cứu đỉnh cao đòi hỏi môi trường thoải mái, không phải áp lực. Công ty không có cơ cấu tổ chức cứng nhắc, không có chỉ tiêu hiệu suất theo quý, và nửa thời gian làm việc của mỗi nhà nghiên cứu được dành để tự do khám phá các hướng quan trọng mà không cần phê duyệt từ cấp trên.
Ông Lương tóm gọn triết lý: "Tầm nhìn không phải là khẩu hiệu trên tường, mà là cách công ty hành động mỗi ngày." Điều duy nhất ông tuyên bố không thể nhượng bộ là sự ổn định của đội ngũ, không phải tốc độ hay doanh thu.
Không chạy theo xu hướng: Tập trung vào lộ trình AGI
Điều từ chối thứ ba là không đuổi theo các hướng đang thịnh hành. Video AI, mô hình 3D, world model, super app – những từ khóa đang thu hút hàng tỷ USD đầu tư – đều bị DeepSeek từ chối. Ông Lương gọi video generation và 3D là "hype thương mại thuần túy" không liên quan đến giới hạn trên của trí tuệ.
Thay vào đó, công ty theo đuổi lộ trình sáu bước hướng đến AGI: từ language model, chain-of-thought, agent, continuous learning, self-iteration đến embodied intelligence. Hiện tại DeepSeek đang ở giữa giai đoạn agent và xác định continuous learning là rào cản tiếp theo. Mọi thứ không nằm trên lộ trình đó đều bị loại bỏ có chủ đích.
Ba điều từ chối kết nối với nhau theo một logic nhất quán. Ông Lương cảnh báo: "Nếu tầm nhìn của anh là lấy nhiều hơn, anh đã thua rồi." Ông cho rằng OpenAI đang chịu áp lực ngày càng lớn chính vì muốn độc chiếm quá nhiều thứ cùng một lúc. DeepSeek chọn con đường ngược lại: từ bỏ nhiều thứ để tăng xác suất làm được một thứ duy nhất, và ít nhất tính đến thời điểm này, cách tiếp cận đó đang cho thấy những kết quả mà không ai có thể bỏ qua.



