DeepSeek vừa khiến cuộc chiến về giá AI trở nên khó chịu hơn rất nhiều đối với những người còn lại tại bàn. Công ty khởi nghiệp có trụ sở tại Hàng Châu đã công bố mô hình V4.1 Flash vào ngày 10 tháng Chín, giới thiệu hệ thống với 552 tỷ tham số, hứa hẹn vượt trội hơn các đối thủ chính trong khi chi phí vận hành thấp hơn đáng kể.
Phản ứng ngay lập tức của thị trường đã nói lên tất cả trước khi bất kỳ biểu đồ chuẩn nào có thể. Cổ phiếu của các đối thủ Trung Quốc trong lĩnh vực AI là MiniMax và Z.ai giảm hơn 8% sau thông báo, trong khi Alibaba chứng kiến cổ phiếu giảm hơn 2%.
Điều gì làm cho V4.1 Flash trở nên khác biệt
Mô hình sử dụng kiến trúc mixture-of-experts, một cách nói hoa mỹ để chỉ rằng nó chỉ kích hoạt một phần nhỏ các tham số tổng thể cho mỗi nhiệm vụ cụ thể. Kết quả là hiệu suất cao mà không cần tiêu tốn chi phí tính toán để kích hoạt tất cả các nơ-ron cùng lúc.
DeepSeek đã phát triển V4.1 Flash với khả năng đa phương tiện bản địa, nghĩa là nó có thể xử lý văn bản, hình ảnh và các loại dữ liệu khác một cách trực tiếp. Công ty đã tối ưu hóa đặc biệt mô hình này cho các nhiệm vụ lập trình và các quy trình được ngành gọi là “agentic”, nơi các hệ thống AI tự chủ lập kế hoạch và thực hiện các quy trình nhiều bước.
Các tuyên bố về hiệu suất là đáng chú ý, nhưng giá cả mới là yếu tố thực sự gây đột phá. Các mô hình trước đây của DeepSeek có giá khoảng 0,14 USD mỗi triệu token đầu vào và 0,28 USD cho token đầu ra. Các mô hình DeepSeek trước đây như V4-Flash được phát hiện có chi phí vận hành rẻ hơn hơn 100 lần so với các lựa chọn tương đương, trung bình khoảng 3 xu mỗi lần kiểm tra so với 3,15 USD của Claude Fable 5 thuộc Anthropic.
Phiên bản Flash V4.1 dự kiến sẽ vượt trội hơn Kimi K3 của Moonshot với mức giá thấp hơn đáng kể.
Một mô hình gây gián đoạn có tính toán
Mô hình V3 của công ty được huấn luyện trên 2.000 GPU Nvidia H800 với chi phí được báo cáo là 5,6 triệu đô la. Để đặt điều này vào bối cảnh, các phòng thí nghiệm AI hàng đầu của Mỹ đã chi hàng trăm triệu, đôi khi hàng tỷ đô la để huấn luyện các mô hình trọng tâm của họ.
Vào năm 2025, chiến lược của DeepSeek tập trung vào chi phí suy luận thấp và các mô hình mở đã gây ra những đợt bán tháo đáng chú ý trên toàn bộ ngành công nghệ. Hệ quả rộng lớn hơn khó có thể bỏ qua: hệ sinh thái AI của Trung Quốc đang sản xuất các mô hình đẳng cấp thế giới dù phải hoạt động dưới các hạn chế xuất khẩu chip của Mỹ.
Điều này có nghĩa gì đối với thị trường AI
Phản ứng của thị trường chứng khoán đối với việc ra mắt V4.1 Flash cho thấy các nhà đầu tư đang coi mối đe dọa này một cách nghiêm túc. Sự sụt giảm hơn 8% của MiniMax và Z.ai phản ánh mối lo ngại thực sự rằng chiến lược định giá của DeepSeek có thể thu hẹp biên lợi nhuận trên toàn bộ ngành AI Trung Quốc. Ngay cả Alibaba, với mô hình kinh doanh đa dạng hơn nhiều, cũng cảm nhận được cú rung chuyển.
Các báo cáo cho thấy DeepSeek đang chuẩn bị niêm yết trên Thị trường STAR của Thượng Hải thêm một chiều kích mới vào bức tranh tổng thể. Việc niêm yết công khai sẽ giúp công ty tiếp cận nguồn vốn đáng kể đồng thời cung cấp một mốc định giá có thể tiếp tục định hình lại cách các nhà đầu tư nhìn nhận về lĩnh vực AI.
