Tối thứ Ba tuần này, DeepSeek Nền tảng mở công bố thông báo kế hoạch điều chỉnh lại giá API mô hình lớn, lần này là mức giảm giá được mong đợi.

Giá trong giờ thấp điểm: đầu vào (hit cache) 0,02 nhân dân tệ, đầu vào (miss cache) 1 nhân dân tệ, đầu ra 4 nhân dân tệ (đơn vị: nhân dân tệ / triệu token). Giá trong giờ cao điểm vẫn là hai lần giá giờ thấp điểm, tức là hit cache 0,04 nhân dân tệ, miss cache 2 nhân dân tệ, đầu ra 8 nhân dân tệ.

Đợt điều chỉnh này chỉ áp dụng cho dòng V4-Flash, giá của V4-Pro cấp cao hơn vẫn giữ nguyên. Giá mới sẽ có hiệu lực lúc 12:00 giờ Bắc Kinh ngày 10 tháng 9.
Đồng thời, chính thức xác định giờ cao điểm là từ 9:00–12:00 và 14:00–18:00 theo giờ Bắc Kinh, từ thứ Hai đến thứ Sáu, các thời gian còn lại là giờ rảnh.
Trước đây, DeepSeek Việc tăng giá đã gây ra nhiều cuộc thảo luận rộng rãi. Giải thích chính thức đưa ra là để phân bổ tài nguyên hợp lý hơn, khuyến khích người dùng điều chỉnh thời gian thực hiện nhiệm vụ. Giới bên ngoài thường cho rằng DeepSeek V4 Flash 0731 có tính năng vượt trội về giá cả, thu hút lượng lớn người dùng toàn cầu sử dụng, và DeepSeek Thiếu đủ sức tính toán.
So sánh theo chiều dọc, trước khi tăng giá lúc 0:00 ngày 17 tháng 8, Flash có mức giá thống nhất là 0,02 nhân dân tệ (hit cache) / 1 nhân dân tệ (miss) / 2 nhân dân tệ (output). Đặt mức giá mới lần này vào:

Nói cách khác, hai mức giá ở phía đầu vào đã trở lại mức trước khi tăng giá, trong khi đầu ra vẫn ở mức gấp đôi so với trước khi tăng giá. Nếu tính theo mức đỉnh, sự chênh lệch còn lớn hơn nữa: mức đỉnh mới là 0,04 / 2 / 8 nhân dân tệ, so với mức trước khi tăng giá là 0,02 / 1 / 2 nhân dân tệ, tương ứng là 2 lần, 2 lần và 4 lần.
Do đó, khả năng người dùng thực sự quay trở lại trạng thái “sử dụng thoải mái” trong quá khứ phụ thuộc vào ba biến số của ứng dụng riêng: tỷ lệ hit bộ nhớ đệm, tỷ lệ đầu vào/đầu ra và mức độ có thể phân tán thời gian thực hiện tác vụ. Đối với các kịch bản có tỷ lệ hit bộ nhớ đệm cao như ngữ cảnh dài, prompt hệ thống cố định, hoặc gọi lặp lại Agent, sự giảm sút sẽ rõ rệt; còn đối với các kịch bản chủ yếu tập trung vào đầu ra tạo sinh, cảm nhận sẽ hạn chế. Như đã biết DeepSeek Tỷ lệ hit cache của API khá cao, do đó phản hồi hiện tại từ mọi người khá tích cực.
Sự giảm giá lần này không phải là sự kiện đơn lẻ, vào chiều qua, DeepSeek Thông báo trên nhóm giao lưu chính thức về việc mở nội bộ thử nghiệm phiên bản tạm thời V4.1 Flash: Tên mô hình là deepseek-v4.1-flash-expires-on-0910, base_url không thay đổi, giới hạn 20 kết nối đồng thời mỗi tài khoản, phí vẫn giữ nguyên như V4 Flash.
Ngoài đa mô-đun bản địa và tốc độ suy luận cực nhanh, công ty chính thức cho biết chi phí đã được giảm nhờ nâng cấp kiến trúc. Có thể thấy rằng, thông qua tối ưu hóa kỹ thuật và kỹ thuật工程 của chính mô hình lớn, DeepSeek Đã luôn nỗ lực cải thiện vấn đề chi phí suy luận.
Tên mô hình expires-on-0910 cho thấy mô hình mới sẽ tự động hết hạn và ngừng hoạt động vào ngày 10 tháng 9 — cùng ngày với việc giảm giá có hiệu lực.
Tháng này, các công ty AI tiên tiến đã cập nhật các mô hình lớn của mình, DeepSeek Nếu phiên bản chính thức V4.1 có thể mang lại sự tăng trưởng rõ rệt về khả năng, kết hợp với đợt giảm giá này, có lẽ có thể tạo thêm một đợt bùng nổ lớn.
Bài viết này đến từ tài khoản WeChat “Machine Heart” (ID: almosthuman2014), tác giả: Machine Heart quan tâm đến mô hình lớn, biên tập: Ban biên tập Machine Heart
