DeepSeek V4-Flash chỉ mất 3 xu mỗi nhiệm vụ, thấp nhất thế giới

iconMetaEra
Chia sẻ
AI summary iconTóm tắt
DeepSeek V4-Flash, một altcoin cần theo dõi trong các thị trường do AI dẫn dắt, hiện chỉ có giá 3 cent mỗi tác vụ, mức thấp nhất toàn cầu. Với giá 0,14 USD mỗi triệu token đầu vào và 0,28 USD mỗi triệu token đầu ra, chi phí của nó chỉ bằng khoảng 1/105 so với Claude Fable 5. Dịch vụ API AI của DeepSeek tạo ra doanh thu hàng năm từ 400–500 triệu USD, với biên lợi nhuận gộp trên 50%. Khi chỉ số nỗi sợ và tham lam trên thị trường tiền điện tử biến động, DeepSeek đang chuẩn bị cho đợt IPO.
DeepSeek ra mắt mô hình mới nhất V4-Flash, chi phí mỗi nhiệm vụ chỉ khoảng 3 cent, thấp nhất trong số các mô hình lớn phổ biến toàn cầu. Giá của V4-Flash là 0,14 USD mỗi triệu token đầu vào và 0,28 USD mỗi triệu token đầu ra, chi phí tổng thể thấp hơn đáng kể so với đối thủ, chỉ bằng khoảng 1/105 so với Anthropic Claude Fable 5. DeepSeek đang chuẩn bị IPO, doanh thu thường niên từ dịch vụ API đám mây đã đạt 400 đến 500 triệu USD, biên lợi nhuận gộp vượt 50%. Cuộc cạnh tranh trong ngành AI đang chuyển từ hiệu suất mô hình sang cuộc đua về chi phí suy luận và hiệu quả thương mại hóa, giúp chi phí biên khi doanh nghiệp triển khai ứng dụng AI có khả năng giảm xuống mức độ lớn.

Tác giả bài viết, nguồn: Wall Street Journal

DeepSeek ra mắt mô hình mới nhất V4-Flash, một lần nữa đưa cuộc cạnh tranh về chi phí của các mô hình AI vào tâm điểm.

The research firm Artificial Analysis's latest calculation shows that the average cost per task completed by V4-Flash is only about 3 cents, the lowest among current mainstream large models globally, roughly 1/105 of Anthropic's Claude Fable 5. This suggests that the marginal cost for enterprises deploying AI applications may further decrease in many general tasks, reigniting market discussions on the return on massive AI capital expenditures.

Đáng chú ý, việc ra mắt V4-Flash diễn ra đúng lúc quá trình thương mại hóa của DeepSeek đang tăng tốc. Theo báo cáo trích dẫn nguồn tin am hiểu, DeepSeek đang chuẩn bị cho khả năng niêm yết lần đầu ra công chúng (IPO). Doanh thu thường niên (ARR) từ dịch vụ API mô hình AI trên đám mây của họ đã đạt từ 400 triệu đến 500 triệu USD, với biên lợi nhuận gộp vượt quá 50%.

V4-Flash lần này tiếp tục theo đuổi chiến lược chi phí thấp và hiệu quả cao, củng cố thêm chiến lược cạnh tranh thị trường dựa trên giá cả và hiệu suất.

V4-Flash, chi phí mỗi nhiệm vụ chỉ 3 cent, hiệu suất chi phí dẫn đầu các mô hình phổ biến toàn cầu

Theo dữ liệu từ Artificial Analysis, giá của V4-Flash là 0,14 USD mỗi triệu token đầu vào và 0,28 USD mỗi triệu token đầu ra.

Tuy nhiên, tổ chức này chỉ ra rằng, so với giá niêm yết đơn thuần, "chi phí mỗi nhiệm vụ hoàn thành (Cost per Task)" mới phản ánh chính xác chi phí thực tế khi sử dụng mô hình. Chỉ số này xem xét tổng lượng token đầu vào và đầu ra được tiêu thụ khi mô hình hoàn thành cùng một nhiệm vụ, do đó mang tính tham khảo cao hơn.

Theo cách tính này, chi phí trung bình mỗi nhiệm vụ của V4-Flash khoảng 3 cent, ở mức thấp nhất trong số các mô hình chính trên toàn cầu.

Để so sánh, Kimi K3 của Moonshot AI khoảng 86 cent, OpenAI GPT-5.6 Sol khoảng 1,86 đô la Mỹ, và Anthropic Claude Fable 5 khoảng 3,15 đô la Mỹ. Chi phí của V4-Flash chỉ bằng khoảng 1/105 so với các mô hình sau.

Artificial Analysis tiếp tục nhấn mạnh rằng, các mô hình có giá token đơn vị thấp hơn, nếu cần tạo ra nhiều nội dung hơn hoặc trải qua nhiều bước tương tác hơn trong quá trình thực hiện nhiệm vụ, thì chi phí sử dụng cuối cùng vẫn có thể cao hơn so với các mô hình có giá cao hơn nhưng hiệu quả hơn. Do đó, "chi phí hoàn thành mỗi nhiệm vụ" mới là chỉ số phản ánh chính xác hơn giá trị sử dụng của mô hình so với chỉ một chỉ số giá đơn lẻ.

Đột phá với giá thấp, cạnh tranh AI chuyển từ "đấu hiệu năng" sang "đấu giá trị sử dụng"

So với xếp hạng hiệu năng, lợi thế chi phí của V4-Flash mới là điều thu hút sự chú ý của thị trường lần này.

Trong năm qua, trọng tâm cạnh tranh trong ngành AI đã dần chuyển từ khả năng mô hình sang chi phí suy luận và hiệu quả thương mại hóa. Khi quy mô ứng dụng AI của doanh nghiệp không ngừng mở rộng, chi phí vận hành mô hình đang trở thành yếu tố quan trọng trong quyết định mua sắm.

Khi một mô hình có thể hoàn thành một nhiệm vụ với chi phí khoảng 3 cent, trong khi chi phí của một số mô hình cao cấp lên đến vài đô la, chi phí tổng thể khi doanh nghiệp triển khai trong các kịch bản tần suất cao như hỗ trợ khách hàng, tự động hóa văn phòng và hỗ trợ mã hóa có thể giảm xuống ở mức độ lớn.

Điều này cũng một lần nữa chạm đến vấn đề mà Phố Wall liên tục quan tâm: liệu khoản đầu tư vốn khổng lồ vào AI cuối cùng có thể chuyển hóa thành lợi nhuận kinh doanh đủ lớn hay không.

Đầu năm 2025, sau khi DeepSeek ra mắt mô hình R1, thị trường từng đánh giá lại tính cần thiết của việc đầu tư vào cơ sở hạ tầng AI toàn cầu, gây ra biến động mạnh trên các cổ phiếu công nghệ. Hiện nay, V4-Flash một lần nữa lấy chi phí vận hành cực thấp làm điểm bán hàng chính, cho thấy sự cạnh tranh trong ngành AI đang tiếp tục chuyển từ "mô hình nào mạnh hơn" sang "ai có thể cung cấp khả năng đủ tốt với chi phí thấp hơn", và cuộc thảo luận về tỷ lệ hoàn vốn đầu tư vào AI có thể lại nóng lên.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.