DeepSeek V4 Flash vượt mức sử dụng của OpenRouter, gây ra sự thay đổi giá toàn cầu trong lĩnh vực AI

iconMetaEra
Chia sẻ
AI summary iconTóm tắt
DeepSeek V4 Flash đã vượt qua OpenRouter về khối lượng gọi mô hình, thúc đẩy các nhà phát triển toàn cầu hướng tới các mô hình AI Trung Quốc. Việc sử dụng OpenCode tăng 30% hàng ngày, trong khi các startup Mỹ giảm chi phí suy luận từ 60% đến 85%. Các mô hình trong nước hiện đang vượt trội các mô hình đóng của Mỹ về lưu lượng truy cập, với 45% đến từ các nhà phát triển Mỹ và châu Âu. Các altcoin cần theo dõi có thể trải qua những thay đổi khi động lực chi phí AI thay đổi. Các mức đọc của chỉ số nỗi sợ và tham lam cho thấy sự lạc quan ngày càng tăng trong lĩnh vực này.
Sau khi DeepSeek V4 Flash ra mắt, nó đã leo lên vị trí đầu bảng về lượng gọi API trên nền tảng OpenRouter, với các nhà phát triển toàn cầu đang chuyển đổi quy mô lớn sang các mô hình AI Trung Quốc. Các nền tảng như OpenCode ghi nhận mức tăng 30% lượng sử dụng hàng ngày, trong khi chi phí suy luận hàng tháng của các startup AI nước ngoài giảm 60% đến 85% sau khi chuyển đổi. Tổng lượng gọi API của các mô hình trong nước đã liên tục vượt quá tổng lượng gọi của các mô hình đóng cửa của các nhà sản xuất Mỹ trong nhiều tuần liền, với các nhà phát triển Mỹ và châu Âu chiếm gần một nửa. Cuộc tái cấu trúc toàn cầu về mô hình lớn do yếu tố giá trị mang lại đang phá vỡ thế độc quyền định giá lâu dài của Thung lũng Silicon.

Tác giả bài viết, nguồn: Phoenix Tech của凤凰网

Tóm tắt: Trong thời gian dài, các nhà sản xuất Thung lũng Silicon đã chi phối quyền định giá cho các mô hình lớn toàn cầu. DeepSeek đã tạo ra hiệu ứng ép buộc trên thị trường nhà phát triển nước ngoài nhờ lợi thế về hiệu năng và giá cả.

Trong những ngày gần đây, một bức tranh hoạt hình AI trên mạng xã hội đã trở nên rất nổi tiếng; nhân vật trong hình dù là Lương Văn Phong, nhưng đã được xử lý theo phong cách hoạt hình, đặc biệt giống các nhân vật hoạt hình như Siêu Nhân, và được cộng đồng mạng đánh giá là hình ảnh của Lương Văn Phong trong mắt các nhà phát triển nước ngoài.

Truyện tranh này muốn thể hiện rằng, vào cuối tuần trước (ngày 31 tháng 7), sau khi phiên bản chính thức của DeepSeek V4 Flash ra mắt, nó đã đảo ngược cục diện sử dụng AI toàn cầu nhờ vào mức giá cực kỳ ưu việt.

Cộng đồng đánh giá mô hình lớn độc lập từ nước ngoài Artificial analysis sau khi thử nghiệm hàng trăm mô hình lớn đã dần hình thành một biểu đồ, trong đó DeepSeek-V4-Flash trở thành một đường phân chia.

Dữ liệu thống kê hàng tuần mới nhất của OpenRouter cho thấy DeepSeek-V4-Flash dẫn đầu danh sách lượng gọi mô hình trên nền tảng, trong khi V4-Pro duy trì vị trí trong top năm, cho thấy các nhà phát triển toàn cầu đang liên tục chuyển lượng lưu lượng suy luận trong môi trường sản xuất quy mô lớn sang giao diện mô hình của doanh nghiệp AI Trung Quốc này.

CEO của OpenCode, Jay (Jaya Kumar), cũng đăng bài vào ngày 1 tháng 8 cho biết, sau khi DeepSeek V4 Flash ra mắt, lượng sử dụng đã tăng 30% trong một ngày, và số người đăng ký mới cho OpenCode Go cũng tăng 30%.

Trong một thời gian dài, các quy tắc của thị trường mô hình lớn toàn cầu đã do các ông lớn ở Thung lũng Silicon viết nên. OpenAI, Anthropic và Google đặt ra các tiêu chuẩn hiệu suất, đồng thời kiểm soát chặt chẽ quyền định giá, với chi phí suy luận cao không ngừng tạo ra rào cản lớn cho các doanh nghiệp khởi nghiệp AI. Các nhà phát triển nước ngoài muốn có dịch vụ mô hình lớn ổn định và chất lượng dường như chỉ có thể chấp nhận thụ động các mức giá do các công ty lớn đóng cửa đưa ra.

Hiện nay, cục diện ngành đang bước vào một điểm ngoặt không thể đảo ngược. Dựa trên năng lực mô hình được liên tục cải tiến và giá API đám mây được tối ưu cực đại, DeepSeek đã vạch ra một “đường cắt tử thần (Kill Line)” rõ ràng trên thị trường nhà phát triển toàn cầu.

DeepSeek V4 Flash tái lên ngôi, các mô hình lớn của Trung Quốc chiếm giữ năm vị trí đầu

所谓斩杀线,不仅指性能的分水岭,更是性能与价格的平衡临界点:在同能力梯队中,定价显著高于 DeepSeek 的模型将持续流失中小开发者;性能弱于 DeepSeek 但成本更高的产品,其生存空间将迅速萎缩。

Dữ liệu gọi token công khai của chu kỳ mới nhất từ OpenRouter cho thấy DeepSeek-V4-Flash đạt vị trí đầu bảng về số lần gọi mô hình đơn lẻ, tiếp theo từ vị trí thứ hai đến thứ năm lần lượt là: Xiaomi MiMo-V2.5, Tencent Hy3, DeepSeek V4 Pro và Zhipu GLM5.2. Khi tổng hợp tổng khối lượng gọi của tất cả các mô hình trong nước, con số này đã liên tục vượt quá tổng khối lượng gọi của các mô hình đóng nguồn của các công ty Mỹ trong nhiều tuần liên tiếp. Trong đó, tỷ lệ nhà phát triển Mỹ và châu Âu trong lưu lượng truy cập gần bằng một nửa, với hàng loạt dự án tự động hóa Agent, công cụ hỗ trợ mã và ứng dụng xử lý văn bản dài chủ động chuyển mô hình mặc định sang DeepSeek.

Ngược lại, tốc độ tăng trưởng trong việc gọi các phiên bản chính của Claude và mô hình hàng đầu của Gemini liên tục chậm lại, thị phần của các mô hình đóng cửa hàng đầu ở nước ngoài không ngừng thu hẹp. Nhiều nhà sáng lập AI khởi nghiệp nước ngoài đã công khai đánh giá lại trên nền tảng X: sau khi đội ngũ chuyển toàn bộ sang DeepSeek, chi phí suy luận hàng tháng giảm từ 60% đến 85%. Đối với các công ty AI nhỏ chưa có lợi nhuận và đang chịu áp lực dòng tiền, sự khác biệt chi phí lớn như vậy đủ để quyết định liệu dự án có thể tồn tại hay không.

Thị trường dần phân hóa thành hai nhóm: các doanh nghiệp đa quốc gia lớn, do cân nhắc về tuân thủ dữ liệu và rủi ro chuỗi cung ứng, vẫn ưu tiên sử dụng dịch vụ từ các nhà cung cấp trong nước như OpenAI và Google; nhưng nhóm các nhà phát triển nhỏ và vừa, có độ linh hoạt cao và cực kỳ nhạy cảm với chi phí, đã bắt đầu di chuyển quy mô lớn.

Nhiều nhà quan sát ngành cho rằng dữ liệu của OpenRouter đã hé lộ một lớp màn che giấu của ngành: trước đây, nhiều đội ngũ chọn mô hình của các công ty lớn ở Thung lũng Silicon không phải vì tin rằng hiệu năng của chúng là không thể thay thế, mà do lâu nay thiếu các phương án thay thế có giá cả hợp lý. Khi các mô hình giá rẻ nhưng có năng lực thuộc nhóm hàng đầu xuất hiện, sự lựa chọn từ phía cầu lập tức chuyển hướng.

Tất nhiên, dữ liệu từ các nền tảng tổng hợp bên thứ ba có giới hạn tự nhiên. Lưu lượng truy cập cao hay thấp không tương đương với quy mô doanh thu của doanh nghiệp, vì phần lớn yêu cầu tập trung vào phiên bản Flash nhẹ và giá rẻ; đồng thời mẫu dữ liệu của nền tảng không đại diện cho thị trường khách hàng doanh nghiệp và chính phủ. Tuy nhiên, không thể phủ nhận rằng cộng đồng nhà phát triển là nguồn gốc của sự đổi mới trong ngành AI; nắm bắt được nhà phát triển chính là nắm bắt được nền tảng cho sự phát triển của hệ sinh thái ứng dụng trong tương lai.

Vẫn là vua về khả năng chi trả

Ngay trong ngày DeepSeek ra mắt V4 Flash, Artificial analysis đã thử nghiệm thực tế 128 mô hình lớn. Thuật ngữ “đường cắt bỏ” ra đời từ đó; các nhà phát triển đều cho rằng, chỉ có giá thấp không đủ cạnh tranh, chỉ có hiệu năng cao cũng khó khuấy động thị trường hiện hữu; chỉ khi mô hình đạt hiệu năng ngang hàng top đầu đồng thời có lợi thế giá cả đột phá, mới có thể liên tục tạo áp lực lên đối thủ cạnh tranh.

Phân tích lại sự phát triển của chiến lược định giá DeepSeek, có thể thấy rõ cách nó từng bước xây dựng rào cản giá. Tháng 5 năm 2026, DeepSeek-V4-Pro công bố giảm giá vĩnh viễn 75%, chuyển đổi chương trình khuyến mãi ngắn hạn thành mức giá cơ sở dài hạn, phá vỡ ngưỡng giá thấp nhất của các mô hình suy luận cao cấp toàn cầu tại thời điểm đó; sau đó, V4-Flash chính thức ra mắt, kết hợp cơ chế lưu trữ cuộc hội thoại và chiến lược định giá phân biệt đỉnh-đáy, giúp chi phí đầu vào Token trong các tình huống khớp bộ nhớ đệm tiếp tục giảm sâu hơn.

So sánh ngang hàng giá cả của các API đám mây công khai cho các mô hình lớn phổ biến hiện nay (tính theo triệu token, đơn vị USD), sự chênh lệch rõ ràng: Giá đầu ra của DeepSeek V4-Flash là 0,28 USD / triệu token; ngay cả sau nhiều lần điều chỉnh giá, GPT-5.6 Luna vẫn có giá đầu ra khoảng 1,2 USD / triệu token. Các mô hình cao cấp cùng cấp như Claude Sonnet và Gemini đều có giá cao hơn DeepSeek từ vài lần đến gần mười lần.

Bộ dữ liệu này đã thúc đẩy cộng đồng nhà phát triển nước ngoài đạt được sự đồng thuận: hầu hết các bối cảnh thương mại nhắm đến người dùng cuối (C-end) và doanh nghiệp vừa và nhỏ (SMB), việc chịu chi phí suy luận cao gấp chục lần để đạt được sự cải thiện hiệu năng ở mức độ nhỏ bé là không khả thi về mặt thương mại. Bất kỳ đối thủ nào nằm trên “đường cắt bỏ” này chỉ còn hai lựa chọn: chủ động giảm giá đáng kể, hoặc hoàn toàn từ bỏ thị trường nhà phát triển phổ cập, tập trung vào khách hàng doanh nghiệp cao cấp có ngân sách dồi dào và coi trọng sự ổn định của chuỗi cung ứng.

Trước tình trạng lưu lượng liên tục bị chia sẻ, OpenAI đã khẩn cấp giảm giá các mô hình dòng GPT; các nhà sản xuất châu Âu như Mistral đã điều chỉnh lại chiến lược thương mại hóa, dựa vào chiến lược mã nguồn mở miễn phí kết hợp ưu đãi trên đám mây để giữ vững nền tảng nhà phát triển; nhiều nhà cung cấp mô hình mã nguồn mở vừa và nhỏ buộc phải tính toán lại chi phí và từ bỏ ảo tưởng lợi nhuận dựa trên biên lợi nhuận API cao.

Quan trọng hơn, DeepSeek đã nổi tiếng trong ngành với mức giá thấp trong thời gian dài. Thay vì áp dụng chiến lược trợ giá cạnh tranh về giá, họ liên tục tối ưu hóa kỹ thuật nền tảng, như kiến trúc suy luận hiệu quả, bộ nhớ đệm KV động, điều phối lưu lượng theo đỉnh và đáy, cùng các giải pháp tối ưu hóa văn bản dài để giảm chi phí suy luận trên mỗi Token. Liang Wenhfeng cho biết trong nội bộ rằng chiến lược giá thấp giúp nhiều nhà phát triển hơn có thể sử dụng DeepSeek, điều này đã truyền cảm hứng rất lớn trong nội bộ.

Ngưỡng giá trị hiệu quả mang đến một vấn đề ngành hoàn toàn mới: tiêu chí cốt lõi của cuộc cạnh tranh mô hình lớn đang chuyển dịch. Trước đây, ngành so sánh số lượng tham số, sức mạnh tính toán huấn luyện và điểm Benchmark; hiện tại, chỉ số đầu tiên các nhà phát triển tính toán là “mỗi đơn vị chi phí có thể đổi lấy bao nhiêu đầu ra hiệu quả”.

48 giờ khuấy động mạng xã hội

Dữ liệu về hiệu suất và giá cả cuối cùng được chuyển hóa thành danh tiếng thực tế từ cộng đồng. Các nền tảng X, subreddit r/LocalLLaMA trên Reddit, HackerNews và LMSYS Arena tạo thành chiến trường chính của dư luận nước ngoài, trong đó nền tảng X chứng kiến các nhà phát triển và doanh nhân AI hàng đầu liên tục đăng tải nội dung kiểm nghiệm thực tế, thúc đẩy làn sóng quan tâm đến DeepSeek tiếp tục gia tăng, với dư luận thể hiện sự phân tầng rõ rệt.

Điều thú vị là, ngay ngày trước khi phiên bản chính thức của DeepSeek V4 Flash được ra mắt, OpenAI vừa thông báo giảm 80% giá API của GPT5.6 Luna. Ngày hôm sau, có người đăng hình ảnh về DeepSeek trong phần bình luận, cũng có người cảm ơn các mô hình lớn của Trung Quốc, cho rằng chính các mô hình lớn Trung Quốc đã khiến OpenAI lo lắng, điều này có lợi cho các nhà phát triển.

Nhiều nhà phát triển cá nhân cũng bày tỏ sự yêu thích đối với DeepSeek, không chỉ vì giá trị性价比 cao, mà còn do tốc độ phản hồi nhanh và trải nghiệm sử dụng “mượt mà”.

Quan điểm của các chuyên gia phố Wall hơi khác biệt. Nhóm lạc quan cho rằng cuộc cạnh tranh về giá do DeepSeek khởi xướng đã thúc đẩy việc ứng dụng AI nhanh chóng được triển khai và hạ thấp rào cản đổi mới toàn cầu; trong khi nhóm bi quan lo ngại rằng cuộc chiến giá kéo dài sẽ thu hẹp lợi nhuận của toàn ngành và làm suy yếu nguồn vốn đầu tư dài hạn của doanh nghiệp vào nghiên cứu và phát triển mô hình.

Đường biên giới hiệu suất giá mà DeepSeek vạch ra về bản chất đại diện cho sự va chạm trực tiếp giữa hai con đường phát triển mô hình lớn toàn cầu.

Một con đường đại diện bởi các gã khổng lồ Thung lũng Silicon: đầu tư nặng tay để huấn luyện các mô hình chủ lực đóng nguồn, duy trì biên lợi nhuận cao, tập trung vào khách hàng doanh nghiệp lớn, thu lợi từ các đơn hàng B2B giá trị cao, ưu tiên đẩy giới hạn năng lực, nhưng phản ứng chậm với biến động giá cả trên thị trường nhà phát triển phổ cập. Con đường còn lại đại diện bởi DeepSeek: dựa vào tối ưu hóa kỹ thuật để giảm chi phí suy luận, cân bằng giữa hệ sinh thái mã nguồn mở và dịch vụ đám mây, theo đuổi chiến lược lợi nhuận thấp nhưng khối lượng cao, ưu tiên chiếm lĩnh nhóm nhà phát triển, tận dụng hiệu ứng quy mô để phân bổ chi phí, nhanh chóng mở rộng thị phần toàn cầu thông qua lợi thế về giá cả.

Hai con đường không có đúng sai tuyệt đối, nhưng sự trỗi dậy của DeepSeek chứng minh một sự thật cốt lõi: cuộc cạnh tranh giữa các mô hình lớn không còn đơn thuần là so sánh quy mô chi tiêu. Đầu tư vào năng lực tính toán chỉ là nền tảng, hiệu suất suy luận, định giá thương mại hóa và chiến lược hệ sinh thái cũng có thể thay đổi thị phần.

Cuộc sàng lọc toàn cầu các mô hình lớn do tính cạnh tranh về giá trị bắt đầu vẫn chưa kết thúc. Cạnh tranh về giá chỉ là màn dạo đầu; tiếp theo, cuộc so sánh lâu dài về khả năng cải tiến mô hình, dịch vụ toàn cầu, giải pháp tuân thủ và mô hình sinh lời thương mại mới quyết định ai sẽ đứng vững. Ngay vào thứ Hai tuần này (ngày 3 tháng 8), MiniMax chính thức mở nguồn mô hình video tổng quát H3, với tham vọng tái hiện hiệu quả của DeepSeek trong lĩnh vực đa phương thức; cùng ngày, mô hình lớn Qwen3.8-Max của Alibaba cũng chính thức ra mắt, với tổng tham số 2,4 nghìn tỷ, đây là mô hình mạnh nhất từ trước đến nay trong gia đình Qwen. Trọng số mô hình sẽ được mở nguồn vào tuần tới.

Đối với hàng triệu nhà phát triển AI trên toàn cầu, sự thay đổi trực quan nhất đã xảy ra: nhiều lựa chọn hơn, chi phí giảm xuống, và rào cản đổi mới đang liên tục được hạ thấp.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.