AMD và Supermicro ra mắt AMD Instinct Coder để giảm chi phí lập trình AI

iconBlockTempo
Chia sẻ
AI summary iconTóm tắt
AMD và Supermicro đã ra mắt AMD Instinct Coder, một giải pháp mã hóa AI doanh nghiệp nhằm giảm chi phí tiêu thụ token và cải thiện bảo mật dữ liệu. Hệ thống sử dụng định tuyến thông minh để xử lý mã nhạy cảm tại chỗ và chuyển các tác vụ phức tạp sang các mô hình bên ngoài. Được vận hành bởi GPU MI325X của AMD và cơ sở hạ tầng AI của Supermicro, hệ thống bao gồm hỗ trợ phần mềm từ Spectro Cloud. Tin tức về việc ra mắt token này nhấn mạnh một phát triển mới trong tin tức AI + crypto.

Chi phí mã hóa AI sắp mất kiểm soát? Để giải quyết các vấn đề của doanh nghiệp, AMD, Supermicro và Spectro Cloud đã cùng công bố vào ngày 5 tháng này giải pháp AI inference toàn diện “AMD Instinct Coder”. Giải pháp này nổi bật với công nghệ “ưu tiên tại chỗ” và định tuyến thông minh, giúp doanh nghiệp giảm đáng kể chi phí tiêu thụ Token trong khi vẫn đảm bảo an toàn cho mã nguồn nhạy cảm.
(Tình tiết trước: Meta công bố mô hình đại lý AI mạnh nhất Muse Spark 1.1! Hỗ trợ ngữ cảnh lên đến triệu, thành thạo mã hóa và điều khiển máy tính tự chủ)
(Bổ sung bối cảnh: SpaceXAI thuộc sở hữu của Musk vừa chính thức ra mắt mô hình mạnh nhất "Grok 4.5"! Hợp tác với Cursor tấn công mạnh vào đại lý mã hóa AI, tích hợp hoàn hảo với phần mềm văn phòng Office)

随着人工智能(AI)编写代码的工具在开发者社区中迅速普及,企业面临的 Token 消耗成本正急剧上升。为了解决企业、云服务商与主权 AI 运营商的这一痛点,计算巨头 AMD、硬件厂商 Supermicro 以及云管理初创公司 Spectro Cloud 于台北时间 8 月 5 日共同宣布,正式推出名为「AMD Instinct Coder」的企业级 AI 编码推理解决方案。

Giải quyết các điểm đau về chi phí và an ninh: Công nghệ định tuyến thông minh

Theo dự đoán của tổ chức nghiên cứu Gartner, nếu thiếu mô hình quản trị phù hợp, chi phí mã hóa AI của doanh nghiệp vào năm 2028 thậm chí có thể vượt quá mức lương trung bình của các nhà phát triển. Giá trị cốt lõi của AMD Instinct Coder nằm ở “mô hình vận hành lai”, có khả năng thông minh xác định dựa trên độ phức tạp của tải công việc: tự động định tuyến các tác vụ mã hóa thông thường đến mô hình được triển khai tại chỗ, trong khi các suy luận phức tạp nâng cao sẽ được giao cho các mô hình tiên tiến bên ngoài thực hiện.

Thiết kế này không chỉ giúp giảm đáng kể chi phí token cao, mà quan trọng hơn, nó cho phép doanh nghiệp giữ mã nguồn nhạy cảm và dữ liệu ngữ cảnh tại chỗ, loại bỏ mối lo ngại bảo mật khi tiết lộ bí mật cho một nhà cung cấp đám mây duy nhất.

Ba công nghệ mạnh mẽ phát huy tối đa sức mạnh: MI325X đảm nhiệm vai trò chính

Giải pháp tích hợp toàn diện này kết hợp hoàn hảo các công nghệ hàng đầu từ ba nhà sản xuất lớn. Về phần cứng, cấu hình ban đầu dự kiến sử dụng GPU AMD Instinct MI325X mới nhất, với 256 GB bộ nhớ HBM3E và băng thông bộ nhớ đỉnh điểm lên đến 6 TB/s, cực kỳ phù hợp cho các tác vụ suy luận AI đòi hỏi nhiều bộ nhớ; cùng với cơ sở hạ tầng AI do Supermicro cung cấp, hỗ trợ tùy chọn làm mát bằng không khí và chất lỏng, với tám GPU doanh nghiệp.

At the software level, it is powered by Spectro Cloud's PaletteAI Inference Launchpad, enabling enterprise platform teams to easily set quotas, metering, and model routing policies to achieve fine-grained multi-tenant control and governance capabilities.

Phá vỡ sự ràng buộc của nhà cung cấp, tăng tốc việc triển khai AI doanh nghiệp

Đối với hợp tác quan trọng này, Giám đốc điều hành Spectro Cloud, Tenry Fu, nhấn mạnh rằng các doanh nghiệp không nên bị ép buộc phải đánh đổi giữa khả năng mô hình và quyền kiểm soát kinh tế; Phó chủ tịch cấp cao của AMD, Dan McNamara, cũng chỉ ra rằng mã hóa AI đã từ công cụ phát triển cá nhân trở thành quyết định then chốt cấp nền tảng doanh nghiệp.

Currently, this solution is being showcased at the Ai4 exhibition in Las Vegas. With this pre-integrated and validated hardware-software combination, enterprises can replace complex DIY infrastructure projects, significantly shortening the time from delivery to production readiness and accelerating the deployment of production-grade AI.

Tham gia kênh Telegram của Dynamic Zone

📍Bài viết liên quan📍

NVIDIA Vera benchmark đã ra mắt! Tăng tốc lưu trữ AI đại lý, mã hóa và khôi phục dữ liệu nhanh hơn 3 lần

Thử nghiệm tác phẩm đầu tiên sau hai năm của cựu trưởng kỹ thuật OpenAI, Mira Murati: AI mã nguồn mở mạnh nhất phương Tây, nhưng trong thực tế lại bị model điện thoại đánh bại

Mô hình chủ lực của OpenAI, GPT-5.6 Sol, độc quyền có mặt trên Cerebras, "thần tài lông trắng" Serenity tuyên bố "công nghệ đã được xác thực" và vào thị trường mua vào

AI có đang khiến các chuyên gia ngày càng ngu hơn? Nghiên cứu mới nhất của Nature: Tỷ lệ phát hiện sai của bác sĩ giảm 6%, kỹ sư thi bị giảm 17 điểm

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể được lấy từ bên thứ ba và không nhất thiết phản ánh quan điểm hoặc ý kiến của KuCoin. Nội dung này chỉ được cung cấp cho mục đích thông tin chung, không có bất kỳ đại diện hay bảo đảm nào dưới bất kỳ hình thức nào và cũng không được hiểu là lời khuyên tài chính hay đầu tư. KuCoin sẽ không chịu trách nhiệm về bất kỳ sai sót hoặc thiếu sót nào hoặc về bất kỳ kết quả nào phát sinh từ việc sử dụng thông tin này. Việc đầu tư vào tài sản kỹ thuật số có thể tiềm ẩn nhiều rủi ro. Vui lòng đánh giá cẩn thận rủi ro của sản phẩm và khả năng chấp nhận rủi ro của bạn dựa trên hoàn cảnh tài chính của chính bạn. Để biết thêm thông tin, vui lòng tham khảo Điều khoản sử dụngTiết lộ rủi ro của chúng tôi.