AMD dan Supermicro Meluncurkan AMD Instinct Coder untuk Mengurangi Biaya Pengkodean AI

iconBlockTempo
Bagikan
AI summary iconRingkasan
AMD dan Supermicro telah meluncurkan AMD Instinct Coder, solusi inferensi pengkodean AI perusahaan yang bertujuan mengurangi biaya konsumsi token dan meningkatkan keamanan data. Sistem ini menggunakan routing cerdas untuk menangani kode sensitif secara on-premise dan memindahkan tugas kompleks ke model eksternal. Didukung oleh GPU AMD MI325X dan infrastruktur AI Supermicro, sistem ini mencakup dukungan perangkat lunak dari Spectro Cloud. Berita peluncuran token ini menyoroti perkembangan baru dalam berita AI + crypto.

Biaya pengkodean AI akan segera kehilangan kendali? Untuk mengatasi tantangan perusahaan, AMD, Supermicro, dan Spectro Cloud secara bersama-sama mengumumkan pada tanggal 5 peluncuran solusi AI inference all-in-one bernama "AMD Instinct Coder". Solusi ini menonjolkan teknologi "local-first" dan routing cerdas, memungkinkan perusahaan untuk menjaga keamanan kode sensitif sekaligus secara signifikan mengurangi biaya konsumsi Token.
(Sebelumnya: Meta meluncurkan model agen AI terkuat, Muse Spark 1.1! Mendukung konteks hingga jutaan, ahli dalam pemrograman dan pengendalian komputer mandiri)
(Background supplement: Elon Musk's SpaceXAI has officially launched its most powerful model, 'Grok 4.5'! Partnering with Cursor to aggressively target AI coding agents, seamlessly integrated with Office productivity software)

随着人工智能(AI)编写代码的工具在开发者社区中迅速普及,企业面临的 Token 消耗成本正急剧上升。为了帮助企业、云服务商与主权 AI 运营商解决这一痛点,计算巨头 AMD、硬件厂商 Supermicro 以及云管理初创公司 Spectro Cloud 于台北时间 8 月 5 日共同宣布,正式推出名为「AMD Instinct Coder」的企业级 AI 编码推理解决方案。

Mengatasi tantangan biaya dan keamanan: teknologi routing cerdas

Menurut prediksi lembaga riset Gartner, jika tidak ada model tata kelola yang tepat, biaya pengkodean AI perusahaan pada tahun 2028 bahkan bisa melebihi gaji rata-rata pengembang. Nilai inti AMD Instinct Coder terletak pada "model operasi hibrida", yang secara cerdas menilai kompleksitas beban kerja: mengarahkan tugas pengkodean rutin ke model yang di-deploy lokal, sementara inferensi kompleks tingkat lanjut diserahkan ke model mutakhir eksternal.

Desain ini tidak hanya secara signifikan mengurangi biaya Token yang tinggi, tetapi yang lebih penting, memungkinkan perusahaan untuk menyimpan kode sensitif dan data konteks secara lokal, menghilangkan kekhawatiran keamanan siber terkait kebocoran rahasia ke penyedia cloud tunggal.

Tiga teknologi unggulan beroperasi penuh: MI325X menjadi andalan

Solusi all-in-one ini secara sempurna mengintegrasikan teknologi terkemuka dari tiga perusahaan besar. Dari segi perangkat keras, konfigurasi awal diperkirakan menggunakan GPU AMD Instinct MI325X terbaru, yang dilengkapi dengan memori HBM3E sebesar 256 GB dan bandwidth memori puncak hingga 6 TB/s, sangat cocok untuk tugas inferensi AI yang padat memori; serta didukung oleh infrastruktur AI enterprise delapan GPU dari Supermicro yang menawarkan opsi pendinginan udara dan cair.

Di tingkat perangkat lunak, didukung oleh PaletteAI Inference Launchpad dari Spectro Cloud, memungkinkan tim platform perusahaan untuk dengan mudah mengatur kuota, pengukuran, dan kebijakan routing model, mencapai kontrol dan fitur tata kelola multi-tenant yang terperinci.

Menghentikan ketergantungan pada pemasok, mempercepat penerapan AI perusahaan

Untuk kolaborasi penting ini, CEO Spectro Cloud, Tenry Fu, menekankan bahwa perusahaan tidak boleh dipaksa untuk berkompromi antara kemampuan model dan kekuatan ekonomi; Wakil Presiden Senior AMD, Dan McNamara, juga menunjukkan bahwa pengkodean AI telah naik dari alat pengembang perorangan menjadi keputusan kritis tingkat platform perusahaan.

Currently, this solution is being publicly demonstrated at the Ai4 exhibition in Las Vegas. With this pre-integrated and validated hardware-software combination, enterprises can replace complex DIY infrastructure projects, significantly shortening the time from delivery to production-ready, and accelerating the deployment of production-grade AI.

Gabung saluran Telegram Dynamic Zone

📍Laporan Terkait📍

NVIDIA Vera benchmark telah dirilis! Mempercepat penyimpanan AI agen, pemulihan enkripsi dan data lebih dari 3 kali lebih cepat

Uji coba karya pertama Mira Murati, mantan Chief Technology Officer OpenAI, setelah dua tahun: AI open-source terkuat dari Barat, tetapi kalah dalam uji coba oleh model ponsel

Model unggulan OpenAI, GPT-5.6 Sol, secara eksklusif hadir di Cerebras, "Sang Dewa Saham Berambut Putih" Serenity menyatakan "teknologi telah diverifikasi" dan masuk untuk membeli di harga rendah

Apakah AI membuat para ahli semakin bodoh? Penelitian terbaru di Nature: tingkat deteksi kesalahan dokter turun 6%, insinyur mendapat skor 17 poin lebih rendah dalam tes

Penafian: Informasi pada halaman ini mungkin telah diperoleh dari pihak ketiga dan tidak mencerminkan pandangan atau opini KuCoin. Konten ini disediakan hanya untuk tujuan informasi umum, tanpa representasi atau jaminan apa pun, dan tidak dapat ditafsirkan sebagai saran keuangan atau investasi. KuCoin tidak bertanggung jawab terhadap segala kesalahan atau kelalaian, atau hasil apa pun yang keluar dari penggunaan informasi ini. Berinvestasi di aset digital dapat berisiko. Harap mengevaluasi risiko produk dan toleransi risiko Anda secara cermat berdasarkan situasi keuangan Anda sendiri. Untuk informasi lebih lanjut, silakan lihat Ketentuan Penggunaan dan Pengungkapan Risiko.