AMD dan Supermicro melancarkan AMD Instinct Coder untuk mengurangkan kos pengkodean AI

iconBlockTempo
Kongsi
AI summary iconRingkasan
AMD dan Supermicro telah melancarkan AMD Instinct Coder, satu penyelesaian inferens pengkodean AI perniagaan yang bertujuan mengurangkan kos penggunaan token dan meningkatkan keselamatan data. Sistem ini menggunakan penghalaan pintar untuk menangani kod sensitif di tempat dan memindahkan tugas kompleks ke model luar. Dikuasakan oleh GPU MI325X AMD dan infrastruktur AI Supermicro, ia termasuk sokongan perisian daripada Spectro Cloud. Berita pelancaran token ini menonjolkan perkembangan baharu dalam berita AI + crypto.

Adakah kos pengkodean AI akan kehilangan kawalan? Untuk menyelesaikan masalah perusahaan, AMD, Supermicro, dan Spectro Cloud mengumumkan secara bersama pada 5 hari pelancaran solusi AI inference serba satu bernama "AMD Instinct Coder". Solusi ini menonjolkan teknologi "lokasi utama" dan penerusan pintar, membolehkan perusahaan mengurangkan kos penggunaan Token secara besar-besaran sambil menjamin keselamatan kod sensitif.
(Pendahuluan: Meta melancarkan model agen AI terkuat, Muse Spark 1.1! Menyokong konteks jutaan, mahir dalam pengkodean dan mengawal komputer secara autonomi)
(Borang latar belakang: SpaceXAI milik Musk secara rasmi melancarkan model terkuat 'Grok 4.5'! Bekerjasama dengan Cursor untuk menyerang agen pengkodean AI, diintegrasikan sepenuhnya dengan perisian pejabat Office)

As AI-powered coding tools rapidly gain adoption among developer communities, enterprises are facing a sharp rise in token consumption costs. To address this pain point for enterprises, cloud service providers, and sovereign AI operators, computing giant AMD, hardware leader Supermicro, and cloud management startup Spectro Cloud jointly announced on August 5 Taipei Time the official launch of “AMD Instinct Coder,” an enterprise-grade AI coding inference solution.

Menyelesaikan masalah kos dan keselamatan: Teknologi penghalaan pintar

Menurut ramalan agensi penyelidikan Gartner, jika tiada model tatacara yang sesuai, pada tahun 2028, kos pengkodean AI perusahaan bahkan mungkin melebihi gaji purata pembangun. Nilai utama AMD Instinct Coder ialah "model operasi hibrid", yang secara bijak menilai kompleksiti beban kerja: menghala tugas pengkodean biasa ke model yang dideploykan secara tempatan, sementara inferens kompleks lanjutan diserahkan kepada model terkini di luar.

Reka bentuk ini tidak hanya secara signifikan mengurangkan kos Token yang tinggi, tetapi lebih penting lagi, ia membolehkan syarikat menyimpan kod sensitif dan data konteks secara tempatan, mengelakkan kebocoran rahsia kepada penyedia awan tunggal.

Tiga teknologi utama beroperasi sepenuhnya: MI325X bertindak sebagai utama

Pakej penyelesaian serba satu ini secara sempurna mengintegrasikan teknologi terkemuka dari tiga pengeluar besar. Dari segi peranti keras, konfigurasi awal dijangka menggunakan GPU AMD Instinct MI325X terkini, yang dilengkapi dengan memori HBM3E 256 GB dan lebar pita memori puncak sehingga 6 TB/s, sangat sesuai untuk tugas inferens AI yang intensif memori; serta dipasangkan dengan infrastruktur AI perniagaan lapan GPU daripada Supermicro yang menawarkan pilihan penyejukan udara dan cecair.

Peringkat perisian disokong oleh PaletteAI Inference Launchpad daripada Spectro Cloud, membolehkan pasukan platform perusahaan dengan mudah menetapkan kuota, pengukuran, dan dasar pengecaman model untuk mencapai kawalan dan tata tertib pelbagai penyewa yang halus.

Menghentikan pengikatan pembekal, mempercepatkan pelaksanaan AI perusahaan

Untuk kerjasama penting ini, Tenry Fu, CEO Spectro Cloud, menekankan bahawa syarikat tidak seharusnya dipaksa untuk berkompromi antara keupayaan model dan kuasa ekonomi; juga, Dan McNamara, Timbalan Presiden Kanannya AMD, menunjukkan bahawa pengkodean AI telah naik dari alat pembangun peribadi kepada keputusan penting peringkat platform perniagaan.

Sekarang, penyelesaian ini sedang dipamerkan di pameran Ai4 di Las Vegas. Dengan kombinasi perisian dan peranti yang telah diintegrasikan dan disahkan ini, syarikat dapat menggantikan projek infrastruktur DIY yang kompleks, mempercepatkan masa dari penghantaran hingga siap produksi, serta mempercepatkan pelaksanaan AI peringkat produksi.

Sertai saluran Telegram Dynamic Zone

📍Laporan Berkaitan📍

NVIDIA Vera ujian piawai keluar! Mempercepat penyimpanan AI agen, pemulihan enkripsi dan data lebih cepat 3 kali

Ujian pertama Mira Murati, bekas ketua teknik OpenAI dalam dua tahun: AI sumber terbuka paling kuat Barat, tetapi kalah oleh model telefon bimbit

Model unggulan OpenAI, GPT-5.6 Sol, secara eksklusif melangkah ke Cerebras, "God of White Hair" Serenity menyatakan "teknologi telah disahkan" dan masuk untuk membeli pada harga rendah

Adakah AI membuat pakar semakin bodoh? Kajian terkini Nature: Kadar pengesanan kesalahan doktor turun 6%, jurutera mendapat 17 markah kurang dalam ujian

Penafian: Maklumat yang terdapat pada halaman ini mungkin telah diperoleh daripada pihak ketiga dan tidak semestinya menggambarkan pandangan atau pendapat KuCoin. Kandungan ini adalah disediakan bagi tujuan maklumat umum sahaja, tanpa sebarang perwakilan atau waranti dalam apa jua bentuk, dan juga tidak boleh ditafsirkan sebagai nasihat kewangan atau pelaburan. KuCoin tidak akan bertanggungjawab untuk sebarang kesilapan atau pengabaian, atau untuk sebarang akibat yang terhasil daripada penggunaan maklumat ini. Pelaburan dalam aset digital boleh membawa risiko. Sila menilai risiko produk dan toleransi risiko anda dengan teliti berdasarkan keadaan kewangan anda sendiri. Untuk maklumat lanjut, sila rujuk kepada Terma Penggunaan dan Pendedahan Risiko kami.