AI kodlama maliyetleri kontrol dışı mı olacak? Kurumsal sorunları çözmek amacıyla AMD, Supermicro ve Spectro Cloud, 5'te "AMD Instinct Coder" adlı tek duraklı bir AI çıkarım çözümünü duyurdu. Bu çözüm, "yerel öncelikli" ve akıllı rota teknolojisini vurgulayarak, şirketlerin hassas kodlarını korurken Token tüketim maliyetlerini büyük ölçüde azaltmasını sağlıyor.
(Önceki bölüm: Meta, en güçlü AI ajant modeli Muse Spark 1.1’i duyurdu! Milyonlarca bağlamı destekliyor, kodlama ve bilgisayar kontrolünü özgürce yapıyor)
Elon Musk'un SpaceXAI'si en güçlü model olan 'Grok 4.5'i resmen tanıttı! Cursor ile birlikte AI kodlama ajantlarına saldırdı ve Office ofis yazılımlarıyla mükemmel entegrasyon sağladı.
随着人工智能(AI)编程工具在开发者社区中迅速普及,企业面临的代币消耗成本正急剧上升。为解决企业、云服务商和主权AI运营商的这一痛点,计算巨头AMD、硬件厂商Supermicro以及云管理初创公司Spectro Cloud于北京时间8月5日共同宣布,正式推出名为“AMD Instinct Coder”的企业级AI编码推理解决方案。
Maliyet ve güvenlik sorunlarını çözün: Akıllı rota teknolojisi
Gartner araştırmalarına göre, uygun bir yönetim modeli yoksa 2028 yılına kadar şirketlerin AI kodlama maliyetleri geliştiricilerin ortalama maaşını aşabilir. AMD Instinct Coder'in temel değeri, "karışık operasyon modeli"dir; bu model, iş yükü karmaşıklığına göre düzenli kodlama görevlerini yerel olarak dağıtılmış modellere otomatik olarak yönlendirirken, gelişmiş karmaşık çıkarımları dışarıdaki öncü modellere bırakır.
Bu tasarım, yüksek token maliyetlerini önemli ölçüde azaltmanın yanı sıra, işletmelerin hassas kodlarını ve bağlam verilerini yerel olarak korumasını sağlayarak gizliliklerini tek bir bulut sağlayıcısına verme güvenlik endişelerini ortadan kaldırır.
Üç Güçlü Teknoloji Tam Güçle: MI325X Ana Rolde
Bu tümleşik çözüm, üç büyük şirketin öncü teknolojilerini mükemmel şekilde entegre eder. Donanım açısından, ilk yapılandırma, 256 GB HBM3E belleğe ve 6 TB/s'ye kadar tepe bellek bant genişliğine sahip AMD'nin en yeni Instinct MI325X GPU'sunu kullanmayı planlamaktadır; bu, bellek yoğun AI çıkarım görevleri için idealdir; ayrıca Supermicro tarafından sağlanan sekiz GPU'lu kurumsal AI altyapısı ile birlikte hava ve sıvı soğutma seçenekleri sunulmaktadır.
Yazılım katmanı, Spectro Cloud'un PaletteAI Inference Launchpad'i tarafından desteklenir ve kurumsal platform ekiplerinin kota, ölçüm ve model rota politikalarını kolayca ayarlamasını sağlar, böylece ince ayarlı çok kiracılı kontrol ve yönetim fonksiyonları gerçekleştirilir.
Tedarikçi bağımlılığını kırın, kurumsal AI uygulamalarını hızlandırın
Bu önemli iş birliği için Spectro Cloud CEO'su Tenry Fu, şirketlerin model yetenekleri ile ekonomik kontrol arasında ödün vermek zorunda olmadığını vurguladı; AMD'nin üst düzey başkanı Dan McNamara da AI kodlamasının bireysel geliştirici araçlarından kurumsal platform düzeyindeki kritik kararlara yükseldiğini belirtti.
Şu anda, bu çözüm Las Vegas'ta düzenlenen Ai4 fuarında sergilenmektedir. Önceden entegre edilmiş ve doğrulanmış bu donanım-yazılım kombinasyonu sayesinde işletmeler, karmaşık kendi kendine kurulum altyapı projelerini yerine geçirebilir ve üretimde hazır hale gelme süresini büyük ölçüde kısaltarak üretim seviyesindeki AI uygulamalarının hayata geçirilmesini hızlandırır.

