AMD e Supermicro lançam o AMD Instinct Coder para reduzir os custos de codificação de IA

iconBlockTempo
Compartilhar
AI summary iconResumo
AMD e Supermicro lançaram o AMD Instinct Coder, uma solução empresarial de inferência de codificação por IA voltada para reduzir os custos de consumo de tokens e melhorar a segurança de dados. O sistema utiliza roteamento inteligente para processar código sensível localmente e transferir tarefas complexas para modelos externos. Impulsionado pela GPU MI325X da AMD e pela infraestrutura de IA da Supermicro, inclui suporte de software da Spectro Cloud. Essa notícia sobre o lançamento do token destaca um novo desenvolvimento nas notícias de IA + cripto.

Será que os custos de codificação por IA estão prestes a sair do controle? Para resolver os desafios das empresas, a AMD, a Supermicro e a Spectro Cloud anunciaram conjuntamente em 5 de maio a lançamento da solução integrada de inferência de IA "AMD Instinct Coder". A solução destaca-se pela abordagem "prioridade local" e tecnologia de roteamento inteligente, permitindo que as empresas reduzam significativamente os custos de consumo de tokens, ao mesmo tempo em que garantem a segurança do código sensível.
(Prévia: Meta lança o modelo de agente AI mais poderoso, Muse Spark 1.1! Suporta milhões de contextos, especializado em codificação e controle autônomo de computadores)
(Informação adicional: SpaceXAI, da empresa de Musk, lançou oficialmente o modelo mais poderoso, "Grok 4.5"! Em parceria com o Cursor, ataca fortemente agentes de codificação por IA, com integração perfeita com o pacote Office)

À medida que ferramentas de codificação baseadas em inteligência artificial (IA) ganham popularidade rápida na comunidade de desenvolvedores, os custos de consumo de tokens enfrentados por empresas estão aumentando drasticamente. Para resolver esse problema para empresas, provedores de serviços em nuvem e operadores de IA soberana, a AMD, líder em computação, a fabricante de hardware Supermicro e a startup de gerenciamento em nuvem Spectro Cloud anunciaram conjuntamente, em 5 de agosto, horário de Taipei, o lançamento oficial da solução empresarial de inferência de codificação por IA chamada “AMD Instinct Coder”.

Resolver pontos dolorosos de custo e segurança: tecnologia de roteamento inteligente

De acordo com previsões da instituição de pesquisa Gartner, se não houver um modelo de governança adequado, até 2028 os custos de codificação de IA das empresas podem superar até mesmo o salário médio dos desenvolvedores. O valor central do AMD Instinct Coder reside no "modelo de operação híbrido", que inteligentemente determina, com base na complexidade da carga de trabalho: rotear automaticamente tarefas de codificação comuns para modelos implantados localmente, enquanto as inferências avançadas e complexas são delegadas a modelos de ponta externos.

Este design não apenas reduz significativamente os altos custos de tokens, mas, mais importante ainda, permite que as empresas mantenham seu código sensível e dados contextuais localmente, eliminando preocupações de segurança relacionadas à exposição de informações confidenciais a um único provedor de nuvem.

Três tecnologias principais em pleno funcionamento: MI325X como principal

Esta solução all-in-one integra perfeitamente as tecnologias de ponta de três grandes empresas. Em termos de hardware, a configuração inicial prevê o uso da mais recente GPU AMD Instinct MI325X, com 256 GB de memória HBM3E e largura de banda de memória pico de até 6 TB/s, extremamente adequada para tarefas de inferência de IA intensivas em memória; combinada com a infraestrutura empresarial de IA de oito GPUs fornecida pela Supermicro, com opções de refrigeração por ar e líquida.

A camada de software é suportada pelo PaletteAI Inference Launchpad da Spectro Cloud, permitindo que as equipes de plataforma das empresas definam facilmente cotas, medição e políticas de roteamento de modelos, realizando controle e governança refinados multi-tenant.

Quebrar o sequestro de fornecedores, acelerar a adoção de IA nas empresas

Para esta importante parceria, o CEO da Spectro Cloud, Tenry Fu, enfatizou que as empresas não devem ser forçadas a fazer concessões entre a capacidade do modelo e o controle econômico; o vice-presidente sênior da AMD, Dan McNamara, também destacou que a codificação de IA evoluiu de uma ferramenta para desenvolvedores individuais para uma decisão-chave em nível de plataforma empresarial.

Currently, this solution is being publicly demonstrated at the Ai4 exhibition in Las Vegas. Through this pre-integrated and validated hardware-software combination, enterprises can replace complex DIY infrastructure projects, significantly shortening the time from delivery to production-ready and accelerating the deployment of production-grade AI.

Junte-se ao canal do Telegram da Dynamic Zone

📍Notícias relacionadas📍

NVIDIA Vera benchmark results are in! Accelerated agent-based AI storage, with encryption and data recovery over 3x faster

Mira Murati, ex-chefe técnica da OpenAI, testa sua primeira obra em dois anos: a IA de código aberto mais forte do Ocidente é derrotada por um modelo de celular

O modelo principal da OpenAI, GPT-5.6 Sol, estreia exclusivamente no Cerebras; "o Deus das Ações de Cabelo Branco", Serenity, declara "tecnologia validada" e entra para comprar na baixa

A IA está tornando os especialistas mais burros? Estudo mais recente da Nature: taxa de diagnóstico de médicos caiu 6%, engenheiros pontuaram 17 pontos a menos no teste

Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações. Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.