AMD anuncia a plataforma Helios AI e prevê 60% de computação AI para inferência até 2026

iconMetaEra
Compartilhar
AI summary iconResumo
A AMD anunciou a plataforma Helios AI, o CPU EPYC Venice de sexta geração e os Instinct MI430X e MI350P no evento Advancing AI 2026. A CEO Lisa Su afirmou que 60% do cálculo global de IA será para inferência até 2026, destacando a necessidade de recursos de GPU e CPU. A AMD parceia-se com OpenAI, Meta e Anthropic na Helios, com envios começando até o Q3 de 2026. A iniciativa alinha-se às crescentes tendências de notícias de IA + cripto e às políticas cripto globais em evolução.
A AMD apresentou na conferência Advancing AI 2026 a plataforma de IA em rack Helios, a CPU de servidor EPYC Venice de sexta geração, os Instinct MI430X e MI350P, marcando a entrada da AMD na competição de fábricas de IA com um sistema completo composto por GPU, CPU, rede e software. Lisa Su prevê que, em 2026, cerca de 60% da capacidade global de IA será usada para inferência, e os Agentes precisam de grandes quantidades de GPU para inferência, bem como de grande quantidade de CPU para orquestrar cada etapa. Ela enfatizou que a AMD escolheu um caminho diferenciado com arquitetura Chiplet e combinação de produtos, desenvolvendo em conjunto com empresas líderes como OpenAI, Meta e Anthropic a Helios, cujos primeiros produtos serão entregues no final do terceiro trimestre.

Autor e fonte do artigo: Tencent Tech

Lisa Su resumiu a estratégia da AMD na Keynote em três pontos: liderança em computação, plataforma aberta e “tornar a IA onipresente”.

Advancing AI é o evento anual da AMD voltado para o ecossistema de computação de IA. Em 24 de julho de 2026, horário de Pequim, a AMD lançou em conjunto a plataforma de IA em rack Helios, a CPU de servidor EPYC de sexta geração "Venice", os Instinct MI430X e MI350P, o ROCm.AI, bem como as plataformas "Gorgon Halo" e Kria AI Robotics, destinadas a Agentes locais e robôs. Com o MI455X como núcleo de computação, o Helios foi o protagonista do evento, marcando o início da AMD na competição de fábricas de IA com um sistema completo composto por GPU, CPU, rede e software.

Lisa Su resumiu a estratégia da AMD na Keynote em três pontos: liderança em computação, plataforma aberta e “tornar a IA onipresente”. Por trás dessas três estratégias, há um julgamento claro da AMD sobre as mudanças na indústria de IA: o treinamento continuará a se expandir, mas o foco do consumo de poder de processamento já está acelerando em direção à inferência; os Agentes expandiram uma única chamada de modelo em inferência contínua, chamadas de ferramentas, execução de código e acesso a dados, transformando a infraestrutura de IA de um problema de GPU em um projeto sistêmico envolvendo CPU, rede, software, energia e data centers.

Lisa Su prevê que, em 2026, cerca de 60% da capacidade de IA global será usada para inferência, destacando que agentes precisam de “muitas GPUs para inferência” e também de “muitos CPUs para orquestrar cada etapa”.

Em 24 de julho, durante o evento AMD Advancing AI 2026, a Dra. Lisa Su, presidente do conselho e CEO da AMD, o vice-presidente sênior da divisão de IA da AMD, Vamsi Boppana, e o vice-presidente sênior e gerente geral da divisão de computação e IA empresarial da AMD, Dan McNamara, participaram de uma conversa de cerca de meia hora com a mídia global, incluindo Tencent Technology. Em comparação com o lançamento de produtos apresentado no Keynote, essa conversa abordou alguns dos problemas mais centrais atuais da AMD: se a demanda por IA continuará crescendo rapidamente, se o Helios será entregue conforme o cronograma, como a AMD pretende alcançar a NVIDIA e se um ecossistema aberto é realmente um caminho comercial viável.

Su Zifeng também forneceu uma avaliação da AMD sobre a demanda: “Quanto mais útil a IA se torna, mais as pessoas querem usá-la.” Em sua opinião, o investimento das empresas em IA já passou da redução de custos inicial para a criação de valor mais direta, como desenvolvimento de produtos e crescimento de negócios. Portanto, mesmo que as empresas comecem a controlar os orçamentos de tokens, isso não alterará a tendência de longo prazo de aumento da demanda por poder de processamento.

Diante da pergunta direta sobre se a AMD ainda estava seguindo a NVIDIA, Su Zhenfeng não evitou a questão. Ela afirmou que a AMD escolheu um caminho diferente: utilizar a arquitetura Chiplet e uma combinação de produtos para abranger diferentes cargas de trabalho, além de conectar clientes e parceiros por meio de um ecossistema aberto. Ela enfatizou que a AMD não se contenta com o crescimento natural do mercado, mas “prevê que o crescimento em cada segmento em que participa será superior à média do mercado”; da MI450 para a MI500, “não se trata de uma atualização modesta, mas de outra grande salto”.

Essa abordagem competitiva também se reflete na forma como o Helios foi desenvolvido. Su stated que o Helios não foi desenvolvido independentemente pela AMD e depois entregue aos clientes, mas sim projetado em conjunto com empresas líderes como OpenAI, Meta e Anthropic. Os clientes entram mais cedo no processo de definição do produto, desde o chip até o software, data center e cadeia de suprimentos. Ela chamou essa colaboração de “arma secreta” crucial para a produção em massa pontual do Helios.

As empresas estão começando a controlar orçamentos de tokens; por que a AMD ainda acredita que o mercado de IA crescerá fortemente?

Lisa Su: Esta é uma ótima pergunta.

Em primeiro lugar, prever mercados pode ser uma das coisas mais difíceis, pois as previsões provavelmente não serão totalmente precisas.

Mas o que podemos determinar é que passamos muito tempo conversando com clientes para tentar entender as mudanças fundamentais ocorrendo no nível de carga de trabalho. O que estamos vendo agora é uma demanda muito forte por poder de processamento. Isso é verdadeiro para GPU e aceleradores, mas a mudança no campo de CPU é na verdade ainda mais agressiva.

Quanto ao motivo pelo qual acreditamos que essa tendência persistirá, todos ouviram hoje as opiniões da OpenAI, da Meta e de outros grandes clientes. Precisamos planejar anos à frente para nos prepararmos com chips, energia, data centers e toda a cadeia de suprimentos. Por isso, agora estamos colaborando com nossos clientes mais estreitamente do que nunca.

A IA é um exemplo típico: quanto mais útil ela for, mais as pessoas quererão usá-la. Claro, todos continuarão a aprimorá-la.

Dan anteriormente mencionou o que observamos ao trabalhar com clientes corporativos. Mas, de qualquer forma, a tendência geral de adoção da IA continua em alta. Vemos a IA desempenhando um papel cada vez mais importante no desenvolvimento de produtos e em outros campos-chave que as empresas utilizam para criar valor.

O valor trazido pela IA já ultrapassou amplamente a redução de custos. Reduzir custos pode ter sido o ponto de partida inicial das empresas para implementar a IA, mas agora ela é cada vez mais utilizada para criar valor empresarial real.

Portanto, temos muita confiança na curva de demanda.

Ao mesmo tempo, as pessoas estão gradualmente reconhecendo que já não se trata apenas de um único chip. É necessário um conjunto completo de famílias de chips, combinação de produtos e arquitetura de hardware. Essa sempre foi a avaliação única adotada pela AMD.

Quão complexo é o Helios? O plano Helios será implantado no segundo semestre deste ano; como a AMD define essa implantação? Por que você tem confiança de que poderá concluí-la no prazo?

Lisa Su: Primeiro, quero reconhecer isso de forma muito clara. Todos já devem ter visto, a partir do hardware apresentado no palco, que o Helios é realmente impressionante.

É um resultado de engenharia incrível, envolvendo poder de computação robusto, energia, integração de sistemas, densidade e muitos outros aspectos.

Mas todos precisam lembrar que nos preparamos por anos para este momento.

Isso inclui as capacidades desenvolvidas internamente, como ROCm e capacidades de software de plataforma; inclui as capacidades construídas pela equipe de rede; e também inclui a aquisição da Pensando e da ZT Systems, bem como a integração dessas capacidades.

Uma “arma secreta” que espero que todos sintam hoje é que estamos totalmente alinhados com nossos parceiros. Em outras palavras, a AMD não desenvolve primeiro de forma independente e depois entrega os produtos aos parceiros. Nós os desenvolvemos juntos.

A OpenAI está desenvolvendo conosco, a Meta está desenvolvendo conosco. Todos também ouviram o compartilhamento do cofundador da Anthropic, Tom Brown. Por isso, temos muita confiança na escalada do nosso produto.

“Produção em larga escala” significa que estamos prontos para envio. Começaremos a enviar no final do terceiro trimestre e continuaremos a expandir a escala no quarto trimestre e no primeiro semestre do próximo ano.

Quais data centers receberão os primeiros produtos já foi claramente planejado. Também estamos trabalhando em estreita colaboração com nossos parceiros ODM. Uma diferença entre o Helios e produtos anteriores é que todos os elos da cadeia de suprimentos já foram alinhados. Esta é também uma das principais razões pelas quais mantemos nossa confiança.

Estou muito satisfeito com o progresso do Helios.

Hoje, a AMD lançou novos racks de data center e anunciou parcerias com a Cerebras e avanços em software. Mas, pela linha do tempo, esses produtos parecem ainda estar seguindo a NVIDIA. Ou a estratégia da AMD não é competir pelo primeiro lugar, mas sim considerar que o mercado de IA é grande o suficiente para aceitar uma posição de segundo lugar, desde que consiga uma parcela significativa de mercado?

Lisa Su: Hoje realmente lançamos muitos produtos. Mas, honestamente, acreditamos que estamos trilhando o caminho correto para o futuro da computação de IA. Os GPUs são certamente muito importantes, e também temos grande confiança em nossa rota de GPUs.

Como antecipei hoje, ir de MI450 para MI500 não é apenas uma pequena atualização, mas outra grande salto.

Acreditamos que a AMD alcançará a liderança no campo de expansão de poder de processamento Scale-up. Essa é uma avaliação muito importante, mas é exatamente a direção que estamos observando atualmente.

Escolhemos um caminho diferente. Nos últimos cerca de dez anos, especialmente nos últimos cinco anos, temos investido em arquiteturas e combinações de produtos Chiplet.

Usando o EPYC como exemplo, agora todos estão começando a achar os CPUs interessantes, mas nós nos preparamos por muitos anos para este momento.

Mark Papermaster e sua equipe têm refletido sobre como criar um ecossistema no qual diferentes cargas de trabalho possam utilizar o chip mais adequado. Essa ideia também permeia nosso plano estratégico geral.

Portanto, estamos muito confiantes na posição em que nos encontramos atualmente. Este é um mercado enorme. A AMD acredita que, até 2030, o mercado total em que atuamos alcançará US$ 2 trilhões, um número muito grande.

Mas não queremos apenas compartilhar o crescimento do mercado. Prevemos que a AMD crescerá mais rapidamente do que a média do mercado em todos os segmentos em que participa.

A AMD competirá à sua maneira. Nossa abordagem inclui tecnologia de ponta, ecossistema aberto e a escolha da computação adequada para diferentes cargas de trabalho. Portanto, isso exige tanto amplitude quanto profundidade.

Vamsi Boppana: Lisa já disse tudo.

Novos nichos sempre surgem no mercado. Precisamos manter o foco e executar com rigor as tarefas mais importantes no momento, caso contrário, facilmente nos distrairemos com diversas direções.

Mas, em algum momento, escolheremos um nicho específico e diremos claramente que acreditamos que alcançaremos uma liderança incontestável aqui. Estamos muito confiantes nisso.

Lisa Su: Pelo menos hoje, podemos afirmar com certeza que a AMD possui uma liderança incontestável no campo de CPUs.

Em 2025, a AMD firmou uma parceria de aquisição e implantação de chips com a OpenAI e lhe concedeu warrants correspondentes a até cerca de 10% das ações. Por que a estrutura da transação com a Anthropic foi diferente? Quais mudanças ocorreram no mercado no último ano?

Além disso, qual é o progresso atual da implantação da OpenAI? Conforme o plano anterior, a implantação relacionada deveria começar no segundo semestre de 2026.

Lisa Su: Primeiro, estamos muito felizes, honrados e entusiasmados por colaborar com as empresas de IA mais importantes e avançadas do mundo, incluindo OpenAI, Anthropic, Meta e outras.

Eu explicaria assim: Cada transação é diferente.

Temos uma relação muito especial com a OpenAI. Todos devem ter sentido isso hoje, com o compartilhamento de Sachin e Philippe.

Nós começamos a colaborar com a OpenAI desde o MI300. Ambas as partes trabalharam juntas no planejamento da rota e no avanço do software. Francamente, a OpenAI fez um grande compromisso com a AMD, incluindo uma implantação de até 6 GW.

Anteriormente, mencionamos que o primeiro GW será implantado no segundo semestre de 2026 e se estenderá até 2027. Posso confirmar que este plano está avançando exatamente conforme o esperado.

Sem se referir a um cliente específico, apenas discutindo a situação geral, a demanda total pela série MI450 já superou as expectativas iniciais.

Os clientes viram o desempenho real do hardware e gostaram dos resultados observados. Por isso, estamos aumentando a capacidade de produção e a escala de fornecimento para os próximos trimestres.

Quanto à Anthropic, também mencionei brevemente no palco: a AMD vem acompanhando a Anthropic há vários anos, desde que Dario e Tom fundaram a empresa.

Mas esse tipo de parceria sempre exige encontrar o momento adequado. Para qualquer empresa, integrar uma nova plataforma de chip requer um grande investimento de engenharia. Portanto, entendemos que a Anthropic dedicar capacidade de engenharia, recursos, financiamento e tempo à plataforma AMD é uma decisão extremamente significativa.

Cada transação é diferente. O protocolo da Anthropic gira principalmente em torno do MI450, com uma capacidade máxima de até 2 GW. O primeiro GW de capacidade está planejado para ser implantado no primeiro semestre de 2027. Também estamos discutindo com a Anthropic planos de longo prazo.

Portanto, ambas as transações simplesmente utilizaram estruturas diferentes.

Como a Anthropic e a AMD estão colaborando exatamente? Isso envolve recursos de data center?

Lisa Su: Claro. A relação entre a AMD e a Anthropic foi inicialmente estabelecida para fornecer grande capacidade de computação, apoiando a expansão contínua da Anthropic.

Os usuários podem esperar que a Anthropic utilize GPUs e CPUs da AMD por meio de diversos canais, incluindo serviços em nuvem e possivelmente também seus próprios data centers.

Estamos trabalhando em estreita colaboração com a Anthropic para suportar essas diferentes formas de implantação. O escopo desta colaboração vai muito além da simples aquisição de chips; ambas as partes trabalharão juntas na implantação e inicialização do sistema, bem como na cooperação sobre a execução do Claude na plataforma AMD.

Do ponto de vista de software, Claude e Codex são atualmente um dos plataformas mais poderosas e populares.

Esperamos que os desenvolvedores possam desenvolver de forma muito eficiente em hardware AMD por meio dessas plataformas. Este também é um componente importante da colaboração.

Em relação aos data centers, também estamos ativamente garantindo que haja capacidade de implantação suficiente no mercado. Este é de fato um dos principais focos da AMD, mas não se limita à Anthropic, abrangendo a demanda geral do sistema e do ecossistema.

Considerando que a AMD possui recursos e experiência próprios em design de chips, ela continuará a colaborar a longo prazo com a Cerebras, ou este é apenas um acordo temporário, com a AMD desenvolvendo eventualmente seu próprio produto semelhante?

Lisa Su: Não considero qualquer parceria como uma solução temporária. Não abordamos parcerias sob a perspectiva de “apenas uma medida provisória no início”.

Nós nos associamos à Cerebras porque a Cerebras possui uma tecnologia muito interessante. Existem muitas abordagens diferentes para alcançar aceleração para cargas de trabalho específicas. A tecnologia da Cerebras é uma das mais interessantes e pode funcionar muito bem com o Helios.

A ecossistema aberto mencionado pela AMD significa que colaboraremos com várias empresas que possuem tecnologias valiosas, desde que essas tecnologias atendam ao nosso julgamento para o desenvolvimento a longo prazo.

A longo prazo, acredito que haverá mais desacoplamento e separação de cargas de trabalho no futuro. A velocidade com que essa tendência avança depende parcialmente da estrutura de custos e dos níveis de preço de diferentes soluções.

Mas, do ponto de vista da AMD, possuímos um plano de路线图 muito sólido, incluindo MI400, MI500 e MI600. Ao mesmo tempo, também temos a capacidade de combinar e adaptar diferentes tecnologias de computação.

Estamos muito entusiasmados com a parceria com a Cerebras. Esperem que, no futuro, a AMD continue impulsionando a divisão e o aceleração direcionada de mais cargas de trabalho.

Vamsi Boppana: Deixe-me acrescentar rapidamente algo. Na verdade, não é necessário olhar muito longe; na atual combinação de produtos da AMD, já existem muitos pequenos motores de IA capazes de realizar tarefas de ultra-baixa latência, ultra-baixo consumo de energia e resposta em tempo real.

Confiram nossa gama de produtos integrados e aplicações em setores como automotivo e dispositivos médicos. O ponto central é que a AMD acredita que a IA entrará em diversas formas de computação de maneira profundamente integrada, com diferentes cenários apresentando características distintas. Forneceremos soluções específicas para cada um desses cenários.

Este artigo é da Tencent Technology, autor: Xiao Jing, editor: Xu Qingyang, publicado com permissão da 36Kr.

Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações. Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.