Chamar a bolha de IA de “estourada” porque os custos de inferência estão caindo inverte a economia. A OpenAI reduziu os preços para Luna e Terra, seus modelos mais eficientes em tokens. Mantiveram os preços de Sol e Pro inalterados. Os preços mais baixos resultam de modelos que ficaram mais baratos para operar, usando menos tokens e atendendo cargas de trabalho de forma mais eficiente. Isso abre caminho para um uso muito maior. Tarefas que eram muito caras para serem automatizadas agora podem rodar constantemente em codificação, suporte ao cliente, pesquisa, análise de dados e fluxos de trabalho de agentes. Uma empresa pode gastar menos em cada solicitação individual, enquanto faz milhares de solicitações adicionais em todo seu negócio. A questão dos semicondutores se resume ao total de computação consumida. O preço por token sozinho diz muito pouco. As filas na nuvem estão aumentando, os hiperscalers ainda enfrentam escassez de capacidade e os gastos com infraestrutura continuam a subir. A competição entre modelos pressionará as margens na camada de modelos. A queda nos custos de inferência expande o número de aplicações que podem usar IA economicamente, o que continua impulsionando a demanda em direção a chips, memória, rede e data centers. @jvisserlabs
Luke DavisCompartilhar
Fonte:Mostrar original
Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações.
Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.