Microsoft inicia auditorías internas de costos de IA mientras los empleados gastan millones en tokens

iconMetaEra
Compartir
AI summary iconResumen
Microsoft ha comenzado a auditar el gasto interno en IA después de que datos en la cadena revelaran que algunos empleados gastaron $28,000 en 28 días en tokens. La empresa ahora impone límites de presupuesto y seguimiento de uso, pasando de una adopción agresiva de IA a un control de costos. CoreAI registró el mayor gasto, con algunos usuarios quemando más de $16,000 mensuales. El ejecutivo Jay Parikh criticó el "tokenmaxxing", donde las métricas se inflan para aumentar la visibilidad. Problemas similares han surgido en Uber y Meta. Entre las altcoins para vigilar se incluyen tokens vinculados a IA; las tendencias del mercado sugieren un escrutinio creciente del gasto impulsado por IA.
Algunos viajan de noche hacia el examen imperial, otros renuncian a sus cargos y regresan a sus hogares.

Autor del artículo: Zhang Yongyi

Fuente: GeekPark

Durante mucho tiempo, los empleados de Microsoft compartieron espontáneamente una tabla mantenida por ellos mismos para intercambiar números de salarios y bonos, una especie de proyecto subterráneo de transparencia salarial común en grandes empresas.

Este año, en la tabla que posteriormente obtuvo Business Insider, apareció una nueva columna: «Gastos mensuales en IA».

Aproximadamente 350 empleados estadounidenses completaron esta columna. La celda más alta indica: 28 días, 28.000 dólares estadounidenses (aproximadamente 190.000 yuanes chinos).

La respuesta de Microsoft no fue otorgarle una distinción al estudiante. La empresa ha comenzado a restringir la gestión del uso de tokens: se han implementado presupuestos por departamento, los gastos individuales de tokens aparecen en el panel de control, y el modelo predeterminado interno se cambió a GPT-5.6 Sol de OpenAI.

Microsoft ha comenzado una auditoría interna.

Clasificación del uso de tokens

La información más importante en esta tabla no está en los números, sino en la posición: la columna «Gastos en IA» aparece en una tabla que muestra los salarios.

Los empleados colocan el uso de IA junto a su salario, lo que deja absolutamente claro que, en Microsoft en 2026, cuántos tokens consumes al mes es tan relevante como cuánto ganas.

Estas cifras tampoco son estimaciones arbitrarias. Un detalle fácil de pasar por alto en el informe es que Microsoft proporcionó a sus empleados una herramienta interna que les permite consultar el monto de IA que han utilizado en los últimos 28 días. Actualmente, la mediana voluntaria reportada por toda la empresa de Microsoft es de 300 dólares mensuales, aproximadamente 2,000 yuanes.

Honestamente, este precio realmente no es sorprendente, ya que el costo laboral total de un ingeniero de software de Silicon Valley comienza en unos 20,000 a 30,000 dólares mensuales; una factura de IA de 300 dólares es una gota en el océano.

Pero lo que realmente encarece la factura está por venir. En la tabla organizada por departamentos de BI, la mediana del departamento central de IA de Microsoft, CoreAI, alcanzó 975 dólares (aproximadamente 6.577 yuanes), más del triple del promedio de toda la empresa; el departamento Microsoft AI rondó los 490 dólares, Experiences and Devices unos 250 dólares y Azure unos 241 dólares. Varios departamentos superaron los 10.000 dólares en los valores máximos individuales, y en CoreAI alguien llegó a gastar 16.000 dólares. El récord de 28.000 dólares en 28 días pertenece al departamento de Soluciones para Clientes y Socios.

Aunque 350 personas representan solo el 0,16% de los 223.000 empleados globales, y la encuesta es voluntaria, no un censo, además, las personas dispuestas a publicar sus facturas de IA no son una muestra aleatoria. Pero la distribución real solo puede ser más extrema que esta tabla, no más moderada.

Quemar 28.000 dólares en 28 días, ¿qué significa esto? Un promedio de 1.000 dólares diarios. Cuando Geek Park escribió hace tres meses el artículo «Microsoft pausa el vibe coding», hicieron un cálculo hipotético: un ingeniero con un salario anual de 300.000 dólares tiene un costo diario de más de 800 dólares. En ese momento, el título del artículo era una afirmación: «Quemar tokens ya es más caro que un empleado». Ahora, se ha convertido en una fila en una tabla: el dinero quemado por este empleado es más caro que contratar a otro ingeniero sentado a su lado.

De hecho, el círculo de Silicon Valley ya ha bautizado este comportamiento como "tokenmaxxing", que se refiere a la acción de maximizar el uso de tokens.

Las prácticas incluyen enviar intencionalmente prompts enormes, llenar completamente la ventana de contexto y ejecutar consultas automatizadas; el objetivo no es resolver problemas, sino hacer que los números en el panel de uso interno de la empresa parezcan más favorables.

Claramente, un comportamiento solo recibe un nombre cuando es lo suficientemente común. La existencia de esta palabra es, por sí misma, evidencia.

Durante el último año, esta fiebre de tokens le envió a casi todos los empleados de empresas tecnológicas la misma señal: abrazar la IA es una prueba de avanzada, y quienes sepan usarla reemplazarán a quienes no lo hagan. Cuando los jefes enfatizan diariamente el uso de la IA y la cantidad es exactamente un número visible, aumentarla se convirtió en la forma más fácil de gestionar hacia arriba. La calidad de la producción puede discutirse durante mucho tiempo, pero el nivel de uso es evidente de inmediato.

Cuando el volumen se convierte en un número visible, la quema de tokens inevitablemente se desliza hacia un nuevo desempeño de horas extras.

Esta escena ya se ha repetido más de una vez este año: el CTO de Uber admitió ante The Information en una entrevista que la empresa implementó un ranking interno para incentivar a los empleados a usar más IA, y el resultado de este mecanismo de incentivos fue agotar el presupuesto anual de programación con IA en solo cuatro meses.

La versión de Meta es aún más exagerada: en abril, un empleado creó un tablero llamado Claudeonomics que clasificaba a 85,000 colegas según el uso de tokens; en 30 días, toda la empresa consumió 60 billones de tokens, con un solo líder que usó 281 mil millones; Fortune estimó que solo él valía 1.4 millones de dólares; el tablero se retiró dos días después de que The Information lo revelara, y Zuckerberg ni siquiera entró en los primeros 250. Android Headlines dijo que también surgió un indicio similar dentro de Amazon.

La diferencia es que la clasificación de Uber la establece la empresa de arriba hacia abajo, mientras que las "clasificaciones" de Meta y Microsoft surgieron espontáneamente entre los empleados: nadie lo ordenó, la estructura de incentivos floreció por sí sola.

Los altos ejecutivos de Microsoft claramente entendieron toda la historia detrás de este evento. Jay Parikh, vicepresidente ejecutivo a cargo de CoreAI, escribió en un memorándum interno de agosto: "Tokenmaxxing no es el verdadero objetivo que buscamos. Espero que todos se enfoquen en los resultados que realmente generen un cambio para los clientes y el negocio."

El significado que la nota no mencionó directamente es muy evidente: la empresa ha reconocido que una parte considerable de los tokens quemados por los empleados no compró productividad, sino una postura.

En el informe de BI, también se comparó de forma dolorosa los datos salariales de la misma tabla: al menos hasta ahora, quienes utilizan más la IA no han recibido aumentos, bonos o promociones más altos. Aún no se ha materializado la recompensa por el desempeño, pero ya llegó la factura.

Y justo al día siguiente de que Microsoft comenzara a retirar la licencia de Claude Code, alguien publicó en las redes sociales otra factura mucho más grande.

El 15 de mayo de 2026, Peter Steinberger, desarrollador de OpenClaw, publicó un tweet con un tono despreocupado, aparentemente para promocionar su herramienta de barra de menú CodexBar: la nueva versión muestra los costos de la API de forma mucho más atractiva. Lo realmente impactante era su imagen adjunta: 1.305.088,81 dólares en gastos de la API de OpenAI en 30 días, 603 mil millones de tokens, 7,6 millones de solicitudes, modelo principal GPT-5.5, y en el día del tweet se gastaron casi 20.000 dólares.

Steinberger se unió a OpenAI en febrero de este año, y esta factura obviamente también será reembolsada por OpenAI. Los que gastan este dinero son aproximadamente 100 instancias de agentes de codificación Codex ejecutándose en paralelo; detrás de ellas, solo tres personas mantienen el proyecto de código abierto OpenClaw. Él mismo define este comportamiento como "lujo" al verificar una pregunta: si los tokens no costaran nada, ¿cómo escribiríamos software en el futuro?

1.3 millones de dólares, aproximadamente 46 veces la cantidad del récord del de Microsoft. Pero las dos facturas son completamente opuestas: por un lado, 100 agentes trabajan para tres personas; por el otro, las personas aumentan el consumo para impresionar en la evaluación. Ambas son exhibiciones, pero una muestra productividad y la otra muestra una postura. En el mismo mes de mayo, algunos viajan de noche hacia el examen imperial, mientras que otros renuncian a sus cargos y regresan a sus hogares.

De herramientas de corte a revisión de facturas

Alarga un poco la línea de tiempo: la actitud de Microsoft hacia los costos de la IA cambió tres veces a velocidad de rayo en un año, lo que lo convierte en uno de los que más rápido ha cambiado de postura entre las grandes empresas de internet.

En diciembre de 2025, liberó Claude Code a miles de empleados, animando a todos a redefinir sus flujos de trabajo con IA.

En mayo de 2026, canceló las licencias de Claude Code para la mayoría de los empleados, citando «unificación de la cadena de herramientas», pero dejó una salida: los modelos Claude aún podían usarse a través de Copilot CLI.

Para agosto, también se eliminaron los escalones. CNBC informó que el modelo predeterminado de GitHub Copilot para empleados ya se ha cambiado a GPT-5.6 Sol de OpenAI. Según la versión oficial de GitHub, Sol no es un modelo económico, sino el de mayor capacidad de razonamiento en la familia GPT-5.6; los medios extranjeros interpretan que este movimiento no ahorra nivel, sino el destino de la factura: el informe indica que es más rentable que la familia Claude, y Android Headlines afirma que Microsoft ya no alienta a los empleados a usar herramientas de terceros como Claude en tareas de programación.

Primero recorta los productos, luego cambia los modelos y finalmente implementa el presupuesto y los paneles de control. La granularidad del control se reduce desde «¿qué herramientas estás usando?» hasta «¿cuánto gastaste este mes?».

El momento en sí también es información: la revocación de licencias en mayo tenía una fecha límite fijada para el 30 de junio, el último día del año fiscal de Microsoft; el presupuesto y el monitoreo entraron en vigor durante los dos primeros meses del nuevo año fiscal. Leído en conjunto: la última acción del año fiscal anterior fue eliminar un costo fuera de control; la primera acción del nuevo año fiscal fue establecer un rubro presupuestario formal para la IA.

Los gastos en IA en los libros de Microsoft recorrieron en un año el camino desde «experimento» hasta «línea contable». El sector de la nube ya recorrió este camino: primero se fomentó que todos los equipos de la empresa migraran a la nube, luego se dispararon las facturas, y finalmente surgió un puesto especializado llamado gobernanza de costos en la nube. Ahora le toca a los tokens.

Hace tres meses, cuando Microsoft detuvo el vibe coding, la conclusión de Geek Park fue: la verdadera razón del choque no es que la IA sea demasiado cara, sino que la organización aún no ha cambiado, y la mayoría de las empresas no cambiarán en el corto plazo.

Ahora Microsoft ha dado su respuesta oficial. No cambió la organización; cambió el sistema de presupuesto: actualizó las directrices internas, estableció presupuestos por departamento y registró los gastos individuales en un panel de control. En palabras del memorando de Parikh: «gestionar los gastos de tokens con la misma disciplina que se aplica a otros recursos clave».

Suena impecable. Los tokens son recursos por naturaleza, y los recursos deben tener un presupuesto.

Pero en esta solución hay un bucle: la herramienta interna que hace visible el uso fue lanzada por Microsoft misma; los empleados inflaron los números, y la solución de Microsoft fue colocar los gastos de cada persona en otro tablero. La recompensa numérica anterior se gastaba mucho, la siguiente recompensa numérica se gastaba con ahorro. Cuando el indicador cambió de dirección, la reacción de los empleados hacia el indicador no cambió. Seis meses después, no me sorprendería que apareciera una columna llamada «relación de producción por token» en esta tabla.

El significado de este evento para las empresas de internet en China puede incluir algunos intentos y errores de los «pioneros»: actualmente, muchas empresas chinas aún se encuentran en la «fase de diciembre de 2025» de Microsoft, asignando cuotas, estableciendo referencias y incluyendo la tasa de uso de IA en los OKR.

Microsoft simplemente llegó primero a la segunda mitad de la historia: primero animar, luego clasificar, luego auditar. La diferencia de tiempo es el tráiler.

Lo que siempre ha importado no es el precio de la IA, sino la reacción de las personas ante los «números visibles».

Mientras haya al menos una columna de números visible, siempre habrá alguien encargado de actualizarla.

Descargo de responsabilidad: La información contenida en esta página puede proceder de terceros y no refleja necesariamente los puntos de vista u opiniones de KuCoin. Este contenido se proporciona solo con fines informativos generales, sin ninguna representación o garantía de ningún tipo, y tampoco debe interpretarse como asesoramiento financiero o de inversión. KuCoin no es responsable de ningún error u omisión, ni de ningún resultado derivado del uso de esta información. Las inversiones en activos digitales pueden ser arriesgadas. Evalúa con cuidado los riesgos de un producto y tu tolerancia al riesgo en función de tus propias circunstancias financieras. Para más información, consulta nuestras Condiciones de uso y la Declaración de riesgos.