Un empleado de Microsoft gastó 28.000 dólares en herramientas de IA en un período de 28 días, lo que llevó a la empresa a implementar controles de gasto. La compañía ha comenzado a rastrear el uso de tokens y ha cambiado su modelo por defecto a GPT-5.6 Sol.
El gasto descontrolado en IA se convirtió en un problema cuando los empleados comenzaron a manipular los paneles de Copilot mediante una práctica conocida como 'tokenmaxxing'. Esta práctica consistía en quemar deliberadamente tokens de IA en consultas de bajo valor o inútiles para ascender en las tablas de clasificación internas.
La empresa había animado a sus ingenieros a utilizar la IA de forma agresiva, pero las facturas resultantes llevaron a una nueva columna en la hoja de cálculo de compensación interna: 'AI $ Usage Per Month'. Un empleado de la organización Customer and Partner Solutions reportó un gasto de 28.000 dólares en un solo mes.
Datos del gasto interno
Aproximadamente 350 empleados en Estados Unidos enviaron datos de gasto, de un total de más de 223.000 empleados a nivel global. La mediana del gasto en toda la empresa fue de unos 300 dólares por período de 28 días, pero las medianas por equipo mostraron diferencias significativas:
- CoreAI: ~975 dólares
- Seguridad: ~526 dólares
- Microsoft AI: ~490 dólares
- Cloud + IA: ~325 dólares
- Mediana de la empresa: ~300 dólares
Algunos máximos individuales superaron los 10.000 dólares, mientras que otros empleados gastaron solo decenas de dólares.
La respuesta de Microsoft
A principios de agosto de 2026, el vicepresidente ejecutivo de CoreAI, Jay Parikh, envió un memo interno en el que dejaba clara la postura de la empresa: "Tokenmaxxing no es lo que estamos optimizando. Quiero que todos nos centremos en maximizar los resultados que mueven la aguja para nuestros clientes y nuestro negocio".
Ahora están activos los objetivos de presupuesto de tokens a nivel de división, y el gasto personal es visible en los paneles internos. Aunque no se ha confirmado un límite máximo por ingeniero, el gasto en tokens está siendo rastreado.
Cambio de modelo
Microsoft ha cambiado sus cargas de trabajo internas a GPT-5.6 Sol como modelo por defecto en GitHub Copilot y flujos de trabajo relacionados, citando "mayor valor de nuestra inversión en tokens". El uso de Claude de Anthropic para codificación ha sido desalentado internamente, una reasignación significativa de la demanda.
Esta situación refleja un momento de madurez en la industria de la IA, similar a lo que ocurrió con la computación en la nube cuando los costos se dispararon. La empresa busca más impacto por token, no menos tokens, y cada empresa que utiliza herramientas de IA está observando de cerca estos desarrollos.
