Una startup de YC levanta 13,5M$ contra el ‘tokenmaxxing’: lección para tu gasto en IA

La operación, respaldada por la aceleradora Y Combinator, refleja el giro del ecosistema tras la fiebre de quemar tokens sin control. La lección para cualquier equipo es auditar el gasto en IA antes de que el burn rate se descontrole.

La moda de disparar tokens de IA sin control está disparando los costes de las startups sin un retorno equivalente. Una compañía surgida de la aceleradora Y Combinator acaba de levantar 13,5 millones de dólares (unos 12,5 millones de euros) para ponerle freno al ‘tokenmaxxing’. La lección para cualquier founder es clara: medir el gasto en IA antes de que el burn rate se coma la caja.

Qué es el ‘tokenmaxxing’ y por qué se ha convertido en un problema

El término, todavía sin equivalente en español, define la obsesión por maximizar el uso de tokens en los modelos de lenguaje como ChatGPT o Claude. Hace apenas unos meses, los grandes nombres de Silicon Valley lo alentaban. El CEO de OpenAI, Sam Altman, dijo estar «entusiasmado con lo que harán las startups de tokenmaxxing»; el de Nvidia, Jensen Huang, llegó a afirmar que un ingeniero que no quema 250.000 dólares en tokens «está haciendo algo mal». Incluso Meta organizó competiciones internas para premiar el consumo de tokens.

Publicidad

Pero el verano ha traído un baño de realidad. La euforia ha chocado con las facturas. «.

El CEO de Microsoft, Satya Nadella, ha advertido en un post reciente que el tokenmaxxing genera «adicción» y que los clientes pagan dos veces: por los tokens y por ceder su propiedad intelectual. Por si fuera poco, Alex Karp, CEO de Palantir, ha sido aún más tajante: las empresas están «furibundas» por un gasto que «no crea valor».

Gastar tokens sin medir el retorno no es innovación: es incinerar la caja de la startup con un clic.

La startup de Y Combinator que quiere frenarlo y su ronda de 13,5 millones de dólares

En medio de este batacazo de expectativas, una startup de Y Combinator ha cerrado una ronda de financiación de 13,5 millones de dólares con un objetivo muy concreto: acabar con el despilfarro. La compañía, cuyo nombre aún no ha trascendido en España, ha desarrollado una plataforma de routing de modelos de IA que asigna cada consulta al motor más eficiente, evitando que una simple redacción de correo queme tokens del modelo más potente y caro.

La jugada no es nueva, pero sí oportuna. Según Jue Wang, consultora de Bain & Company, «muchas empresas están viendo cómo el coste en tokens se duplica casi cada dos meses. A 200 dólares por desarrollador al mes, multiplicado por 20.000 empleados, es una partida que ningún responsable había previsto». La solución pasa por herramientas que hagan model routing: mandar las tareas sencillas a modelos baratos y las complejas a los más capaces.

📦 Caso de estudio: La startup de routing de modelos de IA

  • El reto: La fiebre del tokenmaxxing encarecía los presupuestos sin mejorar los resultados.
  • La jugada: Levantar capital para construir un sistema que elija en cada momento el modelo más rentable.
  • El resultado: Ronda de 13,5 millones de dólares y el respaldo de la aceleradora más prestigiosa del mundo.
  • La lección: La eficiencia en el uso de la IA puede ser un modelo de negocio tan escalable como la propia tecnología.

tokenmaxxing

Del baño de tokens a la resaca: lo que el caso enseña a cualquier founder

El giro de guion tiene miga. Hace tres meses, los gurús vendían el tokenmaxxing como señal de vanguardia; ahora los mismos ejecutivos hablan de «despilfarro» y «adicción». Para un founder, la enseñanza es doble. Primero, que el coste de usar IA sin control puede disparar el burn rate y acortar el runway de forma silenciosa. Segundo, que el problema abre una oportunidad de negocio: las herramientas de optimización, ya sean de routing, de modelos abiertos o de medición de impacto, serán tan demandadas como lo fueron las de analítica en la era del big data.

Raffi Krikorian, CTO de Mozilla, lo compara con la métrica de líneas de código que las software factories abandonaron hace años: «Creo que el tokenmaxxing será un blip del que nos reiremos en un año». La lección para quien esté montando unastartup es que ningún KPI basado en la cantidad bruta de uso, sin correlación con resultados, aguanta el escrutinio de una cuenta de resultados.

Y mientras tanto, los modelos abiertos chinos como Kimi de Moonshot o GLM de Zhipu ofrecen capacidades similares a una fracción del precio, lo que podría alargar la fiebre del tokenmaxxing entre los más despreocupados. Pero el consenso de los analistas es firme: la disciplina se impondrá.

🚀 Hoja de Ruta para Emprender

  • Mide el coste real de la IA: No asumas que cada llamada a la API es productiva. Audita cuántos tokens gastas y para qué, como harías con cualquier otro recurso.
  • Implanta el ‘model routing’ hoy: Incluso sin una herramienta externa, define reglas manuales para usar modelos ligeros en tareas simples. El ahorro puede mantener tu runway meses extra.
  • Cultiva el escepticismo ante el hype: Si un líder de opinión te vende un KPI de cantidad bruta, pregúntale por el retorno. Si no sabe responder, no lo muevas a producción.

Publicidad