La entrada se procesa en paralelo —fase de prefill—, así que su coste es sobre todo de cómputo. La salida se genera un token cada vez —fase de decode—, limitada por cuánta memoria hay que mover para cada uno: por eso escala peor, y por eso el precio de tabla siempre pone la salida más cara. De aquí salen los tres mandos de abajo: un acierto de caché reutiliza un prefill ya hecho (por eso cuesta ~10%), y los tokens de razonamiento son decode puro — se facturan como salida porque, técnicamente, es justo lo que son.