@mralekai: 💸 Un ingeniero de Spotify publicó el 3 de septiembre cómo recortó un 90% los tokens que consumía con Claude Code. El post llegó a portada de Hacker News en un día. El diagnóstico de Dimitri Mazmanov: la mayor parte del gasto no se va en pensar. Se va en leer archivos enteros y generar código predecible. Miles de tokens, casi cero razonamiento, todo pagado al modelo más caro del mercado. Lo interesante es cómo lo resolvió, porque no es lo que la gente asume. No le pidió a Claude que delegara. Puso un hook que intercepta cada lectura de archivo antes de que ocurra: si el archivo pasa de 350 líneas, la bloquea y la redirige a Gemini 2.5 Flash, que lee, resume y devuelve viñetas. Claude paga por el resumen, no por el archivo. La frase que resume la lección: las instrucciones son consejo, el hook es ley. Se aplica en la frontera de la herramienta, no en el prompt, así que funciona aunque el modelo ignore las indicaciones. La letra pequeña: son mediciones propias sobre cuatro escenarios en un monorepo de Java, cada delegación añade entre 10 y 30 segundos, y el modelo barato se dejó un bug de concurrencia. No sirve para editar, depurar ni decidir arquitectura. Por qué importa: Gartner calcula que para 2028 el coste de las herramientas de IA por desarrollador superará su propio salario. Ya hay un 6% de empresas pagando más de 2.000 dólares al mes por programador. ¿Sabes cuánto te cuesta tu agente al mes? 👇

MrAlekAI
MrAlekAI
Open In TikTok:
Region: ES
Tuesday 08 September 2026 21:05:36 GMT
18994
1221
19
126

Music

Download

Comments

nomepisotees
No Me Pisotees :
Creía que eso era básico xD los agentes de exploración van con modelos pequeños
2026-09-09 00:04:47
9
rolemiaster
ROLEMIASTER :
hasta donde yo sé eso está muy bien cubierto por Omniroute
2026-09-08 22:02:01
9
user2380000925
Dani :
trueeeeee
2026-09-09 10:09:53
0
pietro.de.ocre
Pietro de Ocre :
la cosa es... spotyfive ha soltado algun repo para implementar esto que dices o solo ha dicho que lo hace asi y ya está? que cada umo se monte su router de pensamiento profundo?
2026-09-09 06:09:49
1
brian14jy
Brian Jara :
Apple hace lo mismo desde Enero xddd
2026-09-09 13:49:50
3
jad.pepe.grov
PEPE GROV :
orquestación. sobre esta actividad pero sumado a computación cuántica para matemáticas etc. algo he oído en entornos de emprendimiento. superQ quantum creo que era. pero no sé lo verde que está.
2026-09-09 14:38:22
1
tetrix125
tetrix :
las IA no piensan....😒
2026-09-09 15:45:43
2
shadeofmoon
David Guzman :
Yo no entiendo porque se complican tanto, yo uso minimax M3, no me gasto más de 1 billón de tokens al menos, como? Sin tanti drama, uso un modelo de conocimiento regeneratico que impide al modelo almacenar contexto basura, además, cada proyecto lleva su estructurada interna dentro de un .md, por lo cual, el modelo antes de empezar la sesión (eso está dentro de una Skill) debe si o si leer el .md que le da la estructura del proyecto, decision,mes, bugs, el plan de implementación si aún está en desarrollo, esto permite que cualquier modelo entre, lea y sepa en donde va, ahorra tokens y sesiones que son innecesarias, para proyectos grandes, con más ee 200k de contexto es un alivio de consumo grandísimo… eso es el estándar en grandes compañías, ni siquiera me lo invente yo, solo que todos esperan que GitHub les salve la vida, tampoco esta mal leer algo de documentación de vez en cuanto
2026-09-09 17:10:32
0
ivan_kl00
ivan :
Hay algo que nunca me cuadra, y es el contexto. Claude razona y en base al razonamiento sabe qué cambiar y cómo cambiarlo, pero esa información se pierde cuando delega esa tarea a un modelo inferior no? Es decir, imaginemos que Claude empieza a razonar sobre cómo cambiar una interfaz, y para eso necesita leer un archivo, si la lectura de ese archivo la hace Gemini, cómo le dice Gemini exactamente a Claude lo que ha leído sin perder contexto?? Es algo que no entiendo
2026-09-08 22:12:10
2
xexe.the_me
Xexe :
"el uso de IA por desarrollador va a superar el salario del desarrollador" Tengo la ligera sospecha de que el desarrollador genera algo de tanto valor que incluso en este escenario de pérdida el que se queda con el fruto del trabajo del desarrollador no percibe pérdidas.
2026-09-09 16:47:09
0
tiuviprograming
Franky :
La clave es como construyó una aplicación que al ayudarme de un llm consuma pocos tokens además según el caso si es visual le pasas los CSS si es crear un componente le pasas tus componentes personalizados y si es una funcionalidad le pasas tus librería , pedir a un agente que haga una tarea y le das todo el proyecto de golpe pues ....
2026-09-09 05:58:28
2
jhosep.frigg
Joseph Frigg :
interesante
2026-09-09 15:37:16
1
devsecuritys
AiDevSec :
Me parece increíble como toman de novedoso esto, cuando desde hace años existe el modo recommended en plataformas como cursor, copiloto, y demás, que dinámicamente cambia el modelo según la complejidad del problema
2026-09-08 23:04:25
1
To see more videos from user @mralekai, please go to the Tikwm homepage.

Other Videos


About