🔧 Herramientas que están petando
GitHub★ 119334 · +12358 esta semana
Agente de programación ligero que corre en el terminal. Va al grano: te ayuda a currar sin montar una feria de herramientas alrededor.
Veredicto: Para quien quiere probar un agente de código sin liarse demasiado y ya trabaja cómodo en terminal. Ojo: huele a producto potente, pero también a dependencia de ecosistema y a que no siempre te va a sacar del marrón mejor que tú mismo.
GitHub★ 17207 · +5946 esta semana
Alternativa local-first a Logitech Options+ escrita en Rust. Sirve para remapear botones, DPI y SmartShift por HID++, sin cuenta y sin telemetría.
Veredicto: Muy buena pinta si te toca pelearte con Logitech Options+ y quieres algo más limpio y privado. La pega real es obvia: depende de que tu hardware encaje bien y de que no te falten las pijadas propietarias que a veces solo da el software oficial.
GitHub★ 32782 · +5593 esta semana
Linux bonito, moderno y con mucha opinión detrás. Es de esas distros/sets que te lo dan todo bastante mascadito, con estilo y decisiones ya tomadas.
Veredicto: Mola si quieres una base visualmente cuidada y con criterio, sin empezar desde cero cada vez. La limitación es clara: si no te va el rollo opinionado, te puede parecer que te han montado una jaula bonita.
📰 Noticias que importan
Hacker News▲ 68
Han sacado un benchmark para medir agentes de IA haciendo curro científico real desde terminal. La gracia no es solo si responden bien, sino si aguantan una tarea larga sin petar ni inventarse una movida rara a mitad de camino. Te importa porque cada vez venden más agentes como si fueran becarios mágicos, y aquí por fin se intenta medirlos en algo más serio que un prompt bonito.
Veredicto: Útil para quien quiera comparar agentes con algo más cercano a trabajo real. La pega es la de siempre: el benchmark puede quedarse corto frente a la complejidad del mundo real, así que no lo compres como verdad absoluta.
Hacker News▲ 448
Un análisis curioso sobre qué palabras y patrones parecen ser clave para que Claude funcione mejor. Es de esas piezas que te hacen flipar un poco porque enseñan que muchas veces el rendimiento depende de detalles más tontos de lo que parece. Te interesa si curras con prompts, evals o sistemas alrededor de LLMs y quieres entender dónde se rompe la magia.
Veredicto: Interesante como lupa para entender comportamiento de modelos y prompts. El límite es que esto no te da una receta universal: puede ser una observación útil, pero también una foto bastante específica de un modelo concreto.
Hacker News▲ 595
La conversación va de que los modelos pequeños ya no son un apaño cutre, sino una opción seria para muchas tareas. Con mejores costes, menos latencia y despliegues más manejables, empiezan a molar de verdad para producto. Te importa porque no todo necesita un monstruo gigante quemando pasta y CPU a lo loco.
Veredicto: Muy relevante para quien diseña producto, infra o coste de inferencia. La pega es que no sirven para todo: si necesitas razonamiento pesado o máxima cobertura, el modelo pequeño puede quedarse corto y hacerte un buen marrón.