Herramientas de IA para devs, en español
|
6 de octubre de 2026
Edición semanal
|
|
|
Semana cargada en el ecosistema de herramientas AI para devs: Anthropic publicó una guía oficial para exprimir al máximo Opus 5.5 en Claude Code, mientras Figma da un paso atrás y restringe su MCP server a clientes aprobados, dejando a muchos workflows agentic en el limbo. Además, un artículo que está generando conversación seria propone repensar cómo estructuramos documentación en lugar de confiar ciegamente en memoria persistente. Todo esto y más te espera abajo.
|
|
actualización
|
Hacker News
|
|
Opus 5.5 no es solo más listo, hay que saber pedírselo
Anthropic acaba de publicar su guía oficial para exprimir Opus 5.5 tanto en Claude como en Claude Code, y el nivel de interés en Hacker News (241 puntos, 161 comentarios) dice bastante sobre lo que la gente está notando en producción. El modelo tiene más capacidad de razonamiento extendido, pero eso no sale gratis: consume más tokens y tiempo. La clave está en saber cuándo activar el pensamiento profundo y cuándo dejarlo en modo rápido. Esto significa que ahora puedes delegarle tareas de arquitectura o debugging complejo que antes requerían varias iteraciones, pero ojo con los costes si lo usas indiscriminadamente en pipelines automatizados. leer más
|
|
|
Figma cierra la puerta de su MCP a quien no le dé la gana
Figma ha decidido que su servidor MCP solo va a funcionar con clientes en su lista blanca oficial, dejando fuera herramientas como Pieces y otros clientes alternativos. Si estabas construyendo un workflow agentic con Claude Code, Cursor u otras herramientas que no estén en esa lista bendecida, mala suerte. Esto huele a movimiento de control de plataforma más que a preocupación técnica legítima. Ojo con esto porque si dependes de integraciones Figma en tus pipelines de diseño-a-código, puede que de repente dejen de funcionar sin previo aviso. Centralizar quién puede hablar con tu API siempre acaba mal para el ecosistema. leer más
|
|
|
Los agentes de coding no necesitan memoria, necesitan buena documentación
Un artículo que está pegando fuerte en HN plantea algo que, una vez que lo lees, parece obvio: el problema de los agentes de coding no es que no recuerden cosas entre sesiones, sino que no tienen acceso a documentación estructurada sobre tu proyecto. En lugar de implementar sistemas de memoria persistente complejos, la solución es más simple: ficheros como `ARCHITECTURE.md`, `DECISIONS.md` o convenciones claras de proyecto. Esto significa que puedes mejorar drásticamente tus agentes hoy mismo sin tocar ninguna infraestructura — solo escribiendo mejor documentación. Irónico que la solución sea la misma que llevamos ignorando para los humanos. leer más
|
|
|
¿Por fin un benchmark serio para evaluar code review con IA?
GitHub acaba de publicar ReviewBench, un benchmark abierto para medir qué tal lo hacen los agentes de IA revisando código. Lo interesante no es solo que exista, sino cómo está construido: PRs reales de GitHub, ground truth de múltiples fuentes y métricas alineadas con lo que pasa en producción, no con escenarios de laboratorio inventados. Esto significa que por primera vez puedes comparar de forma reproducible si Copilot, Claude o cualquier otro agente detecta bugs y sugiere mejoras mejor que otro. Ojo, que GitHub tiene obvio interés en que Copilot quede bien, así que revisa la metodología antes de tragarte los resultados a pies juntillas. leer más
|
|
|
Routing inteligente: el modelo correcto para cada tarea de código
Interesante proyecto que aparece en HN: un router open-source que decide automáticamente qué modelo LLM usar según la tarea concreta dentro de un agente de coding. La idea es simple pero potente — no todas las subtareas necesitan el modelo más caro y capaz. Completar un import no es lo mismo que refactorizar arquitectura. El resultado, según dicen, equipara el rendimiento de Astra con un coste significativamente menor. Esto significa que puedes montar agentes de coding más baratos sin sacrificar calidad donde importa. Ojo con los benchmarks propios, pero la arquitectura de routing merece revisarse. leer más
|
|
|
System76 dice no al código IA: ¿valentía o nostalgia?
System76, los creadores de Pop!_OS, han prohibido explícitamente el código generado por IA en la mayoría de sus repositorios de COSMIC. Los motivos son los de siempre pero legítimos: dudas sobre licencias, calidad inconsistente del código generado, y responsabilidad sobre quién firma lo que se mergea. Lo interesante es que se atreven a hacerlo público y a convertirlo en política oficial. Si usas Copilot o Claude Code en el día a día, esto debería hacerte pensar: ¿sabes exactamente qué está metiéndose en tu codebase? Ojo porque muchas empresas tendrán pronto políticas similares y tú querrás tener una respuesta clara. leer más
|
|
|
serena
Si trabajas con agentes de código y te has preguntado cómo darles acceso real a un proyecto sin que pierdan el contexto, serena es tu respuesta. Este toolkit MCP actúa literalmente como un IDE para tu agente: ofrece recuperación semántica de código, edición precisa de ficheros y navegación inteligente por el repositorio, todo accesible desde cualquier cliente compatible con MCP (Claude Desktop, Cursor, lo que uses).
Con más de 30.000 estrellas, la tracción en la comunidad habla por sí sola — no es un experimento, es una herramienta que la gente está usando en producción.
Encaja especialmente bien si construyes flujos de automatización donde el agente necesita entender estructura de proyecto, no solo leer ficheros sueltos. Puedes usarlo para refactorizaciones asistidas, generación de código contextual o revisiones automáticas con comprensión semántica real.
ver en GitHub
|
|
🔧 Herramienta de la semana
|
|
rtk es un proxy CLI escrito en Rust que se interpone entre tus herramientas de desarrollo y el LLM, comprimiendo y filtrando el contexto antes de enviarlo. El resultado prometido: reducir el consumo de tokens entre un 60-90% en comandos cotidianos como `git diff`, logs de compilación o salidas de tests.
Esta semana la probaría si usas agentes de coding de forma intensiva (Cursor, Claude Code, Copilot Workspace) y la factura de tokens empieza a doler. El caso de uso más claro es en proyectos con outputs verbosos donde el ruido supera a la señal.
¿Para quién NO es? Si usas LLMs ocasionalmente o tu contexto ya es limpio, el overhead de configuración no compensa. Con 82k stars en trending hay hype considerable; verifica que los benchmarks aplican a tu stack real.
probarla
|
|
|
Figma cierra la puerta justo cuando más la necesitabas abierta
Mientras todo el mundo debate cómo integrar agentes en su workflow, Figma decide quién puede jugar en su campo. No es un bug, es una decisión de negocio: controlar el acceso MCP para monetizar o proteger su ecosistema. A ti esto te afecta porque si usas Claude Code o Cursor para leer specs de diseño automáticamente, ese flujo probablemente está roto o lo estará pronto. El mensaje real: no construyas infraestructura crítica sobre MCPs de terceros sin un plan B. La promesa del "todo conectado" sigue siendo frágil.
|
|
¿Qué herramienta de IA estás usando más esta semana?
Responde a este email y cuéntame. Leo todas. (👍 si te sirvió · 👎 si no)
|
|
¿Te ha servido esta edición? Pásasela a un compañero dev.
Reenviar y que se suscriba →
|
|
DevAI — Herramientas de IA para devs, en español
Escrita por Alex cada semana
Ediciones anteriores
·
Cancelar suscripción
|