Herramientas de IA para devs, en español
|
28 de julio de 2026
Edición semanal
|
|
|
Otra semana cargada: VS Code 1.130 llega con cambios que van a notar de inmediato quienes trabajen con Copilot, y al mismo tiempo GitHub reescribe su modelo de pricing de una forma que conviene entender antes de que llegue la próxima factura. En paralelo, Anthropic desvela cómo estructurar el contexto para sacar el máximo a Claude 5, justo cuando Google entra fuerte con unos nuevos Gemini Flash que van directos a la yugular del segmento de modelos rápidos y baratos. Si construyes o usas agentes de coding, esta edición te interesa. Sigue leyendo.
|
|
|
VS Code 1.130: Copilot se integra aún más en tu flujo de trabajo
La versión 1.130 de VS Code trae mejoras enfocadas principalmente en la integración con Copilot y en cómo las extensiones de IA interactúan con el editor. Si usas Copilot a diario, notarás refinamientos en el chat y en las sugerencias inline que hacen la experiencia bastante más fluida. También hay ajustes en la API de extensiones que afectan a cualquier herramienta de AI que tengas instalada. Ojo con revisar si alguna de tus extensiones necesita actualización para aprovechar los nuevos hooks. Nada revolucionario, pero sí el tipo de pulido incremental que acaba marcando diferencia en el día a día. leer más
|
|
|
Anthropic reescribe las reglas de cómo darle contexto a Claude
Anthropic ha publicado una guía técnica sobre cómo estructurar el contexto para Claude 5, y vale la pena leerla aunque uses otros modelos. La tesis central: estos modelos son suficientemente potentes como para que el orden, la estructura y la ubicación de la información dentro del contexto importen muchísimo más que antes. Ya no basta con meter todo en el system prompt y rezar. Ojo especialmente si usas Claude Code o tienes integraciones con la API, porque algunos patrones que funcionaban con Claude 3 ahora son activamente contraproducentes. Esto significa que toca revisar prompts que "ya funcionaban". leer más
|
|
|
Google revienta el mercado de modelos "pequeños" con tres Gemini Flash nuevos
Google ha lanzado de golpe tres modelos: Gemini 2.5 Flash (renombrado 3.6 Flash), 2.5 Flash-Lite y una variante especializada en ciberseguridad. El movimiento apunta directamente al segmento donde Anthropic y OpenAI dominaban con comodidad: modelos baratos y rápidos para tareas agentic y coding. Lo interesante es que Flash-Lite apunta a ser la opción más económica de Google hasta la fecha, mientras que el modelo Cyber es una señal clara de que los verticales especializados van a ser el siguiente campo de batalla. Si estás eligiendo modelo para pipelines de automatización o agentes, esto ya merece una benchmarks comparativa seria. leer más
|
|
|
Copilot cobra ahora por token: ¿sale a cuenta o te la están colando?
GitHub ha cambiado el modelo de facturación de Copilot para alinearlo con las tarifas estándar de API de los modelos subyacentes. Lo que están vendiendo, básicamente, es el acceso al modelo más todo el andamiaje alrededor: las políticas de empresa, la integración en el IDE, los filtros de seguridad y el harness de contexto que convierte tu código en prompts decentes. La pregunta real es si ese overhead justifica el precio frente a llamar directamente a la API de Anthropic o OpenAI. Para equipos grandes con políticas de compliance, probablemente sí. Para un freelance o startup pequeña, igual merece la pena calcularlo. leer más
|
|
|
Las "fábricas de software" con IA fallan por razones predecibles
390 puntos en HN no es casualidad: este análisis clava exactamente por qué los setups de coding agents que parecen prometedores en demos mueren en producción. El argumento central es que obsesionarse con el harness —el scaffolding que orquesta al agente— no es suficiente si el contexto que le das al modelo es basura o está mal estructurado. Puedes tener el pipeline más elegante del mundo y el agente seguirá tomando decisiones estúpidas. Si estás construyendo con Claude Code, Cursor o cualquier agente similar, esto te va a hacer replantearte cómo diseñas el contexto antes de añadir más capas de automatización. leer más
|
|
actualización
|
Hacker News
|
|
Claude Opus 5 bajo el microscopio: ¿vale lo que cuesta?
Alguien ha tenido la buena idea de pasar Claude Opus 5 por SlopCodeBench, un benchmark diseñado específicamente para medir calidad de código real, no los típicos ejercicios de leetcode que cualquier modelo memoriza. Los resultados son interesantes porque el foco está en detectar "slop" — código genérico, verboso y sin criterio que técnicamente funciona pero que ningún dev con dos dedos de frente escribiría. Ojo con esto porque si tu caso de uso es generación de código de producción, estos datos te ayudan a justificar (o no) el coste premium de Opus 5 frente a modelos más baratos como Sonnet. leer más
|
|
|
rtk
Si usas herramientas como Claude Code, Cursor o Codex a diario, sabes que los tokens se van volando (y con ellos, el dinero). rtk es un proxy CLI escrito en Rust que se interpone entre tu flujo de trabajo y el LLM, comprimiendo el contexto enviado entre un 60-90% en comandos habituales de desarrollo. Sin dependencias, un solo binario: instalas y funciona.
Con 73.587 estrellas en GitHub, la tracción habla por sí sola — claramente ha tocado una fibra sensible en la comunidad dev.
Encaja perfectamente si tienes un presupuesto ajustado de API o si trabajas en equipo y queréis recortar la factura mensual sin cambiar vuestro tooling. Puedes usarlo como capa transparente y empezar a ver el ahorro desde el primer día.
ver en GitHub
|
|
🔧 Herramienta de la semana
|
|
codeburn es un dashboard local que agrega el consumo de tokens y costes de 31 herramientas de AI coding (Claude Code, Cursor, Codex, Gemini CLI…) en un solo lugar. Si usas varias herramientas a la vez, sabes el dolor: facturas dispersas, sin visibilidad de qué proyecto o tarea está quemando más presupuesto.
Esta semana la usaría para hacer un inventario real de mis gastos de la última quincena. Un `npx codeburn` y tienes el desglose por modelo, proyecto y tarea sin instalar nada permanente. Ideal para equipos que quieren justificar (o recortar) el gasto en AI.
El límite claro: si solo usas una herramienta, su propio dashboard suele bastar. Aquí el valor está en la agregación multi-tool.
probarla
|
|
|
El context engineering no es el nuevo prompt engineering: es fontanería real
Anthropic lleva semanas insistiendo en que el rendimiento de Claude 5 depende más de cómo estructuras el contexto que del modelo en sí. Y tienen razón, pero ojo: esto no es magia nueva, es ingeniería de software de toda la vida aplicada a LLMs. A ti esto te afecta porque si usas Claude Code o la API directamente, organizar mal tus system prompts, documentos y herramientas puede costarte tokens y resultados mediocres. Lo que Anthropic llama "context engineering" es, básicamente, pensar antes de pegar. Nada de humo, pura disciplina de dev.
|
|
¿Qué herramienta de IA estás usando más esta semana?
Responde a este email y cuéntame. Leo todas. (👍 si te sirvió · 👎 si no)
|
|
¿Te ha servido esta edición? Pásasela a un compañero dev.
Reenviar y que se suscriba →
|
|
DevAI — Herramientas de IA para devs, en español
Escrita por Alex cada semana
Ediciones anteriores
·
Cancelar suscripción
|