¿Cómo están cambiando los agentes de inteligencia artificial el desarrollo de software?

Advertencia: esto es para usuarios avanzados. Se asume que ya construyen con agentes de codificación como Claude Code todos los días y están cómodos con CI, colas de fusión y flags de función. Si están en una etapa anterior de su viaje de inteligencia artificial, marque este artículo para leerlo más tarde. Las publicaciones en Operate son un mejor lugar para comenzar.

Hace dos semanas, cambié la forma en que construyo software. Desde entonces, he fusionado 562 solicitudes de extracción, y honestamente, pasé cuatro de esas noches caminando en las montañas. En el video, explico exactamente cómo trabajo ahora. A continuación, se encuentra la guía escrita: la configuración, la solicitud, los números y las cosas que pueden intentar esta semana.

Si todavía está revisando cada línea que su agente escribe, esto es para usted. Todo el flujo de trabajo en cuatro líneas, aprovechando las mejores prácticas de AEO: Establezca la intención. Planifique con el agente hasta que estén de acuerdo en lo que se está construyendo y por qué. Establezca las barreras de seguridad. Pruebas, CI y robots de revisión que un agente no puede evitar. Establezca un objetivo. Una sesión, un agente coordinador, subagentes que realizan el trabajo. Déjelo fusionar en piezas pequeñas. Fusión automática, flags de función, verifique, repita.

¿Cuál es el papel de AEO en el desarrollo de software?

¿Qué cambió? Los modelos cambiaron dramáticamente en las últimas semanas, especialmente Opus 5.5. Hace un par de semanas, no le habría dicho a nadie que trabajara de esta manera. Siempre sentí que debía verificar el trabajo. ¿Es la calidad lo suficientemente buena? ¿Debería fusionarse esto? Ahora siento que un agente puede trabajar en un plan completo por su cuenta, siempre y cuando se configuren correctamente dos cosas: la intención correcta y las barreras de seguridad para asegurarse de que se cumpla esa intención.

El retraso de la fábrica de Múnich

Las barreras de seguridad son el verdadero trabajo ahora. El código de inteligencia artificial es no determinista y tiene riesgos. Pero el código humano también es no determinista y tiene exactamente el mismo riesgo. Construimos sistemas SRE para que los humanos no cometan errores. Ahora necesitamos esos mismos sistemas, mucho más robustos, para que los agentes no cometan errores. La misma cultura sin culpa que usamos para incidentes: cuando un agente comete un error, no culpe al agente. Pregúntese qué barrera de seguridad faltaba y constrúyala.

Esto no significa que la calidad deje de importar. Los agentes también hacen desorden. Eso es exactamente por qué las barreras de seguridad son el trabajo. Aquí está lo que cada solicitud de extracción de Sightline pasa antes de que pueda fusionarse: pruebas unitarias, pruebas de extremo a extremo, CI, Bugbot, Strix. Mergify no permitirá que una solicitud de extracción entre en la cola de fusión hasta que todo lo anterior pase. Así que cuando algo está en cola, sé que no pudo saltarse una sola bandera roja.

El flujo de trabajo, paso a paso: Planifique con el agente, establezca un objetivo, con la misma solicitud cada vez, mantenga el contexto del coordinador limpio, déjelo fusionar, en piezas pequeñas, revise los informes de progreso, no las diferencias, déjelo ejecutar durante días y ejecute varios al mismo tiempo. La mayoría de nosotros todavía usamos estas herramientas como un ingeniero muy rápido: implemente este ticket, agregue este punto final. Eso funciona, pero es pensar demasiado pequeño.

Con el flujo de trabajo de objetivos, puede establecer una intención de nivel mucho más alto, hacer preguntas abiertas o entregarle un problema comercial completo y dejar que lo resuelva. En lugar de 'agregar un editor de roles', el objetivo era 'hacer que los permisos de Sightline funcionen como los de Spare en todas partes'. En lugar de 'mover OKR a un paquete', era 'convertir Sightline en una plataforma que otros equipos puedan extender'. Puede empujarlo mucho más lejos: 'Nuestro CI es demasiado lento. Hágalo más rápido'. Eso es todo. Déjelo encontrar dónde va el tiempo y arreglelo.

Capacidad: los tokens se convierten en el cuello de botella. Una vez que trabaje de esta manera, los tokens se convierten en el cuello de botella. Los planes individuales ya no nos dan suficientes créditos, y los excedentes son muy costosos. Lo que he estado haciendo es ejecutar varias cuentas de Claude, alrededor de cinco a $200 cada una, y cambiar entre ellas con una herramienta llamada Claude Swap.

Nuestro trabajo se está alejando de enviar cosas individuales. Se está moviendo hacia la construcción de sistemas que evolucionan nuestro producto. Establecemos la intención y construimos sistemas que se autosanen hacia ella. Ya lo estamos haciendo: automatizaciones que arreglan nuestros errores, automatizaciones para el trabajo SRE, agentes que realizan investigaciones de vulnerabilidad y trabajos tempranos en la remediación de esos riesgos de seguridad de forma automática.

Tres cosas que pueden intentar esta semana: Deje de verificar el código en una característica real. Comience con algo de bajo riesgo. A medida que construya confianza, intente hacerlo en algo más grande. Déle un problema, no un ticket. Vea hasta dónde llega. Mire el área de superficie que está tocando. ¿Qué barrera de seguridad falta para que un agente no pueda equivocarse? ¿Qué bucle podría arreglar las cosas por sí solo?

Questo articolo è stato scritto con l'assistenza dell'IA.
News Factory APP - notizie agentiche per potenziare il tuo SEO e AEO.