Case Study

Una sola línea base para cada herramienta de codificación con IA

Cómo Wilkes & Liberty consolidó la configuración de varias herramientas de codificación con IA en un solo repositorio de línea base versionado: un solo cambio revisado aterriza en cada máquina, y la desviación se anuncia en lugar de esconderse.
August 3, 2026
Topics:AI Agent GovernanceConfiguration ManagementDeveloper Experience
Tags:Model Context Protocol

Wilkes & Liberty realiza su propio trabajo de entrega mediante agentes de codificación con IA: varios, de distintos proveedores, en la máquina de cada ingeniero. Esa práctica hizo aflorar un problema que la mayoría de los equipos que adoptan estas herramientas encontrarán en un trimestre: cada herramienta guarda su propia configuración, en su propio formato, en su propio rincón del directorio de inicio. Las habilidades vivían en un lugar para una herramienta y en otro para la siguiente. Las conexiones a servidores se cableaban a mano. Cuando algo se rompía, se rompía en una máquina, en silencio, y seguía roto hasta que alguien notaba que la herramienta había dejado discretamente de hacer parte de su trabajo.

El problema, en concreto

Tres síntomas se repetían. Primero, la desviación: dos máquinas que debían comportarse de forma idéntica no lo hacían, porque una había sido configurada a mano meses antes. Segundo, la rotura silenciosa: una herramienta perdía una capacidad (un directorio de habilidades desvinculado, una conexión a un servidor caída) y no reportaba nada, porque nada había fallado de forma abrupta. Tercero, el mantenimiento no pagado: cada mejora en la configuración de una herramienta tenía que repetirse a mano para las demás o simplemente nunca ocurría.

El enfoque

La solución fue tratar la configuración de las herramientas de IA como ya tratamos la infraestructura: como código versionado con una sola fuente de verdad. Un único repositorio de línea base declara ahora todo lo que las herramientas comparten: reglas operativas, habilidades, definiciones de agentes, conexiones a servidores y colecciones de habilidades de terceros fijadas, con sus licencias registradas y verificadas. Adaptadores ligeros por herramienta traducen la única línea base al formato nativo de cada una. Un comando de activación la aplica; un comando de diagnóstico verifica que lo que está activo en la máquina coincide con lo que declara la línea base, y advierte cuando no es así.

Dos reglas de diseño hicieron la mayor parte del trabajo. La política debe aplicarse donde está escrita: un requisito de licencia que el código de sincronización no verifica es un deseo, no una compuerta. Y cada verificación debe poder fallar: un comando de salud que solo lee su propio registro aprobará para siempre mientras el mundo se pudre a su alrededor.

Resultados

Un ingeniero configura una máquina nueva clonando un repositorio y ejecutando un comando. Un cambio en cualquier recurso compartido (una habilidad nueva, una colección de terceros actualizada, una nueva conexión a un servidor) se publica como una sola solicitud de extracción revisada y aterriza en cada máquina y cada herramienta mediante un pull. La desviación ahora se anuncia en lugar de esconderse: el comando de diagnóstico encontró y nombró fallas de configuración que antes pasaban sin reportarse durante horas, incluida una en la que una herramienta reportaba éxito mientras omitía el trabajo.

La línea base es también la forma en que evaluamos lo que recomendamos a los clientes. Ejecutamos la implementación de referencia de la práctica antes de aconsejar a nadie que la adopte.