Segun MarkTechPost (AI/ML News), Microsoft ha liberado un agente de código denominado code-testing-generator, diseñado para automatizar y optimizar la generación de pruebas unitarias en entornos de desarrollo. Este sistema, disponible como parte del plugin dotnet-test dentro del repositorio MIT-licensed dotnet/skills, resuelve una brecha común en herramientas de asistencia al desarrollo: la falta de especificidad en prompts como “genera pruebas”. Mientras que soluciones tradicionales no definen el lenguaje, ubicación del archivo o tipo de afirmaciones, el agente realiza un análisis previo del repositorio antes de comenzar cualquier acción. Así, identifica el entorno de código, el marco de pruebas y las convenciones existentes, y luego ejecuta un flujo de trabajo estructurado que incluye planificación, escritura, ejecución y verificación de las pruebas generadas.
Los resultados de pruebas muestran una superioridad notable: en un conjunto interno de 152 tareas, el agente alcanza una tasa de cumplimiento del 92.1%, frente al 78.9% registrado por GitHub Copilot. Ambos utilizan el mismo modelo de inteligencia artificial y prompts idénticos, lo que permite una comparación directa y válida. El sistema no opera como un servicio en la nube, sino que se integra como un módulo dentro de entornos existentes de desarrollo, permitiendo que los usuarios ejecuten el agente directamente en sus propios entornos. Este enfoque garantiza que los códigos y datos permanezcan localmente, reduciendo riesgos de exposición y cumplimiento.
El potencial de este avance es especialmente relevante para empresas del Perú que operan en sectores regulados, como salud, seguros o servicios públicos, donde la calidad del software y la trazabilidad de los procesos son críticas. Muchas organizaciones peruanas gestionan sistemas heredados con altos niveles de deuda técnica, lo que exige ampliación de cobertura de pruebas sin aumentar el esfuerzo humano. El agente permite reforzar la cobertura de pruebas en módulos sin evaluación previa, generar pruebas para diferencias de código en solicitudes de integración y establecer estándares uniformes en repositorios poliglóticos. Además, su capacidad para detectar y corregir fallos en pipelines de construcción —como aquellos que compilan localmente pero no se ejecutan en entornos de integración continua— es una ventaja clave para equipos que enfrentan problemas de calidad.
Para los equipos pequeños, el ahorro de tiempo en la investigación de estructura de código es significativo. Para startups y empresas medianas, el agente representa una herramienta de escalabilidad sin inversión adicional en personal. En entidades del sector público o financieros, donde los procesos deben cumplir con normativas estrictas, la automatización de pruebas puede convertirse en un pilar de gestión de riesgos. La tecnología, aunque aún en fase de desarrollo, demuestra una viabilidad sólida desde equipos independientes hasta grandes corporaciones, ofreciendo una solución práctica y accesible para una amplia gama de usuarios.
