01

Hipótesis y alcance

Hipótesis: con herramientas de archivos, terminal y Godot en modo headless, un equipo de agentes puede producir un prototipo pequeño y corregir errores técnicos sin intervención humana continua. El alcance debe ser deliberadamente estrecho para que la prueba mida el sistema y no la ambición del juego.

  • Una sola mecánica central.
  • Una escena jugable y una pantalla de resultado.
  • Controles de teclado y mando definidos.
  • Sin servicios externos ni compras.
  • Presupuesto máximo de iteraciones y coste.
02

Arquitectura del equipo

Cada rol tiene un contexto y una autoridad diferente. El coordinador no edita todo; el verificador no reescribe silenciosamente el trabajo que evalúa.

Coordinador

Fija alcance, divide trabajo, conserva criterios y decide entre iterar o escalar.

Diseñador de juego

Define bucle, reglas, estados, dificultad y señales al jugador.

Ingeniero Godot

Crea escenas, recursos, GDScript y configuración del proyecto.

QA / verificador

Ejecuta importación, análisis, pruebas y sesiones acotadas; devuelve evidencia.

Herramientas

Sistema de archivos, control de versiones, comandos de Godot y captura de registros.

Humano

Aprueba el brief, las acciones de riesgo y la aceptación final del criterio subjetivo.

03

Bucle autónomo

El coordinador mantiene un estado explícito y no permite iteraciones infinitas.

  • Crear o actualizar un artefacto acotado.
  • Ejecutar importación headless y recoger errores.
  • Comprobar scripts y lanzar la escena durante un número limitado de frames.
  • Clasificar el fallo: sintaxis, recurso, comportamiento o criterio no comprobable.
  • Asignar la corrección al especialista adecuado.
  • Repetir hasta pasar o agotar el presupuesto y escalar.
04

Pruebas y evidencia

Godot admite scripts, importación, ejecución y exportación desde línea de comandos. Eso permite que la verificación dependa de salidas del motor y artefactos, no de la confianza en el texto del modelo.

Integridad

Existe project.godot, las rutas resuelven y la importación finaliza.

Análisis

Los scripts se parsean y no aparecen errores bloqueantes.

Ejecución

La escena inicia, mantiene el bucle previsto y termina de forma controlada.

Comportamiento

Pruebas instrumentadas observan estados y reglas deterministas.

Exportación

El preset genera una build reproducible cuando las plantillas están disponibles.

Registro

Cada iteración conserva objetivo, cambio, comando, salida y decisión.

05

Lo que todavía no se debe afirmar

La auditoría sí demuestra compilación, ejecución headless y una conducta acotada en la copia reparada. No demuestra que el snapshot original sea ejecutable ni quién lo creó: sin prompts, historial de agentes, commits e intervenciones humanas no existe procedencia autónoma certificada de extremo a extremo.

  • No trasladar los resultados de la copia reparada al snapshot original.
  • No atribuir autonomía total sin prompts, historial e intervenciones.
  • No confundir una acción verificada con una partida completa.
  • No confundir reglas implementadas con diversión, balance o rendimiento probado.
  • No publicar costes o tiempos sin medición reproducible.