Un sitio trilingüe, publicado en su propio dominio, diseñado y construido por mí y por una IA, desde el primer commit hasta el texto de cada caso. Dieciocho sesiones de trabajo, todas registradas mientras ocurrían.
Empecé creyendo que la habilidad nueva sería escribir buenos encargos. No fue así.
Leyó el color del píxel, y acertó solo la mitad
Necesitaba sacar la paleta del design system y solo tenía una captura de pantalla. Las etiquetas con el código eran texto demasiado pequeño para leerse: en la imagen, manchas. En lugar de intentar descifrarlas, la IA leyó el color del píxel de cada muestra y devolvió la escala entera.
Uno de los escalones salió #3381ff, exactamente el valor que yo ya conocía.
Tomé la coincidencia como prueba de que el método era correcto.
No lo era. Comprobada después contra la fuente real, el color de marca estaba exacto en los veinte escalones. La escala de neutro, no: llega hasta 1100, y yo la había registrado parando en 1000, con un escalón que no existe desplazando todos los demás.
El método confirma una rampa cuya estructura ya conoces. No descubre la estructura. Acerté donde yo ya sabía la respuesta, y fue justo ahí donde creí haber probado algo.
La etiqueta es ilegible en el origen y el código sale exacto del otro lado, porque lo que se leyó no fue el texto: fue el color del píxel. Esta escala salió correcta en los veinte escalones. La de neutro, no.
Doce imágenes bonitas, rechazadas por una medida
Quería que el gato de la marca cruzara la pantalla caminando. Le pedí las poses a la IA, y salieron preciosas.
Entonces medí. En un paso real la pata recorre entre el 35% y el 45% del cuerpo de un fotograma al siguiente. En las doce imágenes generadas, el recorrido quedaba entre el 5% y el 16%. Al tamaño en que el gato aparece de verdad en el sitio, esa diferencia son tres píxeles: eran doce veces la misma imagen.
Nada en ellas parecía mal, y ese es el punto. Lo que separó "bonito" de "funciona" fue escribir el criterio de aceptación en número antes de encargar el material.
Ninguna de estas preguntas tiene respuesta técnica
Elegir el problema. Qué casos entran, qué tiene que demostrar cada uno, qué se queda fuera.
Ver qué está mal en la pantalla. El título de un caso cortado a media palabra. Una portada que no dialogaba con la de al lado. Una afirmación sobre estacionamientos que solo valía para la foto del ejemplo. Nada de eso rompe el build.
Responder lo que no está en ningún archivo. Uno de los casos parecía trabajo hecho para una empresa real, y ninguna lectura del material resolvería la duda: solo yo sabía que el briefing venía de un bootcamp. Esa respuesta se convirtió en la espina dorsal del caso entero.
Un defecto que ningún test detecta: el periodo nunca cedía espacio y se comía el nombre del caso. En una de las pantallas medidas, quedaba un píxel para el título.
La parte que decide no se hizo más pequeña
Falta escribir un caso de trabajo, y este trata de un proyecto que sigue ocurriendo. El registro sigue abierto.
Lo que ya se puede decir: la ejecución se aceleró de verdad. La parte que decide si el resultado sirve sigue siendo mía, y no se hizo más pequeña. Se hizo más visible.
