Me pediste dos cosas: un estudio en profundidad de las herramientas que tenemos, y un plan para que Claude haga una web entera él solo — atacando el fallo nº1: cuando va sin ti, las estructuras salen genéricas. Dos agentes han barrido todo el sistema (skills, comandos, hooks, almacén, masters, comercial). Esto es lo que hay, por qué falla, y el plan.
La conclusión del inventario en una frase: tienes un arsenal enorme de PIEZAS y un método excelente CONTIGO dentro — pero la inteligencia de ESTRUCTURA (qué secciones, en qué orden, con qué ritmo) vive en 12 fichas, 18 capturas con prosa y tu cabeza. Cuando tú no estás, Claude no tiene de dónde sacar una estructura buena — y tira de su promedio estadístico.
El flujo tiene 4 paradas donde apruebas la FORMA (refs → paradigma → spec → 2º rechazo = stop). El único modo autónomo (fábrica nocturna) tiene prohibido diseñar: solo instancia masters. El 16/07 se saltó eso y salieron 3 webs del mismo molde: tu ojo era el único control y no estaba.
Hero centrado + 3 tarjetas + secciones clónicas. Tu diagnóstico del 06/07 lo clavó: bajo presión, el modelo recorta exactamente los pasos de consulta. La lista negra de composiciones existe — pero es PROSA que el propio modelo se autoevalúa.
Los 18 fragmentos "estructura" del banco son capturas con prosa. Las recetas son 4. Los NORTEs de los
masters son 5. No existe un banco de esqueletos MEDIDOS que un generador esté OBLIGADO a usar.
Y la ironía: disecciona-ref.js YA extrae la estructura medida de cualquier web (probado con Bloom:
hero 1800px vídeo → portfolio 3840px → services → about → cta → faq, con fondos y ritmo) — pero esa tabla
hoy no la consume nadie.
"Prohibido 3 variantes del mismo esqueleto" es una regla-consejo. El 16/07 se entregaron 3 variantes del mismo esqueleto. Tu doctrina del 06/07 es la respuesta: solo se cumplen los controles con artefacto obligatorio consumido aguas abajo. La divergencia hay que MEDIRLA, no pedirla.
De noche solo corre qa-demo-expres (checklist mecánico: contraste, h1, 404s). El que juzga
diseño (web-ui, ojos frescos anti-IA) no corre en autónomo — y su veredicto "nunca sustituye
tu OK", así que nadie lo ha convertido en gate con dientes.
No se trata de pedirle a Claude "sé más original" (eso ya fracasó 3 veces). Se trata de que en modo autónomo la estructura venga de fuera del modelo — robada y medida de webs reales que ya demostraron funcionar — y de que los controles de calidad sean scripts y jurados que fallan solos, no prosa autoevaluada. El mismo giro que ya hiciste el 06/07 con el NORTE y el LISTÓN, aplicado ahora a lo único que quedó fuera: la composición.
↑ esto es un ESQUELETO MEDIDO (Bloom, extraído hoy con tu disector): orden, pesos, ritmo. Un banco de 40 de estos, etiquetados por sector, es la vacuna contra el hero+3-tarjetas.
Pasar disecciona-ref.js (+ barrido-rueda.js) sobre las 17 favoritas + 25-35 webs
premiadas por sector (Awwwards/godly/recent.design, de tus galerías de la Biblia). De cada una,
normalizar la tabla "Estructura de secciones" a un ESQUELETO.md: orden de roles
(hero/obra/prueba/oferta/cierre), pesos relativos, ritmo claro↔oscuro, dónde va la media, columna
vertebral. Nuevo script extrae-esqueleto.js + escaparate CATALOGO-ESQUELETOS.html
(el 3º, junto a código y gusto) con el wireframe dibujado de cada uno.
Nuevo artefacto obligatorio docs/ESQUELETO.md (esqueleto elegido + tabla sección→contenido
real del negocio). El hook bloquea escribir el index sin él — igual que hoy bloquea estilos sin NORTE.
Y dos scripts con dientes:
mide-esqueleto.js — mide la página CONSTRUIDA con el mismo extractor y la compara contra
el ESQUELETO declarado: nº y orden de secciones, ritmo de fondos, pesos. Deriva = deny.mide-divergencia.js: dados los 3 bocetos de una ronda, calcula distancia estructural
(secuencia de roles + huella de layout por sección). Si dos se parecen demasiado → la ronda no vale y
se regenera cambiando de columna vertebral, no de fuente tipográfica. El "3 variantes
del mismo molde" del 16/07 se vuelve imposible de colar.
Panel de 3 subagentes juzgando RENDERS (no código), cada uno con una lente distinta:
① ojos-frescos anti-IA (la rúbrica de web-ui, que ya existe), ② lado-a-lado contra la referencia
origen del esqueleto (compara-replica.js), ③ "cliente del sector" — test de los 5 segundos:
¿parece ESTE negocio o una plantilla? Pasan 2 de 3 y ningún 🔴.
Un run = elegir cliente → web entera → informe, sin tocar a nadie:
_comercial/VETADOS.md (tus proyectos en curso y sectores vetados — la lección Itek,
convertida en artefacto que el selector está obligado a leer).Cada mañana, tu veredicto sobre el run queda registrado como dato:
| Regla | Por qué se queda |
|---|---|
| El envío es tuyo | Ningún run contacta con nadie. Deploy siempre noindex. El experimento produce webs y datos, no mensajes. |
| DOS CARRILES separados | Tu workflow habitual NO se toca: ni un comando, ni un gate, ni un paso. El carril autónomo es un comando NUEVO propio (/fabrica-total) y sus proyectos llevan el marcador modo-autonomo: en el NORTE (mismo patrón que instancia-de-master:). Los gates nuevos de F2 (ESQUELETO.md obligatorio, mide-esqueleto, lista negra ejecutable) SOLO disparan si ven ese marcador — en tus sesiones dirigidas, gate-webs se comporta EXACTAMENTE igual que hoy. Si el carril autónomo muere mañana, tu flujo ni se entera. |
| Workflow director = producción | Esto es un banco de pruebas paralelo — si un run sale bien, la web se puede rescatar; si sale mal, solo se pierde una noche de máquina. |
| Sin precio no hay cliente | Los runs trabajan sobre prospectos del PIPELINE o ficticios; nunca sobre encargos de cliente (ahí manda /tanda y su gate de precio). |
| VETADOS.md manda | Nunca más un run pisando un proyecto tuyo en curso (Itek). Si la lista no existe o está vacía, el selector se detiene. |
Mi recomendación de orden: F1 (banco de esqueletos) es la que desbloquea todo y es independiente — aunque no automatices nada más, te sirve para TUS sesiones de /arranca-web desde el primer día. Después F2+F3 (los gates), F4 (jurado), y el primer run F5 en una noche controlada.
Las 17 favoritas + ~30 premiadas por tus 6 sectores (reformas, hostelería, salud, casa-rural, camper, arte). Puedo cosechar 10-15 por sesión. Tú revisas el catálogo visual cuando esté.
Para el primer run F5: ¿un prospecto real del PIPELINE (score ≥70, sector con esqueletos) o un negocio ficticio de un sector que controles? Real = dato más útil; ficticio = riesgo cero.
Necesito de ti la lista corta: proyectos tuyos en curso y sectores que no quieres que un run toque. 5 minutos, una vez.
Todo lo demás son decisiones técnicas que tomo yo y quedan escritas en cada fase.
Fuentes: inventario de 2 agentes sobre ~/.claude + 07_Webs (18/07) · post-mortems 28/06, 06/07, 16/07 · disección Bloom (estructura medida, verificada hoy)