Estudio + plan · 18/07/2026 · investigado sobre tu sistema real

La web autónoma:
de elegir cliente
a web terminada.

Me pediste dos cosas: un estudio en profundidad de las herramientas que tenemos, y un plan para que Claude haga una web entera él solo — atacando el fallo nº1: cuando va sin ti, las estructuras salen genéricas. Dos agentes han barrido todo el sistema (skills, comandos, hooks, almacén, masters, comercial). Esto es lo que hay, por qué falla, y el plan.

01 — EL ARSENAL (lo que ya tienes, contado de verdad)

El sistema es grande. Y tiene un agujero con forma de estructura.

~183fichas de código (efectos, componentes, islas React)
12fichas de ESTRUCTURA (4 recetas + 8 costuras) — el 6% del almacén
85fragmentos del banco de gusto (18 de tipo "estructura", en prosa)
5masters de sector (reformas el más completo)
7hooks-candado (gate-webs v2.2 lee contenido, gate-deploy, gate-precio…)
3subagentes QA (web-ui, qa-demo-expres, verificador-fuente-motion)
18scripts Playwright (disecciona-ref, compara-replica, barrido-rueda…)
4checkpoints humanos en el flujo — todos son TU ojo

La conclusión del inventario en una frase: tienes un arsenal enorme de PIEZAS y un método excelente CONTIGO dentro — pero la inteligencia de ESTRUCTURA (qué secciones, en qué orden, con qué ritmo) vive en 12 fichas, 18 capturas con prosa y tu cabeza. Cuando tú no estás, Claude no tiene de dónde sacar una estructura buena — y tira de su promedio estadístico.

02 — EL DIAGNÓSTICO (por qué solo = genérico)

Cinco causas, todas con evidencia en tus post-mortems.

1 · Toda la garantía de calidad eres tú

El flujo tiene 4 paradas donde apruebas la FORMA (refs → paradigma → spec → 2º rechazo = stop). El único modo autónomo (fábrica nocturna) tiene prohibido diseñar: solo instancia masters. El 16/07 se saltó eso y salieron 3 webs del mismo molde: tu ojo era el único control y no estaba.

2 · El modelo cae a su atractor estadístico

Hero centrado + 3 tarjetas + secciones clónicas. Tu diagnóstico del 06/07 lo clavó: bajo presión, el modelo recorta exactamente los pasos de consulta. La lista negra de composiciones existe — pero es PROSA que el propio modelo se autoevalúa.

3 · El conocimiento de estructura no es consumible

Los 18 fragmentos "estructura" del banco son capturas con prosa. Las recetas son 4. Los NORTEs de los masters son 5. No existe un banco de esqueletos MEDIDOS que un generador esté OBLIGADO a usar. Y la ironía: disecciona-ref.js YA extrae la estructura medida de cualquier web (probado con Bloom: hero 1800px vídeo → portfolio 3840px → services → about → cta → faq, con fondos y ritmo) — pero esa tabla hoy no la consume nadie.

4 · Nadie mide la divergencia

"Prohibido 3 variantes del mismo esqueleto" es una regla-consejo. El 16/07 se entregaron 3 variantes del mismo esqueleto. Tu doctrina del 06/07 es la respuesta: solo se cumplen los controles con artefacto obligatorio consumido aguas abajo. La divergencia hay que MEDIRLA, no pedirla.

5 · El jurado nocturno actual no juzga diseño

De noche solo corre qa-demo-expres (checklist mecánico: contraste, h1, 404s). El que juzga diseño (web-ui, ojos frescos anti-IA) no corre en autónomo — y su veredicto "nunca sustituye tu OK", así que nadie lo ha convertido en gate con dientes.

03 — LA IDEA CENTRAL

Sustituir tu ojo por artefactos que no se pueden fingir.

No se trata de pedirle a Claude "sé más original" (eso ya fracasó 3 veces). Se trata de que en modo autónomo la estructura venga de fuera del modelo — robada y medida de webs reales que ya demostraron funcionar — y de que los controles de calidad sean scripts y jurados que fallan solos, no prosa autoevaluada. El mismo giro que ya hiciste el 06/07 con el NORTE y el LISTÓN, aplicado ahora a lo único que quedó fuera: la composición.

hero·vídeo
obra·3840
servicios
about
ventajas
cta
faq

↑ esto es un ESQUELETO MEDIDO (Bloom, extraído hoy con tu disector): orden, pesos, ritmo. Un banco de 40 de estos, etiquetados por sector, es la vacuna contra el hero+3-tarjetas.

04 — EL PLAN (6 fases, cada una usable por sí sola)

De banco de esqueletos a fábrica completa.

F1

Banco de ESQUELETOS medidos

2-3 sesiones · la pieza clave

Pasar disecciona-ref.js (+ barrido-rueda.js) sobre las 17 favoritas + 25-35 webs premiadas por sector (Awwwards/godly/recent.design, de tus galerías de la Biblia). De cada una, normalizar la tabla "Estructura de secciones" a un ESQUELETO.md: orden de roles (hero/obra/prueba/oferta/cierre), pesos relativos, ritmo claro↔oscuro, dónde va la media, columna vertebral. Nuevo script extrae-esqueleto.js + escaparate CATALOGO-ESQUELETOS.html (el 3º, junto a código y gusto) con el wireframe dibujado de cada uno.

  • Regla dura: en modo autónomo la columna vertebral SALE del banco (3 candidatos del sector/intención, elige el que mejor casa con los assets del negocio) — prohibido inventar estructura de cabeza.
  • Los 18 fragmentos "estructura" del banco de gusto se re-miden con el disector (hoy son prosa).
Artefacto: banco-esqueletos/*.md + catálogo visual · consumido por F2 y F5
F2

Gate de estructura (gate-webs v3)

1 sesión

Nuevo artefacto obligatorio docs/ESQUELETO.md (esqueleto elegido + tabla sección→contenido real del negocio). El hook bloquea escribir el index sin él — igual que hoy bloquea estilos sin NORTE. Y dos scripts con dientes:

  • mide-esqueleto.js — mide la página CONSTRUIDA con el mismo extractor y la compara contra el ESQUELETO declarado: nº y orden de secciones, ritmo de fondos, pesos. Deriva = deny.
  • Lista negra ejecutable — detector del molde genérico (hero eyebrow+título-izq+foto-caja, 3 tarjetas iguales, secciones clónicas) sobre el DOM real. Hoy es prosa; pasa a ser suspenso automático medible.
Artefacto: ESQUELETO.md + informe de mide-esqueleto · consumido por el jurado F4
F3

Divergencia medida

1 sesión

mide-divergencia.js: dados los 3 bocetos de una ronda, calcula distancia estructural (secuencia de roles + huella de layout por sección). Si dos se parecen demasiado → la ronda no vale y se regenera cambiando de columna vertebral, no de fuente tipográfica. El "3 variantes del mismo molde" del 16/07 se vuelve imposible de colar.

Artefacto: DIVERGENCIA.md con puntuaciones · consumido por el informe nocturno
F4

El jurado nocturno con dientes

1-2 sesiones

Panel de 3 subagentes juzgando RENDERS (no código), cada uno con una lente distinta: ① ojos-frescos anti-IA (la rúbrica de web-ui, que ya existe), ② lado-a-lado contra la referencia origen del esqueleto (compara-replica.js), ③ "cliente del sector" — test de los 5 segundos: ¿parece ESTE negocio o una plantilla? Pasan 2 de 3 y ningún 🔴.

  • Suspenso → UNA regeneración con cambio de esqueleto obligatorio. 2º suspenso → STOP: se quedan los bocetos y el informe (tu regla del 2º rechazo, ahora como código).
  • Honestidad: el jurado NO es tu ojo. El experimento mide cuánto se le acerca — no finge que lo iguala.
Artefacto: VEREDICTO-JURADO.md · gate de build y de deploy
F5

El circuito completo (el experimento)

1 noche por run

Un run = elegir cliente → web entera → informe, sin tocar a nadie:

  • Elegir: SISTEMA-SCORE (≥70 + filtros F1-F6) sobre el PIPELINE + nuevo _comercial/VETADOS.md (tus proyectos en curso y sectores vetados — la lección Itek, convertida en artefacto que el selector está obligado a leer).
  • Cosechar: datos y fotos reales del negocio (Maps, web vieja) — lo que ya hace bien la nocturna.
  • Diseñar: NORTE auto con §2-LISTÓN desde el banco de gusto del sector + receta de dirección (1 columna vertebral del banco de esqueletos + injertos con rol único) → 3 bocetos estáticos → F3 mide divergencia → F4 jurado → ganador.
  • Construir: spec de motion con FUENTE del almacén (audita verificador-fuente-motion) → build → mide-esqueleto + QA → deploy noindex.
  • Informar: NOCHE-*.md con renders, esqueleto elegido, divergencia, veredicto del jurado y LA decisión de las 9:00. Nada se envía a nadie: el clic sigue siendo tuyo.
Artefacto: la web desplegada + informe completo · consumido por ti a las 9:00
F6

Métricas y bucle de mejora

continuo

Cada mañana, tu veredicto sobre el run queda registrado como dato:

  • Métrica reina: ¿habrías aprobado el boceto ganador en una ronda 1 tuya? (sí / casi / no). Punto de partida real: 0/3 (16/07). Objetivo del experimento: 2/3 "casi o sí" en 5 runs.
  • Divergencia media entre bocetos · gates disparados por run · coste y duración por web.
  • Cada "no" → post-mortem de 5 líneas → regla nueva SOLO si se puede volver gate-artefacto (tu doctrina del 06/07).
Artefacto: EXPERIMENTOS.md acumulativo — la memoria del proyecto de autonomía
05 — LO QUE NO CAMBIA

Las líneas rojas del experimento.

ReglaPor qué se queda
El envío es tuyoNingún run contacta con nadie. Deploy siempre noindex. El experimento produce webs y datos, no mensajes.
DOS CARRILES separadosTu workflow habitual NO se toca: ni un comando, ni un gate, ni un paso. El carril autónomo es un comando NUEVO propio (/fabrica-total) y sus proyectos llevan el marcador modo-autonomo: en el NORTE (mismo patrón que instancia-de-master:). Los gates nuevos de F2 (ESQUELETO.md obligatorio, mide-esqueleto, lista negra ejecutable) SOLO disparan si ven ese marcador — en tus sesiones dirigidas, gate-webs se comporta EXACTAMENTE igual que hoy. Si el carril autónomo muere mañana, tu flujo ni se entera.
Workflow director = producciónEsto es un banco de pruebas paralelo — si un run sale bien, la web se puede rescatar; si sale mal, solo se pierde una noche de máquina.
Sin precio no hay clienteLos runs trabajan sobre prospectos del PIPELINE o ficticios; nunca sobre encargos de cliente (ahí manda /tanda y su gate de precio).
VETADOS.md mandaNunca más un run pisando un proyecto tuyo en curso (Itek). Si la lista no existe o está vacía, el selector se detiene.
06 — QUÉ DECIDES
Tu veredicto

¿Arrancamos por F1?

Mi recomendación de orden: F1 (banco de esqueletos) es la que desbloquea todo y es independiente — aunque no automatices nada más, te sirve para TUS sesiones de /arranca-web desde el primer día. Después F2+F3 (los gates), F4 (jurado), y el primer run F5 en una noche controlada.

Decisión 1 — ¿empiezo la cosecha de esqueletos?

Las 17 favoritas + ~30 premiadas por tus 6 sectores (reformas, hostelería, salud, casa-rural, camper, arte). Puedo cosechar 10-15 por sesión. Tú revisas el catálogo visual cuando esté.

Decisión 2 — el primer cliente-cobaya

Para el primer run F5: ¿un prospecto real del PIPELINE (score ≥70, sector con esqueletos) o un negocio ficticio de un sector que controles? Real = dato más útil; ficticio = riesgo cero.

Decisión 3 — VETADOS.md

Necesito de ti la lista corta: proyectos tuyos en curso y sectores que no quieres que un run toque. 5 minutos, una vez.

Todo lo demás son decisiones técnicas que tomo yo y quedan escritas en cada fase.

Fuentes: inventario de 2 agentes sobre ~/.claude + 07_Webs (18/07) · post-mortems 28/06, 06/07, 16/07 · disección Bloom (estructura medida, verificada hoy)