Cómo crear un inventario de URL de WordPress con IA

Un inventario de URL es la base factual de la mayor parte del trabajo de SEO y migración de WordPress. La IA puede normalizar exportaciones y clasificar patrones, pero no puede deducir un sitio completo a partir de la primera página de una respuesta de API o de un solo mapa del sitio. Cree el inventario a partir de varias fuentes identificadas y conserve las discrepancias.

El análisis SEO solo es tan fiable como la evidencia proporcionada. Un modelo de lenguaje no conoce por sí mismo el estado de rastreo, la indexación, las clasificaciones, la selección canónica ni el rendimiento de una página. Trátelo como organizador de evidencia y generador de hipótesis, y luego verifique cada hallazgo en el sistema fuente adecuado.

En una frase: cree una fila estable por cada URL descubierta, conserve cada fuente que la informó y señale los conflictos en vez de elegir silenciosamente un valor.

Lo que esta guía le ayuda a lograr

El resultado debe ofrecer una vista trazable de las URL públicas, privadas, redirigidas y faltantes, con ID de WordPress cuando estén disponibles. Debe respaldar auditorías posteriores sin pretender que una fuente de datos representa todo el sitio.

Un resultado útil no es solo una respuesta pulida. Debe mostrar qué registros o páginas se examinaron, qué evidencia no estaba disponible, qué dedujo el asistente, qué debe decidir una persona y qué acciones siguen prohibidas.

Lo que debe contener un resultado exitoso

  • Un registro de URL normalizada con todas las variantes de fuente observadas.
  • ID de contenido de WordPress, tipo, estado, idioma y fechas cuando estén disponibles.
  • Evidencia HTTP, canónica, de mapa del sitio y de política de indexación cuando se proporcione.
  • Indicadores de presencia de fuente que muestren dónde se descubrió cada URL.
  • Campos de conflicto y de datos faltantes.
  • Un alcance de inventario y una fecha de extracción claramente definidos.

Evidencia e insumos que se deben preparar

WordPress, los mapas del sitio, los rastreadores y los sistemas de analítica responden preguntas distintas. Únalos sin borrar las diferencias.

  • Exportaciones completas y paginadas de entradas, páginas y tipos de contenido personalizados de WordPress.
  • Todos los mapas del sitio XML e índices de mapas del sitio.
  • Una exportación de rastreo con la URL final, el estado y campos canónicos.
  • Un mapa de redirecciones o datos de servidor cuando estén disponibles.
  • Exportaciones de páginas de Search Console y analítica cuando sean pertinentes.
  • Asignaciones de idioma, sección del sitio y responsable del contenido.
  • Reglas de normalización de URL aprobadas para el proyecto.

Registre la fecha, fuente, alcance y omisiones conocidas de cada insumo. Elimine credenciales, información personal y datos de clientes que no sean necesarios para la tarea.

Mantenga las fuentes de descubrimiento como evidencia separada

Una URL en WordPress pero ausente del mapa del sitio no es automáticamente un error. Una URL en analítica pero ausente de WordPress puede estar redirigida, ser externa, histórica o generada. Conserve indicadores como in_wordpress, in_sitemap, in_crawl e in_search_data antes de interpretarlos.

Normalice sin ocultar diferencias

La normalización de mayúsculas y minúsculas, barra final, protocolo, host y consulta puede evitar el conteo duplicado. Conserve tanto el valor sin procesar como la clave normalizada para que los revisores puedan inspeccionar qué cambió. No elimine parámetros hasta conocer su función.

Un flujo de trabajo seguro

  1. Declare los hosts, protocolos, idiomas y tipos de contenido incluidos.
  2. Exporte cada fuente con fechas y evidencia de paginación.
  3. Almacene las URL sin procesar antes de aplicar reglas de normalización.
  4. Cree una clave de URL normalizada e indicadores de presencia de fuente.
  5. Una los ID de WordPress, estados, resultados HTTP, canónicas y evidencia de mapas del sitio.
  6. Pida al asistente que clasifique los conflictos y los campos faltantes.
  7. Revise manualmente las discrepancias de alto impacto.
  8. Congele la instantánea del inventario para el trabajo posterior.
  9. Cree tareas separadas para redirecciones, canónicas o cambios de contenido.

El flujo de trabajo separa intencionadamente el análisis de la implementación. Una fase de cambio posterior debe referirse al resultado aprobado en vez de ampliar silenciosamente los permisos de la identidad analítica.

Plantilla de prompt

Antes de usar este prompt, reemplace cada valor entre corchetes. No pegue contraseñas, claves de API, registros privados de clientes ni información personal no relacionada en la instrucción.

Cree un inventario de URL de WordPress normalizado a partir de los archivos fuente proporcionados.

Devuelva una fila por URL normalizada con:
- URL normalizada y todas las variantes sin procesar
- Host, ruta, consulta e idioma
- ID de WordPress, tipo de contenido y estado
- Fechas de publicación y modificación
- Presencia en WordPress, mapa del sitio, rastreo, Search Console, analítica y mapa de redirecciones
- Estado HTTP y URL final cuando se proporcionen
- Canónica declarada cuando se proporcione
- Clase de conflicto y evidencia faltante
- Prioridad de revisión y justificación

Reglas:
1. No suponga que una fuente está completa.
2. Conserve los valores sin procesar y las fechas de las fuentes.
3. No elimine parámetros sin una regla aprobada.
4. No invente datos HTTP, canónicos ni de indexación.
5. No cambie WordPress, redirecciones ni mapas del sitio.

Por qué este prompt está estructurado así

El modelo de presencia de fuente crea una unión auditable en lugar de una hoja de cálculo plana que oculta contradicciones. Las variantes sin procesar y las claves normalizadas permiten cuestionar la deduplicación.

Límite de acceso recomendado

Use una identidad Read Only. El asistente puede inspeccionar los registros de WordPress incluidos en el alcance, pero deben rechazarse los intentos de crear, editar, eliminar o publicar contenido.

El flujo de trabajo recomendado tiene bajo riesgo cuando los datos fuente están delimitados y no se concede permiso de escritura. Riesgo bajo no significa cero revisión.

Lo que debe permanecer fuera de esta tarea

  • Sin redirecciones, canónicas, cambios de noindex ni eliminaciones.
  • Sin afirmación de que la ausencia de un mapa del sitio implica desindexación.
  • Sin suposición de que la paginación de la API está completa sin evidencia.
  • Sin eliminación de parámetros de consulta antes de conocer su función.
  • Sin estado HTTP ni URL final inferidos.

El nivel de acceso es una recomendación inicial, no un derecho universal. Las capacidades exactas disponibles para una identidad deben proceder de la versión instalada del producto y de su cobertura publicada.

Cómo encaja WP Agent Control

Este es un flujo general de WordPress, no una promesa de que Agent Control pueda editar todos los objetos o integraciones tratados. En la ruta guiada, empiece por las páginas públicas. Las operaciones de plugins, temas, usuarios, ajustes, archivos, eliminación, WooCommerce, ACF y constructores no son tareas guiadas nativas. Utilice herramientas y permisos evaluados por separado cuando sea necesario.

Obtén información estructurada del sitio e inspecciona páginas publicadas seleccionadas después de conectar. Esta lectura pública no requiere una tarea temporal. También puedes navegar por páginas públicas sin el plugin; Agent Control añade acceso estructurado y continuidad hacia operaciones autorizadas en WordPress.

Conectar tu IA: docs first profile · Ver funciones y compatibilidad: coverage

Lista de verificación

  • Cada fuente tiene fecha y alcance.
  • La finalización de la paginación está documentada.
  • Se conservan los valores de URL sin procesar y normalizados.
  • Los conflictos de fuentes siguen visibles.
  • Los ID de WordPress se conservan cuando están disponibles.
  • Ningún estado de URL cambió durante la creación del inventario.

Modos de fallo comunes

  • El mapa del sitio equivale al sitio: el inventario excluye URL válidas no incluidas en el mapa del sitio.
  • Exportación de la primera página de API: se omite la paginación y el resultado se declara falsamente completo.
  • Normalización destructiva: los parámetros o diferencias de ruta se descartan antes de la revisión.
  • Borrado de conflictos: una fuente sobrescribe silenciosamente a otra.

Nota avanzada

Use instantáneas de inventario inmutables con ID de URL estables. Los rastreos posteriores y los mapas de migración pueden referirse a la misma identidad, lo que permite al equipo observar transiciones de estado sin reescribir evidencia histórica.

Guías relacionadas

Próximo paso

Use el inventario congelado para el análisis de páginas huérfanas, la revisión de solapamientos y la auditoría SEO más amplia.

Fuentes y verificación

Esta página se verificó a partir de las siguientes fuentes primarias. Última revisión de las fuentes: .