Comment inventorier le contenu WordPress avec l’IA

L’IA peut aider à transformer les enregistrements WordPress en un inventaire de contenu utile, mais la couche de récupération doit d’abord renvoyer un jeu de données complet et borné. Utilisez un accès Read Only, demandez des champs explicites, gérez la pagination et comparez le nombre d’enregistrements avec WordPress ou une exportation indépendante.

Le rôle de l’assistant est d’organiser, de classer et de résumer les enregistrements. Il ne doit pas déduire que la première page de l’API représente l’ensemble du site ni modifier du contenu pendant l’inventaire.

En une phrase : récupérez d’abord un jeu de données complet en lecture seule, puis laissez l’assistant le classer sans modifier WordPress.

Ce que ce guide vous aide à accomplir

Cette tâche produit un registre de contenu qui peut soutenir une migration, une planification éditoriale, des audits SEO et la maintenance. Il devrait identifier chaque enregistrement, son type, son état, son URL, ses dates et sa taxonomie pertinente sans recueillir de données privées inutiles.

Un flux de travail d’IA utile ne se définit pas seulement par la qualité de la réponse. Il se définit aussi par les données que l’assistant peut atteindre, les actions qu’il est autorisé à réaliser, les preuves que vous pouvez examiner ensuite et la facilité avec laquelle l’accès peut être retiré.

Pourquoi c’est important

De nombreux sites ne savent pas combien de contenus ils possèdent, quels enregistrements sont publics, où se trouvent les doublons ou quelles pages n’ont pas été modifiées depuis des années. Un inventaire transforme un patrimoine de contenu invisible en un jeu de données gérable.

L’IA apporte de la valeur après la récupération en regroupant les sujets, en détectant des tendances et en résumant les lacunes. L’exhaustivité de la récupération demeure un fait technique qui doit être prouvé séparément.

Résultat attendu

Une exécution réussie devrait produire :

  • Un tableau d’enregistrements avec des ID WordPress stables.
  • Des totaux distincts par type de publication et par état.
  • Des URL canoniques et des dates de publication ou de modification lorsque disponibles.
  • Des classifications par sujet, responsable ou revue avec un niveau de confiance explicite.
  • Une liste des champs ou types de contenu indisponibles.

Définir le périmètre de l’inventaire

Décidez si l’inventaire inclut les articles publiés, les pages, les brouillons, le contenu privé, les produits, les médias ou les types de publication personnalisés. Commencez par le plus petit ensemble utile. Les enregistrements privés ne devraient être inclus que lorsque la tâche et le traitement des données l’exigent.

Nommez les champs avant la récupération. Les champs utiles peuvent inclure l’ID, le titre, l’état, le type, l’URL, l’ID de l’auteur, la date de publication, la date de modification, les catégories et les étiquettes. Évitez de récupérer le contenu complet lorsque les métadonnées suffisent.

Prouver l’exhaustivité

Les réponses REST de WordPress sont paginées. Enregistrez les en-têtes de total ou les métadonnées de pagination lorsqu’ils sont disponibles, récupérez chaque page requise dans une limite définie et comparez le total final avec l’administration WordPress, WP-CLI ou une exportation.

Si le connecteur masque la pagination, le guide doit expliquer comment l’exhaustivité est vérifiée. Un tableau plausible de 10 enregistrements n’est pas l’inventaire d’un site de 1,000 pages.

Classer après la récupération

Une fois les enregistrements stabilisés, demandez à l’assistant de les regrouper par sujet, objectif de page, étape du parcours, famille de produits ou priorité de révision. Gardez les classifications générées par machine séparées des champs sources. Ajoutez un champ de confiance ou « à réviser » plutôt que de présenter chaque classification comme un fait.

Conserver un instantané

Enregistrez l’inventaire assaini avec un horodatage, un identifiant de site, la méthode de récupération et les versions des sources. Cela fournit une base stable aux audits ultérieurs. Ne stockez ni identifiants ni contenu complet inutile dans l’instantané.

Un flux de travail sûr

  1. Sélectionnez les types de publication, les états et les champs WordPress inclus.
  2. Créez une identité Read Only et testez une demande portant sur un seul enregistrement.
  3. Récupérez les enregistrements avec une pagination explicite et un maximum documenté.
  4. Comparez les totaux avec une source WordPress indépendante.
  5. Normalisez les ID, URL, dates et valeurs de taxonomie.
  6. Demandez à l’assistant de classer ou de prioriser le jeu de données stable.
  7. Révisez un échantillon de chaque classification.
  8. Stockez un instantané assaini et horodaté, puis révoquez l’accès si la tâche est terminée.

Recette de prompt

Avant de copier ce prompt, remplacez chaque valeur entre crochets. Ne collez pas d’identifiants, de données client ou d’informations privées dans l’instruction.

Créez un inventaire de contenu WordPress à partir de la source de données connectée en lecture seule.

Périmètre :
- Types de publication : [posts, pages]
- États : [publish]
- Nombre maximal d’enregistrements : [500]
- Champs requis : ID, type de publication, état, titre, URL canonique, date de publication, date de modification, catégories et étiquettes.

Règles :
1. Suivez la pagination jusqu’à ce que tous les enregistrements inclus soient récupérés ou que le maximum soit atteint.
2. Indiquez le nombre de demandes, les enregistrements par type de publication et les champs indisponibles.
3. Ne récupérez pas le contenu complet sauf s’il est nécessaire pour classer l’enregistrement.
4. Ne créez, ne modifiez, ne supprimez ni ne publiez quoi que ce soit.
5. Ajoutez un groupe de sujets suggéré distinct et une priorité de révision. Indiquez qu’il s’agit de classifications d’IA, non de données sources.
6. Renvoyez des lignes compatibles CSV ainsi qu’un court résumé.

Pourquoi le prompt est structuré ainsi

Le prompt sépare les champs sources des classifications d’IA et fait de la preuve de pagination une partie du livrable. Le maximum évite une opération non bornée tout en obligeant l’assistant à signaler lorsque l’inventaire est incomplet.

Limite d’accès recommandée

Utilisez une identité Read Only. L’assistant peut examiner les données WordPress incluses dans son périmètre, mais toute tentative de créer, modifier, supprimer ou publier du contenu devrait être refusée.

Faible ne veut pas dire nul. Révisez le périmètre des données d’entrée et assurez-vous que la sortie ne contient aucune information privée ou non pertinente.

Le niveau d’accès est une recommandation de départ, non une autorisation universelle. Les capacités WordPress exactes accessibles à une identité doivent provenir de la version de produit installée et de sa couverture publiée, non de cet article seul.

Ce qui doit rester hors de la tâche

  • Aucune opération d’écriture.
  • Aucune hypothèse selon laquelle l’exploration des URL publiques comprend les brouillons ou les enregistrements privés.
  • Aucun mélange entre les classifications d’IA et les champs WordPress canoniques.
  • Aucune exportation de contenu complet lorsque les métadonnées suffisent.

Comment WP Agent Control s’intègre

Obtenez des informations structurées sur le site et examinez des pages publiées après la connexion. Cette lecture publique ne nécessite aucune tâche temporaire. Vous pouvez aussi consulter les pages publiques sans le plugin ; Agent Control ajoute un accès structuré et la continuité vers du travail WordPress autorisé.

Autorisez une tâche de brouillon et sélectionnez les contenus de référence. L’assistant peut créer et réviser les brouillons créés par cette tâche. Les références existantes restent en lecture seule, même si ce sont elles-mêmes des brouillons. Vérifiez le résultat dans WordPress.

Avec Solo, Pro ou Agency, autorisez une tâche de proposition pour les contenus et champs sélectionnés. Examinez la comparaison complète dans WordPress et sélectionnez les propositions approuvées. L’approbation est liée à l’objet, aux champs et au contenu courant ; une source ou une tâche modifiée peut l’invalider. Approuver un changement de contenu n’autorise pas sa publication. Avec Solo, Pro ou Agency, il faut aussi une tâche de publication qui couvre l’approbation encore valide. Vérifiez vous-même le résultat publié.

Connecter votre IA : docs first profile · Voir les fonctions et la compatibilité : coverage

Liste de vérification

  • Les totaux d’enregistrements correspondent à une source indépendante.
  • La pagination est complète ou la limite est divulguée.
  • Les ID et URL correspondent aux enregistrements WordPress.
  • Les classifications d’IA sont clairement étiquetées.
  • Aucun contenu n’a été modifié.
  • L’instantané ne contient aucun identifiant ni donnée privée inutile.

Modes de défaillance courants

  • S’arrêter à la première page : une réponse d’API partielle est présentée comme le site complet.
  • Récupérer trop de données : le contenu complet et les champs privés sont collectés alors que les métadonnées suffiraient.
  • Perdre l’identité de la source : le tableau final omet les ID WordPress, ce qui rend la vérification et les mises à jour peu fiables.
  • Traiter les classifications comme des faits : les étiquettes de sujets générées par le modèle sont fusionnées avec les données sources canoniques.

Note avancée

Pour les inventaires récurrents, utilisez un identifiant d’instantané et hachez le jeu de données source normalisé. Les exécutions ultérieures peuvent signaler les ajouts, suppressions et champs modifiés. L’assistant devrait classer seulement le delta lorsque possible, ce qui réduit le coût et facilite l’inspection de la dérive.

Guides connexes

Continuer

Prochaine étape : copiez le prompt, exécutez-le d’abord avec le niveau d’accès recommandé et vérifiez la sortie avant d’accorder une permission plus étendue. WP Agent Control peut fournir une identité WordPress distincte et révocable pour ce flux de travail contrôlé. Consultez Produit et Tarification.

Sources et vérification

Cette page a été vérifiée à partir des sources primaires suivantes. Dernière révision des sources: .