Pourquoi nous échantillonnons de vraies réponses (et ne les modélisons pas)
Il n'y a pas d'API publique pour « qu'est-ce que ChatGPT a dit mardi dernier ». Voici pourquoi Citations.io échantillonne de vraies réponses au lieu de modéliser les scores de visibilité.
La tentation de modéliser
Il est tentant de noter la visibilité de l'IA à partir d'entrées que vous possédez déjà : nombre de backlinks, autorité de domaine, balisage schema, etc. C'est peu coûteux à calculer, sans frais d'API, et facile à expliquer.
Le problème : les moteurs n'utilisent pas ces entrées comme on pourrait s'y attendre. Un score modélisé prédit si vous devriez apparaître dans une réponse. Un score échantillonné vous indique si vous êtes apparu.
Ce que l'échantillonnage signifie réellement
Citations.io exécute chaque requête suivie sur les quatre principaux moteurs (ChatGPT, Perplexity, Gemini, Claude), jusqu'à 5 réponses échantillonnées par moteur et par scan. Nous capturons la réponse verbatim et étiquetons les mentions de votre marque et de chaque concurrent nommé.
Tout sur le tableau de bord — visibilité %, part de réponse, taux de recommandation, couverture des citations — découle de ces réponses échantillonnées. Vous pouvez cliquer sur n'importe quel chiffre et lire la réponse d'où il provient.
Étiquettes de confiance
Une seule réponse échantillonnée n'est qu'une anecdote. Nous étiquetons chaque agrégat avec une étiquette de confiance :
- Directionnel (1 à 20 réponses) — utile pour la direction des tendances, pas pour les affirmations absolues.
- Modéré (21 à 100 réponses) — signal solide, à rapporter chaque semaine.
- Fort (plus de 101 réponses) — suffisamment confiant pour un rapport de conseil d'administration.
C'est la différence entre « votre visibilité a chuté de 12 points » (parfois une modélisation effrayante) et « votre visibilité a chuté de 12 points avec une forte confiance sur 240 réponses » (signal exploitable).

