Accueil
Metabacklinks
  • Accueil
  • Prestations

    Site Web auto-géré

    Un site premium qui se met à jour seul.

    Site e-commerce

    Vendez en ligne, sans y penser.

    Acquisition de leads

    Vos visiteurs deviennent des contacts.

    Référencement SEO / GEO

    Soyez trouvé sur Google et les IA.

    Campagnes publicitaires

    De la pub qui rapporte, pilotée pour vous.

    Contre-expertise

    Nous vérifions le travail des autres.

    Refonte & maintenance

    Nous refaisons votre site, puis nous veillons dessus.

    Conseils et formations

    Nous vous formons au web et à l’IA.

  • Expertise

    Intelligence artificielle

    Comprendre l’IA, se former à ses usages et automatiser vos tâches du quotidien.

    Web & digital

    Votre présence en ligne pensée de bout en bout, du premier écran de votre site jusqu’à la vente.

    Logiciels métiers

    CRM et ERP connectés à votre activité, pour piloter vos clients et vos process au même endroit.

    Notre CRM

    Notre CRM

    Centralisez vos leads et vos clients, connecté à votre site et à vos agents.

  • Agents IA

    Agent Superviseur

    Véritable chef d’orchestre. Pilote l’équipe et vous informe des travaux en cours.

    Agent Webmaster

    Maintenance et sauvegardes. Code optimisé pour des sites rapides et en ligne.

    Agent SEO / GEO

    Audits, indexation et performances. Votre visibilité sur Google et dans les IA.

    Agent Rédactionnel

    Contenus optimisés et stratégie éditoriale.

    Agent Webmarketing & Leads

    Landing pages, tunnels de conversion et génération de leads clients.

    Agent Community Manager

    Réseaux sociaux, e-réputation et avis Google.

    Agent Conversationnel

    Accueil, qualification et prise de rendez-vous. Gère aussi les rappels.

    Agent Cybersécurité & Conformité

    Sécurité, monitoring et conformité RGPD. Applique les correctifs et réduit les risques.

    Agent Spécialiste SEA

    Google Ads, Meta Ads et LinkedIn Ads. Coûts ajustés à votre budget.

    Agent Traducteur

    Véritable linguiste. Traduction et adaptation en plusieurs langues.

    Agent Growth hacking

    Expérimentations et leviers de croissance. Capte les futurs leads.

    Agent Veille technique

    Veille sur les nouveautés web, IA et tendances. Journaliste d’investigation.

  • Secteurs

    Immobilier & Bâtiment

    Agences, promoteurs, architectes et BTP.

    Santé & médical

    Cabinets, cliniques, thérapeutes et libéraux de santé.

    Tourisme et gastronomie

    Hôtels, gîtes, restaurateurs, traiteurs et domaines.

    Éducation & formation

    Écoles privées et centres de formation.

    Secteur public & institutionnel

    Mairies, collectivités, associations et fédérations.

    Créateurs & Inventeurs

    Lancer son activité, son réseau ou son outil métier.

    Industrie & grands comptes

    Grandes entreprises, pharma, portails et extranets.

    Commerces & professions de proximité

    Garages, coiffeurs, avocats, notaires et artisans.

  • News & Tuto
Nous contacter
Accueil
Metabacklinks

Menu

  • Accueil
    • Toutes les prestations
    • Site Web auto-géré
    • Site e-commerce
    • Acquisition de leads
    • Référencement SEO / GEO
    • Campagnes publicitaires
    • Contre-expertise
    • Refonte & maintenance
    • Conseils et formations
    • Toutes nos expertises
    • Intelligence artificielle
    • Web & digital
    • Logiciels métiers
    • Toute l’équipe
    • Agent Superviseur
    • Agent Webmaster
    • Agent SEO / GEO
    • Agent Rédactionnel
    • Agent Webmarketing & Leads
    • Agent Community Manager
    • Agent Conversationnel
    • Agent Cybersécurité & Conformité
    • Agent Spécialiste SEA
    • Agent Traducteur
    • Agent Growth hacking
    • Agent Veille technique
    • Tous les secteurs
    • Immobilier & Bâtiment
    • Santé & médical
    • Tourisme et gastronomie
    • Éducation & formation
    • Secteur public & institutionnel
    • Créateurs & Inventeurs
    • Industrie & grands comptes
    • Commerces & professions de proximité
  • News & Tuto

Robots.txt Next.js, bloquer sans se tromper

David TouzetDavid Touzet·Mise à jour le 4 août 2026·8 min de lecture
  1. Metabacklinks
  2. ›
  3. Articles
  4. ›
  5. Next.js

Le fichier robots.txt indique aux robots où ils peuvent aller. Next.js le génère depuis un fichier TypeScript, ce qui permet de le construire avec de la logique plutôt que de l'écrire à la main. Le vrai sujet n'est pas la syntaxe, elle tient en 6 lignes. Le vrai sujet est de savoir ce que bloquer veut dire, parce que la confusion la plus répandue fait disparaître des pages que personne ne voulait cacher.

  • Étape 1 · Créer le fichier robots.ts dans Next.js
  • Étape 2 · Les 4 champs que Google lit dans un robots.txt
  • Étape 3 · Robots.txt ou noindex, la confusion qui coûte cher
  • Étape 4 · Gérer les robots d'IA et les robots trop gourmands
Étape 1

Créer le fichier robots.ts dans Next.js

Même convention que pour le sitemap, on ne réinvente rien. Un fichier nommé robots.ts, placé à la racine du dossier app, génère le fichier robots.txt servi à la racine du site.

Il exporte une fonction par défaut nommée robots, qui renvoie un objet. Cet objet contient 2 choses utiles.

  • Le champ rules, avec le robot visé, ce qu'il peut explorer et ce qu'il ne peut pas.
  • Le champ sitemap, avec l'adresse complète de votre sitemap, dont la génération est détaillée dans notre article dédié.

Un point qui surprend tout le monde. Vous pouvez très bien déposer un fichier robots.txt statique dans le dossier public. Le format TypeScript n'apporte rien de plus au robot, il apporte quelque chose à votre équipe. Vous construisez vos règles avec des variables, vous adaptez le comportement entre la préproduction et la production, et le fichier reste versionné avec le reste du code.

Ce dernier usage est le plus précieux. Une préproduction accessible et explorée par Google est un problème classique, qui met des semaines à se réparer. Une condition sur la variable d'environnement suffit à tout bloquer sur cet environnement, et rien sur le site réel.

Le fichier se vérifie en mode développement, à l'adresse robots.txt.

Étape 2

Les 4 champs que Google lit dans un robots.txt

La liste est courte, et beaucoup de tutoriels en ajoutent qui ne servent à rien.

  • user-agent. Le robot visé. L'astérisque désigne tous les robots. La règle la plus spécifique l'emporte sur la règle générale.
  • disallow. Les chemins interdits. Un chemin terminé par une barre oblique couvre tout ce qui se trouve en dessous.
  • allow. Les exceptions à une interdiction. Utile pour bloquer un dossier entier tout en laissant passer une page précise.
  • sitemap. L'adresse de votre sitemap, en adresse complète.

Tout le reste est ignoré par Google. Le champ crawl-delay, qui apparaît dans quantité d'exemples, n'a jamais eu d'effet sur son exploration. Bing et Yahoo, eux, le respectent. Si vos serveurs souffrent d'un robot trop insistant, c'est donc une piste valable, mais pas pour Google.

Ce qu'on bloque utilement sur un projet Next.js.

  • Les routes d'API, qui n'ont aucune raison d'apparaître dans les résultats.
  • L'espace d'administration et les tunnels de connexion.
  • Les pages de résultats de recherche interne, qui génèrent une infinité d'adresses au contenu quasi identique.
  • Les pages de confirmation après formulaire ou paiement.
Étape 3

Robots.txt ou noindex, la confusion qui coûte cher

C'est l'erreur la plus fréquente, et elle produit exactement l'inverse du résultat recherché.

Les 2 mécanismes ne font pas la même chose.

  • Le robots.txt bloque l'exploration. Le robot ne lit pas la page. Il peut malgré tout en connaître l'existence par un lien venu d'ailleurs, et l'afficher dans les résultats sans description.
  • Le noindex bloque l'indexation. Le robot lit la page, y trouve la consigne, et ne l'affiche pas.

D'où le piège. Bloquer une page dans robots.txt et lui poser un noindex ne fonctionne pas, puisque le robot bloqué n'entre jamais dans la page et ne lira jamais la consigne. Le résultat est une adresse fantôme qui reste listée.

La règle pratique est simple. Pour qu'une page n'apparaisse jamais dans les résultats, utilisez le noindex et laissez l'exploration ouverte. Pour économiser du temps d'exploration sur des zones sans intérêt, utilisez le robots.txt.

Un rappel de sécurité qui vaut d'être écrit. Un robots.txt est un fichier public, lisible par tous. Y lister vos chemins sensibles revient à publier la carte de ce que vous voulez cacher. Ce fichier gère la politesse des robots, jamais la confidentialité. Le réglage page par page est détaillé dans notre article sur la metadata Next.js.

Étape 4

Gérer les robots d'IA et les robots trop gourmands

Le paysage a changé. À côté de Google et Bing, une nouvelle famille de robots parcourt le web pour alimenter des modèles et pour répondre en direct aux questions des utilisateurs.

La décision se prend en 2 temps.

  • Les robots d'entraînement collectent votre contenu pour construire des modèles. Les bloquer se défend, en particulier sur un contenu original et coûteux à produire.
  • Les robots de réponse vont chercher une page au moment où quelqu'un pose une question, et citent la source. Les bloquer vous retire des réponses générées, qui deviennent un vrai canal de visites.

Notre position pour un site d'entreprise, et elle est tranchée. Sur du contenu qui sert à être trouvé, vous laissez passer. La visibilité dans une réponse d'intelligence artificielle vaut aujourd'hui davantage qu'une protection illusoire, puisque votre page reste de toute façon accessible à qui la lit.

Le second sujet concerne les robots d'outils d'analyse, qui explorent parfois de façon très soutenue et pèsent sur les serveurs. En Next.js, le champ rules accepte un tableau, ce qui permet de poser une règle spécifique par robot. Vous laissez tout ouvert par défaut et vous restreignez uniquement ceux qui posent problème.

Ces choix se relisent 2 fois par an. La liste des robots évolue vite, et un fichier écrit il y a 18 mois ne décrit plus le web d'aujourd'hui.

Liens utiles

Les liens à garder sous la main

Gardez ces pages ouvertes pendant que vous réglez vos accès robots.

  • Le guide complet du SEO Next.js
  • Comment Google interprète le robots.txt
  • La référence officielle du fichier robots
FAQ

Questions fréquentes

Créez un fichier robots.ts à la racine du dossier app et exportez une fonction par défaut nommée robots. Elle renvoie un objet contenant vos règles et l'adresse de votre sitemap. Next.js sert alors le fichier robots.txt automatiquement à la racine du site.
Le fichier robots.txt empêche l'exploration, la page n'est pas lue. Le noindex empêche l'indexation, la page est lue mais n'apparaît pas dans les résultats. Ce sont 2 mécanismes différents, et les combiner sur une même page ne fonctionne pas.
Exactement 4, user-agent, allow, disallow et sitemap. Tous les autres sont ignorés, y compris crawl-delay qui circule encore beaucoup. Bing et Yahoo, en revanche, tiennent compte de crawl-delay.
C'est un arbitrage, pas une règle. Les bloquer protège votre contenu de l'entraînement, mais vous prive aussi des citations dans les réponses générées, qui deviennent une source de visites. La plupart des sites de contenu ont intérêt à les laisser passer.
Le champ rules accepte un tableau plutôt qu'un objet unique. Chaque entrée cible un user-agent différent avec ses propres règles. Vous pouvez ainsi tout autoriser par défaut et poser des restrictions sur un robot précis.
Non. Sans lui, tout est exploré, ce qui convient à beaucoup de sites vitrines. Il devient utile dès que le site contient une administration, des pages de test, une recherche interne ou des routes techniques que rien ne justifie d'explorer.
Votre partenaire web

Un site Next.js rapide, conçu pour durer

Next.js offre vitesse et modernité, on en fait un vrai atout. On conçoit et développe votre site à Montpellier, performant et taillé pour le référencement.

Faire le point sur votre site
12 agents IA métier

Des agents IA pour un site au top

L’Agent Webmaster optimise votre code et votre vitesse, l’Agent SEO travaille votre visibilité et l’Agent Rédactionnel l’alimente. 12 agents IA au travail.

Voir les 12 agents
Fond dégradé Metabacklinks
Logo Metabacklinks

Partenaire Web & IA à Montpellier. On crée des sites auto-gérés par des agents IA. Vous gardez la main.

13 rue de Lavalette, 34830 Clapiers
Agglomération de Montpellier
06 68 34 12 84 · contact@metabacklinks.com

FacebookInstagramWhatsApp
Prestations
  • Site Web auto-géré
  • Site e-commerce
  • Acquisition de leads
  • Référencement SEO
  • Campagnes publicitaires
  • Contre-expertise
  • Refonte & maintenance
  • Conseils et formations
Automatisation des tâches
  • Des réseaux qui s’animent seuls.
  • Du contenu neuf, en continu.
  • Chaque page, dans toutes les langues.
  • Cité par les IA. Trouvé sur Google.
  • Un carnet qui se remplit tout seul.
  • Un client accueilli, à toute heure.
  • Un site tenu à jour, tout seul.
  • Un site protégé, jour et nuit.
Derniers articles
  • Google Stacking, les liens Google qui comptent5 août 2026
  • Propriétés de plateforme, la Search Console mesure vos réseaux5 août 2026
  • Acheter des vues YouTube, le piège qui fait fermer4 août 2026

© 2026 Metabacklinks · · Mentions légales· Glossaire· Emojis· Évolution des LLM· Partenaires· À propos· CRM