[spip-dev] Redirection automatique vers les URL « propres »

Bonjour,

Il me semble qu'à un moment donné, je ne sais plus dans quelle version de SPIP, si on arrivait sur le site par une URL valable (mode « page » par exemple) mais ne correspondant pas à la configuration (disons « arbo » dans mon cas), il y avait une redirection automatique.

Par exemple si l'utilisateur arrive avec :
http://gasteroprod.com/?page=article&id_article=798

Il est automatiquement redirigé vers :
http://gasteroprod.com/blog/google-chrome-sur-mac-bilan-mitige.html

Or cela n'est plus le cas.

J'ai rêvé, ou c'est une vraie régression qui risque de pénaliser le référencement des sites pour « duplicate content » ?

-Nicolas

Bonjour,

Il me semble qu’à un moment donné, je ne sais plus dans quelle version de SPIP, si on arrivait sur le site par une URL valable (mode « page » par exemple) mais ne correspondant pas à la configuration (disons « arbo » dans mon cas), il y avait une redirection automatique.

Par exemple si l’utilisateur arrive avec :
http://gasteroprod.com/?page=article&id_article=798

Il est automatiquement redirigé vers :
http://gasteroprod.com/blog/google-chrome-sur-mac-bilan-mitige.html

C’est le cas depuis
http://gasteroprod.com/?article798
qui est une url reecrite
mais pas depuis
http://gasteroprod.com/?page=article&id_article=798
qui est une url directement fonctionnelle.

Or cela n’est plus le cas.

J’ai rêvé, ou c’est une vraie régression qui risque de pénaliser le référencement des sites pour « duplicate content » ?

les urls canoniques sont là pour ça non ?

<link rel="canonical" href="http://www.spip-contrib.net/Agenda-2-0" />

Cédric

Il me semble qu’à un moment donné, je ne sais plus dans quelle version de SPIP, si on arrivait sur le site par une URL valable (mode « page » par exemple) mais ne correspondant pas à la configuration (disons « arbo » dans mon cas), il y avait une redirection automatique.

Par exemple si l’utilisateur arrive avec :
http://gasteroprod.com/?page=article&id_article=798

Il est automatiquement redirigé vers :
http://gasteroprod.com/blog/google-chrome-sur-mac-bilan-mitige.html

C’est le cas depuis
http://gasteroprod.com/?article798
qui est une url reecrite
mais pas depuis
http://gasteroprod.com/?page=article&id_article=798
qui est une url directement fonctionnelle.

Arf. Ce serait envisageable à ton avis ?

Or cela n’est plus le cas.

J’ai rêvé, ou c’est une vraie régression qui risque de pénaliser le référencement des sites pour « duplicate content » ?

les urls canoniques sont là pour ça non ?

<link rel="canonical" href="http://www.spip-contrib.net/Agenda-2-0" />

Effectivement, mais je ne suis pas sûr qu’elles soient exploitées par tout le monde. Enfin, si Google le fait, c’est déjà ça… :wink:

Il me semble qu’à un moment donné, je ne sais plus dans quelle version de SPIP, si on arrivait sur le site par une URL valable (mode « page » par exemple) mais ne correspondant pas à la configuration (disons « arbo » dans mon cas), il y avait une redirection automatique.

Par exemple si l’utilisateur arrive avec :
http://gasteroprod.com/?page=article&id_article=798

Il est automatiquement redirigé vers :
http://gasteroprod.com/blog/google-chrome-sur-mac-bilan-mitige.html

C’est le cas depuis
http://gasteroprod.com/?article798
qui est une url reecrite
mais pas depuis
http://gasteroprod.com/?page=article&id_article=798
qui est une url directement fonctionnelle.

Arf. Ce serait envisageable à ton avis ?

Tout est toujours envisageable

Or cela n’est plus le cas.

J’ai rêvé, ou c’est une vraie régression qui risque de pénaliser le référencement des sites pour « duplicate content » ?

les urls canoniques sont là pour ça non ?

<link rel="canonical" href="http://www.spip-contrib.net/Agenda-2-0" />

Effectivement, mais je ne suis pas sûr qu’elles soient exploitées par tout le monde. Enfin, si Google le fait, c’est déjà ça… :wink:

Je crois qu’à peu près tous les moteurs de recherche l’utilise correctement

Cédric

Arf. Ce serait envisageable à ton avis ?

Tout est toujours envisageable

Je voulais dire : Cela serait-il une évolution acceptable dans SPIP ?

Outre l’éventuel soucis de duplicate content, qui ne semble finalement pas être un vrai soucis, avoir une même page accessible depuis plusieurs URL différentes (après redirections éventuelles), ça peut pour le moins être déroutant pour les utilisateurs, et fausser les analyses des outils de statistiques de consultation.

les urls canoniques sont là pour ça non ?

<link rel="canonical" href="http://www.spip-contrib.net/Agenda-2-0" />

Effectivement, mais je ne suis pas sûr qu’elles soient exploitées par tout le monde. Enfin, si Google le fait, c’est déjà ça… :wink:

Je crois qu’à peu près tous les moteurs de recherche l’utilise correctement

OK pour le duplicate content donc.

Ce serait envisageable à ton avis ?

ça a été intégré il y a .. 14 mois
http://trac.rezo.net/trac/spip/changeset/13773

cf. aussi URL canonique - ZZZ

-- Fil

Je sais bien, je l'ai aussi dans mes squelettes, mais je parlais de la redirection...

-Nicolas

Quel redirection ?

http://gasteroprod.com/blog/google-chrome-sur-mac-bilan-mitige.html
EST http://gasteroprod.com/?page=article&id_article=798

À moins faire boucler ton serveur, tu n'arriveras nulle part me semble t il.
D'où les urls canonique pour dire quelle url à connaitre de la ressource ciblée.

Km

Ce que veut dire Nicolas, et je le rejoins à 300% là dessus, c’est que désormais, si tu décides en cours de route, de changer de structure d’URL pour une raison X ou Y (passer de “pages” à “arbo” ou de “propres2” à “libres”, les liens vers des pages URL old school pointaient bien vers les bonnes pages malgré le changement de type d’URL (via une 301 ou 302 (bien que la 301 soit recommandée en ce cas précis)).
Maintenant ce n’est plus le cas !!!

Ca oblige certes à un peu de constance pour le choix de ses URLs (en soit, c’est pas un mal) mais ca pose surtout problème en cas de refonte, si l’on change la structure des URLs car du coup, tous les liens faits vers de vieilles URLs ne redirigent plus, d’où Google qui enregistre des 404 en série pour le site concerné, ce qui du coup, fait descendre les 2 sites dans les résultats de recherche : l’un pour avoir autant d’erreur 404 non corrigées, l’autre pour linking vers des pages foireuses.

My 2 Cents…

Etienne.

2010/5/1 cam.lafit@azerttyu.net <cam.lafit@azerttyu.net>

Faut arêter de dire n’importe quoi et prendre le temps de tester avant de dire qu’une fonctionnalité ne marche pas.
Les urls propres sont redirigées entre elles vers la plus récentes quand tu changes d’url, comme avant, et rien n’a changé.

Il y a deux exceptions (mais ni plus ni moins qu’avant) :

  • /?page=truc&id_truc=xx
    qui n’est pas une url réécrite mais une url directement interprétable. Elle n’est pas redirigée (et ne l’a jamais été). C’était la question de Nicolas
  • les urls arbos qui ne redirigent pas une ancienne url arbo vers une nouvelle url arbo.

Je ne vois pas ce que des 404 viennent faire là qui plus est, car dans tous les cas on a aucune 404. Et en ce qui concerne google, il est tenu informé de la bonne url via l’info d’url canonique.

Cédric

Quel redirection ?

http://gasteroprod.com/blog/google-chrome-sur-mac-bilan-mitige.html
EST Gastero Prod. - L'ancien blog de Nicolas Hoizey

Non, fait un strcmp() des deux... :-p

À moins faire boucler ton serveur, tu n'arriveras nulle part me semble t il.
D'où les urls canonique pour dire quelle url à connaitre de la ressource ciblée.

Ce que je veux, c'est que l'utilisateur voit mon URL propre dans son navigateur même s'il a initialement demandé la seconde.

-Nicolas

Euh... non, pas de 404 à priori, en tout cas avec mon SPIP SVN et le plugin du core kivabien, qui conserve l'historique des URL...

-Nicolas

Faut arêter de dire n’importe quoi et prendre le temps de tester avant de dire qu’une fonctionnalité ne marche pas.
Les urls propres sont redirigées entre elles vers la plus récentes quand tu changes d’url, comme avant, et rien n’a changé.

Il y a deux exceptions (mais ni plus ni moins qu’avant) :

  • /?page=truc&id_truc=xx
    qui n’est pas une url réécrite mais une url directement interprétable. Elle n’est pas redirigée (et ne l’a jamais été). C’était la question de Nicolas

Il me semblait qu’elle l’avait été dans le passé, c’était peut-être dans mon propre fichier d’URL, avant que j’adopte le « arbo » du core…

  • les urls arbos qui ne redirigent pas une ancienne url arbo vers une nouvelle url arbo.

Ah, oui, aussi, c’est vrai. Et pourquoi, alors, si les autres le font ?

Je ne vois pas ce que des 404 viennent faire là qui plus est, car dans tous les cas on a aucune 404. Et en ce qui concerne google, il est tenu informé de la bonne url via l’info d’url canonique.

La 404 c’était avant le plugin « urls_etendues » du core, si je ne m’abuse.