# # Sitemap permitido, búsquedas no. # # # Permitimos el feed general para Google Blogsearch. # # Impedimos que permalink/feed/ sea indexado ya que el # feed con los comentarios suele posicionarse en lugar de # la entrada y desorienta a los usuarios. # # Lo mismo con URLs terminadas en /trackback/ que sólo # sirven como Trackback URI (y son contenido duplicado). # User-agent: bingbot Sitemap: http://www.codifica.me/sitemap_index.xml Disallow: /?s= Disallow: /search Disallow: /feed/* Disallow: /feed Disallow: /comments/feed Disallow: /wp-content/plugins/ Disallow: /wp-content/themes/ Disallow: /wp-includes/ Disallow: /*/attachment/ Disallow: /tag/*/page/ Disallow: /tag/*/feed/ Disallow: /page/ Disallow: /*/feed/* Disallow: /*/feed/rss/* Disallow: /*/trackback/* Disallow: /*/*/feed/* Disallow: /*/*/feed/rss/* Disallow: /*/*/trackback/* Disallow: /*/*/*/feed/* Disallow: /*/*/*/feed/rss/* Disallow: /*/*/*/trackback/* Disallow: /solucion/tag/* Disallow: /solucion/user/* Disallow: /solucion/register* User-agent: googlebot Sitemap: http://www.codifica.me/sitemap_index.xml Disallow: /?s= Disallow: /search Disallow: /feed/* Disallow: /feed Disallow: /comments/feed Disallow: /wp-content/plugins/ Disallow: /wp-content/themes/ Disallow: /wp-includes/ Disallow: /*/attachment/ Disallow: /tag/*/page/ Disallow: /tag/*/feed/ Disallow: /page/ Disallow: /*/feed/* Disallow: /*/feed/rss/* Disallow: /*/trackback/* Disallow: /*/*/feed/* Disallow: /*/*/feed/rss/* Disallow: /*/*/trackback/* Disallow: /solucion/tag/* Disallow: /solucion/user/* Disallow: /solucion/register* # # A partir de aquí es opcional pero recomendado. # # Lista de bots que suelen respetar el robots.txt pero rara # vez hacen un buen uso del sitio y abusan bastante… # Añadir al gusto del consumidor… User-agent: MSIECrawler Disallow: / User-agent: WebCopier Disallow: / User-agent: HTTrack Disallow: / User-agent: Microsoft.URL.Control Disallow: / User-agent: libwww Disallow: / # # Slurp (Yahoo!), Noxtrum y el bot de MSN a veces tienen # idas de pinza, toca decirles que reduzcan la marcha. # El valor es en segundos y podéis dejarlo bajo e ir # subiendo hasta el punto óptimo. # User-agent: noxtrumbot Crawl-delay: 50 Disallow: / User-agent: msnbot Crawl-delay: 30 Disallow: / User-agent: Slurp Crawl-delay: 10 Disallow: / # Primero el contenido adjunto. # También podemos desindexar todo lo que empiece # por wp-. Es lo mismo que los Disallow de arriba pero # incluye cosas como wp-rss.php User-agent: * Disallow: /private Disallow: /wp-content/uploads Disallow: /wp-content/plugins Disallow: /wp-content/themes Disallow: /wp-includes Disallow: /wp-admin Disallow: /wp-