# # robots.txt para tu blog en WordPress. # # Usar bajo propia responsabilidad, que nos conocemos }:) # http://sigt.net/archivo/robotstxt-para-wordpress.xhtml # # # ULTIMO las reglas para TODOS los agentes # debe ir el ultimo por recomendacion de robots.txt.org # # Primero el contenido adjunto. # User-agent: * Allow: /buxLL/wp-content/uploads/ Allow: /fanfiction/wp-content/uploads/ # # NO usar las que siguen, # podrian evitar indexar las PAGINAS, # pero es posible que eviten que Yahoo y otros lean las entradas #Allow: /buxLL/wp-content/uploads/2007/ #Allow: /buxLL/wp-content/uploads/2008/ #Allow: /buxLL/wp-content/uploads/2009/ #Allow: /fanfiction/wp-content/uploads/2007/ #Allow: /fanfiction/wp-content/uploads/2008/ #Allow: /fanfiction/wp-content/uploads/2009/ #Disallow: /buxLL/wp-content/uploads/ #Disallow: /fanfiction/wp-content/uploads/ # Disallow: /buxLL/wp-content/plugins Disallow: /buxLL/wp-content/themes Disallow: /buxLL/wp-includes Disallow: /buxLL/wp-admin Disallow: /fanfiction/wp-content/plugins Disallow: /fanfiction/wp-content/themes Disallow: /fanfiction/wp-includes Disallow: /fanfiction/wp-admin # # # desactiva carpetas concretas # Disallow: /cgi-bin Disallow: /tmp Disallow: /audiovisual Disallow: /imagenes Disallow: /recursos Disallow: /Pruebas01 Disallow: /buxLL/imagenes Disallow: /buxLL/html/ Disallow: /buxLL/cgi-bin Disallow: /buxLL/wp-content/backup-db Disallow: /buxLL/wp-content/cache Disallow: /buxLL/wp-content/gt-cache Disallow: /buxLL/wp-content/languages Disallow: /buxLL/wp-content/upgrade Disallow: /buxLL/wp-content/widget-cache Disallow: /buxLL/wp-content/advanced-cache.php Disallow: /buxLL/wp-content/wp-cache-config.php Disallow: /buxLLFF Disallow: /fanfiction/cgi-bin Disallow: /fanfiction/imagenes Disallow: /fanfiction/wp-content/backup-db Disallow: /fanfiction/wp-content/cache Disallow: /fanfiction/wp-content/gt-cache Disallow: /fanfiction/wp-content/languages Disallow: /fanfiction/wp-content/upgrade Disallow: /fanfiction/wp-content/widget-cache Disallow: /fanfiction/wp-content/advanced-cache.php Disallow: /fanfiction/wp-content/wp-cache-config.php # # desactiva las PAGINAS de obrasm indexa las fichas # Disallow: /fanfiction/wp-content/uploads/obras/ # # También podemos desindexar todo lo que empiece # por wp-. Es lo mismo que los Disallow de arriba pero # incluye cosas como wp-rss.php # #Disallow: /wp- # # # Sitemap permitido, búsquedas no. # Sitemap: http://buxaralibrosles/buxLL/sitemap.xml Disallow: /?s= Disallow: /search Sitemap: http://buxaralibrosles/fanfiction/sitemap.xml Disallow: /?s= Disallow: /search # # # Permitimos el feed general para Google Blogsearch. # # Impedimos que permalink/feed/ sea indexado ya que el # feed con los comentarios suele posicionarse en lugar de # la entrada y desorienta a los usuarios. # # Lo mismo con URLs terminadas en /trackback/ que sólo # sirven como Trackback URI (y son contenido duplicado). # Allow: /feed/$ Disallow: /feed Disallow: /comments/feed Disallow: /*/feed/$ Disallow: /*/feed/rss/$ Disallow: /*/trackback/$ Disallow: /*/*/feed/$ Disallow: /*/*/feed/rss/$ Disallow: /*/*/trackback/$ Disallow: /*/*/*/feed/$ Disallow: /*/*/*/feed/rss/$ Disallow: /*/*/*/trackback/$ # # MIO - agentes especificos # # # Google buscador de imagenes # excluye carpetas primarias y los GIFs que pueden ser animados # User-agent: Googlebot-Image Disallow: /imagenes/ Disallow: /*.gif$ # # Google Adsense desactivado # #User-agent: Mediapartners-Google* #Disallow: / # # # buscador general de Google # excluye cualquier imagen # User-agent: Googlebot Disallow: /*.gif$ Disallow: /*.jpg$ Disallow: /*.png$ Disallow: /*.php$ Disallow: /*.js$ Disallow: /*.inc$ Disallow: /*.css$ Disallow: /*.gz$ Disallow: /*.wmv$ Disallow: /*.cgi$ Disallow: /*.xhtml$ # # desactiva todos los archivos con ? en la url Disallow: /*?* # # elimina las paginas dinamicas Disallow: /*? # # elimina todas las paginas bajo un directorio concreto #User-agent: Googlebot #Disallow: /directorio # # # A partir de aquí es opcional pero recomendado. # # Lista de bots que suelen respetar el robots.txt pero rara # vez hacen un buen uso del sitio y abusan bastante... # Añadir al gusto del consumidor... User-agent: MSIECrawler Disallow: / User-agent: WebCopier Disallow: / User-agent: HTTrack Disallow: / User-agent: Microsoft.URL.Control Disallow: / User-agent: libwww Disallow: / # # Slurp (Yahoo!), Noxtrum y el bot de MSN a veces tienen # idas de pinza, toca decirles que reduzcan la marcha. # El valor es en segundos y podéis dejarlo bajo e ir # subiendo hasta el punto óptimo. # User-agent: noxtrumbot Crawl-delay: 50 User-agent: msnbot Crawl-delay: 30 User-agent: Slurp Crawl-delay: 10