# # robots.txt para tu blog en WordPress. # # Usar bajo propia responsabilidad, que nos conocemos }:) # # Permitir trabajar a los botsde 2 am a 7:45 am # Las horas son siempre Greenwitch Visit-time: 0000-0800 # Primero el contenido adjunto. User-Agent: * Allow: /developblog/ Disallow: / Disallow: /blog/admin.php Disallow: /blog/plugins/ Disallow: /blog/themes/ Disallow: /blog/locales/ Disallow: /blog/cache/ Disallow: /blog/conf/ Disallow: /blog/cron/ Disallow: /blog/media/ Disallow: /blog/htsrv/ Disallow: /blog/inc/ Disallow: /blog/rsc/ Disallow: /blog/skins_adm/ Disallow: /css Disallow: /flash Disallow: /images Disallow: /img Disallow: /javascript Disallow: /prueba # También podemos desindexar todo lo que empiece # por wp-. Es lo mismo que los Disallow de arriba pero # incluye cosas como wp-rss.php #Disallow: /wp- # # Sitemap permitido, búsquedas no. # #Sitemap: http://tu-web/sitemap.xml #Disallow: /?s= #Disallow: /search # # Permitimos el feed general para Google Blogsearch. # # Impedimos que permalink/feed/ sea indexado ya que el # feed con los comentarios suele posicionarse en lugar de # la entrada y desorienta a los usuarios. # # Lo mismo con URLs terminadas en /trackback/ que sólo # sirven como Trackback URI (y son contenido duplicado). # Allow: /feed/$ #Disallow: /feed #Disallow: /comments/feed #Disallow: /*/feed/$ #Disallow: /*/feed/rss/$ #Disallow: /*/trackback/$ #Disallow: /*/*/feed/$ #Disallow: /*/*/feed/rss/$ #Disallow: /*/*/trackback/$ #Disallow: /*/*/*/feed/$ #Disallow: /*/*/*/feed/rss/$ #Disallow: /*/*/*/trackback/$ # # A partir de aquí es opcional pero recomendado. # # Lista de bots que suelen respetar el robots.txt pero rara # vez hacen un buen uso del sitio y abusan bastante... # Añadir al gusto del consumidor... User-agent: MSIECrawler Disallow: / User-agent: WebCopier Disallow: / User-agent: HTTrack Disallow: / #User-agent: Microsoft.URL.Control #Disallow: / User-agent: libwww Disallow: / # # Slurp (Yahoo!), Noxtrum y el bot de MSN a veces tienen # idas de pinza, toca decirles que reduzcan la marcha. # El valor es en segundos y podéis dejarlo bajo e ir # subiendo hasta el punto óptimo. # User-agent: noxtrumbot Crawl-delay: 50 User-agent: msnbot Crawl-delay: 30 User-agent: Slurp Crawl-delay: 10