# # robots.txt para tu blog en WordPress. # # Usar bajo propia responsabilidad, que nos conocemos }:) # http://sigt.net/archivo/robotstxt-para-wordpress.xhtml # # Primero el contenido adjunto. User-agent: * Disallow: /wp-content/plugins/ Disallow: /wp-content/themes/ Disallow: /wp-includes/ Disallow: /wp-admin/ Disallow: /ar/ Disallow: /bg/ Disallow: /ca/ Disallow: /cs/ Disallow: /da/ Disallow: /de/ Disallow: /el/ Disallow: /es/ Disallow: /en/ Disallow: /fi/ Disallow: /fr/ Disallow: /hi/ Disallow: /hr/ Disallow: /id/ Disallow: /it/ Disallow: /iw/ Disallow: /ja/ Disallow: /ko/ Disallow: /lt/ Disallow: /lv/ Disallow: /nl/ Disallow: /no/ Disallow: /pl/ Disallow: /pt/ Disallow: /ro/ Disallow: /ru/ Disallow: /sk/ Disallow: /sl/ Disallow: /sr/ Disallow: /sv/ Disallow: /tl/ Disallow: /uk/ Disallow: /vi/ Disallow: /zh-CN/ Disallow: /zh-TW/ Disallow: /wp- Disallow: /?s= Disallow: /search # # Sitemap permitido, b?squedas no. # Sitemap: http://blog.tipesoft.com/sitemap.xml # # Permitimos el feed general para Google Blogsearch. # # Impedimos que permalink/feed/ sea indexado ya que el # feed con los comentarios suele posicionarse en lugar de # la entrada y desorienta a los usuarios. # # Lo mismo con URLs terminadas en /trackback/ que s?lo # sirven como Trackback URI (y son contenido duplicado). # Allow: /feed/$ Disallow: */feed/ Disallow: */trackback/ Disallow: /*/feed/$ Disallow: /*/feed/rss/$ Disallow: /*/trackback/$ Disallow: /*/*/feed/$ Disallow: /*/*/feed/rss/$ Disallow: /*/*/trackback/$ Disallow: /*/*/*/feed/$ Disallow: /*/*/*/feed/rss/$ Disallow: /*/*/*/trackback/$ # # A partir de aqu? es opcional pero recomendado. # # Lista de bots que suelen respetar el robots.txt pero rara # vez hacen un buen uso del sitio y abusan bastante... # A?adir al gusto del consumidor... # Google Image User-agent: Googlebot-Image Disallow: Allow: /* # Google AdSense User-agent: Mediapartners-Google* Disallow: Allow: /* # Internet Archiver Wayback Machine User-agent: ia_archiver Disallow: / # digg mirror User-agent: duggmirror Disallow: / User-agent: MSIECrawler Disallow: / User-agent: WebCopier Disallow: / User-agent: HTTrack Disallow: / User-agent: Microsoft.URL.Control Disallow: / User-agent: libwww Disallow: / # # Slurp (Yahoo!), Noxtrum y el bot de MSN a veces tienen # idas de pinza, toca decirles que reduzcan la marcha. # El valor es en segundos y pod?is dejarlo bajo e ir # subiendo hasta el punto ?ptimo. # User-agent: noxtrumbot Disallow: Allow: /* Crawl-delay: 50 User-agent: msnbot Disallow: Allow: /* Crawl-delay: 30 User-agent: Slurp Disallow: Allow: /* Crawl-delay: 10