User-Agent: * Allow: /blog/wp-content/uploads/ Disallow: /blog/wp-content/plugins/ Disallow: /blog/wp-content/themes/ Disallow: /blog/wp-includes/ Disallow: /blog/wp-admin/ # También podemos desindexar todo lo que empiece # por wp-. Es lo mismo que los Disallow de arriba pero # incluye cosas como wp-rss.php Disallow: /blog/wp- # # Sitemap permitido, búsquedas no. # Sitemap: http://www.oceanidas.net/blog/sitemap.xml Disallow: /blog/?s= Disallow: /blog/search # # Permitimos el feed general para Google Blogsearch. # # Impedimos que permalink/feed/ sea indexado ya que el # feed con los comentarios suele posicionarse en lugar de # la entrada y desorienta a los usuarios. # # Lo mismo con URLs terminadas en /trackback/ que sólo # sirven como Trackback URI (y son contenido duplicado). # Allow: /blog/feed/$ Disallow: /blog/feed Disallow: /blog/comments/feed Disallow: /blog/*/feed/$ Disallow: /blog/*/feed/rss/$ Disallow: /blog/*/trackback/$ Disallow: /blog/*/*/feed/$ Disallow: /blog/*/*/feed/rss/$ Disallow: /blog/*/*/trackback/$ Disallow: /blog/*/*/*/feed/$ Disallow:/blog/*/*/*/feed/rss/$ Disallow: /blog/*/*/*/trackback/$ # # A partir de aquí es opcional pero recomendado. # # Disallow Globa translator # Disallow: /blog/ar/ Disallow: /blog/bg/ Disallow: /blog/ca/ Disallow: /blog/cs/ Disallow: /blog/da/ Disallow: /blog/de/ Disallow: /blog/el/ Disallow: /blog/en/ Disallow: /blog/et/ Disallow: /blog/fi/ Disallow: /blog/fr/ Disallow: /blog/gl/ Disallow: /blog/hi/ Disallow: /blog/hr/ Disallow: /blog/hu/ Disallow: /blog/id/ Disallow: /blog/it/ Disallow: /blog/iw/ Disallow: /blog/ja/ Disallow: /blog/ko/ Disallow: /blog/it/ Disallow: /blog/lv/ Disallow: /blog/mt/ Disallow: /blog/nl/ Disallow: /blog/no/ Disallow: /blog/pl/ Disallow: /blog/pt/ Disallow: /blog/ro/ Disallow: /blog/ru/ Disallow: /blog/sk/ Disallow: /blog/sl/ Disallow: /blog/sq/ Disallow: /blog/sr/ Disallow: /blog/stale/ Disallow: /blog/sv/ Disallow: /blog/th/ Disallow: /blog/tl/ Disallow: /blog/tr/ Disallow: /blog/uk/ Disallow: /blog/vi/ Disallow: /blog/zh-CN/ Disallow: /blog/zh-TW/ # # Lista de bots que suelen respetar el robots.txt pero rara # vez hacen un buen uso del sitio y abusan bastante... # Añadir al gusto del consumidor... User-agent: MSIECrawler Disallow: /blog/ User-agent: WebCopier Disallow: /blog/ User-agent: HTTrack Disallow: /blog/ User-agent: Microsoft.URL.Control Disallow: /blog/ User-agent: libwww Disallow: /blog/ # # Slurp (Yahoo!), Noxtrum y el bot de MSN a veces tienen # idas de pinza, toca decirles que reduzcan la marcha. # El valor es en segundos y podéis dejarlo bajo e ir # subiendo hasta el punto óptimo. # User-agent: noxtrumbot Crawl-delay: 50 User-agent: msnbot Crawl-delay: 30 User-agent: Slurp Crawl-delay: 10 User-agent: GigaBot Disallow: /blog/ User-Agent: MJ12bot Disallow: /blog/ User-agent: IRLbot Disallow: /blog/