pechatiplus, так как вы все проспали, поясню более объемно. С 8 апреля не существует понятия "по России". И галочка тут совершенно не причем.
Яндекс по IP, теоретически, пытается выдать пользователю его региональные сайты в бывшей ранее "общей" выдаче. Не всегда получается, чему посвящен соседний топик на 2000 с лишним постов (/ru/forum/339082), советую ознакомиться, много интересного узнаете.
Хотя для Вас, как ориентированного на регион, это даже возможно, лучше - такая выдача. Просто термин "по России" теперь у всех будет вызывать грустную улыбку. Такого в Яндексе более нет.
Забавно, выдача различается на:
- основном поиске и на расширенной один вариант (sfront4-013 и безномерной sfront023)
- на PDA-версии и на Mail.ru другой вариант (при том что Мейл.ру счас как то крючит, то сервак не откликается, то без картинок отдет страницы)
К чему бы это?
Запросы
http://yandex.ru/yandsearch?text=%D0%B2%D1%8B%D1%82%D1%8F%D0%B6%D0%BD%D0%BE%D0%B9+%D1%88%D0%BA%D0%B0%D1%84
http://pda.yandex.ru/search.xml?query=%D0%B2%D1%8B%D1%82%D1%8F%D0%B6%D0%BD%D0%BE%D0%B9+%D1%88%D0%BA%D0%B0%D1%84
Клеит, опцию выбрать надо после первичного поиска.
В зависимости от косячности УРЛовой структуры прошлой, количества уникальных страниц на сайте, наличия 301-редиректов со старых адресов на новые и т.п. может занять достаточно много времени.
У меня например полтора месяца (в сентябре-октябре) сайт переиндексировался полностью (~19 тыс. страниц магазин, из-за косячности движка в индексе было ~300000 дублей и пустышек). При том, что со старых адресов, а также с дублей и прочего были пересылки по 301, по несуществующим реально адресам выдавалось 404, роботс.тхт был настроен и т.п.
Но это было, повторюсь, в сентябре-октябре, под Находку. Сколько бы это заняло сейчас - трудно сказать, примеров счас нет.
Вообще то для IE7 не так уж много хаков и надо, он конечно глючный, но требует после Фоксового кода минимальной обработки напильником. Это если не извращаться с кодом. Например, CSS-свойство min-height в нем и так прекрасно работает.
К тому же, есть такая штука как условные комментарии в IE, где можно вполне в файлики сгруппировать все наборы хаков под любое сочетание версий, и не надо загаживать базовый код. Рекомендую погуглить. Для организации пространства кода очень удобно. Если конечно не решается задача по нагруженности сайта как на главной Гугла, например.
А приведенный сайт с хаками в IE7 очень забавно разъезжается, кстати... Хотя макет то примитивный...
А то что вы продемонстрировали как пример для Гугли
так это заголовок вообще то для файла "Сайтмапа сайтмапов", т.е. карты файлов XML-карт сайта, если их пришлось создать несколько, когда в один файл по количеству урлов или объему данных превышается ограничение.
А схема - просто должна быть, при том с валидным адресом, не более. У меня изначально Гуглевые карты (но по стандарту sitemaps.org) Яшка с самого запуска этого их сервиса замечательно хавает.
sand_man_, смотрел по косвенным, но крайне явным признакам. Типа время отдачи страницы - сайт на php+mysql грузится 25 секунд = прощай Яша...
Кроме чистого количества сайтов на 1 IP, что можно посмотреть через сервис из поста 165, можно через http://www.alertsite.com/tools.shtml посмотреть отрезки времени на каждое действие. По данному хосту, по всем сайтам на php картина с отдачей First byte примерно одинаковая. Вывод - страшно тупит комп хоста.
На том же хосте чисто html-сайты более менее работают, там затыки только на резолве DNS, секунд 5-7...
На тему пропавших в последние апдейты из индексов СДЛ или белых сайтов.
У самого 5 числа пропал один из сайтов на обслуживании. После разбирательств выявил, что сервак, на котором сайт, просто дичайшим образом перегружен и php на нем почти не шевелится/ DNS resolve только около 7 секунд.
И на нем дофига сайтов... Вот пример http://www.seoegghead.com/tools/what-is-hosted-on-that-ip.seo?action=get_location_action&info%5Bip_or_domain%5D=89.111.173.75
Хостинг многоуважаемых RBC-Hosting... Блин. И фигня продолжается... Две трети трафа было с Яшки, сайт в последние апы только рос... Обидно.
И практически все сайты по этому хостингу, которые используют скрипты или на cms какой - все потенциально на выход...
Бррр... То ли я слепой, то ли не въехал, толи у меня такого в выдаче просто нет. Можно скрин?
Хитрость в том, что в соответствии с описанием в документации, что Яндекс, что Гугл ввели понятие директивы Allow как расширение стандарта robots.txt. Так что для них то эта директива есть.
А вот для тех роботов, которые ее не понимают, ее нет. И они либо ее проигнорируют, либо обломятся. Но для владельца этого файла, насколько я понимаю, они (эти роботы) без интереса.