Оригинально. Сколько будет беков, какая часть в Яндексе/Гугле?
Я скажу страшную вещь: может поработать над этими страницами, а не над выбрасыванием их из поисковика?
Когда-то было такое модное слово RTFM (Read This Fucking Manual)
В http://rules.yandex.ru/termsofuse.xml сказано:
Деоптимизируйте (ухудшите оптимизацию) персональные страницы так, чтобы в серпе они были, но были по своим запросам очень низко.
Это достаточно редкий случай. Особенно если у владельца зарегестрирован торговый знак.
Нельзя рефрешить Adwords. Это считается накруткой объявлений с оплатой за показы и за это могут забанить.
AOL - это самый начинающие и беднейшие пользователи американского интернета. Поэтому нет ничего странного в том, что срез запросов другой. Настораживают длинные, в десять слов, повторяющиеся по десять раз запросы. Настораживает малое количество вхождений слова crack и других маргинальных слов. Настораживает большое количество поисков, которые ничем не окончились (никуда не нажали). Настораживает непоследывательная нумерация (с пробелами в номерах) и её начало с двухсотых номеров. С другой стороны, статистические исследования выборки в целом достаточно хорошо отражают то, как люди кликают. Странное впечатление от базы.
www.wordtracker.com
отпарсить базу AOL
1. Я знаю сколько там русскоязычных запросов.
2. По некоторым ключевым словам можно хорошо проверить полное количество фраз и поисков через сам Rambler (они дают срезы по окн*).
Так что всё легко проверяется.
Есть проект www.seodream.com . Уже был тестовый запуск со сканом Top100К поисковых фраз. В ближайшие дни будет приведён в порядок сервис и сделан очередной скан Гугля. На этот раз по Top1М фраз (по версии Overture). Войдут все слова с 400 запросами в месяц и более. Информация о результатах скана будет опубликована в ветке /ru/forum/optimization-practices/services
P.S. Ищутся базы: Rambler и Wordtracker (Top500K).