Чем создать sitemap.xml для гугла

[Удален]
#31

можно воспользоваться гугловским скриптом, который написан на питоне.

заливается на хостинг, настраивается, прописывается в планировщик задач (crontab,etc) и всё прекрасно работает

https://www.google.com/webmasters/tools/docs/en/sitemap-generator.html

Scanter
На сайте с 27.07.2006
Offline
107
#32
evg_pits:

Ne ponimau togda, zachem muchatsia s kartoy?

если у тебя страниц менше 5к и хорошая перелинковка - можно и не делать...

one
На сайте с 15.04.2007
Offline
336
one
#33
AlexSatter:
можно воспользоваться гугловским скриптом, который написан на питоне.
заливается на хостинг, настраивается, прописывается в планировщик задач (crontab,etc) и всё прекрасно работает
https://www.google.com/webmasters/tools/docs/en/sitemap-generator.html

Нагружает сервак сильно... Я свои сайт с ~100к страницами все никак немог нормально впихнуть в сайтмэп... До сих пор немогу найти ничего стоящего. Даже прикупил Sitemap Writer Pro 42 в надеже что поможет... фик там...

one добавил 29.03.2008 в 02:53

D@nil:


Простенький сервис генерации карты сайта.
http://sitemap.nildesign.ru/

использую для своих сайтиков.

И это все?

sitemap.xml:

<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.google.com/schemas/sitemap/0.84">
</urlset>
Решения для автоматизации действий ( https://www.facebook.com/automationstudio20/ ) в интернете.
softsp
На сайте с 07.01.2008
Offline
44
#34
AlexSatter:
можно воспользоваться гугловским скриптом, который написан на питоне.
заливается на хостинг, настраивается, прописывается в планировщик задач (crontab,etc) и всё прекрасно работает
https://www.google.com/webmasters/tools/docs/en/sitemap-generator.html

есть неплохой солюшин здесь http://software-guides.info/index.php/staty/11-statyi/38-google-auto-sitemap.html

Общаясь со специалистами, я понял - никакие они нахрен не специалисты (Guy Ritchie) Полезные предложения (http://vippartners.ru/) | Заработок на тизерах (http://vippartners.ru/teaser/) | Показы EroTizer (http://seorega.ru/erotizer)
kardens
На сайте с 09.07.2006
Offline
136
#35

Не первый год пользуюсь http://www.freesitemapgenerator.com/. Очень работоспособная система и карты для гугля делает хорошие. Если открыть баланс на символическую сумму, все будет делать на автомате. Вообщем - рекомендую.

Если снизу посмотреть, то сверху можно подумать, что сбоку не видно...
M
На сайте с 05.03.2006
Offline
80
#36

Понимаю что немножко не в тему с карту сайта, но связано с индексации сайта в Гугл.

На днях попал на интересную статью про то как сделать так, что Гугл быстрo проиндексировал сайт от 200к страниц например.

Статья в перевод с англиского, думаю многим будет интересно и кажды найдет что то новое для себя.

После того, как вы создадите сайт-хамелеон или отбеливатель ссылок, вам наверняка придется решить проблему его индексирования в поисковых системах. Возможно, вам еще не приходилось работать с большими сайтами, в которых больше 20k страниц, но, поверьте мне, проиндексировать их не так уж и сложно. Единственное, что я должен отметить, некоторые из приведенных ниже методов лучше всего подходят для сайтов с числом страниц от 20 до 200 тыс. страниц. Для сайтов, у которых больше или меньше страниц, нужно использовать немного иные методы.
Посещение сайта поисковыми ботами

Здесь нужно отметить два важных аспекта. Первый это структура сайта.
Вы должны так организовать сайт, чтобы максимально облегчить ботам работу по его индексированию. Для этого вы должны создать так называемые “узловые” страницы. Узловые страницы — это страницы со ссылками на внутренние страницы. Например, для сайта каталогов узловой страницей можно считать страницу, внизу которой стоит блок ссылок: “Pages 1, 2, 3, 4, …“. Единственная цель и ценность узловой страницы в том, что она помогает проиндексировать другие страницы сайта. Если вам нужно проиндексировать большой сайт, сначала проиндексируйте узловые страницы, и остальные страницы последуют за ними.

Второй важный фактор — количество посещений сайта поисковыми ботами.
Чем больше объем ботового трафика, тем быстрее проиндексируются страницы сайта. Хотя сам объем не играет большого значения: какой толк от того, что боты будут бомбардировать главную страницу сайта и не будут заходить на внутренние? Вы должны направить ботов, куда вам нужно, и здесь очень важна структура, о которой я рассказал выше.

Статистика по одному из сайтов Эли

Это скриншот со статистикой одного из моих сайтов-хамелеонов, которому всего 10 дней от роду. Обратных ссылок на него совсем немного, однако это не помешало ботам за 6 дней проиндексировать 10k+ страниц.

Как я уже говорил, сделать это совсем не сложно. Для начала мы займемся базовыми вещами, затем перейдем к более продвинутым приемам и закончим тем, что я называю “сайтами-индексаторами”. Что из всего этого использовать, решать вам. Если вы не готовы применять тот или иной прием или у вас пока нет для этого достаточных знаний, остановитесь на более простых вариантах.
Внутренние ссылки на целевых страницах

Это самое простое, что можно придумать. Давайте вернемся к нашему сайту-хамелеону с партнерскими ссылками на сайта знакомств. Там каждая целевая страница представляет какой-то город. И на каждой странице есть (или можно поставить) ссылки на близлежащие города. (Для этого можно использовать выборку по ZIP-кодам или же вытягивать из базы записи, расположенные до и после ряда, которому соответствует указанный город.) Это позволит поисковым ботам переходить с одной целевой страницы на другую до тех пор, пока не проиндексируют все страницы сайта.
Обратная и/или вращающаяся карта сайта

Наверняка вы уже прикрутили простенькую карту сайта к своему сайту, и теперь она ссылается на все страницы ресурса. Говорят, поисковые боты относятся к картам сайта иначе, чем к другим страницам в плане количества ссылок, по которым они готовы перейти, но когда у вас есть 20k страниц и все их нужно проиндексировать, стандартная карта может оказаться малоэффективной.

Если мы отталкиваемся от того факта, что бот переходит только по определенному количеству ссылок с карты сайта, значит, нам нужно сделать так, чтобы он каким-то образом охватил все ссылки. Если у вас небольшой ресурс на 5k страниц, вам вряд ли придется об этом беспокоиться, но если у вас сайт-хамелеон на 30k+ адресов, стандартная карта сайта может оказаться бесполезной тратой времени. Дело в том, что ссылки с главной страницы ведут на внутренние страницы с низким порядковым номером в базе данных. Точно так же устроена и карта сайта — сначала она выдает первые ряды в базе, затем последние. В такой ситуации боты будут ходить по одним и тем же страницам.

Чтобы решить проблему, разверните карту сайта на 180 градусов. Для этого в базе данных замените ORDER BY ‘id’ на ORDER BY ‘id’ DESC (атрибут DESC подразумевает то, что последние страницы будут отображаться первыми, а первые — последними). Так страницы, которые, как правило, плетутся в хвосте карты, сразу привлекут на себя внимание ботов, и те их быстренько проиндексируют. Если с внутренней перелинковкой проблем нет, боты будут индексировать страницы с обеих сторон базы данных и со временем сойдутся в центре. В таком случае полная индексация сайта произойдет намного быстрее, чем если бы боты постепенно шли с первых страниц и до последних.

Еще лучше сделать вращающуюся карту сайта. Допустим, у вас есть 30k страниц. В течение первой недели расположение страниц на карте должно выглядеть так: 30,000-1. Затем вы берете первые 5k страниц и переносите их в конец карты. Теперь карта выглядит так: 25,000-1:30,000-25,001. В начале третьей недели вы снова прокручиваете карту и теперь она имеет вид: 20,000-1:30,30,000-20,001. И так до конца. Этот метод весьма эффективен.
Ссылки на внутренние страницы с других сайтов

Этот метод тоже позволяет существенно увеличить объем ботового трафика на внутренних страницах сайта. Благодаря ему вы сможете ткнуть ботов носом в те участки, которые они упорно не хотят индексировать. Чтобы операция прошла успешно, ставьте ссылки на узловые страницы. Ссылки могут быть идти как с ваших собственных, так и со сторонних ресурсов.
Сайты-индексаторы

Это самая эффективная тактика индексирования из всех, что я описал в этом посте. Сайт-индексатор — это специальный сайт, который вытягивает контент с других ваших сайтов, индексирует свои внутренние страницы и затем самообновляется — закрывает проиндексированные страницы и подхватывает другие, непроиндексированные. Создание такого сайта не займет много времени, однако для этого нужно разбираться в коде.

Сначала вам нужно создать главную страницу, которая будет ссылаться на 50-100 внутренних страниц. Каждая внутренняя страница будет наполняться контентом тех страниц из базы крупного сайта (например, сайта-хамелеона), которые вам нужно проиндексировать. Чтобы главную страницу сайта-индексатора не покидали поисковые боты, направьте на нее поток ссылочного веса с сайтов-отбеливателей ссылок.

После этого задайте команду cron, чтобы он ежедневно вытягивал из Google, Yahoo и MSN данные по запросу SITE:вашдомен.com. Создайте скрипт, который будет парсить результаты и сравнивать их со списком страниц на сайте-индексаторе. Как только страница будет проиндексирована во всех трех поисковиках, скрипт должен ставить на нее 301-й редирект, который будет вести на ее близнеца (целевую страницу с крупного сайта), и отмечать ее в базе данных как проиндексированную.
Теперь сайт-индексатор не будет обращать на нее внимание, и для создания новых внутренних станиц будет подхватывать только те страницы, которые еще не были проиндексированы каким-то (или всеми) из поисковиков. Такой сайт работает на автомате и в этом его настоящая ценность.

Сайт-индексатор будет трудиться до тех пор, пока все страницы крупного сайта не будут проиндексированы в основных поисковых системах. Этот метод работает настолько эффективно, что даже при полном отсутствии внешних ссылок на крупный сайт вы все равно сможете проиндексировать его внутренние страницы. Для этого вам понадобится всего несколько сайтов-индексаторов.

Взято от сюда

Удачи всем.

one
На сайте с 15.04.2007
Offline
336
one
#37
D@nil:
2one

а URL прописал?

Конечно!!!

one
На сайте с 15.04.2007
Offline
336
one
#38

Да нет... все осталось так же...

AK
На сайте с 31.03.2008
Offline
0
#39

Реально ли настроить автоматическую генрацию на сайте?

____________________________________________ gurutrade.com.ua
LE
На сайте с 16.04.2008
Offline
8
#40

У меня такой вопрос.

Создавал XML ручками, кинул туда главные категории с указанием частоты обновления каждой из них.

Поможет ли это в индексировании моего сайта?

И второй вопрос. В автоматических XML создателях, выбираешь как часто твои страницы обновляются, я ставил daily. Возникает вопрос, вот зашёл гугл раз по этим ссылкам, завтра или послезавтра ещё раз - ничего не обновилось, как он дальше себя поведёт?

И третий вопрос.

<lastmod>2008-05-25</lastmod>

Надо ли это значение самому постоянно обновлять, или гугл сам сообразит когда последнее обновление происходило.

Авторизуйтесь или зарегистрируйтесь, чтобы оставить комментарий