Антоний Казанский

Антоний Казанский
Рейтинг
826
Регистрация
12.04.2007
Должность
Частный интернет-маркетолог и SEO специалист
Интересы
Интернет-маркетинг, продуктовое SEO, бизнес аналитика
Влюблён в работу, помогаю бизнесам развивать сайты :)
Barrboss #:
Давайте в конкретику

Здесь нет предмета для долгих сторонних разговоров. На AI невозможно повлиять, чтобы он не ошибался. На человека - можно. Вот и вся конкретика.

Barrboss #:
А кого можно? :))))

Кого можно что? Призвать к ответственности? Любого, кто получает оплату за твой труд.


Barrboss #:
Ни один директолог или сеошник в здравом уме не подпишет договор с конкретной ответственностью за результат, равно как и программист 

У меня написано - призвать к ответственности, а не уговорить подписать договор :)

Но посыл понятен, если основательно в него углубиться - и платящий не подпишется за конкретную ответственность в той части задач, которая возлагается на него. Но это уже другая тема, а здесь по AI.

ArmenDomain #:
Нужно переписывать сайты на собственные коды которые не читают ИИ.

Два вопроса:

1) Зачем?

2) Что за собственные коды, которые не читают ИИ?

То, что ИИ может запороть легали код - понятно, но что за зверь такой, который даже ИИ не читает?

Andrew Z #:
noindex, follow или noindex, nofollow?

Указано выше,

Антоний Казанский #:
настраиваете noindex, follow на страницы фильтров
Ponyk #:
поисковик сам разберëтся что и как брать

Нет, поисковик по кругу будет индексировать страницы и выплёвывать. Cамо собой это не разрулится.

Вот как раз свежий пример, без должной подготовки залили новую версию сайта и страницы тысячами "гуляют туда-сюда".


Andrew Z #:
Подскажите пожалуйста, я правильно понимаю, что предпочтительнее ставить на фильтрах  noindex, follow или можно сделать проще и в Robots поставить директиву Disallow: *? . По мне так поставить директиву в Robots проще, или есть в этом какой-то минус?  

Минус (а скорее нюанс) в том, что Гугл может игнорировать инструкции robots.txt, а вот запрет в мета (или в коде ответа сервера) и Яндекс, и Гугл учитывают корректно, поэтому возвращаясь к первоначальному совету Леонида - настраиваете noindex, follow на страницы фильтров и в принципе robots.txt можно не менять.

Запрет Disallow физические запрещает обходить страницы, но Гугл может игнорировать эту директиву. 

Andrew Z :
Поскольку таких ID (vid_..., cvet_...) сотни

И это довольно неудачная реализация, потому что id надо выносить в значение get параметра, а не в имя get параметра.

В вашем случае действительно проблемно настроить clean-param, потому что вариаций имён самих get параметров множество.

С самого начало, нужно было реализовывать /?color=значение&size=значение


Andrew Z #:
На сколько я знаю данные страницы(https://partnertorg.com/mebel-dlya-vannoy-komnaty?s[cvet_956][0]=191355509) лучше склеивать для веса с главной страницей, или нет?

Нет.

1) У вас в примере выше не Главная, а внутренняя страница.

2) Веса склеиваются через 301 редирект, других вариантов нет.

3) Страницы фильтров не склеивают, они либо не учитываются в индексации по clean-param, либо в настройках меta тегов (noindex), либо запрет индексации через код ответа сервера, либо через robots.txt (но тут Гугл может игнорировать директивы запрета индексации).


Andrew Z #:
Но учитывая то, что система формирует таких страниц десятки, а то и сотни, перечислять их все вручную в robots.txt для директивы Clean param - невозможно. В этом и вопрос. 

Да, потому что реализовывать навигацию с самого начало нужно было с seo специалистом, а не как в моменте захотел программист.

LEOnidUKG вам правильно подсказал - ставьте задачу программисту, чтобы страницы фильтров выводились noindex, follow.

Для индекса эти страницы не нужны, они бесконечно будут генерировать по параметрам фильтра. Буду залетать в индекс и вылетать из него по кругу. Такие явления надо пресекать.

Andrew Z :
Бытует мнение, что лучше ставить Cleanparam, якобы Яндекс обрезает  гет параметры и склеивает их с основной страницей.

Да, get параметры обрабатываются Clean-param. И не якобы, а Яндекс вполне конкретно обрезает до канонических адресов, если правильно настроить.


Andrew Z :
Но если обратиться по этому вопросу в тот же Нейровебмастер Яндекса или поддержку самого Яндекса, то говорят что индексация данных страниц принесет только вред чем пользу.

Вы не разобрались до конца в вопросе, эти страницы (с get параметрами) и не будут индексироваться благодаря настройкам Clean-param.

p.s. 

Но, судя по тому, что вы написал здесь, для вас более актуальное актуальное решение тут.

Lazy Badger #:
Проше пана, ну нельзя так! Наличие результата никоим образом не дает генератору этого результата субъектности,

Я не случайно уточнить, что на него полагаются, как на результат субъектности и не потому что он в привычном смысле им является, а потом что так проще определять AI как явление. В целом, я думаю, это вопрос времени. В предстоящем будущем скорее всего обяжут юридически разделять продукт произведённый с помощью AI (хотя бы для урегулирования вопросов по авторскому праву) и всё остальное. 


Lazy Badger #:
а этак вы любой рукотворной программе выдадите субъектность

Нет, я - не дам :) Это слишком вольный вывод из моих слов :)


Lazy Badger #:
Вот эти обывательские миражи по поводу LLM и надо разгонять из мозгов: "не опыт, а комбинаторика и только на корпусе известного" (ну с точностью тезиса процентов в 95%, не 100)

Про комбинаторику тоже понятно, но одно дело комбинировать в рамка опыта одного человека, другое дело - общность всех доступных знаний. А обучают LLM не для того, чтобы они быстрее "комбинаторили", а чтобы полнота данных повышала качество ответов. Доступные данные и есть совокупный опыт. Понятно, что по сути, это не человеческий опыт, а просто массив данных из разных источников с разной степенью подверженности. Я на намеренное использую привычные для человеческого сознания понятия, которые помогут "приземлить" применительную практику.

Если бы такой задачи не было, все по прежнему говорили бы про разные степени нейробреда. 

А так добрая часть it-шников уже в лёгкой панике, что их заменят :) 

Lazy Badger #:
Это не проблемы

Это проблемы, потому что в большинстве случаев на AI полагаются не просто как на абстрактный массив данных, а как на интеллектуальный результат, следовательно на него полагаются как на субъект, хоть и безличностный, хоть и безвольный.

Док-во очень простое, предполагается, что AI обладает условным совокупным опытом в рамках целевой задачи.

Никто не смотрит на результат работы AI как на случай бессмысленного рандомайза, где с какой-то долей вероятности можно найти случайно образовавшуюся полезность.


Lazy Badger #:
а вторая — не "нерешаемая", так как нет у LLM субъектности, т.е. это не проблема, а статическое состояние

Это уже философия и как говорится, в такую задницу можно вдувать смыслы с любой стороны.

LLM не рассматривается как детский калейдоскоп, который при вращении развлекает причудливыми сочетанием случайно упавших разноцветных камушкофф и их отражением.

На LLM надежда как на практически применимый инструмент и когда в этих результатах AI открыто признается - да, результат не годится, - вот тебе ещё один вариант с такими же отсутствующими гарантиями на достоверность, то, извините, это не может не быть проблемой.  

Всего: 13420