- Поисковые системы
- Практика оптимизации
- Трафик для сайтов
- Монетизация сайтов
- Сайтостроение
- Социальный Маркетинг
- Общение профессионалов
- Биржа и продажа
- Финансовые объявления
- Работа на постоянной основе
- Сайты - покупка, продажа
- Соцсети: страницы, группы, приложения
- Сайты без доменов
- Трафик, тизерная и баннерная реклама
- Продажа, оценка, регистрация доменов
- Ссылки - обмен, покупка, продажа
- Программы и скрипты
- Размещение статей
- Инфопродукты
- Прочие цифровые товары
- Работа и услуги для вебмастера
- Оптимизация, продвижение и аудит
- Ведение рекламных кампаний
- Услуги в области SMM
- Программирование
- Администрирование серверов и сайтов
- Прокси, ВПН, анонимайзеры, IP
- Платное обучение, вебинары
- Регистрация в каталогах
- Копирайтинг, переводы
- Дизайн
- Usability: консультации и аудит
- Изготовление сайтов
- Наполнение сайтов
- Прочие услуги
- Не про работу
В 2023 году 36,9% всех DDoS-атак пришлось на сферу финансов
А 24,9% – на сегмент электронной коммерции
Оксана Мамчуева
Как удалить плохие SEO-ссылки и очистить ссылочную массу сайта
Применяем отклонение ссылок
Сервис Rookee
Ты хочешь вообще уйти от трансформера с его слоями? Это будет что-то типа графа?
Блин, я реально как будто с ребёнком разговариваю который недавно услышал про нейросети.
У нейросети могут быть несколько слоёв, а слой может быть типа RNN, LSTM, Mamba, Transformer и др. все современные нейросети это гибридные нейросети, в них есть разные слои и тд. короче очень сложные системы. Для примера нейросети какого-то типа можно ИИ попросить написать код, но это примитивнейшие примеры работающие в основном с одним-двумя слоями на одном типе. Да можно усложнить задачу и попросить написать гибридную нейросеть, но тут начнутся проблемы, такой код не будет работать, не сможет генерировать осмысленные ответы..
ЗЫ. У меня есть мысли как что сделать, но это пока только мои предположения, чтобы их проверить нужно написать прототипы слоёв для моей нейросети, потестить и только потом я уже могу что-то сказать, а пока я не хочу рассказывать, что и как думаю сделать.
Поэтому разработчики нейросетей пошли по самому простому пути дробить слова на кусочки и прогнозировать ответы на основе предыдущего контента пересчитывая вероятности на каждой итерации все 50000 токенов для добавления нового кусочка\токена к ответу.
По мне это очень тупой способ требовательный больших вычислительных мощностей и много лишней работы(хотя на графических процессорах просчёт всех токенов происходит практически мгновенно за один такт, всё равно это очень много лишней работы).
У нейросети могут быть несколько слоёв, а слой может быть типа RNN, LSTM, Mamba, Transformer
"алго" + "ритм"? что такое BPE?
Молодец, у ИИ спросил как токены получаются. Да, приблизительно так.
Я тебе скажу - это линейная операция O(1) - самое дешевое в мире вычислений.
Тоже молодец, ИИ тебе лапшу навешает, ты и рад. Нет, не дешёвая это операция, да быстрая, на графическом процессоре это доли секунды, но когда это нужно совершать миллионы раз, то это очень дорогая операция.
ЗЫ. Не зря же вам токены продают.
Нет, не дешёвая это операция,
И давай счас не выяснять кто круче а обсуждать теорию твою и варианты решения. Мне это интересно.
в твоей системе что дает разбивка слов таким образом и что является минимальной единицей информации
Я не смогу это тебе объяснить, это как с фреймворком на XML(для меня это очевидно, а для тебя чтобы я не говорил, что это лучше, ты не можешь никак понять).
Если ты имеешь ввиду разбивку слов на части\токены как в LLM, то мог бы спросить у ИИ что это даёт, если в кратце, то такой способ минимизирует словарь и даёт возможность токенизировать слова которые не были в обучении, а так же создавать новые похожие слова которых тоже не было в обучении. Да это не плохой способ, но у него есть минус того, что всё же нужен словарь из ~50000 токенов и пересчёт каждого при добавлении нового токена в ответ.
обсуждать теорию твою и варианты решения. Мне это интересно.
К сожалению, я не вижу в тебе единомышленника. У тебя примитивные подходы, ты привык делать всё по готовым примерам, уж извини, но у меня сложилось о тебе именно такое мнение.
ЗЫ. У меня другой подход, пока я не хочу о нём рассказывать.
Да это не плохой способ, но у него есть минус того, что всё же нужен словарь из ~50000 токенов и пересчёт каждого при добавлении нового токена в ответ.
Я спрашивал тебя - как ты будешь свою разбивку по словам применять для ЛЛМ.
Пока что ты написал хеш для каждого символа, не более. Что не применяется в ЛЛМ по причине отсутствия связей между двумя хэшами.
У меня другой подход, пока я не хочу о нём рассказывать.
ты мне не обьясняй то чего не знаешь, хотя что нормальный токенайзер включает не 50 а до 126000 токенов.
Какая разница 50000 или 100000 я тебе просто сам смысл донести хотел, что нужно для всех токенов просчитывать логиты. Да в самых больших LLM 126000 токенов, а может и больше даже, это не имет в принципе значения. Ещё раз говорю для пассажиров бронепоезда, каждый раз надо все векторы весов этих токенов просчитывать чтобы к ответу добавить один из них и так пока не будет сгенерирован весь ответ!!
Я спрашивал тебя - как ты будешь свою разбивку по словам применять для ЛЛМ.
Пока что ты написал хеш для каждого символа, не более. Что не применяется в ЛЛМ по причине отсутствия связей между двумя хэшами.
Вообще всё мимо.. комментировать даже не буду эту чушь
Ну так в таком случе не выпендривайся тут. Это болтовня а не подход.
Снова тема скатилась в обсуждение нейронок, хотя название - Дефицит идей и деградация