Sly32

Рейтинг
391
Регистрация
29.03.2012
Должность
Software engineer
Slav_on #:
Разумеется нет! Некоторые особо жадные сети льют в канистру если она куплена у них на заправке. Объясняют вполне логично «Малоли где Вы там свою канистру возили и покупали! У нас гарантированно безопасная тара.» просто раньше, не знаю правда или нет, но при покупке 5-10 литров топлива в канистру потребитель узнавал что колонка отпустила ему 4-8,5 литров, а на утро в канистре был осадок из воды, грязи, и почего.
Спасибо, что обьяснили. Значит все в порядке. А то тут злопыхатели пишут что продажи новых автомбилей в июне упали на 16% легковые и на 10% коммерческие. Причем в самый сезон продаж. Уверен что это никак не связано. Продолжайте наблюдение.
ArbNet #:

Я изучил как работают алгоритмы нейросетей. В них слова разбиваются на токены от 2 до нескольких символов в зависимости от частоты наличия в словах. Таких токенов около 50000. Для обучения такой сети нужно очень и очень много данных и времени на обучение и тд. Подход для llm не плохой но слишком затратный и очень много лишней работы при генерации ответа, то есть надо просчитывать все 50000 на каждой итерации..

Я тестил другой подход. Эти функции это прототипы, 64 это токенов русских букв строчных и заглавных без и́ё. Я кодирую слово в числа, а не разбиваю на части токенов по несколько букв. Подход удачный получился. Потом я стал думать как сделать больше токенов для символов и переделал функции кодировки. Понял, что эти прототипы корявые с неправильной формулой. И это на самом деле не единственный случай. У меня так с ИИ постоянно, всё переписываю по своему.

ЗЫ. Да, ИИшный код можно использовать, но по хорошему если подумать, то лучше не надо, лучше свой написать.

Хочешь, я тебе обьясню буквально в 3-х абзацах, почему это не сработает? Пошли в челлендж тему - тут это лишнее. Помнишь, я тее про мамбу писал.  И если бы ты изучил реально то знал бы, что сейчас воспроизводишь метод кодирования, который  давно уже разрабатывался и прищнан неэффективным  для трансформера. 
ArbNet #:
Да в коде есть ограничение на 10 символов и он рабочий,
ArbNet #:
Да, сначала сама пишет с ошибками, потом находит и исправляет

Тебе сделали то, что ты попросил - это раз. То есть это не ошибка нейросети а твоя как постановщика задачи. И два - повторюсь - не используй дешевые поделки китайские а также алису на их базе - они отстают на 2-3 года от нормальных моделей. Лично у меня Sonnet 5  сразу нашел ошибки в твоем коде  и они посерьезнее переполнения.

Нейросеть за тебя не думает - она следует твоим указаниям. Если ты не понимаешь что делаешь - то и результат такой же. И я не понимаю зачем что-то писать уровня задач для обучающихся на LeetCode - это не идея никакая

ArbNet #:
На каждой итерации результат умножается на основание!!
Еще раз - начни с математики!
Даже на последней, 10-й итерации, перед самим умножением result не превышает 64⁹ − 1 ≈ 1.8 × 10¹⁶ — это на три порядка меньше u64::MAX . Умножение result * 64 в худшем случае даёт ≈ 1.15 × 10¹⁸ , что всё ещё почти в 16 раз меньше предела u64

ArbNet #:
Для того кто не соображает, это идеальный код и он его будет применять..
Ты это в алисе что ди писал? Это код в принципе с ошибками. переполнение как раз не проблема. 
при max_len = 10 , основание 64 переполнения быть не может.

Максимально возможное значение result после 10 итераций — это 64^10 - 1 :

64^10 = 2^60 ≈ 1.15 × 10^18
u64::MAX = 2^64 - 1 ≈ 1.8 × 10^19

2^60 почти в 16 раз меньше u64::MAX . То есть даже если на каждом шаге брать максимальный код (63) и пройти все 10 символов, итоговое число уместится в u64 с большим запасом.


Может начни с математики?
Slav_on #:
Раньше тоже не наливали в канистры. Это если хотите современный тренд жаловаться на то что не льют в канистры. Были и остаются ограничения:
Понятно, спасибо, то есть в обычную металлическую канистру как наливали так  и сейчас нальют на любой заправке в стране?
romancher #:
На на обычных сетевых не льют в канистры, а мне нужно для квадроцикла и газонокосилки
А раньше наливали или это у вас всегда так?
romancher #:
Ну это последнюю неделю, и то небольшие очереди по 2-3 машины на колонку еще осталось, до этого большинство заправок было с очередями, ну и некоторые пустые были (особенно татнефть). Сегодня канистры 95 заправлял по 125, так и не снижают цены на ноунейм заправках, даже с учетом того что на остальных очередей почти нет.

А что заставило заправляться в 2 раза дороже?

LikeAVirgin #:

Извини, у меня в голове это с чанками, векторами и эмбедингами связано. 😀 Rag - это когда ответ не детеминирован. Не обращай внимания.

Это в корне неверно, РАГ вообще не описывается словами детерменирован-не детерменирован. Более того РАГ   даже не имеет точной спецификации. Это в принципе генерация дополненной информации, а 
LikeAVirgin #:
чанками, векторами и эмбедингами

Это просто один из методов. кроме тех что я описал их еще с десяток есть.

LikeAVirgin #:

А мне это как раз и нужно. В юридической тематике пользователи не платят за варитивность. Только за конкретные ответы с пруфами. Т. е. грубо говоря это узкая тематика, которая жёстко привязана к кокретной технике. Вот эта связка техника+юрисдикция создаёт НЧ. И пользователь получает из сервиса индивидуальную сборку ответов под свои нужды. Одним словом: он может сам несколько недель бесплатно поискать, сравнить, проверить. Или он получает это за плату прямо сразу. 😉

И все верно. Я ошибся ровно наоборот. снижает и очень сильно мой подход. Ирония судбьы - я как раз и занимаюсь  работой с Westlaw. Юриспруденция на основе законов и прецендентов. И именно этот подход обеспечивает релевантность документов. 
LikeAVirgin #:
И да RAG  я не осилила в этой тематике. Другой сервис на RAG хорошо пошёл, но там другая тема, психология.

Ты точно понимаешь, что такое RAG, извини? То что ты описала - он и есть - генерация с дополненной выборкой. Просто ты используешь очень примитивный механизм, я же описал более серьезный подход. Но это именно генерация документа, не поиск по базе. А полноценный ответ, как на консультации у юриста.

Всего: 8310