LLM - Использование нейросетей в работе. Кодинг, администрирование, безопасность, хостинг, статистика

A
На сайте с 21.04.2007
Offline
154
#101
Sly32 #:
Да мог бы и не начинать. давай, ткни пальчиков  по твоей линке - где конкретно там про экономию токенов? Тебя никак не смутил, что прайс есть только на исходящие токены?
Зачем, английский ты не знаешь, читаешь плохо, поиском пользоваться не умеешь, ведешь себя как быдлан. Так зачем что-то объяснять?!
S3
На сайте с 29.03.2012
Offline
399
#102
apis #:
Зачем, английский ты не знаешь, читаешь плохо, поиском пользоваться не умеешь, ведешь себя как быдлан. Так зачем что-то объяснять?!
Тебе нечего обьяснять - было бы - уже бы давно сделал это. Я задал конкретный вопрос - как твоя ссылка  помогает экономить токены в трансформерах.  Ты перешел на личности и оценку знаний мной английского, на котором я работаю. По твоей ссылке - НЕ трансформер - эта модел НЕ умеет генерировать текст.  Если бы ты хотел выразить какую-то мысль, то подобрал бы более удачный пример. На каком основании ты мне что-то приписываешь? Я указал тебе на то что ты не дал како-либо полезной инфы, а я перешел по твоей ссылке и внимательнпочитал что это за система. 
S3
На сайте с 29.03.2012
Offline
399
#103
Погружение в своего агента идет полным ходом, писать на Расте довольно забавно, хотя я все равно поклонник ООП языков. Написал агенту кучу тулов, причем последние  уже писал по протоколу MCP. Теперь кроме проверки почты и календаря он умеет найти в интернете сайт, посмотреть его, рассказать о чем. Причем даже с локальными моделями.  Пока что лучшее что нашел - qwen3:8b-q8_0, gpt-oss:20b, deepseek-r1:14b, для qwen3.8:27b не хватает памяти для нормальной работы все таки, непонятно, потому что примерно такой же  gpt-oss:20b вполне себе тянет.  Но это все баловство для тестов, нормально работать только с облачными. 

Авторизуйтесь или зарегистрируйтесь, чтобы оставить комментарий