Что может, что не может AI. Обсуждаем возможности, делимся опытом, спорим, но в рамках приличия.

Александр Воробьев
На сайте с 03.02.2020
Offline
69
#2401
MrPi #:
Какие требования? Интересует комфортная работа. Сколько стоит ПК собрать под норм кодинг?
Присоединяюсь к вопросу. Как я понимаю "основные" критерии: характеристики видео карты и объем оперативки.
master32
На сайте с 09.02.2022
Offline
140
#2402
MrPi #:
Интересует комфортная работа
понятие относительное)
можно запустить на 5080 квантизированную(урезанную) модель и получить 5-15 токенов в секунуду
мимнимальная сборка от 200-250к руб
и это не окупается в сравнении с тем, если покупать токены у провайдеров)
локально запускать имеет смысл, если у тебя уже есть железо, и урезанная модель уже закрывает какую-то задачу

MP
На сайте с 05.05.2025
Offline
27
#2403
master32 #:
понятие относительное)
можно запустить на 5080 квантизированную(урезанную) модель и получить 5-15 токенов в секунуду
мимнимальная сборка от 200-250к руб
и это не окупается в сравнении с тем, если покупать токены у провайдеров)
локально запускать имеет смысл, если у тебя уже есть железо, и урезанная модель уже закрывает какую-то задачу

Ну да. Даже по 100$ за антропиков это 2.3 года работы. 

S3
На сайте с 29.03.2012
Offline
399
#2404
Александр Воробьев #:
Присоединяюсь к вопросу. Как я понимаю "основные" критерии: характеристики видео карты и объем оперативки.

Я qwen 3.8:27b  запустил на Макбук Про М4 24 RAM,  но для этого пришлось повыгружать сначала все. Использовал LM Studio/Bionic. Некоторые задачи закрывать можно, генерация до 25 токенов/сек.  Нашел ее под ollama,  качаю, потом отпишусь - поднимется или нета вот gpt-oss:20b

позволяет комфортно стартовать на моем маке вместе с vscode/colima/docker и вполне комфортно работать. Конечно до хотя бы gpt-5.6-Luna ей далеко но оставил в коллекции - иногда отдаю ей несложные задачи. 

MrPi #:
Ну да. Даже по 100$ за антропиков это 2.3 года работы. 

У меня в месяц в 3 раза больше уходит

upd. через оллама запустилась но это не про комфортную работу. Простой вопрос начисто выжирает все ресурсы даже на моей машине

S3
На сайте с 29.03.2012
Offline
399
#2405

Кто там говорил что художники без работы не останутся?

pavlkonst
На сайте с 22.05.2025
Offline
24
#2406
master32 #:
мимнимальная сборка от 200-250к руб
Железо устареет быстрее, чем успеет окупиться на разнице в стоимости токенов. Через год облачные провайдеры выкатят новое поколение с огромным контекстом за копейки, а на руках останется горячий системник за четверть миллиона с урезанной сеткой на 15 токенов в секунду
Artisan
На сайте с 04.03.2005
Offline
392
#2407
Sly32 #:

Кто там говорил что художники без работы не останутся?

Точно как я писал выше, специальное железо для механического разума, дополнительные конечности для разных задач, удалённая связь между мозгом и телом, и люди не смогут соревноваться с такими существами.

www.leak.info / изучайте даром входящие указатели конкурентов и забытых доменов. █ Есть хороший способ подработки для умных людей, обучение даром, вопросы в личку.
master32
На сайте с 09.02.2022
Offline
140
#2408
pavlkonst #:
Железо устареет быстрее, чем успеет окупиться на разнице в стоимости токенов. Через год облачные провайдеры выкатят новое поколение с огромным контекстом за копейки, а на руках останется горячий системник за четверть миллиона с урезанной сеткой на 15 токенов в секунду
да это условности, например 2-3 года назад прикупил 4090 за 200к, окупилась ~х8, к сожалению масштабировать не получается, нужен сильный маркетинг, а его нет)

A
На сайте с 21.04.2007
Offline
154
#2409
Astra = Opus 5, своих денег не стоит. Поспешность в суждениях, самовольное ссужение задачи. Последней каплей было отказ снятия блокировки авторевью, ссылаясь на то что он не может и не в его силах, сменил на Sol тот исправил. Astra стоит рассматривать как бестолковую и переходную модель и пользоваться Sol Ultra.
UD
На сайте с 05.03.2016
Offline
79
#2410
Sly32 #:

Я qwen 3.8:27b  запустил на Макбук Про М4 24 RAM,  но для этого пришлось повыгружать сначала все. Использовал LM Studio/Bionic. Некоторые задачи закрывать можно, генерация до 25 токенов/сек.  Нашел ее под ollama,  качаю, потом отпишусь - поднимется или нета вот gpt-oss:20b

позволяет комфортно стартовать на моем маке вместе с vscode/colima/docker и вполне комфортно работать. Конечно до хотя бы gpt-5.6-Luna ей далеко но оставил в коллекции - иногда отдаю ей несложные задачи. 

У меня в месяц в 3 раза больше уходит

upd. через оллама запустилась но это не про комфортную работу. Простой вопрос начисто выжирает все ресурсы даже на моей машине

На что тратите, если не секрет? Мне на ai saas поддержку и внедрение фич хватает в целом подписки за сотню баксов, при этом всегда фронтирная модель, максимальное размышление. Фейбл да, хватает ненамного, но и Опус хорош.

Для разработки с нуля сервиса пришлось брать бы 200$, но это все-равно немного. Команда программистов стоила бы от сотен тысяч рублей до миллиона и выше в месяц, а модель мне ведет еще сео, маркетинг, дизайн и прочее. 

Авторизуйтесь или зарегистрируйтесь, чтобы оставить комментарий