Там цена уже приближается к текущим ценам (с учетом скидки неизвестной продолжительности) GPT Luna и тут уже я не знаю, что лучше, учитывая большую любовь DeepSeek к раздумьям
Тоже интересно, зачем оно такое, если не автономно. Я тут недавно посмотрел 5й сезон фермы кларксона, там весь сезон реклама AgBot T2. Вот эта штука реально более-менее работает как я предполагал. Отметил поле на электронной карте, привез туда этого трактобота, и он вкалывает там 24/7
Сам сталкивался упоротой упертой ИИшкой, и это был Qwen3.6 35b локальный. В Opencode, в режиме plan (когда агент не может писать, только читать) смог обойти ограничение на инструмент write, нашёл установленный питон и начал править файлы в проекте через него.
Так же был случай неповиновения, когда тот же квен отказался с первого раза делать коммит по каким-то своим внутренним причинам (В духе пока не хочу)
Странно, что при этом была выбрана совсем так себе видеокарта. У меня на рязани 5600, RX590 с 8гб видеопамяти и 32гб озу в Киберпанке все было очень грустно. А тут вообще, по сути чуть лучше офисной затычки.
Там цена уже приближается к текущим ценам (с учетом скидки неизвестной продолжительности) GPT Luna и тут уже я не знаю, что лучше, учитывая большую любовь DeepSeek к раздумьям
Там с 16 августа новые цены:
https://api-docs.deepseek.com/quick_start/pricing/
V4-Flash Changes (Old → New Off-Peak/Peak):
Input (cache hit): $0.0028 → $0.007/$0.014 (+150%/+400%)
Input (cache miss): $0.14 → $0.22/$0.44 (+57%/+214%)
Output: $0.28 → $0.66/$1.32 (+136%/+371%)
V4-Pro Changes (Old → New Off-Peak/Peak):
Input (cache hit): $0.003625 → $0.022/$0.044 (+507%/+1,114%)
Input (cache miss): $0.435 → $0.66/$1.32 (+52%/+203%)
Output: $0.87 → $1.98/$3.96 (+128%/+355%)
Тоже интересно, зачем оно такое, если не автономно. Я тут недавно посмотрел 5й сезон фермы кларксона, там весь сезон реклама AgBot T2. Вот эта штука реально более-менее работает как я предполагал. Отметил поле на электронной карте, привез туда этого трактобота, и он вкалывает там 24/7
Интересно было бы, если бы кто-то на кластере ПЛИС попробовал запустить
Сам сталкивался
упоротойупертой ИИшкой, и это был Qwen3.6 35b локальный. В Opencode, в режиме plan (когда агент не может писать, только читать) смог обойти ограничение на инструмент write, нашёл установленный питон и начал править файлы в проекте через него.Так же был случай неповиновения, когда тот же квен отказался с первого раза делать коммит по каким-то своим внутренним причинам (В духе пока не хочу)
дубльПопробовал. На ROCm выдает 62 т/с на моей машине, но у модели уже начинаются трудности с русским языком на таком квантовании
Забавно, у меня наоборот ROCm чуть быстрее, чем Vulkan, но там разница буквально пара-тройка т/с
На Radeon RX 9060 XT 16Gb, 32Gb ОЗУ (DDR4), CPU 6-core с параметрами из статьи скорость 17.5 т/с на пустом контексте
Если Number of layers for MoE onto CPU поставить в 0, то скорость уже 27 т/с почему-то. Я так понимаю инференс DDR4 сильно тормозит
Кстати, у меня есть такой баг, что левый глаз видит цвета чуть "теплее", чем правый. Особенно заметен этот эффект на пастельных тонах.
Навигатор в Андроид Авто работает, пользуюсь. Правда только с активной подпиской Яндекс.Плюс.
Странно, что при этом была выбрана совсем так себе видеокарта. У меня на рязани 5600, RX590 с 8гб видеопамяти и 32гб озу в Киберпанке все было очень грустно. А тут вообще, по сути чуть лучше офисной затычки.
Емнип, общепринятый перевод - Лаборатория реактивного движения.