Pull to refresh

Comments 13

Интересно, но хотелось бы поглядеть на тесты против других моделей (хотя бы того же Gemini, старого 3.1 Pro и нового Flash 3.7). И в статье нет ничего про то, на какой карточке гоняете, и каковы очки на конкретных задачах (кодинг, документы, иное).

добрый день,
сейчас в тесте RTX PRO 6000 от Селектел, актуальный бенчмарк на ней.

Gemini в личных целях почти не использую, но записал запрос :)

Штука по цене 1.8 мегарубля - это СВОЯ карта?! Богато живёте :)

Тут что-то непонятно. Человек прикидывает срок окупаемости DGX Spark словно не в курсе что есть пути попроще - подписки, те же дисцилляты, но удаленно и бесплатно. ХЗ. Ну захотел поделиться результатом трудов - спасибо, интересно.

две DGX Spark, ~700 тысяч рублей

А интернет говорит что одна DGX Spark ~700 тысяч рублей :)

Писать чекпойнт, пойнт так же безграмотно, как андройд.

Самое смешное, что в нормативных словарях записан именно такой вариант. (Страница 3043 в орфографическом словаре от института русского языка им. Виноградова)

Ну просто долбени, которые не слышат как говорят, записали туда.

А ещё локальный Qwen3.8-27B может работать с изображениями, а локальный DeepSeek не может. Не знаю, как там по API.

не нашел что за карта использовалась. У меня ollama на 3090 дает 47-50 tps.

У меня тоже 3090 , но такого TPS я не достиг, подскажите какой движок используете (llama.cpp, vlm , ...) если можно ссылку на hf модели (gguf же?) , там и квант будет понятен и чей форк (unsloth?) или lmstudio-community ? И главное параметры запуска(загрузки) какие?

Дуал 2080ti с nvlink даёт до 100т/с на qwen 27b в q8. Контекст близкий к максимальному. Учитывая цену, сейчас это топ комплект для плотного квена. За последние 2 недели цены выросли % на 30. Чуть дешевле пара 3070м на 16гб, но скорость +-35 т/с в однопотоке, двухпоток 2х скорости.

Sign up to leave a comment.

Articles