Обновить
64K+

Видеокарты

Графические адаптеры

72,25
Рейтинг
Сначала показывать
Порог рейтинга
Уровень сложности

Инженерная тайна AMD из нулевых: что общего между Xbox 360, HTC HD2, Sony Ericsson Xperia Play и LG Optimus L2

Время на прочтение11 мин
Охват и читатели12K

Порой, когда погружаешься в исходный код драйверов и даташиты на железо, удивляешься тому, какие интересные инженерные решения использовались в устройствах прошлых лет. И пожалуй самым диковинным таким решением можно назвать подход AMD к разработке видеочипов в нулевых годах.

В этой статье всё как вы любите - подробная предыстория, анализ зацепок, изучение исходного кода и ответ на вопрос: что-же общего между коммуникатором из 2007'ого, смартфоном 2009'ого, ноутбуком 2012'ого и Xbox 360?

Читать далее

Новости

Blackview Gamibook 16 — самый честный обзор на ноутбук за 160к с RTX5060

Время на прочтение10 мин
Охват и читатели6.9K

В современных ноутбуках меня пугает только одно: в моделях дешевле 1.000$ чаще всего дискретного GPU вообще нет и роль видеоускорителя выполняет урезанный Arc/RDNA, а в некоторых случаях совсем уж слабый UHD Graphics. И хотя на современных встройках вполне можно поиграть в AAA года эдак до 2023'его, 720P гейминг на минималках даже с апскейлингом выглядит так себе на 2.5K матрице...

Недавно ребята из Blackview предложили на обзор свой новый ноутбук с RTX 5060, i7-13650HX и 300Гц 2.5K матрицей - Gamibook 16. Я решил сделать честный обзор - с бенчмарками в портативном/десктопном режиме, тесте игр, скорости компиляции проектов на C++/C#, а также разборкой и осмотром конструктива устройства. Интересно? Тогда жду вас под катом!

Читать далее

Самый подробный обзор AMD FSR (1-3): он лучше NVIDIA DLSS — и вот почему

Уровень сложностиСредний
Время на прочтение20 мин
Охват и читатели6.5K

Привет, постоянные и не очень читатели!

В первой части цикла я разобрал технологию DLSS во всех её версиях — с предпосылками и историей появления, байками и мемами про Хуанга и даже применением в бизнес-приложениях (чиво?). Материал вышел огромным, и, вероятно, самым подробным про DLSS в Рунете. Почитать можно здесь: «Судный день грядёт [часть 1]: глобальный разбор апскейлера DLSS — от игр к работе»

Теперь пора обозреть пролетарскую FSR (FidelityFX Super Resolution) — технологию улучшения изображения от AMD, которая, по моему мнению, превосходит DLSS от NVIDIA. Почему? Расскажу в конце статьи.

Дропдаун

Часть 4. Обошел еще одно ограничение NVIDIA: первым в мире включил P2P на CMP90HX, а помогли мне в этом… инженеры NVIDIA

Уровень сложностиСредний
Время на прочтение18 мин
Охват и читатели21K

В ходе моего исследования видеокарт линейки NVIDIA CMP, обхода их ограничений и снятия лимитов, оставалась еще одна проблема - видеокарты не могли нормально обмениваться данными напрямую друг с другом. Для моей задачи это было довольно неприятно, потому что сервер собирался ради запуска больших языковых моделей на нескольких дешевых видеокартах одновременно.

В итоге я полез разбираться, можно ли открыть на CMP 90HX настоящий P2P. И получилось - впервые в мире включить прямой обмен между этими картами, заставить одну CMP реально обращаться к памяти другой и получить нормальную скорость передачи.

Самое забавное, что по дороге мне очень сильно помогли сами инженеры NVIDIA. Не лично, конечно. Они просто забыли в драйвере ровно те внутренние механизмы, которыми сами пользовались при разработке и отладке.

Взломать драйвер NVIDIA

GTX 1080 Ti не сдаётся: выбираем лучшую MoE-модель для llama-server среди 35B, 120B и 176B

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели9.8K

Привет, Хабр! В прошлой статье я рассказывал, как запустить 176B-класс Qwen3.8-Flash-Next на GTX 1080 Ti, и тогда это был, скорее, эксперимент на грани возможного. Но недавно я наткнулся на материал на ast-softpro.ru, где ребята запустили Qwen 3.8-27B на двух RTX 5060 Ti по 16 ГБ (32 ГБ суммарно). Если коротко, они подтвердили, что гибридная архитектура DeltaNet + attention позволяет эффективно работать с длинным контекстом, а на их стенде модель в квантизации Q4_K_M выдавала около 24 токенов/с. Именно это, а также комментарии на Хабре, подтолкнуло меня к серии экспериментов, о которых пойдёт речь. Забегу наперед, я был удивлён результату: на моём стенде, который я опишу ниже, результаты на одной из моделей, которая как минимум не хуже, оказались сопоставимыми.

Читать далее

Qwen3.8–27B на двух RTX 3060 12ГБ: как я разогнал OpenCode с ~9 до ~40 токенов/с при 128K контекста

Уровень сложностиСредний
Время на прочтение22 мин
Охват и читатели12K

Можно ли превратить две RTX 3060 12 ГБ на старой Z97-платформе в нормальный локальный backend для OpenCode? Я начал с 9 токенов/с на длинном контексте и в итоге получил около 40 токенов/с в реальной агентной сессии с контекстом за 100K без уменьшения модели и без отказа от 128K.

В статье — tensor split без CUDA P2P, Q8 KV‑cache, встроенный MTP, подбор n-max, неудачные эксперименты с NCCL и shared buffers, реальные long‑context тесты и проверка качества на coding‑задачах.

Читать далее

Как запустить 176B‑класс Qwen3.8-Flash‑Next в DeepSeek Harness на GTX 1080 Ti

Уровень сложностиСредний
Время на прочтение15 мин
Охват и читатели11K

Когда смотришь на характеристики современных MoE‑моделей, иногда возникает странная мысль: а что будет, если взять модель с сотнями миллиардов параметров и попробовать запустить её на старом игровом GPU?

С Qwen3.8-Flash‑Next этот эксперимент оказался особенно интересным.

Qwen3.8-Flash‑Next — мультимодальная MoE‑модель, которую сама команда Qwen называет ранним предпросмотром архитектуры, лежащей в основе Qwen4. В основной части модели 125 млрд параметров, дополнительно используется около 51 млрд параметров n‑gram embedding‑таблиц, а на один токен активируется около 6 млрд параметров. Поэтому в сообществе модель часто называют 176B‑классом: 125B + 51B. В model card отдельно также указан 4B MTP‑компонент.

Модель использует гибридную архитектуру Gated DeltaNet (GDN) и Qwen Sparse Attention (QSA). Всего в ней 48 слоёв: три из четырёх используют GDN, а каждый четвёртый — QSA. Кроме того, здесь используется 512 экспертов MoE, из которых на каждом токене выбираются 10 маршрутизируемых экспертов плюс shared expert.

Нативный контекст модели составляет 262 144 токена, то есть 256K в обычном обозначении.

На бумаге всё это выглядит впечатляюще. На практике возникает главный вопрос: куда поместить более 100 GB модели, если видеокарта располагает всего 11 GB VRAM?

В моём случае ответ оказался неожиданным: GTX 1080 Ti действительно достаточно, чтобы запустить такую модель, если использовать llama.cpp и правильно распределить вычисления между GPU и оперативной памятью.

Читать далее

Что на самом деле происходит, когда видеопамять заканчивается

Уровень сложностиПростой
Время на прочтение13 мин
Охват и читатели6.4K

В сентябре 2026-го разводить холивар о том, хватает ли 8 ГБ видеопамяти, уже как‑то неприлично. И даже не потому что вопрос закрыт, а потому что выбора особо не осталось. Ну, посудите сами. RTX 50 Super, которую нам два года обещали как спасение с 3-гигабайтными чипами GDDR7, на Gamescom похоронили окончательно. А то, что осталось на полках, дорожает на глазах: за один только август восьмигиговая RTX 5060 Ti у нас подорожала почти на 30–40%. И не потому что доллар вырос. Реальная причина — это дефицит памяти и то, что партнеры NVIDIA в попытках выжить первым зарезали именно дешевые карточки. Ну, оно и понятно: в условиях, когда чипов не хватает, штамповать копеечную Dual или Ventus — де‑факто самоубийство.

Читать далее

12 ГБ VRAM и WAN 2.2 I2V‑A14B: как заставить RX6700XT генерировать видео неограниченной длины

Уровень сложностиСложный
Время на прочтение4 мин
Охват и читатели8.3K

12 ГБ VRAM, AMD, WAN 2.2 I2V‑A14B. Начал решать проблемы с генерацией видео и ограничениями железа — в итоге собрал пайплайн, который генерирует видео неограниченной длины, без швов. Вот как это работает и что пришлось принять как данность.

Читать далее

Поиск идеального ML ноута — с макбука на x86+Linux

Уровень сложностиПростой
Время на прочтение18 мин
Охват и читатели13K

В этом несерьёзном посте попробую разобраться с вполне серьёзным вопросом: каким должен быть идеальный ноутбук для ML-разработчика.

Читать далее

Хакинтош на i5-13600KF и Radeon RX 5700 XT: как поставить macOS на Gigabyte Z690 UD с OpenCore 1.0.7

Уровень сложностиСредний
Время на прочтение13 мин
Охват и читатели6.5K

Пошагово от BIOS до первой загрузки: кому подойдёт эта сборка и что менять, если железо отличается; что скачать; какой SMBIOS; подмена CPUID; ACPI; кексты с версиями и назначением; карта USB на 15 портов; звук, сеть, NVMe, гибридные ядра. В конце — проверки после установки и порядок обновления загрузчика.

Читать далее

Тест DeepSeek, Qwen, GLM и прочих LLM на продвинутом пользовательском железе

Уровень сложностиПростой
Время на прочтение16 мин
Охват и читатели13K

В статье рассказываю о личном опыте запуска современных LLM на домашнем ПК, сравниваю модели, кванты и движки, показываю результаты практических тестов и делюсь выводами о том, что сегодня по моему мнению имеет смысл запускать локально.

Читать далее

Конец эры ПК: вычисления переезжают в дата-центры

Время на прочтение18 мин
Охват и читатели8.8K

Первая часть этого материала рассказала о пути Nvidia от производителя видеокарт для игровых компьютеров до самой влиятельной корпорации мира. За последние несколько лет ее технологии изменили всю планету— теперь человечество вошло в эру искусственного интеллекта.

Однако для его развития нужны все новые ресурсы: огромные энергетические запасы, гигантские строительные площадки размером с целые города, но прежде всего — кремниевые чипы. Их нехватка может привести не только к исчезновению многих некогда крупных производителей комплектующих для ПК, но и видоизменить сам персональный компьютер. 

Многие считают, что это и есть план Nvidia. Так ли это на самом деле? Разберемся во второй части материала.

Читать далее

Ближайшие события

Как наращивают память видеокарты и сколько это стоит

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели9.2K

Несколько недель назад интернет гудел новостными заголовками, в которых говорили, что продавец из Гонконга выложил на eBay видеокарту GeForce RTX 2080 Ti с 22 ГБ видеопамяти вместо штатных одиннадцати. При этом он просил за нее всего 499 долларов. Тогда мало кто вспомнил, что про такие же карты с тем же ценником еще в феврале 2024 года рассказывали ребята из Tom's Hardware, но в то время переделкой занимались китайские мастерские. Сама по себе эта история очень интересная, особенно учитывая, что это не курьез из новостной ленты, а вполне сложившийся рынок со своими ценами и своей логикой. Сейчас расскажу все по порядку.

Читать далее

Почему профессиональная GPU стоит впятеро дороже игровой с той же начинкой

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели16K

Привет, Хабр! На связи Илья Мартысь из Рег.облака. Видеокарты RTX 5090 и RTX PRO 6000 Blackwell собраны на одном кристалле. Разница в цене — почти вчетверо.

Объяснить ее одним словом «профессиональная» не выйдет. Причин три: объем памяти, ECC и лицензионное соглашение на драйвер. Последняя вообще не про железо, но именно она решает, попадет карта в стойку или нет. Заодно расскажу, почему A100 2020 года до сих пор в работе, хотя рядом стоят карты втрое быстрее.

Читать далее

Глупый пользователь против Умного Ноутбука ч. 2. Флагманы — Зло

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели11K

Графомания - штука такая. В отсутствии новых идей, приходится возвращаться к старым. Собственно новая статья – является продолжением вот этой вотъ.

Сегодня в программе:

1. P-cores vs E-cores
2. Болезненный переход с АМД на Интел.
3. Почему не получается резать частоту, но можно резать PL.
4. Почему 80 ватт*час для Intel Ultra 9 275HX не тоже самое, что 80 ватт*час для ryzen 5 5600h.
5. Криво нанесенный ЖМ с завода.
6. Троттлинг.
7. Много троттлинга.
8. Графомания.
И полная безграмотность. Всё в общем как всегда.

Похихикать над автором... Снова :-)

Моддеры хакнули DLSS 5 и запихнули его во всё подряд — от Skyrim до GTA San Andreas

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели15K

Иногда что-то супер-мега-секретное вылезает наружу не через слив, а просто потому что кто-то забыл вынуть один файл из билда. Ну забыли и забыли, с кем не бывает.

Именно так всё и произошло на прошлой неделе с DLSS 5 – скандальной штукой от Nvidia. Официального анонса не было, зато была ранняя версия игры NBA 2K27, в которой была незаметная DLL-ка nvngx_dlssnr.dll на 158 мегабайт... и понеслось.

За считанные дни модеры натянули нейросетевой рендер на добрых три десятка игр, от Cyberpunk 2077 до GTA San Andreas, которой уже двадцать лет в обед (хотя ремастеру чуть меньше).

Если вы следили за DLSS 5 с марта, то помните все эти мемы и хейт. Попробуем разобраться, что произошло, как работает технически, что показывают тесты и почему до сих пор спорят о судьбах игровой индустрии. Заодно накидаю картинок и видео, потому что тут тот случай, когда лучше один раз увидеть, чем сто раз прочитать.

Читать далее

Встречаем RTX PRO 6000 BSE: достойная ли это альтернатива H100 NVL по производительности, качеству и цене

Время на прочтение10 мин
Охват и читатели12K

Графический ускоритель NVIDIA RTX PRO 6000 Blackwell Server Edition в сравнении с более распространенными H100 интересен прежде всего аппаратной поддержкой NVFP4 — четырехбитного формата весов с двухуровневым масштабированием, представленного в 2025 году. Как переход моделей на NVFP4-квантизацию влияет на производительность? Что и при каких профилях нагрузки с учетом этого перехода окажется предпочтительней — ускоритель нового семейства Blackwell или старый знакомый H100?

Меня зовут Алексей, я инженер по разработке ПО искусственного интеллекта в YADRO. В ходе статьи я получу подробные ответы на эти вопросы, а помогут в этом YADRO G4208P G3 — производительные серверы для задач ИИ, машинного обучения и глубокой аналитики. В один такой сервер я установлю четыре RTX PRO 6000, в другой — восемь H100 NVL. Оценивать буду на моделях различного размера и архитектуры: Qwen3.6-27B (dense), Qwen3.6-35B-A3B (MoE) в форматах FP8 и NVFP4, а также DeepSeek-V4-Flash в форматах Mixed FP4 и NVFP4. Использую vLLM в сценариях offline и server — vLLM 0.23.0 для Qwen, vLLM 0.26 для DeepSeek-V4-Flash — а также Docker-image на основе nvidia/cuda:13.2.0-cudnndevel-ubuntu22.04.

Читать далее

«Оригинальное видение»: как геймеры сменили гнев на милость к DLSS 5 и что это говорит о восприятии нейросетей в целом

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели7.8K

Вчера произошло интересное событие. В сеть утекла ранняя версия DLLS 5, технологии, которая при помощи искусственного интеллекта улучшает (кто-то скажет ухудшает) графику в играх.

Я знаю, что это очень узкая тема, относительно редко обсуждаемая на Хабре, но на нее можно взглянуть шире. Изначальная реакция на DLSS 5 и то, что произошло вчера, многое говорят о том, как мы относимся к нейросетям -- да и вообще к любой новой технологии.

Читать далее

Компьютер по подписке: как Nvidia превращает вычисления в сервис

Время на прочтение13 мин
Охват и читатели6.8K

Ежегодная выставка Computex в Тайбэе уже более 40 лет собирает производителей и энтузиастов компьютерной индустрии. За годы мероприятие стало компасом всей отрасли, четко указывающим на то, как именно будет развиваться рынок в обозримом будущем.

Все это время Computex посвящалась потребительской электронике: готовым ПК, процессорам, видеокартам, памяти, материнским платам, системам охлаждения, мониторам и периферии, однако в 2026 году все изменилось. Главной темой экспозиции стала AI Together: в демозонах и на сценах обсуждали искусственный интеллект — агентов, роботов, ускорители, серверы, дата-центры и то, сколько гигаватт они будут потреблять. Консьюмерская техника, за исключением той, на которую бренды успели наклеить шильдик с упоминанием AI-технологий, оказалась вне главных павильонов. 

Ключевой фигурой выставки стал CEO Nvidia Дженсен Хуанг, сделавший ряд громких заявлений. Он говорил о том, что раньше компьютеры создавались для человека, а теперь вычислительные ресурсы, память и постоянный доступ к инфраструктуре нужны ИИ-агентам, которых потенциально может быть куда больше, чем людей, а значит, для чипмейкеров этот рынок куда объемнее и перспективнее.

Звучит как фантастика, но представители отрасли допускают, что все мы движемся к модели, где дома уже не будет производительного персонального компьютера, вместо него — тонкий клиент для базовых задач. Что-то сложнее, например, игры или комплексные вычисления в специализированных программах, будет запускаться в дата-центрах, а доступ к их мощностям станет приобретаться по подписке. На чем строится эта теория? Об этом — в материале.

Читать далее
1
23 ...