Обновить
64K+

Видеокарты

Графические адаптеры

64,39
Рейтинг
Сначала показывать
Порог рейтинга
Уровень сложности

Возвращение короля: разбираемся, что такое Qwen3.8 27B

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели13K

14 августа 2026 года, 15:00 UTC.

CEO Anthropic Дарио Амодей срочно созвал заседание. Экс-глава Apple Тим Кук пожалел, что встроил в айфоны облачную Gemini, так и не дождавшись локальной модели нужного уровня. Где-то в датацентрах Alibaba щёлкнул рубильник, на Hugging Face слетел обратный отсчёт, и в мир вышла Qwen3.8-27B – новая dense-модель на 27 миллиардов параметров, которую даже прозвали «локальным Opus’ом», поскольку она позиционируется как одно из самых мощных открытых решений для локальной генерации.

Ждали её всем миром: обратный отсчёт на huggingface, первые пиксельные пеликаны на великах – всё как положено.

Если вкратце, это открытая (Apache 2.0) мультимодальная модель, которая понимает текст, картинки и видео, влезает в одну ооочень мощную домашнюю видеокарту, а временами по бенчмаркам обгоняет закрытые облачные модели уровня Claude Opus 4.6.

Если не вкратце – читайте дальше, потому что там есть и триумф, и зависания на 49 минут раздумий!

Читать далее

Новости

Рискованный бизнес Nvidia

Уровень сложностиПростой
Время на прочтение16 мин
Охват и читатели16K

Джей Кук, который прославился как американский герой за свою роль в обеспечении финансирования Союзных сил в Гражданской войне, 1 января 1870 года подписал контракт, который, по сути, привёл уже к Мировой войне.

В 1864 году Конгресс США создал Northern Pacific Railway (Северную Тихоокеанскую железнодорожную компанию), чтобы соединить Великие Озёра и залив Пьюджет-Саунд путями, которые в конечном итоге должны были пролегать от Дулута до Такомы. Эта хартия включала 40 миллионов акров прилегающих к путям земель, которые государство пообещало компании за их строительство. Однако в течение следующих шести лет Northern Pacific с трудом находила финансирование в то время, как Union Pacific и Central Pacific успешно строились навстречу друг другу и в мае 1869 забили «золотой костыль», символически ознаменовав окончательное соединение Сакраменто и Омахи.

Читать далее

Как DLSS 5 меняет графику в играх и где тут подвох

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели7.2K

В марте Nvidia показала DLSS 5 и получила такую волну критики, какой у зеленых не было довольно давно. Сейчас, спустя несколько месяцев, компания дала повод снова о ней поговорить. Она просто вышла и показала то, что стоило показывать сразу. Это касается в первую очередь инструментов, которые развязывают руки разработчикам и позволяют лучше управлять нейросетями в своих играх. Звучит пространно и непонятно, но сейчас разберем, в чем именно преимущество новой функции.

Читать далее

Масштабирование LLM: от одного чипа до ЦОДа. Глава 4. Тренировка трансформера

Уровень сложностиСредний
Время на прочтение9 мин
Охват и читатели6.5K

Наконец-то мы добрались непосредственно до того, как тренировать трансформер, не просто тренировать, а делать это эффективно и масштабируемо.

Как мы уже знаем из прошлых глав, трансформер штука тяжелая и на один ускоритель обычно не влезает, поэтому цель масштабирования состоит в том, чтобы распихать тренировку модели по нескольким ускорителям, и желательно при этом, чтобы производительность и пропускная способность такой системы росли пропорционально количеству ускорителей в ней. А этого добиться довольно сложно, просто потому что чем больше ускорителей в системе, тем сложнее и накладнее передавать данные между частями системы и все это дело синхронизировать.

Как мы видели в одной из предыдущих глав про шардинг матричных операций, распределенное матричное умножение требует разных дополнительных операций вроде AllGather или ReduceScatter, которые занимают шину данных и тратят процессорное время. В общем наша задача не просто масштабировать систему, а еще и понять, когда остановиться, потому что накладные расходы становятся совсем неподъемными.

В этой главе мы обсудим четыре вида параллелизма, их достоинства, недостатки и когда что можно применять и/или комбинировать. Для простоты будем считать, что работаем внутри одного вычислительного кластера и учитывать только соединения между ускорителями.

Читать далее

Тайна 3dfx Voodoo: изучаем архитектуру GPU из 90-х «по винтикам»

Уровень сложностиСредний
Время на прочтение11 мин
Охват и читатели18K

Недавно мне подарили настоящую легенду — STB 3dfx Voodoo 3 с двумя TMU, 16'ю мегабайтами видеопамяти и 2D-ускорителем. Как настоящий гик и любитель покопаться в ретро-железе, я сразу же нашел даташит и начал изучать внутреннюю архитектуру этого игрового монстра. И поверьте, здесь есть на что посмотреть!

В сегодняшней статье мы во всех деталях изучим архитектуру оригинальной 3dfx Voodoo, узнаем почему Nvidia выиграла в гонке видеокарт и почему игры с API Glide выглядели гораздо красивее, чем с D3D/OpenGL! Если любите настоящие технарские статьи без нейрослопа и рерайта — жду вас под катом!

Читать далее

NVIDIA RTX PRO 5000 Blackwell с 72 Гб видеопамяти. Есть ли смысл переплачивать за «половинку» флагмана?

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели7.9K

RTX PRO 5000 Blackwell на 72 Гб: золотая середина для локальных ИИ-моделей или переоцененный апгрейд? Разбираемся в нашем обзоре.

Читать далее

Перегрев или норма: можно ли долго гонять процессор на 95 градусах

Уровень сложностиПростой
Время на прочтение9 мин
Охват и читатели8.5K

Вывести мониторинг в оверлей и потом всё время коситься в угол экрана – особый тип извращения. Особенно когда там на процессоре загорается 95 градусов. Ну и что пытливый втыкатель делает, когда видит подобные цифры? Правильно, идёт гуглить, натыкается на форумные ветки чёрт-те каких годов, читает хоровые завывания о том, что выше 80 градусов железо в принципе не живёт, и к ночи уже присматривает себе водянку тысяч за 20. Хотя по факту-то паниковать и необязательно. Для нынешних Ryzen эти 95 градусов - не авария и не косяк сборщика, а нормальный рабочий режим, до которого камень осознанно доводит себя сам. И AMD про это прекрасно знает, потому что так и задумывала. Случаи, когда напрячься действительно надо, конечно, бывают. Только выглядят они совсем не так, как думает большинство, и температура там далеко не главное.

Читать далее

AMD и 4 ГБ: разбираемся с RX 9050

Уровень сложностиПростой
Время на прочтение5 мин
Охват и читатели6.9K

На прошлой неделе AMD обновила свою линейку видеокарт Radeon RX 9000 и добавила в нее младшую модель. При этом ни анонса, ни пресс-релиза не было. Вместо этого компания просто завела в разделе Radeon RX 9000 Series новую страницу. Версия на 8 ГБ стоит от 279 долларов, и она довольно скучная, тем более до нас она вряд ли доедет в ближайшее время. Куда интереснее то, что вместе с ней на прилавки вернулись десктопные видеокарты с 4 ГБ памяти, которых у AMD не было с 2022 года. И вот тут действительно интересно, зачем это нужно в наше время, но давайте обо всем по порядку.

Читать далее

Подробная история развития 2D-графики в PC

Уровень сложностиПростой
Время на прочтение11 мин
Охват и читатели17K

Сейчас в сети можно найти много статей и видеороликов о становлении 3D-графики в обычных пользовательских ПК. Даже я в своем блоге веду соответствующую рубрику, где мы с вами не только вспоминаем историю знаковых видеокарт из 90-х, но и во всех подробностях изучаем их архитектуру, возможности и графические API. Однако всё это время мы с вами обходили тему 2D-ускорителей на ПК, которые тоже очень сильно эволюционировали и изменились со времен самой первой видеокарты в IBM PC.

Если вам интересно узнать о том, зачем видеокарте нужен был свой собственный BIOS, как работали цветные режимы в первых видеокартах и почему объём VRAM в те годы решал больше, чем сейчас — жду вас под катом!

Читать далее

Почему выбрать денойзер сложнее, чем написать свой

Уровень сложностиСредний
Время на прочтение12 мин
Охват и читатели14K

Устранение шума на видео с плёнки — тема объёмная, и эта индустрия меня не на шутку увлекла. Немногим раньше я даже обучил свой собственный компактный «устранитель шума Archivist» для плёнки, не найдя существующих альтернатив.

Но такой путь самурая оказался жесток — 2 месяца потраченного времени и сотни сожжённых часов работы ГПУ. Повторять — чересчур даже для меня, при всей любви к многомесячным проектам :). С того момента я ещё тщательнее пригляделся к доступному рядовому пользователю арсеналу.

Но как всегда, оказалось, выбирать-то вообще нелегче, и я снова потратил просто уйму времени. И в процессе помимо прочего, абсолютно возненавидел одного из лидеров списка по качеству.

Всего у нас 6 участников: 5 отобранных нейросетей, 1 ручной алгоритмический ветеран индустрии + 1 потенциальный король новой эры.

Читать далее

Как устроена Kimi K3: 2,8 трлн параметров, линейное внимание и агенты на миллион токенов

Уровень сложностиСложный
Время на прочтение11 мин
Охват и читатели13K

Moonshot AI выпустила веса Kimi K3 — мультимодальной MoE‑модели с 2,8 трлн параметров, из которых на каждом токене активируются 104 млрд. В отдельных тестах программирования и работы с инструментами K3 обходит Claude Opus 4.8, GPT-5.5, GPT-5.6 Sol или Claude Fable 5. Однако сводить релиз к таблице результатов было бы ошибкой: сама Moonshot признаёт в техническом отчёте, что в среднем модель уступает Fable 5 и GPT-5.6 Sol.

Как следует из технического блога Moonshot, все решения K3 проектировались совместно: гибрид Kimi Delta Attention и глобального MLA, Attention Residuals, MoE на 896 экспертов, обучение длинных агентных траекторий и отдельная система кеширования. Разберём, какие задачи решает каждый компонент, что подтверждено опубликованными материалами и где отчёту Moonshot пока приходится верить на слово.

Читать далее

Как превратить домашний сервер в игровой стриминг на любое устройство в доме

Уровень сложностиСредний
Время на прочтение9 мин
Охват и читатели13K

Мой игровой ПК с 5800×3D переехал в шкаф в прихожей и стал домашним сервером, а играю я теперь на телевизоре, Steam Deck и ноутбуке — стримом с него же. В этой статье расскажу, почему мне не подошла привычная связка Sunshine + Moonlight и как вместо неё поднять Wolf из проекта Games on Whales, о котором на русском, кажется, ещё не писали: свой виртуальный дисплей под каждого клиента, несколько сессий одновременно и никакого Steam на хосте. Отдельно — про главные грабли: с Wolf не работает официальный проброс NVIDIA‑драйвера, и после каждого обновления стриминг молча умирал, пока я не научил сервер чинить себя сам.

Читать далее

История создания самодельной видеокарты на 8 192 ядра RISC-V из тысяч дешевых микроконтроллеров

Время на прочтение7 мин
Охват и читатели22K

Немецкий разработчик с ником bitluni потратил около полугода на создание одной из самых необычных DIY-систем. Вместо того чтобы использовать готовый графический процессор или FPGA, он решил построить аналог графического ускорителя из 8 192 недорогих RISC-V микроконтроллеров. Их он объединил в единую иерархическую структуру.

Энтузиаст хотел показать, насколько далеко можно зайти, используя самые простые и доступные компоненты. По пути нашему герою пришлось решать задачи синхронизации тысяч микроконтроллеров, организации питания, автоматической прошивки и обмена данными между всеми узлами системы. Именно этим проект и интересен. Давайте посмотрим, что здесь и как работает.

Читать далее

Ближайшие события

Как мы запустили Ornith‑35B на ноутбуке с 8 ГБ VRAM и разогнали её до 99 ток/с на AMD Strix Halo

Уровень сложностиСредний
Время на прочтение11 мин
Охват и читатели14K

Ornith‑1.0‑35B обошла Qwen3.5‑397B в Terminal‑Bench, а на нашем локальном срезе хорошо показала себя в агентном кодинге. Мы решили проверить, насколько быстрее она сможет работать на AMD Strix Halo с пропускной способностью памяти до 256 ГБ/с.

В статье — результаты экспериментов с Vulkan, MTP, селективной квантизацией и n‑gram reuse: что не дало прироста, как удалось получить 99 ток/с без потери качества и каким способом 35B‑модель запустилась на Windows‑ноутбуке с 8 ГБ VRAM.

Читать далее

Тайна Intel i740 — самой экзотической видеокарты из 90-х

Уровень сложностиСредний
Время на прочтение9 мин
Охват и читатели24K

Ранее я часто рассказывал об особенностях видеокарт из 90-х. В рамках прошлых статей, мы успели с вами рассмотреть внутреннюю архитектуру 3dfx Voodoo, узнать о кастомном графическом API в S3 ViRGE, и даже написать свою собственную небольшую демку под видеокарты из 90-х. Вместо рассказов о GeForce 256 и ATi 3D Rage, в сегодняшнем материале мне хотелось бы поговорить о видеокарте, которая обогнала своё время — и при этом всё равно провалилась. Как вы уже поняли — речь пойдет об Intel i740.

Каким был первый GPU от Intel, на что он был способен и в чём заключается его главная тайна — читайте в сегодняшней статье!

Читать далее

vLLM vs LMDeploy vs Triton: обзор бэкендов для инференса LLM

Уровень сложностиСредний
Время на прочтение25 мин
Охват и читатели15K

Лучший способ сжечь бюджет компании на инфраструктуру — запуск LLM в продакшене. Но только если вы не знаете, какой бэкенд использовать и как его настраивать.

Проблема в том, что параметры современных нейросетей растут по экспоненте, а обрабатываемый контекст становится все длиннее. Из-за этого операционные расходы на генерацию текста превращаются в главный барьер для масштабирования сервисов. Обслуживать запросы к LLM в десятки раз сложнее и дороже, чем крутить классический поиск по ключевым словам. Чтобы не разориться на счетах и выжать максимум из дорогостоящих GPU, нужен специализированный софт.

В этой статье мы подробно сравним три ведущих бэкенда для инференса: vLLM, LMDeploy и экосистему NVIDIA Triton Inference Server в связке с TensorRT-LLM. Мы разберем, как они управляют памятью, какие методы квантования используют и как распределяют запросы, а также оценим результаты их бенчмарков на актуальных архитектурах NVIDIA Hopper и Blackwell.

Читать далее

Запуск тяжелых 3D-игр на компьютере со слабой видеокартой — от теории к практике

Уровень сложностиСредний
Время на прочтение25 мин
Охват и читатели9.9K

Вот уже несколько десятилетий идёт непрерывная борьба между требованиями игр к производительности компьютерного железа (и в первую очередь видеокарт) и возможностями самих видеокарт.

Создатели игровых движков внедряют всё более продвинутые визуальные технологии, разработчики игр на этой основе создают более реалистичные игровые проекты, а чипмейкеры, в свою очередь, разрабатывают новые архитектуры видеочипов, способных удовлетворить эти аппетиты.

При этом видеокарты устаревают намного быстрее других компьютерных компонентов. Если флагманский процессор пятилетней давности сейчас ещё выглядит вполне бодрым, то новейшая игровая видеокарта всего через несколько лет становится безнадёжно устаревшей, а вскоре превращается чуть ли не в офисную “затычку для слота”: новые игры в нативном разрешении монитора начинают заметно тормозить даже на не самых тяжёлых настройках.

Так что же делать, если ещё не совсем старая видеокарта пока не превратилась в “затычку для слота”, но уже на пути к этому (или если это пусть и новая, но встройка, которая по сравнению с дискретными видеокартами никогда и не была мощной), и какая-то новая игра в нативном разрешении монитора уже откровенно не тянет?

Конечно, можно уменьшить разрешение в настройках игры — например, запустив её в 1080p или даже 720p, однако на современных мониторах с цифровыми LCD- или OLED-панелями и простейшими апскейлерами это выглядит, мягко говоря, не слишком хорошо, и изображение превращается в мыльное шоу.

Попробуем поискать другие паллиативные решения:

Читать далее

Запускаем LLM локально на майнинг ферме из 4 GPU

Время на прочтение3 мин
Охват и читатели14K

В последнее время становится все более популярным локальный запуск LLM. У каждогг свои причины, но основные это: проблемы с западными сервисами, нестабильный интернет и утечка данных в открытый доступ (преценденты уже были).

В этой статье я расскажу как запускал LLM локально на майнинговом железе, какие тонкости есть при запуске. Расскажу архитектуру моей сборки и примерную стоимость железа. Также протестирую скорость работы с некоторыми наиболее популярными MoE LLM, включая модели от гугла и ChatGPT. По поводу целесообразности подобных сборок решение каждый примет сам исходя из своих задач и финансовых ресурсов.

Читать далее

Почему говорят, что у AMD драйверы хуже, чем у NVIDIA

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели9K

Tom's Hardware в июне пересобрал рейтинг лучших игровых видеокарт. Инфоповод подхватили буквально все, но сам по себе он не так интересен, как один посыл, который дали авторы. Сначала они назвали лучшей картой высокого класса GeForce RTX 5070 Ti. А ее прямого конкурента, Radeon RX 9070 XT, удостоили далеко не самой лестной оценки. Причем не за скорость: AMD стоит почти на треть дешевле и в чистой растеризации отстает на считанные проценты. Вот только, по мнению издания, у AMD сырая экосистема и проблемные драйверы, что перевешивает всю выгоду в цене. Обвинять AMD в плохих драйверах в 2026 году довольно смело, особенно если вспомнить, что творилось у NVIDIA последние полтора года.

Читать далее

Дело на вечер: собираем домашний ИИ-сервер

Уровень сложностиПростой
Время на прочтение2 мин
Охват и читатели19K

Конечно, можно купить готовый (за ~1.3 млн. руб. есть неплохие варианты), но нам ведь главное процесс, ведь так? К тому же, не все готовы выложить такую сумму за возможность запускать дома нейронку. Итак, что нам пригодится, чтобы влезть в бюджет до 400 тыс. руб.:

Читать далее
1
23 ...