Обновить

Все потоки

Сначала показывать
Порог рейтинга
Уровень сложности

Таинственное гудение: причина восприятия низкочастотных звуков

Время на прочтение18 мин
Охват и читатели7.3K

Организм человека и все его составляющие системы являются чрезвычайно сложными и тесто взаимосвязанными друг с другом. Полного понимания того, как что работает, пока нет, а потому существует множество аспектов работы некоторых систем, которые и по сей день порождают множество вопросов и дискуссий. К числу таковых относится и необычное явление, когда крайне малый процент людей воспринимают низкочастотные звуки (LFSP от low-frequency sound percepts), проявляющиеся в виде гула или звуковых пульсаций. Ученые из Норвежского университета естественных и технических наук (Тронхейм, Норвегия) провели исследование, в котором попытались установить причины и/или источники этого таинственного гула. Как проводилось исследование, какие испытания использовались, и что они показали? Ответы на эти вопросы мы найдем в докладе ученых.

Читать далее

LLM смотрит на мой сад: как ИИ-зрение решает, звать ли меня накрыть мебель перед дождём

Уровень сложностиСредний
Время на прочтение11 мин
Охват и читатели5.8K

LLM анализирует картинку с камеры и перед дождём решает, накрыта ли садовая мебель - если нет, шлёт в Telegram фото сада, радар и кнопки «Накрыл» / «Отложить». Всё на голом Home Assistant, без своего кода, регистрации и смс. Собрал за меня Claude Code, а я разбираю архитектуру, YAML и грабли.

Читать далее

Что остаётся аналитику, если AI крепчает?

Уровень сложностиСредний
Время на прочтение15 мин
Охват и читатели7.7K

Привет, меня зовут Юрий Черепов, я технический лидер системной аналитики в Альфа-Банке. Однажды на внутреннем «митапе» для аналитиков, где мы обсуждали, как AI применять в работе аналитика мне задали вопрос «Не делает ли AI людей «слабее»? Не приведёт ли использование AI к деградации профессиональных навыков? Мы ему всё делегируем и разучимся думать сами»

Вопрос хороший. Хочется разобраться, что происходит и в какое будущее всё движется. Но сначала я бы хотел окунуться в прошлое.

Читать далее

Как я делал текстовую игру для веба

Уровень сложностиСредний
Время на прочтение11 мин
Охват и читатели7.4K

Привет, Хабр! Меня зовут Костя, я десять лет занимаюсь коммерческой Android-разработкой. Давно хотелось попробовать себя в вебе, а эксперименты с LLM давали некоторую уверенность в том, что по крайней мере есть шанс написать агентами поддерживаемый код и задеплоить.

Что же можно сделать? Конечно тамагочи! Текстовая браузерная игра: герой живёт в мире мрачного будущего. Непрямое управление, возможность предлагать миссии, а также тюнинг предпочтений героя. Эдакий Годвилль, но на новый лад. Как я делал, и что получилось, спустя пару недель, расскажу под катом :)

Читать далее

Интервью с Ником Бостромом (Эксклюзив для Хабра)

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели9K

Ник Бостром — шведский философ и ведущий мыслитель в области рисков, связанных с развитием искусственного интеллекта, долгосрочного будущего человечества и трансгуманизма. Он является автором «аргумента симуляции», согласно которому мы можем прямо сейчас находится внутри симулированного мира, созданного суперкомпьютерами. Мистер Ник согласился дать небольшое интервью специально для Хабра. Фото: The Institute.

Читать далее

Memorization vs Generalization: что действительно умеет языковая модель (TLM) на 2 160 параметров (v1.1.0)

Уровень сложностиСредний
Время на прочтение2 мин
Охват и читатели6.9K

Продолжая тему Крошечной Языковой Модели на Nodejs мы поймем где проходит граница ее возможностей. На примере Крошечной Языковой Модели (TLM) из 2 160 параметров мы проведём воспроизводимый эксперимент и увидим в цифрах: знакомый шаблон - 99,93%, перестановка токенов - 81,69%, неизвестная структура -?%.

Читать далее

Полтора месяца зависаний, ноль дампов и 44 байта нулей

Уровень сложностиСредний
Время на прочтение8 мин
Охват и читатели12K

Полтора месяца моя рабочая машина умирала. Не BSOD, не перезагрузка — именно умирала: экран чёрный, вентиляторы на видеокарте выходят на сто процентов и так и остаются. Никакой реакции ни на что. Только кнопка Reset.

Сначала раз в неделю. Потом два. К середине июля — три раза за сутки.

Но хуже самих зависаний было другое: после них не оставалось ничего. Ни дампа, ни минидампа, ни BSOD, ни единой записи WHEA. В журнале — Event 41, Kernel-Power, «система была перезагружена, завершив работу некорректно», BugcheckCode = 0. Windows даже не успевала понять, что умерла.

Отлаживать нечего. Есть только труп и никаких улик.

Забегая вперёд: виновата оказалась не память, не драйвер и не блок питания, хотя я последовательно подозревал всех трёх. Виноват был PCIe Gen5. Лечится одним пунктом в BIOS. Полтора месяца страданий лечится одним пунктом в BIOS.

Читать далее

Всё что нужно знать про DuckLake

Уровень сложностиПростой
Время на прочтение16 мин
Охват и читатели7.6K

Когда вышел DuckDB 1.0, я написал статью Всё что нужно знать про DuckDB. Теперь вышел DuckLake v1.0 — LakeHouse-формат из той же экосистемы. Это отличный повод разобраться, как он устроен и как его можно использовать в production-сценариях.

В этой статье разберём, какую проблему решает DuckLake, чем его архитектура отличается от Apache Iceberg и как поднять DuckLake локально или в окружении, приближённом к production: PostgreSQL для каталога метаданных и S3/MinIO для файлов данных.

Читать далее

Как мы организовали тест-сессию в продукте: пилот формата

Уровень сложностиСредний
Время на прочтение3 мин
Охват и читатели7K

Я Лиза, UX-исследователь в Экстерне. Не так давно я организовывала тест-сессию в нашем продукте. В статье расскажу, что мы делали в рамках пилота такого формата исследования, с какими проблемами столкнулись и какие преимущества выделили.

Дизайнеры в Контуре уже пытаются возродить формат тест-сессий для исследований. Поэтому в нашем b2b-продукте мы тоже решили попробовать впервые провести его в этом году.

Опыт получился интересным — мы отловили проблемы интерфейса, как и хотели. Но еще больше поняли про сам формат исследования.

Тест-сессии обычно описывают как быстрый способ проверить интерфейс с коллегами — без рекрута пользователей и полноценного цикла исследования. Но в итоге нам показалось, что всё немного сложнее.

Читать далее

Meilisearch и Manticore Search: проверяем сравнение на практике

Время на прочтение12 мин
Охват и читатели6.7K

Несколько дней назад Meilisearch опубликовал сравнение с Manticore Search . Мы тоже любим сравнения: в 2023 году опубликовали своё с воспроизводимыми бенчмарками. Сразу оговоримся: мы спорим не со всей статьёй. Часть выводов Meilisearch справедлива, а кое-где сравнение говорит в пользу Manticore Search.

Однако часть сведений о Manticore Search уже устарела. Спорить в теории мы не стали: запустили актуальные версии обоих движков (Manticore Search 28.4.4 и Meilisearch 1.41/1.48) и повторили описанные сценарии. Ниже мы приводим команды и ответы обоих движков, чтобы проверку можно было повторить самостоятельно.

Читать далее

Приложение открывается только с VPN. Разбирался почему

Уровень сложностиСредний
Время на прочтение6 мин
Охват и читатели14K

Пользователи из регионов начали писать в поддержку одно и то же: приложение не открывается. Симптомы у всех разные. У кого-то вечная загрузка, у кого-то белый экран, у кого-то заходит, только если включить VPN.

На своём компьютере всё летает. С зарубежного сервера проверяю, тоже без проблем. Сижу, чешу затылок.

Сначала списал на случайные глюки у провайдеров. Мало ли, бывает. Но обращений становилось больше, а не меньше, и в какой-то момент стало ясно: это не совпадение, это системная штука. Пришлось лезть в сетевой дебаг с головой.

В этой статье расскажу, как искал причину таймаутов, где я сам сначала неправильно объяснил себе проблему, и что в итоге поменял в инфраструктуре, чтобы всё заработало стабильно.

Читать далее

Как жить когда не хватает Multicall

Уровень сложностиСредний
Время на прочтение8 мин
Охват и читатели9.8K

При web3-разработке часто приходится заниматься вопросами консистентности считываемых из блокчейна данных и оптимизацией таких запросов так как у RPC‑провайдеров достаточно жёсткая тарификация за каждую единицу газа/RPC‑запрос. Обычно достаточно использования Multicall (умный контракт, который объединяет вызовы view‑ и pure‑ функций других умных контрактов в одном RPC‑методе eth_call), однако такое решение имеет свои лимиты. Так Multicall должен умещаться в предельный gaslimit, допускаемый RPC‑провайдером (зачастую он не очень велик и самое большое, что есть на рынке — это всего 500 миллионов единиц газа у одного из публичных RPC‑провайдеров). Другой проблемой чистого multicall является проблема консистентности: дробление запроса по нескольким вызовам multicall, чтобы уложиться в лимиты, может привести к тому, что часть запросов получат данные из текущего блока, а часть из следующего, что по очевидным причинам не подходит, например, для получения состояния всех пулов какого‑нибудь DEX типа Uniswap или Algebra при трейдинге. Крайне элегантное и эффективное решение данной проблемы для python‑разработчиков было выполнено командой YearnFinance (а именно BobTheBuilder) и опубликовано в виде pip‑пакета dank_mids. Именно его мы разберём в этой статье.

Читать далее

Гаплогруппа G2a и картвельские языки: совпадение или след общего древнего субстрата?

Уровень сложностиСредний
Время на прочтение19 мин
Охват и читатели12K

Моя Y-хромосомная гаплогруппа — G2a. Именно это когда-то подтолкнуло меня изучать происхождение мужских линий, их древние миграции и распространение среди современных народов.

Разбираясь в Y-хромосомном дереве, я обратил внимание на обособленное положение G относительно большой ветви HIJK, из которой позднее выделились H, I, J, Q, R и другие линии. Параллельно, изучая народы Кавказа, я узнал о картвельской языковой семье — самостоятельной ветви, к которой относятся грузинский, сванский, мегрельский и лазский языки.

Сначала это было только внешнее сходство двух обособленных ветвей. Но затем выяснилось, что среди сванов — носителей первой отделившейся ветви картвельских языков — доля G2a достигает примерно 78,5%. Высокая частота G2a наблюдается и у мегрелов, а генетические исследования дополнительно выделяют сванов как отдельный аутосомный кластер.

В статье я пытаюсь разобраться, является ли это простым совпадением, следом общего кавказского субстрата или свидетельством исторической связи между ранними картвелоязычными популяциями и отдельными ветвями G2a. Это любительская гипотеза, поэтому я отдельно рассматриваю источники, контраргументы, древнюю ДНК и границы выводов, которые действительно можно сделать из имеющихся данных.

Читать далее

Ближайшие события

2. Рекурсивный движок llama.cpp на RTX 3050: тесты Qwen 32B и 7B Coder — прирост качества х3 и аппетиты по памяти

Уровень сложностиСредний
Время на прочтение5 мин
Охват и читатели18K

В этой статье мы детально разберём, есть ли практическая польза от рекурсивного механизма в форке llama.cpp, и стоит ли овчинка выделки. Для объективности сравним поведение трёх разных моделей — от лёгких 7B до тяжёлых 32B — в одинаковых условиях, замерив качество и скорость

Читать далее

Если ссылки схлопываются, значит это кому‑то нужно

Уровень сложностиСложный
Время на прочтение10 мин
Охват и читатели14K

В прошлой статье (Непослушный using ) я разобрал, как using вмешивается в поиск имён и почему его поведение часто расходится с тем, что от него ждет программист, и на этом ветку статей про поиск имен (name lookup) можно временно закрыть.

Using'и попортят вам в проектах еще немало крови, но в целом их проблемы известны и легко ловятся, а теперь давайте поговорим обauto и выводе типов в шаблонах, который регулярно удивляет даже опытных программистов на C++, когда речь идёт о распаде типов (type decay) и неявных ловушках при работе с ним. Представьте, что у нас есть несколько переменных, которые выглядят разными: const int&, просто intconst int и int&&.

По наивной интуиции можно подумать, что компилятор должен относиться к ним по‑разному: и где‑то ссылка, где‑то константность, где‑то rvalue, но это будет работать только до тех пор, пока мы не используем auto или шаблон.

Потихоньку дописываю книгу, в целом каркас уже сложился и большая часть материала уже собрана и обработана в черновике, если вам интересно, что получилось, то главы выложены на гитхабе в русском и английском вариантах или тут, если вам больше нравится в виде статей, а то, что ещё дописывается уже больше шлифовка, чем поиск нужной формы. Оглавление и ссылки будут под катом.

Читать далее

Сонар из Музыкальной Колонки

Уровень сложностиПростой
Время на прочтение12 мин
Охват и читатели16K

В этом тексте я написал про то как упражняться в радиолокации на основе экспериментов в акустическом диапазоне. Я собрал прототип сонара и попробовал определять расстояния до условных целей.

Читать далее

Внешний бенчмарк причинного recall: проверяем память ИИ-ассистента на YDB Яндекса

Уровень сложностиСредний
Время на прочтение6 мин
Охват и читатели9.5K

Коротко, о чём речь, — для тех, кто пришёл по слову «Яндекс» и предыстории не знает. Когда ИИ-ассистент помогает чинить баг, самое ценное — не сочинить ответ с нуля, а вспомнить: похожий симптом уже разбирали, вот issue, вот причина, вот PR с фиксом. Вопрос ровно один — достаёт ли ассистент это прошлое решение из памяти. Мы это померили на своём корпусе тикетов и получили две цифры. Обычный семантический поиск (по смыслу слов) находит нужный прошлый фикс по симптому лишь в 38% случаев; обход явных причинных связей «issue → закрывший его PR» — в 87%. То есть сходство слов упирается в треть, а явные связи поднимают recall в разы.

Читать далее

Архитектура TMS на .NET: кластер, потоки координат и объектное хранилище

Уровень сложностиСложный
Время на прочтение12 мин
Охват и читатели10K

Это разбор архитектуры системы управления транспортом — без сроков, без смет и без сравнения технологий по галочкам. Только устройство: из чего система собрана, как разложена по кластеру, куда идут данные и почему именно так.

Коротко о предмете. Заказы приезжают из SAP, под них подбираются водитель и машина с учётом требований к транспорту и к точкам. Рейс идёт по точкам с временными окнами, на точках чек-листы, при выдаче и возврате машины составляются акты с фиксацией повреждений. Сверху — поток GPS-координат, отслеживание рейсов и мест, мобильное приложение водителя и публичный контур, где клиент видит свою доставку.

Пятнадцать модулей, три ноды за балансировщиком, RabbitMQ и Kafka по три ноды, PostgreSQL, Redis из шести.

Читать далее

Бенчмаркая System.Text.Json: те же данные, те же настройки, до ×4,3 разницы

Уровень сложностиСложный
Время на прочтение14 мин
Охват и читатели11K

В документации к PropertyNameCaseInsensitive есть предупреждение про накладные расходы, но не сказано, когда они появятся. Замерил на четырёх машинах, трёх рантаймах и трёх размерах входного JSON: пока через настройки идёт один регистр ключей, флаг не добавляет ничего — 0,92–1,09. Политика именования camelCase тоже.

Разницу до ×4,3 даёт другое: какие ещё написания этих ключей прошли через настройки раньше. Два экземпляра JsonSerializerOptions, созданные через new с одинаковыми полями, делят один кеш имён.

Внутри: пять историй с таблицами по четырём машинам, листинги из dotnet/runtime, предел кеша в 64 записи и веб-настройки, на которых эта разница не видна.

Читать далее

Один язык документов, несколько форматов: как я отделил layout engine от PDFBox и Apache POI

Уровень сложностиСредний
Время на прочтение12 мин
Охват и читатели10K

Долгое время GraphCompose выглядел как PDF-движок. Но архитектурно PDF никогда не должен был быть центром системы: разработчик описывает документ на одном языке, движок один раз рассчитывает layout, а подключаемые backend’ы переводят готовую геометрию в нативные объекты нужного формата.

Читать далее