Обновить

Моя лента

Тип публикации
Порог рейтинга
Уровень сложности
Предупреждение
Войдите или зарегистрируйтесь, чтобы настроить фильтры
Новость

Claude Fable 5 нашла контрпример к гипотезе Якобиана — ИИ «сломал» 87-летнюю математическую гипотезу

Время на прочтение4 мин
Охват и читатели13K

Сотрудник Anthropic сообщил, что математическая модель Claude Fable смогла найти контрпример к гипотезе Якобиана — одной из самых известных открытых проблем алгебры. Если результат подтвердится, это станет одним из самых заметных примеров, когда ИИ не просто помогает доказывать теоремы, а самостоятельно находит ошибочность фундаментального математического утверждения.

Читать далее
Статья

На дворе C++23, а заставить компилятор проверять код всё ещё помогает только ассемблер

Уровень сложностиСложный
Время на прочтение20 мин
Охват и читатели15K

Казалось бы, современный C++ дает нам море инструментов для контроля кода на этапе компиляции: static_assert, концепты, constexpr всё, что только можно. Но что делать, если вам нужно заставить разработчика вызвать обязательную функцию инициализации инфраструктуры тестирования для библиотечных классов, а проект собирается под ARM с агрессивным -O2 -Os -flto=auto в недрах Yocto/OpenBMC?

В этой статье я расскажу, как попытка добавить удобный режим тестирования для датчиков которые используют header-only библиотеку столкнулась с невероятно умным оптимизатором GCC 14.2, и почему в эпоху мегабайтных исходников нам всё ещё приходится спускаться на уровень инлайн-ассемблера, чтобы просто заставить линкер выдать ошибку для не корректного кода (для определения правила использования хидера).

Читать далее
Пост

Всем привет!

Сегодня поделюсь своим проектом, где использовал возможности открытых моделей LLM для создания автоматизированного конвейера по переводу англоязычных pdf-файлов в русскоязычные pdf. Как человек, интересующийся именно технологиями в области ИИ мне особенно было интересно максимальное приближенное к оригиналу сохранение содержимого переведенного материала, включая схемы, математические формулы, блоки кода (python) и bash-команд, рисунков (само собой), сохранение сносок, ссылок и пр. метаданных. Целью проекта было применение всевозможных доступных стеков и программ, использующих LLM в конкретной практической задаче. И как оказалось, на первый взгляд, простая задача перевода, с которой современная LLM, созданная и обученная на архитектуре трансформеров справляется на сегодняшний день блестяще, для pdf-формата оказалась не совсем простой (но и не скажу, что особо сложной).

О выборе программного стека технологий. Здесь во многом все определило глубина моих познаний и практических умений работать с LLM-моделями и тем оборудованием (потребительским, конечно), которое имеется дома. Поэтому, исходя из пары-тройки (пары) вычислительных узлов (ноутбуков) в домашней локалке мой выбор определил следующие программные и аппаратные компоненты.

Программные компоненты. Прежде всего это среда выполнения wsl. Просто работает в windows, удобна мне как новичку. В wsl установка обычной env стандартным python. И далее уже конкретные ПО для выполнения задачи перевода pdf на русский. Тут пришлось почитать в сети что есть свободное (исходя из цели использования только открытого ПО и LLM, чтобы оценить уровень их развития). Были опробованы такие программы как Docling, Marker-pdf и еще какую-то). В итоге, для извлечения из pdf в markdown формат я использовал Marker-pdf. У него имеется целый набор специализированных ocr-моделей для парсинга содержимого pdf. Marker в режиме конвейера осуществляет извлечение в указанную папку все содержимое исходного pdf в виде отдельных jpg-файлов, файла метаданных и итогового англоязычного .md файла. Для обратного процесса конвертации переведенного на русский язык ru.md я использовал WeasyPrint и Pandoc. Мой выбор - Pandoc. Сложнее, но поддержка xeLatex и куча настроек через опции командной строки и переменных окружения wsl. Pandoc - единственное ПО в моем конвейере, которое не использует LLM. И собственно, середина - перевод. Готовый скрипт на python. Перевод разбитых на части (chanks) в endpoint LLM - requests.post. Фишкой является url, который через специальный балансировщик, управляющий вычислительными узлами в локалке отправляется в requests.post. Получается параллельный перевод на нескольких узлах с  развернутыми OpenAI-совместимыми LLM. Количество узлов - сколько найдется в домашней ИИ лаборатории))). До и после отправки на перевод в LLM - чистка регулярками от различных костылей и защиты от перевода не нужных элементов (чистка колонтитулов, пагинация, сглаживание двойных переносов строк, изоляция спец. блоков от LLM блоков кода, мат. формул, кода внутри строк, приведение кода к pep8), подготовка переведенного _ru.md к сборке pdf-файла в Pandoc. В итоге - pipeline в 3 шага: Marker-pdf, Скрипт-переводчик на python, Pandoc.

Основные шаги перевода (marker, python скрипт, pandoc)
Основные шаги перевода (marker, python скрипт, pandoc)

Все вместе также можно запустить скриптом bash-сценария:

Использование: ./pipeline.sh <path_to_input_pdf> <output_path> [page_range]

Пример1: перевод всего Pdf-файла

./pipeline.sh /mnt/project/raw_data/embeddings.pdf /mnt/project/rendered/embeddings

Пример1: перевод первых 21 страниц Pdf-файла

./pipeline.sh /mnt/project/raw_data/embeddings.pdf /mnt/project/rendered/embeddings 0-20

Репозиторий на github DemonODG/pdf-translator: English-to-Russian PDF Translation Pipeline

Это мой первый пост на тему применения современных LLM моделей в различных практических задачах. Если это вызовет интерес в более подробном описании данного pipeline - напишу статью поподробнее.

Всем добра!

Теги:
+3
Комментарии0
Статья

AI сделал разработку биллинга дешёвой. Стоимость никуда не исчезла

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели9.8K

Почему-то никто не говорит о том, кто будет поддерживать систему через год. Все обсуждают только, насколько быстро её можно написать.

Читать далее
Статья

Обзор книги «Шеринг специалистов»

Уровень сложностиПростой
Время на прочтение9 мин
Охват и читатели11K

Шеринг специалистов — парадоксальная тема. С одной стороны шеринг снижает и без того невысокие зарплаты, с другой — дает возможность прилично зарабатывать. Бизнес тоже увидел свой интерес в этой модели. Еще в 2019 году народ со знанием дела говорил, что так работать не будет, а к 2026 году сформировался целый рынок, и даже комиссия ФАС провела несколько заседаний, чтобы не дай бог никто ничего не монополизировал. Мне довелось стоять у истоков, наблюдать как появлялись первые конкуренты, как модель ушла в народ и как в конце концов смешались представления об аутсорсинге, аренде и шеринге. Понимание этой разницы приносит деньги, а непонимание — опыт.

Что ж. Попробуем разобраться.

Меня зовут Костя Дубровин. Я тот парень, который заварил эту кашу и написал об этом книгу.

Читать далее
Статья

Что такое качественный антидетект-браузер и почему мы написали свой, когда рынок уже перегрет

Уровень сложностиСредний
Время на прочтение17 мин
Охват и читатели13K

Представьте себе огромный, гудящий рынок электроники для «своих» — такая классическая гиковская Мекка. Вокруг снуют суровые инженеры, пахнет канифолью. На прилавках можно найти всё: от редких микросхем и серверных стоек до самописных контроллеров для умного дома.

По логике вещей, если не в центре этого рынка, то хотя бы недалеко от него, должны стоять палатки, где продают профессиональные аппаратные эмуляторы (стелс-роутеры, хитрые программаторы, способные заставить калькулятор «прикинуться» Макбуком). Ведь спрос немаленький — покупателям нужно парсить данные, обходить блокировки, тестировать сети и автоматизировать рутину. 

Но ряды сменяются палатками, а нормальных продуктов из данной ниши как будто и нет. Это либо покрытые пылью китайские недоделки из 2015 года, либо пустые витрины. Есть отдельно стоящие продавцы, у которых можно найти что-то и про антидетект и про парсинг и много про что еще, но продукт, как будто не на своем месте, среди других похожих, но не то.

В данном материале разберем что такое антидетект-браузер и как он работает. Информация из первых уст!

Читать далее
Статья

Гравитация и квантовая физика фундаментально несовместимы

Уровень сложностиПростой
Время на прочтение21 мин
Охват и читатели16K

Итан Сигел (американский астрофизик-теоретик и научный журналист, изучающий теорию Большого взрыва, автор рубрики "Спросите Итана", один из пропагандистов современных научных знаний), 24 марта 2026 года опубликовал статью с безапелляционным заявлением о том, что два описания Вселенной, которые прекрасно работают, общая теория относительности и квантовая физика, абсолютно несовместимы. Несмотря на все поиски многочисленных теорий квантовой гравитации...

@avshkol перевел эту статью (и снабдил несколькими разъясняющими примечаниями) для всех, кто хочет глубже погрузиться в одну из ключевых проблем (даже, скорее, Проблему №1) современной физики...

Читать далее
Новость

За полгода киберпреступления сократились на 30% и 120 тысяч случаев на фоне внедрения антифрод‑мер и сервисов «Госуслуг»

Время на прочтение1 мин
Охват и читатели9.1K

Минцифры РФ сообщило, что за последние полгода число киберпреступлений сократилось почти на 120 тысяч. По данным МВД, это на 30% меньше, чем за тот же период прошлого года: 371,4 тысячи случаев против 252,9 тысяч.

Снижение заметно и по итогам 2025 года. После запуска «Антифрода 1.0» число случаев онлайн-мошенничества уменьшилось на 90 тысяч. В Минцифры РФ отметили, что пострадавшие от телефонных мошенников смогут рассчитывать на компенсацию ущерба от банков или операторов связи.

Читать далее
Новость

Национальное агентство кадастра Румынии признало кибератаку после нескольких дней сбоев сервиса

Время на прочтение2 мин
Охват и читатели7.9K

Национальное агентство кадастра и земельного реестра Румынии (ANCPI) официально подтвердило, что причиной масштабного сбоя в работе его цифровых сервисов стала кибератака. Несколько дней до этого ведомство называло произошедшее «техническим инцидентом», однако позже признало, что речь идёт о крупнейшем инциденте информационной безопасности в истории учреждения.

Читать далее
Новость

Австралия введет экологические ограничения для дата‑центров, обслуживающих ИИ

Время на прочтение2 мин
Охват и читатели8K

Правительство Австралии представило национальную стратегию развития искусственного интеллекта, которая впервые предусматривает отдельные экологические требования для ЦОД, сообщает The New York Times. Власти намерены ограничить влияние стремительно растущей ИИ‑инфраструктуры на энергосистему и водные ресурсы страны, постараясь при этом сохранить привлекательность Австралии для технологических инвестиций.

Читать далее
Пост

Теорема Хаага и элементарные частицы

Увидел любопытный сюжет из истории теории квантового поля. Теория квантового поля должна описывать взаимодействия и взаимопревращения элементарных частиц. На этом пути выработан формализм с использованием лагранжиана и теории возмущений, который обеспечил прекрасное описание экспериментальных данных. Тем не менее, далее была доказана теорема Хаага, которая противоречила интуиции физиков, обсуждавших взаимодействие разных элементарных частиц.

Если интуиция противоречит теореме, то по идее в физике тем хуже должно быть для интуиции. Однако в случае теоремы Хаага все пошло по-другому. Большинство физиков выбрало интуицию, а теорема Хаага оказалось на обочине теории квантового поля.

Атомизм является краеугольным камнем научной картины мира. Приведу широко известную цитату Ричарда Фейнмана:

'Если бы в результате какой-то мировой катастрофы все накопленные научные знания оказались бы уничтоженными и к грядущим поколениям живых существ перешла бы только одна фраза, то какое утверждение, составленное из наименьшего количества слов, принесло бы наибольшую информацию? Я считаю, что это — атомная гипотеза (можете называть ее не гипотезой, а фактом, но это ничего не меняет): все тела состоят из атомов — маленьких телец, которые находятся в беспрерывном движении, притягиваются на небольшом расстоянии, но отталкиваются, если одно из них плотнее прижать к другому. В одной этой фразе, как вы убедитесь, содержится невероятное количество информации о мире, стоит лишь приложить к ней немного воображения и чуть соображения.'

В квантовой механике существует принцип дополнительности частица-волна, а также проблема интерпретации волновой функции. Однако при рассмотрении теоремы Хаага можно считать, что обычная квантовая механика является идеалом атомизма, поскольку эта проблема никак не связана с интерпретацией квантовой механики.

Квантовая теория поля создана для описания квантовых процессов, связанных с возникновением и превращением частиц. В данном случае требуются специальные усилия, чтобы найти элементарную частицу как таковую в уравнениях квантового поля. Обычная интерпретация частицы в квантовой теории поля связана с репрезентацией Фока, в которой нулевое состояние поля соответствует отсутствию частицы, а возбужденные состояния поля можно связать с наличием одной, двух и т. д. элементарных частиц.

Проблема появляется при переходе к рассмотрению взаимодействующего квантового поля. Согласно теореме Хаага репрезентацию Фока невозможно использовать в случае наличия взаимодействия. Физики Стритер и Уайтмен (Streater and Wightman) выражают действие теоремы Хаага таким образом:

'Картина взаимодействия существует только в случае отсутствия взаимодействия.'

Сказанное выше не означает наличие противоречий в теории квантового поля. Речь идет только про то, что во внутренне непротиворечивой теории квантового поля с взаимодействиями нельзя найти аналога частиц в духе обычной квантовой механики. Таким образом, квантовая теория поля не позволяет создать онтологию, в которой есть элементарные частицы в привычном понимании.

Doreen Fraser. The fate of ‘particles’ in quantum field theories with interactions. Studies in History and Philosophy of Science Part B: Studies in History and Philosophy of Modern Physics 39, no. 4 (2008): 841-859.

Источник

Теги:
+4
Комментарии4
Новость

Российские исследователи представили ИИ-алгоритм Uni-Bond для перевода 3D-структур молекул в химические формулы

Время на прочтение2 мин
Охват и читатели7.7K

Исследователи Института AIRI, НИУ ВШЭ, Московского центра перспективных исследований, МГУ имени М. В. Ломоносова, ТГУ и УрФУ разработали алгоритм искусственного интеллекта Uni-Bond. Как сообщили информационной службе Хабра в пресс-службе AIRI, новый алгоритм переводит трёхмерные координаты атомов в плоскую структурную формулу молекулы. Разработка позволяет связать программы физического 3D-моделирования и алгоритмы машинного обучения, которые предсказывают свойства веществ. Работа представлена на конференции ICML в Сеуле, Южная Корея.

Читать далее
Новость

Я вычислю тебя по бз-бз-бз: создали ИИ-устройство против малярии

Время на прочтение5 мин
Охват и читатели8.2K

Пока все внимание приковано к гонке ИИ-гигантов и большим потреблениям энергии, денег и т. п., на противоположном конце технологического спектра происходит тихая революция. На прошедшем в Женеве саммите ООН AI for Good представили портативный прибор для борбы с малярией и лихорадкой денге, разработанный группой исследователей, включая доцента UOW Киранa Триведи.

Для эпидемиологов это прорыв: традиционный мониторинг требует сбора проб воды, транспортировки личинок в лабораторию и их ручного анализа под микроскопом. Но с инженерной точки зрения куда интереснее другое — то, как именно полноценную нейросеть для обработки аудио удалось «утрамбовать» в микроконтроллер стоимостью $10.

Читать далее

Ближайшие события

Статья

Вебинар 21 июля: как находить клиентов на Авито

Время на прочтение1 мин
Охват и читатели9.8K

Как находить клиентов по смежным покупкам на Авито

Переезд, дача, сезон — люди уже выбирают смежные товары. Это сигналы будущей покупки: их можно ловить раньше прямого поиска и приводить клиентов дешевле.

21 июля в 11:00 мск приглашаем на бесплатный вебинар. Покажем, как работать со смежным спросом, куда вести покупателя, как попадать в момент выбора без лишних расходов

О чём ещё расскажем:

Читать далее
Статья

SINN: как превзойти спектральные методы при решении многомерных уравнений в частных производных

Уровень сложностиСложный
Время на прочтение7 мин
Охват и читатели11K

Привет, Хабр. Меня зовут Тянчи Ю, я работаю младшим научным сотрудником в группе «Вычислительный интеллект» AIRI и учусь на четвёртом году аспирантуры Сколтеха. Мои научные интересы включают научное машинное обучение и численный анализ, а также применение этих инструментов к задачам вычислительной математики.

Думаю, никому из читателей не нужно объяснять, почему уравнения в частных производных столь важны. Их приходится постоянно решать для моделирования физических, инженерных и финансовых систем — причём быстро и с высокой точностью. Однако с ростом размерности задачи вычислительная стоимость классических численных методов стремительно увеличивается.

Спектральные методы обеспечивают исключительно высокую точность в задачах малой размерности. Методы на основе нейронных сетей, напротив, лучше подходят для многомерных задач, но часто уступают с точки зрения точности и эффективности. В 2024 году мы предложили подход, объединяющий преимущества этих двух направлений: спектрально‑информированную нейронную сеть (Spectral Informed Neural Network, SINN). С тех пор нам удалось его усовершенствовать.

Недавно на конференции ICML 2026 мы представили статью, посвящённую новому методу (она, к слову, получила там Spotlight). Здесь же я хотел бы кратко рассказать, что именно мы сделали.

Читать далее
Новость

Google разрабатывает ИИ-чип Frozen v2, который «зашьет» архитектуру Gemini непосредственно в кремний

Время на прочтение2 мин
Охват и читатели7.8K

Google работает над новым серверным ИИ-чипом под внутренним названием Frozen v2, который должен существенно повысить эффективность выполнения моделей Gemini.

Компания планирует реализовать часть архитектуры модели непосредственно на аппаратном уровне, что позволит сократить энергопотребление и увеличить производительность инференса. Проект пока находится на ранней стадии и официально не анонсирован.

Читать далее
Статья

Что нового в IntelliJ IDEA 2026.2

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели12K

Несмотря на то, что IntelliJ IDEA уже несколько лет официально недоступна в России, она по-прежнему остаётся одной из самых популярных IDE среди разработчиков. На днях вышла свежая версия 2026.2.

В релиз вошли новые инструменты для работы с ИИ-агентами, изменения в отладчике и автоматизация ряда повседневных операций. Также появилась поддержка Java 27, Kotlin 2.4, TypeScript 7, будущего Gradle 10 и обновления для Spring, Terraform и Docker Compose.

В статье пройдемся по основным изменениям.

Читать далее
Пост

Собираю резюме, чтобы вычислить причины отказов.

Апдейт на 22.07 (спустя неделю): 5к просмотров, ни одного письма в личку, работать не с чем. То ли мало кто из читателей попадает в очерченную мною группу (не получали ответ на отклики, или не джава-сеньоры, или например ищут не удаленку) а может таких и вообще очень мало за последнее время, то ли читателям не интересно помочь, то ли не хотят/опасаются рассказывать.

---

Хочу получить ответ, но прямой не получу.

Я 20 с чем-то лет в разработке, чего-то классного и прорывного по-моему не было, хотя были и широко известные в узких кругах продукты. Все где-то 15-20 проектов в различных стеках начиная с Win32*, сейчас - Java и микросервисы. Живу в регионах, лет 13 работаю удаленно, последние годы - в крупных компаниях.

Так вот, я конечно знаю что рынок и процессы найма - в тяжелом состоянии. Но у меня наблюдается как будто что-то другое, скорее система, чем невезение. Последние три месяца я копаюсь в рынке, откликаясь на интересные мне вакансии, которых набралось 128 штук пока что. И ни на один отклик ко мне никто не пришел. Кроме ИИ, чтобы задать какие-то вопросы. Да, речь не о проваленных интервью, а об отказе без выхода на связь, или отсутствии ответа. 128 откликов и из них 100% - в пустоту. (Тут стоит отметить, что в 2-3 достаточно контактные конторы из потенциально интересных мне я не писал, есть причины)

И конечно же, мне хочется знать, в чем причина, чтобы этот барьер преодолеть так или иначе. 128 раз подряд - это явно система. Но диалог (когда на него все же обходными путями удается выйти) выглядит примерно так: "мы не предоставляем индивидуальную детализацию по причинам отказа на этапе первичного отбора"

И поэтому я хочу сейчас попробовать другой подход. Дамы и господа Java Senior, проживающие НЕ в Мск/СПб, кто на горизонте 2-3 месяцев (можно 6, но 2-3 это более актуальное состояние рынка) получил визит рекрутера в ответ на отклик в крупные и известные компании (рефералки или прямые письма рекрутерам не в счет, только реакция на отклики в HH) - предлагаю вам написать мне в личку и поделиться своим резюме, с которым вы тогда откликались (можно было бы обезличенным, но просьба все же оставить возраст, если он был, ВУЗ, и тп - сами понимаете, это все может быть факторами отсева). Можно даже не показывать, куда именно, хотя эффективнее будет, конечно, если показать. Если получили оффер, будет здорово, если это тоже отметите. Если удастся собрать достаточно информации для каких-то выводов - опубликую фоллоу-ап.

Теги:
+11
Комментарии13
Статья

Как загрузить любой шрифт Google Fonts на дисплей ESP32 — без Processing и ручной конвертации

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели14K

Встроенных шрифтов TFT_eSPI хватает ровно до того момента, когда интерфейс ESP32 хочется сделать аккуратнее обычного тестового стенда. В статье автор показывает браузерный генератор для Google Fonts и собственных TTF, а заодно объясняет, как устроен формат VLW и что важно учесть при работе со сглаживанием, LittleFS, переносами строк и размером файла.

Настроить шрифты
Статья

Как переработать архитектуру хранилища и мигрировать часть нагрузки в Data Lakehouse

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели10K

У корпоративных хранилищ есть одна особенность: чем дольше они живут, тем больше задач на них пытаются навесить.

Сначала туда попадают предсказуемые вещи: CRM, ERP и внутренняя отчетность. Но потом добавляются документы, записи разговоров, данные для ML, генеративный ИИ и еще десяток сценариев, о которых никто не думал, когда проектировал DWH десять лет назад.

Что тогда делать? Сейчас расскажу.

Читать далее