Обновить
256K+
1 650,96
Рейтинг
75 477
Подписчики
Сначала показывать

Как мы учим гуманоида работать в динамической среде и почему это не так просто, как кажется

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели7.5K

Сегодня большинство впечатляющих демонстраций роботов показывают их действия в статической среде: предметы лежат на столе, освещение стабильно, камера направлена в рабочую зону, а сама сцена почти не меняется. В таких условиях современные VLA действительно показывают высокое качество управления.

Но реальные задачи для роботов в быту или на производстве намного сложнее. Как минимум — объекты движутся по конвейеру. И если с ними взаимодействует не закрепленный манипулятор, а полноростовой робот, ему придется делать шаги и поддерживать баланс тела дополнительными движениями. Все это многократно усложняет расчет движений.

Привет, Хабр! Меня зовут Дания, я ML-инженер в MTC Web Services. Мы в RnD-направлении Physical AI разрабатываем VLA (Vision-Language-Action) политику для гуманоида, который должен взаимодействовать не с аккуратно разложенными объектами на столе, а с предметами, которые двигаются во время выполнения действия.

В этом материале я хочу сосредоточиться на одной конкретной проблеме: почему робот уверенно берет предмет со стола, но начинает промахиваться, когда предмет едет по конвейеру. А еще расскажу, над чем мы сейчас работает у себя, чтобы научить гуманоида справляться с задачей в подобных условиях.

Читать дальше

Полезные ссылки

MWS Octapi Integration Platform: объединение сложных филиальных организаций при помощи Event Mesh

Время на прочтение11 мин
Охват и читатели7.1K
Всего голосов 5: ↑5 и ↓0+11
Комментарии0

Добро пожаловать на борт, или Как в МТС проходит техонбординг

Время на прочтение14 мин
Охват и читатели9.2K
Всего голосов 33: ↑28 и ↓5+26
Комментарии7

Интеграционная платформа в The Platform: что умеет, как работает и зачем ей Workflow Engine

Время на прочтение7 мин
Охват и читатели5.8K
Всего голосов 10: ↑10 и ↓0+13
Комментарии3

DataOps Platform: из чего состоит наша платформа для работы с данными и как мы её создавали

Время на прочтение5 мин
Охват и читатели7.8K
Всего голосов 7: ↑5 и ↓2+9
Комментарии1

Одна платформа, чтобы мониторить всех: как мы осуществляем трассировку, работаем с логами и метриками во всей экосистеме

Уровень сложностиСредний
Время на прочтение6 мин
Охват и читатели16K
Всего голосов 12: ↑12 и ↓0+18
Комментарии8

Умные камеры для переговорных комнат: какие бывают, как работают и что выбрать

Время на прочтение7 мин
Охват и читатели6.1K

Привет, Хабр! Еще 5 лет назад интеллектуальные функции камер в переговорных комнатах в основном ограничивались автоматической регулировкой экспозиции и простым шумоподавлением. Сейчас к этому добавились нейросетевые детекторы людей, отслеживание по голосу и видео, режим мультикадра и режиссерские сценарии переключения. Но даже самая продвинутая камера будет бесполезна, если ее тип и расположение не соответствуют размеру комнаты и сценариям встреч, а свет настроен неправильно.

Меня зовут Дмитрий Белозеров — я работают в МТС Линк и моя команда отвечает за ПО и оборудование для переговорных комнат. На основе своего опыта и опыта коллег составил гид по основным типам камер, ИИ-функциям и сценариям для разных помещений. Материал пригодится новичкам и тем, кто хочет быстро погрузиться в тему.

Читать дальше

Превращаем виртуальный индикатор кислорода Subnautica в реальное устройство. Часть 1

Время на прочтение10 мин
Охват и читатели13K

Если подумать, то игр, действие которых разворачивается преимущественно или целиком под водой не так много. Да, я изучал подводный город Восторг в BioShock, управлял героями в Barotrauma и исследовал бесконечный океан в ABZÛ. Но ни одна из них не подарила мне столько эмоций, сколько Subnautica. Тот самый случай, когда садишься днем поиграть на час, а потом обнаруживаешь, что в реальном мире уже глубокая ночь.

Сейчас в ранний доступ вышла вторая часть, и для меня это стал отличным поводом перепройти оригинальную игру с нуля. Ныряешь, и главным прибором становится счетчик кислорода. Он позволяет оценить, стоит ли двигаться дальше или пора возвращаться. А прозвучавшее синтетическим голосом слово «oxygen» говорит о том, что времени на принятие решения уже не осталось. В какой-то момент мне пришла мысль: было бы здорово превратить счетчик в реальное устройство. Это и положило начало небольшому, но интересному DIY-проекту.

Читать дальше

Старая архитектура, новые процессоры: зачем AMD продолжает выпускать Zen 2

Время на прочтение5 мин
Охват и читатели8.3K

Кажется, что в процессорном мире все идет строго по плану: вышла Zen 5, готовится следующее поколение, а сокет AM5 постепенно становится основной платформой AMD. На этом фоне немного странно видеть в продаже процессоры с архитектурой 2019 года. И речь не о складских остатках, а о вполне новых моделях.

Вот наглядный пример — в марте 2026 года вышел Ryzen 7 4700LE. Восемь ядер, шестнадцать потоков, теплопакет 65 Вт, никакой встроенной графики и все тот же сокет AM4. В его основе лежит архитектура Zen 2 и кристалл Renoir, давно знакомый по мобильным процессорам. Теперь этот чип используют в недорогих игровых сборках с RTX 3050 с ценой примерно 800 долларов. Возникает закономерный вопрос: зачем AMD продолжает выпускать процессоры на архитектуре и платформе, которые, казалось бы, уже давно должны были уйти в прошлое?

Читать дальше

Данные, которые нельзя выдумать: как мы собираем трейсы для тренировки агентских навыков Cotype

Уровень сложностиСредний
Время на прочтение11 мин
Охват и читатели8.7K

Привет, Хабр! На днях мы выкатили третье поколение языковых моделей Cotype — флагманскую Cotype Pro 3 и ее облегченную версию Cotype Light 3 (к слову, лайт мы выкатили чутка раньше, но это не имеет значения). Почитать о характеристиках моделей можно вот в этом посте. Тут же мы расскажем вам о нюансах обучения — точнее о том, как мы учим наши модели выполнять многошаговые сценарии без запинок, что совершенно необходимо, так как они выступают ключевым компонентом наших корпоративных ИИ-агентов и мультиагентных систем.

Велком под кат

И треснул мир напополам: как в США и Китае развили две инженерные школы графического GenAI

Уровень сложностиСредний
Время на прочтение18 мин
Охват и читатели8.4K

Генерация изображений в последнее время заметно продвинулась и справляется даже с тонкими задачами на высоком уровне. За последние два года я с базовыми знаниями в дизайне оформлял книги, готовил иллюстрации для статей, собирал презентации и решал графические задачи в коммерческих проектах — и вынес из этого одно: универсальной модели не существует. Каждая архитектура сильна в своей нише, а выбор инструмента стал такой же частью работы, как и сам промпт.

Работая с Midjourney, DALL-E 3, FLUX, Hunyuan-DiT, Wanxiang и Seedream, я заметил: один и тот же запрос в разных системах давал принципиально разные результаты — и дело было не в стилистике. Одни модели буквально расставляли объекты по местам, как в инструкции. Другие могли проигнорировать часть описания, зато выдавали плотность деталей и сложность ракурсов, недоступную первым.

Сначала я списывал это на языковой барьер — казалось, что западные и китайские системы по-разному интерпретируют запрос. Но список причин быстро расширился: датасеты, токенизаторы, глубина текстовых энкодеров. Каждая деталь что-то объясняла, но общей картины не давала. За различиями стояло нечто большее — две инженерные школы, изначально оптимизировавшие разные ресурсы, а сейчас движущиеся к конвергенции.

Тут я вспомнил старый плакат из дизайн-студии нулевых: «Быстро. Дешево. Качественно. Выберите любые два». Раньше это звучало как шутка, теперь — как точное описание логики развития сложных систем.

Эта статья — попытка понять сложившуюся экономику моделей через их историю: разобрать ключевые развилки последних лет, заглянуть под капот графических движков и понять, в какие ниши сегодня выстраивается конвергенция технологий.

Читать далее

Не только Neuralink: как сегодня развиваются интерфейсы «мозг-компьютер»

Время на прочтение7 мин
Охват и читатели14K

Когда Neuralink Илона Маска выкладывает ролики, где человек силой мысли двигает курсор или печатает текст, это всегда собирает кучу просмотров и обсуждений. И ведь это не просто так — технология действительно впечатляет. Импланты вживляют прямо в кору, сигналы от отдельных нейронов летят в компьютер почти без потерь, и выглядит все это как настоящее будущее, которое уже здесь.

Но за громкими новостями о Neuralink легко не заметить, что эта компания не главная. Сегодня интерфейсы «мозг-компьютер» развиваются сразу в нескольких направлениях: от полностью имплантируемых систем до устройств, которые достаточно просто надеть на голову. Причем именно второй путь сейчас особенно активно продвигают китайские компании, рассчитывая быстрее вывести такие решения из лабораторий в реальную медицину. Давайте разбираться. 

Читать дальше

Вы умеете читать чужие мысли. Но наука уже 50 лет не может понять как

Уровень сложностиСредний
Время на прочтение11 мин
Охват и читатели15K

Девочка Салли прячет шарик в корзинку и уходит. Тетя Анна достает его и перекладывает в коробку. Салли возвращается.

Вопрос двум детям, которые наблюдали: где Салли будет искать шарик?

Трехлетний ответит — в коробке. Там же шарик, логично.
Четырехлетний — в корзинке. Там, где его нет, но там Салли его оставила.
Чувствуете логическую дыру? А ее нет.

Только что я воспроизвел вам известный научный эксперимент, который по сей день оставляет науке когнитивного восприятия незакрытый вопрос. Сегодня поговорим об одной из самых загадочных и простых теорий психологии, с которой не могут разобраться полвека.

Читать далее

Кулеры больше не нужны? Создан материал с «программируемым» отведением тепла от чипов

Время на прочтение4 мин
Охват и читатели11K

Современные процессоры, графические ускорители и ИИ-чипы становятся все мощнее, но вместе с производительностью растет и нагрев. Причем проблема не только в том, что тепла много. На одном участке кристалла температура может быть значительно выше, чем на соседнем, а в многослойных чипах отвести тепло от внутренних компонентов становится все сложнее.

Исследователи из Университета Осаки предложили необычный способ частично решить эту проблему. Они создали материал, который позволяет направлять тепловое излучение в нужную сторону и одновременно не требует постоянного питания для сохранения выбранного режима. По сути, это программируемый элемент управления теплом: достаточно один раз задать нужное состояние, после чего оно сохраняется до следующего изменения. Добиться такого эффекта удалось, объединив магнитооптический материал с решеткой на основе вещества с фазовым переходом. Как это работает? 

Читать дальше

Время течет назад, а у Вселенной три временных измерения?

Уровень сложностиСредний
Время на прочтение7 мин
Охват и читатели14K

Стрелка часов выглядит самым надежным элементом физической реальности. Секунды сменяют друг друга строго вперед, прошлое закрыто, будущее неизвестно. Но стоит обратиться к уравнениям микромира, как эта уверенность рассыпается.

Базовые законы Вселенной — от механики Ньютона до квантовой теории поля — обладают T-симметрией. Математически они инвариантны относительно обращения времени. Если заменить переменную t на −t, формулы продолжат работать корректно. В микромире нет разницы между прошлым и будущим. Однако наше макроскопическое восприятие фиксирует жесткий односторонний вектор. Откуда берется эта асимметрия?

За последние годы физики предложили несколько радикальных объяснений парадокса. Мы разберем четыре любопытные концепции: модель Джулиана Барбура, работы физика Рокко, специальную теорию относительности и механизм Пейджа — Вуттерса.

Забегая вперед: к консенсусу ученые все еще не пришли а некоторые теории и вовсе предлагают исключить время из списка базовых физических величин.

Читать далее

Ученые составили каталог вирусов: он поможет предсказать следующую пандемию

Время на прочтение6 мин
Охват и читатели8.7K

Практически каждый год в научных журналах появляются сообщения о двух-трех новых потенциально опасных для людей вирусах. Большая часть так и остается в разряде любопытных находок — интересных для специалистов, но не вызывающих особого шума за пределами лабораторий. Но иногда среди них попадаются те, что потом меняют правила игры на годы вперед. Достаточно вспомнить ВИЧ, который выявили в начале восьмидесятых, или тот коронавирус, что в 2020-м привел к глобальным последствиям.

Чтобы каждый раз не начинать оценку нового вируса с нуля, исследователи обновили и опубликовали каталог всех известных РНК-вирусов, способных инфицировать человека. Сейчас в нем собраны сведения о 239 видах, включая их главные характеристики: круг хозяев, пути передачи, умение распространяться между людьми и другие важные параметры. Благодаря этому новые находки можно быстрее сопоставлять с уже изученными вирусами и гораздо раньше понимать, насколько серьезную угрозу они потенциально представляют. 

Читать дальше

Коллега по имени Себастьян: зачем Microsoft сделала своего OpenClaw

Время на прочтение7 мин
Охват и читатели7.1K

Независимый разработчик собирает инструмент, через несколько недель о нем говорит весь интернет, а спустя несколько месяцев крупная корпорация показывает собственную версию той же идеи — с корпоративными политиками, аудитом и подпиской. Знакомая история? Так происходит любая технореволюция. Недавно этот путь прошел OpenClaw — от opensource-проекта до Scout, нового ИИ-агента Microsoft. Разберем, почему эта история интересна и самим продуктом, и тем, как индустрия приручает технологии.

Читать далее

Apache Camel: почему аналитик в нём ничего не сделает и при чём тут красивый UI

Уровень сложностиПростой
Время на прочтение9 мин
Охват и читатели14K

Привет, Хабр! Меня зовут Александр Бардаш, и я CTO интеграционной платформы MWS Octapi. В одной из предыдущих статей я рассказывал, как мы выбирали движок для low-code и почему остановились на Temporal, отказавшись от Apache Camel. С тех пор регулярно получаю один и тот же вопрос — от продактов, аналитиков, а иногда и от коллег-архитекторов: «Подождите, ну сейчас же есть Karavan, Kaoto, нормальные визуальные редакторы. Аналитик там накидает кубики, настроит логику, разве это не cделает Camel доступнее?» Короткий ответ — нет, не cделает. А вот почему, предлагаю разобрать в материале.

Дисклеймер: это мой личный опыт и опыт команды. Тема спорная, у вас может быть своя картина.

Читать далее

Как научить ИИ понимать графики: разбираем новый набор данных ChartNet от MIT

Время на прочтение7 мин
Охват и читатели11K

Привет, Хабр! Меня зовут Павел, я ML-инженер и исследователь в области ИИ. Недавно наткнулся на исследование, посвященное проблеме понимания графиков визуально-языковыми моделями (Vision-Language Model, VLM), и решил подробнее разобраться в этой теме.

В наши дни большое количество научных, деловых и политических данных представляется в формате графиков, однако современные VLM решают задачу их анализа лишь частично. Одна из главных причин этого — отсутствие масштабных и разнообразных наборов данных для обучения и тестирования.

Исследователи из MIT и IBM Research предложили оригинальное решение — ChartNet, мультимодальный датасет для обучения моделей анализу и интерпретации графиков. Разберемся, как он устроен и насколько эффективен.

Читать далее

Наём без испытательного срока: как AI-агенты получили должности и влияют на рынок труда

Уровень сложностиПростой
Время на прочтение12 мин
Охват и читатели9.8K

У AI-агентов уже есть профессии: юрисконсульт, ведущий специалист по внешним коммуникациям, директор контроля работы AI. Это настоящие должности — с обязанностями и зоной ответственности. У некоторых даже с собственной придуманной биографией.

Все три (и еще несколько сотен похожих) произошли из одного и того же места. В октябре 2025-го Anthropic выпустила штуковину под названием skill: папка с инструкциями, которую модель открывает сама, когда задача из промпта совпадает с описанием внутри самого скила.

В переводе на русский — должностная инструкция в текстовом файле, в переводе на айтишный — мастер-промпт. 

Но интересен здесь не только сам формат. Вокруг таких папок уже строится корпоративная инфраструктура: агентам назначают роли, выдают доступы и подключают их к рабочим системам. Крупные компании тратят деньги на внедрение, консультанты зарабатывают на настройке, а при появлении нового плагина падают акции всех компаний в целой отрасли.

В этом материале поговорим о том, зачем вообще одевать папку с инструкциями в костюм сотрудника, кому приносит деньги такая конструкция и как она влияет на бизнес и рынок труда.

Читать далее

Моды, которые превращают ванильный Fallout 4 в современную игру. Часть 1

Время на прочтение7 мин
Охват и читатели9.9K

Несмотря на возраст, Fallout 4 до сих пор остается одной из лучших игр Bethesda. Исследование мира, атмосфера и свобода действий почти не устарели (кто-то с этим поспорит, конечно), а вот техническая часть выдает возраст проекта. Размытые текстуры, подлагивание при движении, особенности работы физики и некоторые ограничения движка постоянно напоминают, что игра вышла еще в 2015 году.

Хорошая новость заключается в том, что совсем не обязательно ставить множество модов. Достаточно собрать небольшую базовую подборку, которая исправляет слабые места и не превращает Fallout 4 в бесконечный эксперимент с совместимостью. По такому пути я и решил пойти в первой части своего обзора. Во второй уже начнется хардкор — с неожиданными модификациями и кардинальными изменениями ванильной игры. Что ж, давайте начнем.

Читать дальше

Java в эпоху ИИ. К чему пришли на пятом MTC Web Services Meetup для разработчиков

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели8.9K

Еще несколько лет назад разработчики на Java в основном обсуждали новые инструменты для создания программ, особенности архитектуры приложений и способы сделать сервисы быстрее и надежнее. Сегодня к этим темам добавился еще один важный вопрос — как искусственный интеллект меняет профессию программиста. Именно с этого началась пятая встреча в рамках MTC Web Services Meetup, которая собрала в Москве Java-разработчиков, архитекторов и инженеров.

Вместо привычной серии докладов организаторы открыли вечер большой дискуссией о том, как меняется современная разработка, чему теперь стоит учиться, какую роль играют ИИ-ассистенты и как их использование влияет на безопасность решений. Обо всем этом — в материале.

Читать дальше

Роботизация тяжелой строительной техники: от экспериментов к реальности

Время на прочтение10 мин
Охват и читатели9.7K

Привет, Хабр! На связи МТС, и сегодня мы снова поговорим о роботах. Но не о доставщиках или пылесосах — тут все серьезнее. Залезем в мир тяжелой строительной техники и посмотрим, как автоматизируют машины, которые работают на стройках.

На любой стройплощадке полно техники: самосвалы, экскаваторы, краны. И рано или поздно их всех роботизируют. Но мы не будем пытаться объять необъятное и остановимся на экскаваторах — точнее, на машинах, которые перерабатывают сыпучие материалы.

Что это значит? Эффективно и точно перемещать большие объемы песка, щебня, мусора — такая задача стоит в куче отраслей: от разгрузки судов до сортировки отходов, строительства и сноса зданий. Это повторяющаяся, тяжелая и небезопасная для человека работа. Обычно ее делают большие гидравлические погрузчики с ручным управлением.

В кино любят показывать роботов, способных практически полностью заменить человека в любой задаче. В реальности все сложнее. Так, робот-экскаватор должен уметь и видеть среду, и выбирать, за какую часть кучи хвататься, и строить маршрут, и управлять движением — все в одном флаконе.

С теорией закончили, переходим к практике. Сначала посмотрим, на чем проводили эксперименты.

Читать далее

wiiMac: запускаем Mac OS X на Nintendo Wii

Время на прочтение8 мин
Охват и читатели12K

Парадоксально, но факт: классическая консоль Nintendo Wii ближе к старым Mac, чем может показаться. Внутри процессор IBM Broadway с архитектурой PowerPС 750 подобные чипы использовались в iMac G3 и iBook G3. Эти компьютеры работали под управлением ранних версий MacOS X, что упрощает задачу — не надо ничего эмулировать. Код ОС будет выполняться процессором нативно, без лишних абстракций.

Однако есть и ряд сложностей: все же Wii не является Macintosh, а следовательно, большая часть компонентов взаимодействуют иначе. У консоли другой загрузчик, видеоподсистема и периферия. Так что запуск на ней MacOS X — задача со звездочкой. Поэтому наливайте себе холодный чай, доставайте фрукты и добро пожаловать под кат.

Читать далее

Сделать технический воркшоп: наш опыт и ошибки после обучения 60+ участников

Уровень сложностиПростой
Время на прочтение10 мин
Охват и читатели6.8K

Привет, меня зовут Филипп Бочаров, CPO в МТС Web Services и член программного комитета HighLoad++. 8 лет я занимаюсь наблюдаемостью (observability) продуктов - внедряю, обучаю, выступаю и менторю. В этом году мы с командой придумали воркшоп "Смотри, как думает агент: Observability AI-агентов с Langfuse", подготовили его всего за 2 месяца и успешно провели на AIConf 2026 и Saint HighLoad++ 2026.

Наш воркшоп прошли уже 60+ человек, которые оценили его содержание на 4.62 из 5 баллов и дали положительный фидбек. Но когда мы начали его готовить, оказалось, что воркшоп требует совершенно другого подхода, чем обычный доклад. Некоторые проблемы мы вообще не могли предсказать. 

В этой статье я поделюсь нашей историей, ошибками и выводами о том, как готовить интерактивные форматы: воркшоп и мастер-класс. Ведь московский HighLoad++ 2026 уже не за горами и открыт для заявок!

Узнать как делать воркшопы
1
23 ...

Информация

Сайт
www.mts.ru
Дата регистрации
Дата основания
Численность
свыше 10 000 человек
Местоположение
Россия