Обновить
128K+

Обработка изображений *

Работаем с фото и видео

59,75
Рейтинг
Сначала показывать
Порог рейтинга
Уровень сложности

Взлом старой каптчи сайта Хабрахабр

Время на прочтение9 мин
Охват и читатели47K

Введение



В данной статье кратко рассказывается о процессе взлома captcha используемой ранее при входе на сайт Хабрахабр.
Целью работы является применение знаний на практике и проверка сложности каптчи.
При разработке алгоритма использован Matlab.

Читать дальше →

Алгоритм аннотирования иллюстраций или почему бы программисту не быть немного дизайнером?

Время на прочтение2 мин
Охват и читатели18K
Хочу представить вашему вниманию одну любопытную задачу и несколько способов ее решения. Изначально задача появилась на stackoverflow, но перед тем как перейти к сути хочу подчеркнуть отсутствие какого бы то ни было желания навязать свою точку зрения.

Итак, задача: есть серия изображений и набор пояснительных меток к каждому изображению, необходимо оптимальным образом расставить метки, избежав пересечения связывающих линий и сохранив общую читабельность.

Читать дальше →

Прецизионный поворот растрового изображения на произвольный угол

Время на прочтение8 мин
Охват и читатели59K
Поворот растрового изображения на углы, кратные 90°, относительно геометрического центра изображения – задача тривиальная и решается без потери качества простым преобразованием координат каждого пикселя.

Для поворота растрового изображения на произвольный угол разработаны быстрые но не оптимальные алгоритмы, дающие приемлемую для практических целей аппроксимацию с потерей качества (например, этот).
Довольно давно, из чисто спортивного интереса, меня заинтересовала задача максимально точного поворота растрового изображения на произвольный угол. К сожалению, мне нигде не удалось найти готовый алгоритм, поэтому пришлось делать его собственноручно. Даже если в итоге я «изобрёл велосипед», результат, как мне кажется, получился достаточно интересным, чтобы им можно было поделиться.

Ниже мы рассмотрим алгоритм прецизионного поворота растрового изображения на произвольный угол относительно произвольного центра с минимальными потерями.

Выражаю благодарность Харченко Владиславу Владимировичу за оказанную помощь.
Читать дальше →

Ушел из жизни Брюс Байер, «отец цифровой фотографии»

Время на прочтение1 мин
Охват и читатели8.8K


К сожалению, никто из нас не вечен. Сегодня стало известно о том, что Брюс Байер, которого действительно можно назвать «отцом цифровой фотографии», умер. Ему было 83 года, и за свою жизнь Байер сделал много чего полезного. Одним из наиболее известных изобретений Байера является «фильтр Байера». Это массив цветных фильтров для светочувствительных элементов датчиков изображения. Соответственно, благодаря данному фильтру стало возможным получать цветные изображения с использованием одного датчика.

Читать дальше →

Делаем превью сайтов в стиле Yandex Браузера

Время на прочтение5 мин
Охват и читатели24K
yandex browserПрошло уже почти два месяца как Yandex порадовал некоторых пользователей новым продуктом — Yandex Браузером. Несмотря на невероятную динамику развития продуктов в этой области (Chrome и Firefox), Яндексу удалось привнести в свой браузер ряд новых идей.

Из всех особенностей этого браузера больше всего меня зацепило их дизайнерское решение относительно изображений сайтов в «быстрых закладках» (Speed dial). Люди любят глазами и поэтому приятно видеть у себя в новом табе не пустую белую страницу, а красочные картинки. Беда только в том, что лично я, чаще всего, смотрю на подпись под этой картинкой или же на favicon, так как по скриншоту сайта бывает очень сложно его узнать. Эту проблему дизайнеры яндекса, на мой взгляд, решили очень элегантно. В данном посте мы посмотрим, как реализовать эту идею на клиентской стороне.

Читать дальше →

Японский сканер оцифровывает книгу в 250 страниц за минуту

Время на прочтение1 мин
Охват и читатели49K


На Хабре недавно публиковалась статья о сканере, разработанном сотрудником Google. Конструкция позволяет отсканировать книгу в 1000 страниц за 90 минут. Но есть еще более производительные устройства. Японцы недавно представили сканер, способный оцифровать те же 1000 страниц за 4 минуты (!). Заявленная производительность — 250 страниц в минуту. Описание сканера и видео с демонстрацией его работы — в продолжении.

Читать дальше →

Intel поглощает разработчика ARM-чипов — компанию ZiiLabs

Время на прочтение3 мин
Охват и читатели11K
Корпорация Intel сообщила о сделке с компанией Creative Technology по приобретению за 50 млн.$ компании ZiiLabs — дочернего предприятия Creative Technology, занимающегося разработкой многоядерных ARM-чипов ZMS-40 и ZMS-20, которые до сих пор применялись в различных Android-устройствах: планшетах, медиа-плеерах таких как Creative Zii Egg и других аппаратах.

ZiiLabs известна тем, что в январе 2012 года представила 100-ядерный SoC-чип ZMS-40. И на рынке мобильных устройств, GPU-решения ZiiLabs конкурируют с графическими чипами PowerVR разрабатываемыми компанией Imagination Technologies.

Согласно условиям достигнутого соглашения, из 50 млн.$, около 30 млн заплачены за основные фонды и инженерные ресурсы ZiiLabs, а остальные — за патенты и лицензии на GPU-технологии ZiiLabs.
Читать дальше →

Робот рисует портреты почти как человек

Время на прочтение1 мин
Охват и читатели27K
Патрик Трессе — французский художник и программист, живущий в Лондоне, уже несколько лет занимается созданием робота, способного рисовать, как человек. Обычно машинная имитация штрихов и линий, сделанных человеческой рукой, выглядит фальшиво и примитивно, но Патрику удалось добиться впечатляющих успехов. Робот по имени Пол, созданный в рамках проекта Aikon-II, рисует довольно убедительно и естественно. Его алгоритмы — плод многолетнего изучения и анализа тысяч графических работ художников разных эпох и стилей.


Читать дальше →

Наложение текста и картинок на изображение с помощью библиотек MagickWand и GD

Время на прочтение5 мин
Охват и читатели21K
MagickWand — одна из библиотек, осуществляющих доступ к пакету программ ImageMagic, для работы с изображениями в PHP. Рассмотрим особенности наложения текста и графики в ней. Говорят, что ImageMagic очень быстрый и дает результат лучшего качества (но не так распространен как GD). За одно проверим это.
Читать дальше →

Конкурс «Интернет-математика: Яндекс.Карты» — опыт нашего участия и описание победившего алгоритма

Время на прочтение12 мин
Охват и читатели42K
Прошло уже больше года после завершения конкурса "Интернет-математика: Яндекс.Карты", но нас до сих пор спрашивают об алгоритме, который принёс нам победу в этом конкурсе. Узнав о том, что недавно Яндекс объявил о старте очередной "Интернет-математики", мы решили поделиться опытом нашего прошлогоднего участия и описать наш подход. Разработанный алгоритм смог с точностью 99.44% правильно определить лишние изображения в сериях панорамных снимков, например, как здесь:



В этой статье мы описываем основные идеи алгоритма и приводим его детали для интересующихся, рассказываем об извлечённых уроках и о том, как это всё вообще было.

Исходный код нашего решения доступен на github (C++ с использованием OpenCV).
Читать дальше →

На фотографиях Lytro теперь можно менять перспективу и цвет

Время на прочтение1 мин
Охват и читатели24K


Так называемый пленоптический фотоаппарат Lytro уже не раз описывался на Хабре. Интерес к этому девайсу понятен — ведь он делает то, на что не способен пока ни один другой фотоаппарат. До настоящего момента на фотографиях, полученных при помощи Lytro, можно было изменять только фокус. Теперь же, с обновлением программного обеспечения, появилась возможность менять перспективу, а также добавлять некоторые фильтры, изменяющие внешний вид фото. Правда, обновление, о котором идет речь, появится только в начале декабря (4 числа).

Читать дальше →

Инженер Google разработал сверхбыстрый сканер — 1000 страниц за 90 минут

Время на прочтение1 мин
Охват и читатели58K


Участник проекта Google Books Бенджамин Стаффин (Benjamin Staffin) опубликовал на своей странице в Google+ сообщение о том, что он разработал действующую модель эффективного сканера для сверхбыстрого сканирования, которая не требует участия человека и крайне бережно относится к страницам книги.
Узнать подробности

Системы распознавания номеров на практике

Время на прочтение9 мин
Охват и читатели102K


Наверняка каждый сталкивался с историями – «Здравствуйте, мне надо проехать в компанию, которая у вас на территории находится», получая в ответ, что «пропуск не заказан», «нельзя» или и вовсе глухие ворота высотой метра 4. Притом сам въезд как правило охраняется очень разным контингентом – от не совсем трезвого дяди Васи со стаей собак до реальных профи на важных объектах.

Задач, решаемых IT-средствами, тут три:
  • На большую часть объектов, где въезд контролирует человек, можно зайти, использовав социнжиниринг, денежную купюру или, наоборот (реже), не войти из-за ряда причин, связанных с человеческим фактором. Нужно делать так, чтобы те, кому нужно въехать, всегда могли это сделать, а те кому не нужно — не могли.
  • При этом издевательство с пропусками лучше пропустить. В идеале – ещё и пропустить стадию выхода из машины вообще. Ваш контакт отправил информацию о том, что вам можно — и ворота открываются автоматически.
  • Служба безопасности должна чётко контролировать перемещения, иметь возможность выяснить, чья вот это машина стоит на территории и видеть перемещения людей по объекту за любой срок.

В топике – про эволюцию от верёвочки на входе до современных систем распознавания номеров.
Читать дальше →

Ближайшие события

Распознавание эскизных изображений

Время на прочтение1 мин
Охват и читатели7.9K
Группа исследователей из американского университета Браун и Берлинского технического университета опубликовали свои результаты, связанные с проблемой компьютерного распознавания эскизов — таких, какие показаны на картинке ниже. При этом в качестве результата приведен не только длинный и скучный документ, а и готовые образцы ПО, которые можно скачать и попробовать.



Узнать подробности

Технологии экранов псевдоголографии

Время на прочтение3 мин
Охват и читатели136K
В этой статье я покажу несколько способов создания псевдоголографических изображений. «Псевдо» потому, что изображение на самом деле плоское, но грамотно спроектированное освещение и фон создают иллюзию объемности.
Читать дальше →

Простой хромакей по цветовой компоненте RGB

Время на прочтение2 мин
Охват и читатели24K
Все чаще и чаще нам на глаза попадается использование хромакея в самых неожиданных местах. Долго свербила мысль попробовать реализовать что-то свое.
Читать дальше →

Кластеризация дубликатов в поиске по картинкам

Время на прочтение4 мин
Охват и читатели18K
Каждый месяц на Яндексе поиском по картинкам пользуется больше 20 миллионов человек. И если кто-то из них ищет фотографии [Мэрилин Монро], это не значит, что им нужно найти лишь самые знаменитые снимки актрисы. В такой ситуации результаты, в которых большая часть найденных изображений будет копиями одних и тех же картинок, вряд ли устроят пользователей. Им придётся пролистать большое количество страниц, чтобы увидеть разные фотографии Монро. Для того чтобы облегчать людям подобные задачи, нам нужно сортировать картинки в результатах поиска так, чтобы они не повторялись. И мы научились «раскладывать их по полочкам».



Когда в 2002 году в Яндексе появился поиск по картинкам, технологий, позволяющих компьютерам непосредственно «видеть», какие объекты есть на изображении, не было вообще.
Читать дальше →

Инструменты для оптимизации сайта под Retina

Время на прочтение1 мин
Охват и читатели23K
В последнее время появляется все больше устройств с экранами, плотность пикселей которых очень высока: компания Apple выпустила MacBook с Retina, Google анонсировал Nexus 10 с разрешением 2560x1600 пикселей. Вместе с современными технологиями приходят новые проблемы для разработчиков сайтов. Например, на новых экранах растровые изображения смотрятся не очень хорошо, их необходимо оптимизировать под Retina. В этой подборке представлены некоторые инструменты, помогающие в этом.

Picturefill (демо), автор Scott Jehl


Делает изображения адаптивными и независимыми от разрешения экрана.

Читать дальше →

Kinect сможет моделировать объекты

Время на прочтение1 мин
Охват и читатели10K
Команда инженеров, занимающаяся проектом Kinect, занята созданием новой и эффектной возможности под кодовым наименованием Kinect Fusion, пришедшей из лабораторий Microsoft Research в реальную разработку, которая вскоре будет включена в SDK и которая позволит выполнять моделирование трёхмерных объектов, просто поместив объект в поле видимости устройства.

Фактически речь идёт о следующем: владелец Kinect, желая получить виртуальную копию чего-либо, начиная от простых объектов вроде мяча и заканчивая объектами со сложной формой, должен поместить этот объект перед Kinect, который выполнит его сканирование и разместит в 3D-пространстве. При этом ничего не помешает выполнить сканирование сразу всех окружающих приставку объектов вроде комнаты; при этом если сенсоры Kinect «ошибутся», то моделируемый предмет можно будет повертеть перед приставкой, и модель будет уточнена.
Узнать подробности

Конкурс Ivideon. Продолжение

Время на прочтение4 мин
Охват и читатели5.7K


Вчера мы рассказали о том, что объявляем конкурс на создание демонстрационного приложения на основе OpenCV для слежения за несколькими объектами, где в качестве приза будет поездка вместе с нашей командой на Шри-Ланку, а также предложение о работе в нашей компании.

Очень здорово, что конкурс был воспринят позитивно и нам активно стали писать всеми различными способами, чтобы уточнить те или иные вопросы. Многие из них были достаточно однотипными, поэтому нам бы хотелось ответить на них в виде отдельного небольшого топика.
Читать дальше →