Обновить
128K+

Обработка изображений *

Работаем с фото и видео

61,48
Рейтинг
Сначала показывать
Порог рейтинга
Уровень сложности

Конкурс Ivideon. Продолжение

Время на прочтение4 мин
Охват и читатели5.7K


Вчера мы рассказали о том, что объявляем конкурс на создание демонстрационного приложения на основе OpenCV для слежения за несколькими объектами, где в качестве приза будет поездка вместе с нашей командой на Шри-Ланку, а также предложение о работе в нашей компании.

Очень здорово, что конкурс был воспринят позитивно и нам активно стали писать всеми различными способами, чтобы уточнить те или иные вопросы. Многие из них были достаточно однотипными, поэтому нам бы хотелось ответить на них в виде отдельного небольшого топика.
Читать дальше →

MIPS продала свои патенты, и потом была куплена Imagination

Время на прочтение2 мин
Охват и читатели9.9K
Чипмейкер Imagination Technologies сегодня объявил о покупке американского разработчика микропроцессоров MIPS Technologies!

Теперь долгое время сотрудничавшие компании Imagination и ARM Holdings могут стать злейшими кокурентами.
Ещё можно вспомнить что ~15% акций компании Imagination Technologies владеет компания Intel, и ещё ~9% акций Imagination владеет такой технологический гигант как Apple — обе компании активно использующие технологии GPU PowerVR — графические процессоры разработанные Imagination.
Читать дальше →

NVIDIA повернулась лицом к Linux

Время на прочтение1 мин
Охват и читатели60K
Многие помнят как Линус Торвальдс показал неприличный жест в адрес NVIDIA после того, как оказалось, что компания спустя рукава относится к поддержке своих видеокарт в Linux.

Как бы то ни было, но в сегодняшнем официальном пресс-релизе NVIDIA неожиданно выяснилось, что новые драйверы для видеокарты GeForce R310 "удваивают производительность и значительно сокращают время загрузки игр на компьютерах с операционной системой Linux."

Даг Ломбарди (Doug Lombardi), вице-президент по маркетингу в Valve:

«В новой версии драйверов NVIDIA смогла повысить общую игровую производительность в ОС Linux. NVIDIA, бесспорно, заняла ведущую позицию, разработав драйверы R310 вместе с нами и другими студиями, чтобы предоставить лучшее решение под Linux для геймеров».

Узнать подробности

Отрезаем голову в nginx

Время на прочтение1 мин
Охват и читатели24K
Не так давно я рассказывал, как у нас в Topface устроено хранение и раздача пользовательских картинок на Topface Developer Day (презентация на speakerdeck). Картинки мы нарезаем на лету в nginx с помощью image_filter.

Люди в основном продолговатые в вертикальном направлении и фотографии себя для сервиса знакомств делают соответствующие, дизайнеры хотят квадратики, а nginx вырезает людям не совсем то, что интересует людей (лицо я имею в виду). На примере longcat получается примерно следующее:

longcat
Как с этим жить

Таинственные текстуры в пустыне Такла-Макан на Google Earth получили объяснение

Время на прочтение2 мин
Охват и читатели54K

Каждый квадрат размером 40х40 метров состоит из 100 элементов, 10 по горизонтали, 10 по вертикали. Общая длина — около 8 км

Благодаря спутниковой фотосъёмке Земли у учёных появился новый инструмент для научных изысканий. В последние годы постоянно пополняется список научных открытий, сделанных с помощью Google Earth. Один из ведущих специалистов по так называемой «домашней археологии» — Амелия Спаравинья (Amelia Carolina Sparavigna) из Туринского политехнического института. С помощью open source программ она осуществляет автоматическую обработку тысяч изображений из отдалённых уголков Земли, куда ещё никогда не доходили научные экспедиции. Обычно это пустыни, труднодоступные горные районы или вообще территории с запрещённым доступом.
Читать дальше →

OpenCV 2.4.3

Время на прочтение7 мин
Охват и читатели46K
Авторы: Анатолий Бакшеев, Кирилл Корняков(kirillkornyakov), Андрей Морозов(aod314), Вадим Писаревский, Олег Скляров(olegsklyarov), Евгений Таланин, Александр Шишков(AlexanderShishkov).

image image

Привет, Хабр!

Мы рады сообщить, что 2 ноября увидела свет новая версия OpenCV, свободной библиотеки компьютерного зрения. Этот пост написан разработчиками библиотеки, работающими в компании Itseez. Мы перечислим основные нововведения с момента выхода предыдущей версии, стоит отметить, что их достаточно много: новые алгоритмы, ускорение существующих, поддержка новых платформ, обновление процесса разработки, интеграции и тестирования, а так же обновлённая документация. За время подготовки релиза было закрыто более 210 задач на трекере (hackathon, release candidate, release): патчи, исправления ошибок, расширение существующей функциональности.

Но обо всём по порядку.
Читать дальше →

Универсальный интерфейс для синхронизации изображений/видео на разных устройствах

Время на прочтение1 мин
Охват и читатели4.6K


Pinch — интересная система, разработанная исследовательской группой из Токийского технологического университета. Японцы создали универсальный интерфейс, позволяющий показывать единое изображение на дисплеях разных устройств, составляющих единую систему.

При этом на каждом из устройств должно быть установлено соответствующее приложение, клиент. Программа-клиент работает с «железом» устройства, а точнее, с акселерометром, для того, чтобы определить положение устройства в пространстве. Для синхронизации изображений используется беспроводный модуль связи Wi-Fi.

По словам разработчиков, Pinch может использоваться, к примеру, для совместной игры пользователей мобильных устройств. Вот видео с демонстрацией работы такой системы.

Технологии трекинга и сканирования с помощью обычной веб-камеры

Время на прочтение2 мин
Охват и читатели39K

Трекинг лица




Решение, позволяющее распознавать лицо человека и отслеживать положение губ, бровей, глаз в режиме реального времени. Компания SeeingMachines предоставляет API для сторонних разработчиков. Компания Ray-Ban довольно давно разместила на сайте flash-приложение, позволяющее примерить очки в реальном времени.
Читать дальше →

Гига-фотография Млечного Пути в разрешении 108199x81503 или очередная история «xyz хватит всем»

Время на прочтение2 мин
Охват и читатели45K
Пару дней назад была новость о том, что Астрономы Европейской южной обсерватории сшили мозаику центра нашей галактики (Млечного Пути) с разрешением 108199x81503 в ИК диапазоне (в ИК меньше рассеяние света на межзвездном газе и пыли — звезд видно намного больше).

К сожалению, результат они выложили лишь в виде онлайн-смотрелки и .psb-файла, размером 24Гб который можно открыть только фотошопом, при этом сам фотошоп отказывался экспортировать его в любой другой формат кроме опять же psb, tiff(само собой неудачно, там размер файла не может превышать 2/4Гб) и RAW. А хотелось что-нибудь, из чего было бы удобно вырезать интересный кусочек на wallpaper…

Забегая вперед, сразу покажу результаты:

1920x1200 2560x1600 2880x1800
Читать дальше →

Активные модели внешнего вида

Время на прочтение12 мин
Охват и читатели39K
Активные модели внешнего вида (Active Appearance Models, AAM) — это статистические модели изображений, которые путем разного рода деформаций могут быть подогнаны под реальное изображение. Данный тип моделей в двумерном варианте был предложен Тимом Кутесом и Крисом Тейлором в 1998 году [1]. Первоначально активные модели внешнего вида применялись оценки параметров изображений лиц, но затем они стали активно применяться и в других областях, в частности, в медицине при анализе рентгеновских снимков и изображений, полученных с помощью магнито-резонансной томографии.


Описание иллюстрации
На рисунке показан результат адаптации активной модели внешнего вида к изображению лица. Синяя сетка показывает начальное состояние модели, а красная — то, что получилось.


В данной статье рассматривается краткое описание того, как функционируют активные модели внешнего вида и связанного с этим математического аппарата, а также приводится пример их реализации.

Читать дальше →

Распознавание плоских объектов OpenCV 2.4

Время на прочтение6 мин
Охват и читатели108K
Привет всем. Я хотел бы рассказать о принципах, лежащих в основе распознавания объектов с использованием OpenCV. Благо какое-то время мне довелось поработать в лаборатории компьютерного зрения ВМК МГУ, и я немного вник в премудрости этой ветви computer science. Задача, которую я буду рассматривать здесь, предлагалась на Microsoft Computer Vision School Moscow 2011 на семинарах Виктора Ерухимова, одного из разработчиков программного комплекса OpenCV. Почти в таком же виде рассматриваемый код можно найти в демках OpenCV 2.4.
Читать дальше →

Графический формат JNG — чем полезен, как устроен, чем сконвертить, посмотреть и загрузить

Время на прочтение9 мин
Охват и читатели17K
На картинке изображенна турецкая снайперская винтовка с очень подходящим названием — JNG. В статье, как вы уже догадались — речь пойдёт о графическом формате JNG, а отнюдь не об оружии. На хабре уже мелькали темы, касающиеся этого формата, однако их было не много, а некоторые, к сожалению, впоследствии были удалены авторами. Не смотря на то, что JNG не особо популярный формат и базируется на формате MNG, который, судя по всему, можно считать мёртворождённым, у JNG есть одно очень хорошее свойство – это высокая степень сжатия графики с потерями плюс начиие альфа канала.
По сути JNG представляет из себя подвид формата MNG (однако со своим маркером в заголовке, позволяющим отличать оба этих формата). Цветовые данные сохраняются в JPEG формате, а вот альфа может хранится в одном из двух вариантов – либо тоже сжатая при помощи JPEG, как картинка в оттенках серого, либо используя такое же как в PNG — сжатие без потерь.
Где может пригодится JNG? Для меня он больше всего подошёл для хранения текстурных атласов в мобильных играх. Небольшой пример – исходный набор графики от игры весил 57 мегабайт, после замены всех png на jng – набор графики стал весить 15 мегабайт. Неплохой выигрыш для мобильной игры. Поиск других областей, где можно применить jng оставлю на усмотрение читателя, я же опишу чем смотреть, чем создавать а также как грузить (с примерами кода на C/C++) картинки в формате JNG, а также немного теории об его устройстве.

Читать дальше →

Простой способ передачи информации через видеосигнал

Время на прочтение2 мин
Охват и читатели6.8K
В Fujitsu предлагают простой способ добавить интерактивности в обычную телевизионную трансляцию с тем, чтобы пользователи смартфонов без каких-либо дополнительных технических устройств (вроде всевозможных приставок) могли легко получить дополнительную информацию на экране своего гаджета.

Идея передачи информации является довольно простой и в некоторой степени подобна известному QR-сканированию — то есть, на смартфоне требуется запустить специальное приложение и направить устройство на телевизор. Специальным образом подготовленная передача будет содержать видеокадры, в которые экран телевизора становится чуть более ярким (или чуть более тёмным): другими словами, последовательность сменяющих друг друга видеокадров с разной степенью яркости и будет кодировать двоичную информацию в видеосигнале — каждая секунда будет содержать 16 бит.
Узнать подробности

Ближайшие события

Фильтрация ложных соответствий между изображениями при помощи динамического графа соответствий

Время на прочтение5 мин
Охват и читатели25K

Многие современные алгоритмы компьютерного зрения строятся на основе детектирования и сопоставления особых точек визуальных образов. По этой теме было написано немало статей на хабре(например SURF, SIFT). Но в большинстве работ не уделяется должного вниманию такому важному этапу, как фильтрация ложных соответствий между изображениями. Чаще всего для этих целей применяют RANSAC-метод и на этом останавливаются. Но это не единственный подход для решения данной задачи.
Данная статья посвящена одному из альтернативных способов фильтрации ложных соответствий.
Читать дальше →

Щелевая съёмка: сжатие времени по горизонтали

Время на прочтение2 мин
Охват и читатели128K

Фото: Jay Mark Johnson

Перед вами оригинальный снимок, без обработки в фоторедакторе или применения каких-то художественных эффектов. Исключительно точное документальное фото. Только это не картина одного момента, как в обычной фотографии. В кадре вместились события, которые происходили в течение около 30 секунд на промежутке пространства шириной 1 пиксел. Снимок сделан методом щелевой фотографии.
Читать дальше →

Искусство подделки фотографий до цифровой эпохи

Время на прочтение2 мин
Охват и читатели51K


В нью-йоркском Метрополитен-музее 11 октября открылась выставка “Faking It: Manipulated Photography Before Photoshop”, посвящённая историческому искусству подделки фотографий, ретуширования и фотомонтажа. Некоторые работы можно посмотреть на сайте музея.

Крупнейшая в мире коллекция «отфотошопленных фотографий» доказывает, что люди начали активно заниматься такими манипуляциями задолго до изобретения компьютеров и цифровой фотографии. Более того, многие методы 150-летней давности используются сейчас практически в неизменном виде.
Читать дальше →

Нейросеть Google приступила к работе

Время на прочтение2 мин
Охват и читатели118K
В июне 2012 года группа исследователей из Google запустила нейросеть на кластере 1000 компьютеров (16 тыс. процессорных ядер; 1 млрд связей между нейронами). Эксперимент стал одним из самых масштабных в области искусственного интеллекта, причём систему изначально создавали для решения практических задач.

Самообучаемая нейросеть — достаточно универсальный инструмент, который можно использовать на разных массивах данных. В компании Google её применили для улучшения точности распознавания речи: «Мы получили уменьшение на 20-25% количества ошибок при распознавании, — говорит Винсент Ванхоук (Vincent Vanhoucke), руководитель отдела распознавания речи в Google. — Это значит, что многие люди получат безошибочный результат». Нейросеть оптимизировала алгоритмы для английского языка, но Ванхоук говорит, что аналогичные улучшения могут быть достигнуты и для других языков и диалектов.
Читать дальше →

Оптическое распознавание символов в Linux

Время на прочтение17 мин
Охват и читатели92K

Введение


Это не просто обзор существующих OCR (мы будем говорить всего о трёх) и не руководство по установке (хотя установка будет описана). Эта статья была создана с целью разобраться, что и как реально может распознать русский и английский языки в Linux.
Читать дальше →

Как мы корректировали фото с Curiosity, чтобы узнать, какого же цвета Марс

Время на прочтение3 мин
Охват и читатели26K
Пока Curiosity весь в делах и NASA не до того, чтобы оповещать нас о результатах исследований, а вопрос о цвете Марса в ходе нашего текущего проекта как нельзя актуален, мы с коллегами вернулись к старой избитой теме: какого цвета Марс.

В NASA ранее тоже задавались таким вопросом. Красивый пейзаж с залитыми Солнцем склонами марсианских стволовых гор, причудливыми базальтовыми дюнами, с экзотическими для Земли, но обычными для Марса фигурами выветривания, сделан в 2003 году членами команды разработчиков камеры THEMIS из Корнельского университета вместе с художником Доном Дэвисом, экспертом в области полноцветных визуализаций планетарных и космических объектов.

image

Дэвис начал с калибровки и сопоставления файлов многоспектральных снимков, сделанных THEMIS VIS в разных диапазонах. Используя в качестве ориентира полноцветные изображения с космического телескопа Хаббл и свой личный опыт в обсерватории Mt. Wilson и других, он вручную отрегулировал баланс цвета, чтобы он наиболее точно соответствовал такому Марсу, который бы мы увидели «своими глазами». Он также вручную немного сгладил и обработал изображение, чтобы минимизировать эффекты остаточного рассеянного света при фотографировании. (оригинал источника информации).

Но у нас же нет такой сложной системы для коррекции приходящих с Марса фото. А многочисленные попытки скорректировать фото с Марса автоматом через «автоматическую цветовую коррекцию» фотошопом нам кажется немного наивными. Очень сомнительно, что фотошоп настроен на приведение марсианских фотографий в земной вид.

Что же делать? Под катом много фото.
Читать дальше →

Автоматический ввод капчи – теория и практика покорения Интернет

Время на прочтение4 мин
Охват и читатели137K
В 2011 году 75-летний юбилей термина «спам» знаменовался вводом капчи 200 миллионов раз ЕЖЕДНЕВНО!



Все эти вводы — следствие борьбы администраторов сайтов со спам-ботами.

Автоматизация процесса распознавания капчи для множества людей, активно ведущих бизнес в Интернете, является насущной проблемой. Можно относиться к таким бизнесменам и специалистам как к «нехорошим и надоедливым спамерам». Однако остановить процесс спам-постинга, по крайней мере, в обозримом будущем возможным не представляется.

Ссылочный маркетинг здесь полноценно и уникально сочетает в себе решение задач продвижения, повышения репутации продвигаемого сайта в глазах поисковых систем. Происходит это по той простой причине, что каждая ссылка на сайт (в т.ч. и из спам-поста) повышает его позиции в выдачах Google, Яндекса и т.д. Следовательно, такой способ «убийства двух зайцев одним выстрелом» выгоден изначально. И значительная часть Интернет-бизнесменов должны не бороться со спам-постингом, а пытаться использовать его в своих целях.

Итак, актуальность решения задачи «обход капчи» сомнений не вызывает.



Читать дальше →