Обновить
128K+

Обработка изображений *

Работаем с фото и видео

60,87
Рейтинг
Сначала показывать
Порог рейтинга
Уровень сложности

Masterpiece as a service: итоги недели нейроарта

Время на прочтение9 мин
Охват и читатели16K

Не так давно завершились сезоны Kubernetes и Machine Learning, подарившие Хабру множество качественных технических статей. В межсезонье мы решили отвлечься от технохардкора и предложили вместо того, чтобы писать о технологии, использовать технологию и показать её результат с точки зрения пользователей. С 4 по 14 апреля мы провели на Хабре Неделю Нейроарта. Всё это время хабраюзеры неустанно публиковали статьи с тегом Kandinsky art, сопровождая их иллюстрациями, сгенерированными нейросетью Kandinsky 2.1.

Сегодня расскажем, как жилось авторам в симбиозе с искусственным интеллектом, и по результатам недели посмотрим, смогут ли генеративные модели составить конкуренцию художникам и иллюстраторам. А заодно объявим, кто те трое счастливчиков, что благодаря этому симбиозу получат по новенькому iPhone 14 Pro.

Узнать результаты

«Процедурное рисование» в ComfyUI

Время на прочтение7 мин
Охват и читатели127K

Кто интересуется темой рисующих нейросетей знают, что сейчас самый продвинутый и часто используемый интерфейс для Stable Diffusion (далее SD) это Automatic1111. Он позволяет использовать, вероятно, все существующие возможности SD на сегодня. Множество расширений, регулярные обновления и поддержка сообщества делают его мощным и удобным инструментом для генерации изображений. Но есть и альтернативные решения, одно из которых я сегодня рассмотрю.

Статья подойдет как тем кто уже пользуется Automatic1111, так и тем кто только планирует более глубоко погрузиться в мир "процедурного рисования".

Читать далее

Тестирование python3-расширения для GIMP

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели3.2K

Графический редактор GIMP предоставляет широкие возможности для создания расширений на языках программирования Scheme (функциональный язык, сходный с LISP) или Python. Для доступа к системным операциям и регистрации собственных действий используется общий реестр Procedural Database (PDB), через который можно выполнять любые действия со встроенными механизмами GIMP (например, создание изображения). В этой статье мы рассмотрим основы создания расширений на Python 3 и возможные подходы к тестированию расширений через PDB.

Читать далее

Windows 10 с Tesla T4 в Azure на примере Stable Diffusion и Automatic1111. Недорого

Уровень сложностиСредний
Время на прочтение7 мин
Охват и читатели6.8K

Краткое содержание:

Если хочется погонять Stable Diffusion или еще как поиграть с AI, а бесплатного Colab не хватает или есть специфические потребности, не обязательно покупать супер видеокарту. Вполне возможно, что spot instance в Azure даст вам желаемое и при этом обойдется дешевле.

И даже если видеокарта вам действительно нужна, это хороший способ понять, какой производительности карта необходима, сколько памяти требуется под ваши задачи...

(осторожно, очень много скриншотов внутри)

<Почему и Как>

Обмануть меня не трудно... Я сам обманываться рад

Уровень сложностиПростой
Время на прочтение2 мин
Охват и читатели6K

Начало положено.

Как человек связавший свою жизнь с искусством, и шесть лет проработав за холстом реальным, прежде чем перейти к виртуальному, мне было интересно понять как искусственный интеллект может соперничать с креативным мышлением человека.

Информационный шум и паника вокруг этой темы еще больше нагнетали и даже будоражили сознание. Ожидалось, что картинка меня поразит и заставит почувствовать себя никчемным созданием в своей нише.  

Очень мне хотелось, чтобы меня удивили, чтобы я с таким же таинственным взглядом как Вилли Вонка перестала быть скептиком и уверовала.

Но уже после первой пробы мне стало ясно, что волшебной палочки не существует и «не так страшен чёрт, как его малюют». Простые запросы выдавали банальные сюжеты - в буквальном смысле визуальный мусор.

Я стала усложнять запросы и давать более точное описание, но с каждым разом становилось словно хуже. Хоть и более конкретные и неважно на русском или английском, они не давали желаемого результата и на каких-то моментах сюжеты заносило откровенно не туда. Все это омрачилось артефактами в виде вторых челюстей или ног растущих из ног персонажа. Смазанные планы, отсутствие базовой анатомии, стеклянные расфокусированные взгляды и каменные лица, статичные позы и очень скудная композиция. 

В моих экспериментах было сложно выдавить хоть какие-то эмоции у персонажа. И после многочисленных попыток я ментально устала играть в эту рулетку. 

Откровенно говоря, стало легче, появилось понимание, что это инструмент, а не соперник и придется затратить немало усилий для формирования запроса, а далее постобработки, чтобы воплотить свою задумку.

Читать далее

«DEEPFAKE» как программа для ЭВМ — искажения реальной информации: развитие и правомерность

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели1.6K

Новая цифровая реальность последних лет, в большинстве технологических решений которой ядром выступает искусственный интеллект (ИИ), существенно исказила восприятие человеком разницы между реальностью и вымыслом. Один из главных «стирателей» такой грани — дипфейк‑технологии, которые можно охарактеризовать как методику автоматизированного, т. е. машинного синтезирования аудиовизуального цифрового контента (изображений, аудио, видео и даже текста) с целью создания видоизмененного и при этом максимально реалистичного контента.

Как бы то ни было, технические подделки, которые, как казалось, делают глубокие изменения внешности в тех же самых фильмах, со временем еще больше развивались и совершенствовались. А ведь несколько лет назад артикуляционная экспрессия и другие элементы синтезированного видео задавались программно‑ по большей части это была «ручная» задача, причем в режиме реального времени.

Продолжить

«Глаза» беспилотных автомобилей: LiDAR и компьютерное зрение

Время на прочтение13 мин
Охват и читатели37K

Самоуправляемое транспортное средство может «видеть» разными способами. Человеческое зрение ему заменяют радары, камеры, лазеры, радиоволны и ультразвук. В этом обзоре поговорим о лидарах и компьютерном зрении (CV) — двух основных инструментах, на которых основано автономное восприятие окружающего мира беспилотными автомобилями. Мы коротко опишем принцип работы технологий, расскажем, кто производит и внедряет подобные устройства, а также сравним их основные достоинства и недостатки.

Читать далее

Стартап хочет обучить ИИ генерировать арт на лицензионных картинках

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели1.7K

Генеративный Интеллект, особенно ИИ преобразования текста в изображение, привлекает столько же судебных исков, сколько и венчурных долларов.

Две компании, разрабатывающие популярные художественные инструменты искусственного интеллекта, Midjourney и Stability AI, вовлечены в судебный процесс, в котором утверждается, что они нарушили права миллионов художников, обучая свои инструменты на изображениях из Интернета. Кроме того, поставщик стоковых изображений Getty Images подал в суд на Stability AI за использование изображений со своего сайта без разрешения для обучения Stable Diffusion, искусственного интеллекта, генерирующего искусство.

Недостатки ИИ - склонность к повторению данных, на которых он обучался, и, соответственно, состав обучающих данных продолжает ставить его под прицел закона. Однако новый стартап Bria утверждает, что минимизирует риск, обучая ИИ, генерирующий изображения, а вскоре и видео, "этическим" способом.

Читать далее

Разговор с Kandinsky 2.1 или не очевидный prompt

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели9.3K

Этот пост не попал бы в сеть, но астрологи объявили неделю нейроарта на Хабре.  А  полотно в конце поста сложно не назвать нейроартом. Kandinsky art.

Читать далее

Искусственный Художник — Google от мира Text-To-Img

Уровень сложностиСредний
Время на прочтение11 мин
Охват и читатели3.7K

Здравствуйте, меня зовут Дмитрий Карловский и я люблю рисовать шедевры, но у меня совсем не хватает терпения довести хоть один из них до конца.

Ранее я уже показывал вам самописного убийцу Гугл Поиска. Пользуюсь им до сих пор и доволен чистотой выдачи. Теперь же мы сделаем убийцу Artstation для творческих личностей, у которых терпения хватает лишь на несколько минут, за которые надо успеть создать настоящую красоту. И в этом нам помогут нейронные сети.

Далее вас ждёт реверс-инжениринг HuggingFace API для использования модели Kandinsky, поддержка запросов на 100 языках мира благодаря модели Small100, проектирование бесконечной виртуальной ленты в несколько строк на $mol и, конечно, примеры творчества Искусственного Художника.

Вскрыть пациента

Раскраски — лучшее применение генеративных сетей :)

Уровень сложностиПростой
Время на прочтение2 мин
Охват и читатели8.5K

Мне кажется, я нашел самое правильное применение генеративных сетей, рисующих по описанию. Это генерация раскрасок! 

У меня есть дети. Дети равно раскраски. Раскраски - это постоянный поиск всякой фигни, типа “хочу чтобы был единорог, а рядом его малыш панда, и чтобы малыш был похож на маму”. Интересно, что нейросети неплохо справляются с такими задачами. Причем, забавный момент - результаты начинающих нейросетей, типа того же Кандинского, принимаются более благосклонно, потому что рисуют они пока плохо. Но! эта “плохость” и ошибки в изображениях очень похожи на рисунки ребенка и воспринимается за творение собрата по детсаду/школе.

Читать далее

Путь в поисках мастерства: IT-практика в промышленном гиганте

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели3K

Всем привет! Продолжим погружение в тему, и сегодня я бы хотел поделиться реальными задачами и кейсами из практики в Норникеле по направлениям Industrial AI и Computer Vision. Ни для кого не секрет, что еще несколько лет назад машинное обучение в промышленности уступало в развитии таким прикладным направлениям, как ML в ИТ / телекоме, банковской сфере, ритейле и т.п. Часто при общении с коллегами из других исследовательских институтов, R&D отделов крупных компаний разговоры о промышленных кейсах в машинном обучении напоминали байки о рыбалке. Или, скорее, рассказы авантюристов-золотоискателей, бросивших стабильность и уют хорошо изведанных земель ИТ и машинного обучения и ушедших в дикие пустынные края в поисках скрытого от всех сокровища.  Все быстро меняется и стараниями флагманских отраслевых компаний, крупных исследовательских коллективов работа над кейсами Industrial AI шагнула далеко вперед - от редких и робких хакатонов к полномасштабной разработке, внедрению и эксплуатации моделей в производственные процессы.

Читать далее

Пять примеров успешного использования ИИ на производстве

Уровень сложностиПростой
Время на прочтение11 мин
Охват и читатели49K

В октябре 2019 года компания Microsoft заявила о том, что искусственный интеллект помогает производственным компаниям обгонять по показателям конкурентов: использующие ИИ производители показывают результаты на 12% лучше, чем их соперники. Поэтому мы скорее всего увидим всплеск применения технологий ИИ на производстве, а также рост новых высокооплачиваемых должностей в этой области.

В статье мы расскажем о пяти примерах использования ИИ-технологий на производстве. Также мы поделимся историями успеха современных промышленных компаний, проанализировав, как внедрение ИИ помогло их бизнесу.
Читать дальше →

Ближайшие события

Чем отличаются ChatGPT3 и ChatGPT4?

Уровень сложностиПростой
Время на прочтение4 мин
Охват и читатели14K

Начнем с обзора.

ChatGPT 4 был запущен 4 марта и стал предметом активного обсуждения. Одним из аспектов обсуждения был вопрос о том, чем он отличается от своего предшественника ChatGPT 3. Присяжные еще не определились, потому что ChatGPT 4 всё еще не полностью доступен публично и является платной версией, в отличие от своего предшественника, что препятствует широкому распространению. Но в открытом доступе уже достаточно информации, чтобы провести предварительное сравнение между двумя версиями. В индустрии программных технологий переход с третьей версии на четвертую означает значительное обновление, и это действительно произошло с новой версией ChatGPT 4. Конечно, она не получила всех тех обновлений, которые ожидали эксперты, но все же она обладает большим потенциалом. Она превосходит свою предшественницу по многим параметрам, таким как способность обрабатывать информацию, понимание контекста подсказок и обработка как текста, так и изображений. В этой статье проводится сравнение двух версий по следующим разделам.

Читать далее

Кто продаёт спутниковые фотографии и сколько они стоят

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели36K


Статья содержит ответы на ряд популярных вопросов, о возможности строительства и запуска космических спутников, способах и стоимости заказа космической фотосъёмки и о ресурсах, на которых можно найти бесплатные спутниковые фото, а также о том, какую пользу приносит использование спутниковых фото в разных сферах жизни.
Читать дальше →

Астрономическая «рыбалка»

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели5.6K

Вы когда-нибудь слышали о астрофотографии? Несложно догадаться, что речь сейчас пойдет о фотографии и астрономии.

Астрофотография - вид фотографии в котором предметом съемки являются различные астрономические объекты, такие как: планеты солнечной системы, шаровые и рассеянные звездные скопления, двойные звезды, туманности, и конечно же Солнце с Луной. Исходя из методики съемки и обработки материала, можно выделить два основных направления в астрофотографии: лунно-планетное (lunar/planetary imaging), и фотография объектов дальнего космоса (deepsky imaging).

Именно о своем опыте в лунно-планетном фото я и хочу вам рассказать. Все фотографии которые вы увидите в статье, получены мной с использованием любительских телескопов.

Читать далее

Автоматическое построение плоской панорамы

Уровень сложностиСредний
Время на прочтение12 мин
Охват и читатели12K

В статье представлен простой алгоритм автоматического сшивания нескольких фотографий в плоское (иногда называют перспективное) панорамное изображение (planar/perspective panoramic image). Статья содержит код на языкеPythonс использованием библиотекиOpenCV.

Читать далее

«Иной путь» Джона Кармака к общему искусственному интеллекту. Часть 1

Время на прочтение6 мин
Охват и читатели4.3K

Культовый разработчик игр, ракетный и VR инженер Джон Кармак переключился на новое амбициозное испытание: разработку общего искусственного интеллекта — формы искусственного интеллекта, которая выйдет за рамки имитации человеческого интеллекта и перейдёт к пониманию сути явлений и решению проблем. Кармак считает что к 2030 году есть 60% шанс достижения начального успеха в разработке общего искусственного интеллекта (ОИИ). В этом интервью вы узнаете о том, как и почему он работает независимо, над тем чтобы это случилось.

Читать далее

Savant: новый высокопроизводительный фреймворк Python для видеоаналитики на оборудовании Nvidia

Уровень сложностиСредний
Время на прочтение22 мин
Охват и читатели6.3K

В статье рассматривается новый открытый фреймворк для потоковой видеоаналитики и демонстрируются его возможности на примере демонстрационного приложения, которое использует модель DeepStream’s PeopleNet для обнаружения людей и их лиц, размывает лица и отображает панель управления с помощью OpenCV CUDA.

Мы будем использовать Savant для обработки видео в реальном времени с протоколом RTSP и для обработки видеофайлов в пакетном режиме, чтобы продемонстрировать, как конвейер может достигать скорости 400 кадров в секунду на Nvidia Tesla T4.

Для тех, кто хочет сначала попробовать без подробностей, мы подготовили скрипты для быстрого старта на основе Docker Compose (раздел "Быстрый старт").

Savant на GitHub: https://github.com/insight-platform/Savant

Читать далее

Обзор современных автономных технологий в России

Время на прочтение2 мин
Охват и читатели2.8K

Автономные технологии становятся все более актуальными в современном мире, и Россия не остается в стороне от этого процесса. В этой статье мы рассмотрим успешные примеры автономных технологий в России, среди которых проекты компании «Яндекс» в Иннополисе и дроны НТР Томск, демонстрирующие инновационный подход и значительный потенциал для дальнейшего развития.

Читать далее