Pull to refresh
64K+
196
263,1
Rating
53
Subscribers
Send message

Да, есть одна такая на примере, но тут скорее "зернышко", а не прям зерно, плюс портит цвет картинки. Лучше продолжить изыскания по части ffmpeg алгоритмов генерации зерна. Вот в ChaiNNer есть интересный инструмент алгоритмической генерации зерна - можно быстро перебрать варианты на стоп кадре, а там уже когда понадобится видео прогнать, лучше с каким-нибудь чат-ботом посоветоваться, как можно перенести затраты на видеокарту ибо на процессоре, как сделанно в chainner, будет довольно долго идти рендер

Ну и ещё я погуглил, - есть какие-то специальные плагины для генерации зерна типа NeatVideo, но наоборот.

видюшное мыло в 60к.

Кажется, или я так-то не упоминал интерполяцию кадров в тексте и никогда ей не пользовался. Или это приведение гиперболы с вашей стороны?

Вы не первые с таким вопросом. Насчёт заказов - пока я всё ещё в смятении. Скорее, что мне очень нравится сама тема деятельности и огромные проекты, которые можно очень долго копать и совершеннствоваться.

Но пока я скорее съезжаю в тему кодинга ибо прогресс в этой сфере апскейлинга/денойзинга и прочего застыл с приходом ИИ изображений/видео-генераторов и делать здесь энтуазисту что-то кардинально круче уже не выйдет. Учёным и исследователям нет никакого интереса оставаться в старой сфере - выжил только Topaz и только для корпоративных пользователей, с их уж расценками в десятки-сотни долларов за 7 минут времени.

Вот и я о самом ремастере собрался с духом написать только спустя 7 месяцев после завершения.

Вы выбрали 2 экстремальных кейса из всех представленных, так и видео лишь часть работы) А насчет ламповости шума - тут как по мне, вопрос на любителя, и возможно поколение - но в данном вопросе я не эксперт. Но помимо эстетики также имеется и технический нюанс - с ним ни гало не убрать, ни резкость не поднять, ни апскейл сделать - в общем ограничений на любые улучшалки - тьма. Как-то так

Думаю вы сможете понять, если обратитесь к моей самой первой статье. Касательно же filmation, - пока нигде не глянуть все постеры.

Хм, у меня в принципе всё каталогизировано по папкам, но я на данный момент далеко от ПК. Отпишу и закреплю в отдельном комментарии информацию сразу, как будет возможность сегодня.

В плане развития - действительно, не заметить гигантский рост практически каждые полгода, - невозможно. Но и статья не является сугубо критикой, а описанием моего опыта и мыслей в текущей фазе развития ИИ, так что на пьедестал "технократа" я не претендую, как и вы)

Так gpt 5.3 codex который использовался к поздним этапам, и вовсе удивлял меня тем, насколько быстро и умно, он работал в любой сфере разработки данной программы. Да даже новый Composer удивляет (или что там на режиме auto в Cursor стоит) - уровень от предыдущей итерации вырос с "ну ладно, можешь цифорки в виджет кнопки подправить, чтобы верстка крупнее стала" до "ты очень долго думаешь, но твои решения действительно работают в ~70% случаев, даже в ядре проекта и краевых случаях".

А это кстати, один из парадоксальных моментов - начал я с имеющегося примера MVP архитектуры, где уже реализованы механизмы смены тем, языка, логика создания стилей , но не сильно это помогло. По итогу архитектуру пришлось докручивать где-то в середине разработки

Да, согласен. У меня в основном все вайбкод проекты как раз таки сталкивались с проблемой, из-за такого "простого" запроса на какую-то фичу. В Improve-ImgSLI основной движок рендера картинки пережил больше 3х этапов полного переосмысления, когда естественным образом хотелось добавить новую функциональность или улучшить существующую.

Как по мне, в случае вайбкодинга, ещё больше больше обостряется потребность, думать на 3 шага вперёд, чтобы не утонуть в переделках "под корень". Промпт не как: "я хочу, чтобы между картинками был слайдер", а "мне нужен механизм отрисовки схожий с GIMP, мы накладываем сплиттер следующим слоем, а картинки делаем текстурами. Используем относительные координаты чтобы, это было масштабируемо, а также по возможности логируем все объекты на сцене"

Интересная концепция) Не знал, что через фотошоп можно и такое проворачивать

Не могу не согласиться, что косяк с мощностью нейросети есть, но если посмотреть с другой стороны - после проделанной работы осталась программа для генерации датасетов, которая не зависит от текущих ограничений, так что может когда-нибудь в другой раз, но у меня выйдет обучить что-то на уровне больших решений) А так самые главные результаты, которые для меня здесь есть - Antilines и RGB модели

Хоть я и не являюсь сторонником зерна на видео, но объективно детализация страдает по нынешним результатам

Тогда речь скорее идёт о диффузионных апскейлерах и кластер-апскейлерах, как, например, Starlight от Topaz. На словах - это, конечно, интересно, но на деле для этого нужен просто огромный R&D отдел плюс копаться в разработках китайцев на arXiv

А не думали о темпоральном денойзере?

Да, но обучение такой модели - это кратно сложнее, нежели то, с чем я уже был знаком (ESRGAN compact). И я бы хотел всё же, чтобы мой эксперимент получил некоторую распространенность, и ESRGAN для этого отлично подходит, так как абсолютное большинство GUI умеет работать с данной архитектурой

Для целлулоидной анимации, как мне кажется, надо искать путь отделять фон от нарисованного на целлулоиде и применять разные фильтры к ним соответственно

Если я правильно понял, то вы говорите об оригинальных фреймах, с которых снимали плёнку, но это скорее абстрактное рассуждение, ибо все они либо лежат в архивах под семью печатями, либо уже давно утеряны/сгорели/испортились. Например, у MGM раза 2 с лишним горели архивы».

хм. Ну хорошо, я постараюсь опубликовать имеющиеся материалы через некоторое время, когда освободится график.

Information

Rating
10-th
Location
Ростовская обл., Россия
Works in
Registered
Activity