Pull to refresh
332
Maxim Mozgovoy@rg_software

university professor and software developer

155
Subscribers
Send message
Я буквально месяц назад пытался найти программу, решающую сходную проблему, а именно каталогизированное хранение страничек, скачанных из интернета. В идеале хотелось бы щелчком из браузера отправить страничку в «прочесть на потом», ну и иметь оффлайновое хранилище с быстрым просмотром, тегами, сохранённым исходным URL и так далее. Совсем хорошо, если можно свои заметки добавлять, но в конце концов, можно отредактировать HTML и сохранить, переживаемо.

К идеалу приближался WebResearch, самая свежая версия которого вышла в 2013 году. С современными браузерами и сайтами он уже работает откровенно плохо, а вот хорошей смены так и нет.

Из интересного: MyTetra, RightNote, UltraRecall, MyBase, MyInfo, TreeDBNotes, Zotero.

Казалось бы, столько всего пересмотрел, а счастья всё равно нет. Или сохранять не умеет (приходится самому из браузера в MHT экспортировать, а это не всегда удобно), или сохранённые MHT не открывает, или встроенного просмотрщика нет, или просто падает на некоторых файлах… в общем, стараюсь сейчас привыкнуть к TagSpaces, но и у этой программы не всё гладко. Автор обещает обновление в мае, будем ждать.

Такое впечатление, что мало кому эта задача актуальна. Странно. Половина проектов заброшены или условно заброшены. А я почти что в ежедневном режиме пользуюсь, вот ведь у всех свои надобности…

Я вполне разделяю ваш сентимент, и всё же президент не ГАИ, и обычно объясняет свою логику, даже если она и не всем по вкусу. Ну а про оспорить — да, но всё же решения начальника на работе имеют приоритет в любом случае.
И опять же, вы исходите из того, что у президента есть желание в данном случае оспаривать гипотетическое решение ЕСПЧ, хотя это далеко не факт.


А так — - yoy can't always get what you want, жизнь такова.

Это ни разу не аргумент. Всё, что вы делаете, может кто-то другой зарубить, но это не повод не делать. Я не говорю уже о том, что он может счесть совершенно нецелесообразным это делать.

Хорошо, там КС именно что занял позицию "противоречит конституции РФ". Я понимаю, что это политизированное решение, но логика тут тоже есть: для меня неочевидно, что страна должна нарушать собственную конституцию, пусть даже по решению ЕСПЧ. Однако это (статистически) исключение, а не правило. А судиться — это в любом случае процесс вероятностный, гарантий никто не даст в любом случае.

Не совсем. Чтобы эта норма сработала, нужно доказать, что решение европейского суда противоречит конституции РФ. На практике такой процедуры, по-моему, ни разу не проводили, и по всем решениям ЕСПЧ исправно платили.

Проблема в том, что слишком многие думали, что можно жить в прекрасном свободном интернете и не пересекаться со скучной кабинетной реальностью. А вот нет, это самообман. Неучастие — это тоже форма участия.

Мне кажется, тут или крестик снять, или трусы надеть. Если система полуавтоматически ловит преступников, это прекрасно. Если её использоватс незаконными целями — это плохо. Если у вас есть законные права, то законная камера их реализации не мешает. А вы хотите, чтобы можно было безнаказанно нарушать закон, ну так можно очень далеко зайти, ведь представления о справедливости у каждого свои.

Никогда не видел написания "стак". Либо стэк, либо стек (чаще).

Честно говоря, я вот думал вставить пару мыслей, но потом обратил внимание на откровенно хамскую манеру общения и решил, что ну его, я не мазохист. Интересно, как можно иметь большой опыт работы с таким подходом к диалогу? Он с роботами что ли имеет дело только?
Идея препроцессора под конкретные типы файлов совершенно здравая, и опция «мультимедийное сжатие» в WinRAR тоже не вчера появилась.

Я не хочу быть критиком, который видит во всём ненужное старьё, но всё же в текущей конкретной статье нам предлагают откровенный шаг назад: вместо автоматического анализа частотности цепочек просто взять словарь, в котором цепочки разбиты просто по критерию «нашли пробел». Не rocket science.

Ну а если абстрактно рассуждать, то размышлять вообще полезно, конечно, и я рад, что автор задумывается о таких вещах.
Ну я же не на общие темы рассуждаю (типа «новое побеждает старое»), а про конкретный предложенный алгоритм, который уже неоднократно всплывал на моей памяти, и представляет собой по сути ручное создание словаря Далем/Ожеговым вместо автоматической процедуры — более оптимальной и надёжной.

А чего удивительного? Есть over 9000 существующих программ с кодом вида
char path[260];


(ну и далее там хранится какой-то путь). Если ограничения снять, эта программа перестанет работать.

К сожалению, не взлетит. Вот именно эта «светлая» идея регулярно приходит в голову разным людям чуть ли не ежегодно. Сначала автор понимает, что выгоднее сжимать слова вместо символов, потом прикидывает, что к каждому отдельному файлу лучше прикладывать отдельный словарь (а иначе сжатие окажется заведомо неоптимальным, расходы на хранение словаря компенсируются перечислением в нём лишь реально обнаруженных слов)…
Затем становится ясно, что помещать в словарь элементы, которые в исходном тексте разделены пробелами, нелогично: чем пробел так замечателен? А если в тексте часто встречается сочетание «ский ди», почему бы не вставить его? Так мы приходим к алгоритму автоматического создания словаря. И в конечном итоге получаем обычный LZW.

Ну потому что ещё 1000 или даже 500 лет тому назад 99% людей на земле жили в этой "цыганской" парадигме. За это время биологически человек мало изменился, т.е. мы с вами такие же "цыганские дети" в недавнем прошлом, а всё-таки шагнуть вперёд сумели.

Ну, как бы да, профессор при известной «прокачанности» может попытаться аутсорснуть свой курс аспиранту (их не так много обычно, чтобы ещё разделять на толковых и бестолковых). Не уверен, правда, что это модель образования моей мечты.

В этом смысле, если всё равно всё делают аспиранты, то разницы между Стэнфордом и Урюпинском нет, т.к. в онлайне всё равно есть лекции светил, а в реале общаться будешь в лучшем случае с аспирантами.

В любом случае обновлять и улучшать курс всё равно будет профессор (когда найдёт на это время и желание...)
А других там не держат, вы не сможете стать преподавателем Стэнфорда, будучи просто вменяемым специалистом по теме и хорошим педагогом.
Я работаю в зарубежном вузе, и вот просто ради полноты картины скажу, что счастья нет нигде. Вам, наверно, хочется, чтобы в вузах преподавали люди, реально работающие на переднем крае науки, а не прочитавшие что-то про нейросети во втором русском издании четвёртого пересказа оригинала? Но в этом случае придётся смириться с тем, что этим людям есть чем заняться в жизни помимо вдалбливания элементарных вещей студентам младших курсов.

Реальность такова, что программирование/информатика не входит в обязательную школьную программу очень многих даже хороших стран. В Британии вводят вот прямо сейчас, в Японии введут с 2020го, если не ошибаюсь. Студентами становятся люди, которые не могут даже написать программу «Hello, world» на Бейсике. При этом им уже на первом-втором году обучения приходится читать достаточно нетривиальные курсы, которые требуют и соответствующего уровня от лектора. Интереса в такой работе не так много, большой процент профессуры именно преподавательскую часть откровенно не любит, и надеяться на постоянное совершенствование и шагание в ногу со временем не приходится.

Да, конечно, если человек профессионально занимается NLP или там нейросетями, он сможет провести прекрасный спецкурс по этой узкой теме, но это лишь небольшая часть общего паззла.
Насчёт короткой жизни продукта не соглашусь, как раз сейчас у кода есть шанс жить десятилетия (я вот не знаю, кому-нибудь за последние 20 лет приходилось самостоятельно писать, скажем, функцию распаковки GIF формата в BMP на C?)

В остальном — ну, да, какие времена, такие и вызовы.
Вы говорите об этом так, словно речь идёт о чём-то очевидно плохом.
Deep learning — это концепция, которая есть и будет, но честное слово, никто не станет переписывать данный курс под самый популярный язык очередной пятилетки. Вот какой язык у них сейчас там используется, такой и будет использоваться очень долго, я так думаю.

Information

Rating
4,314-th
Location
Фукусима, Япония
Date of birth
Registered
Activity