Pull to refresh
332
Maxim Mozgovoy@rg_software

university professor and software developer

0,2
Rating
155
Subscribers
Send message

то их объем ну максимум 10%, остальные 90 приобретаются при обучении.

Да. Или, наоборот, 90 на 10, это столь же обоснованная оценка.

Составьте конкретный список концепций, которые вы считаете врожденными, и мы придумаем эксперименты, которые это подверждают или опровергают.

Это будет очень трудно сделать, т.к. ребёнок с рождения моментально окунается в информационную среду. Но, например: эмоциональная реакция на тот или иной цвет, форму, тактильное ощущение (приятно/неприятно/опасно). Повышенное внимание ко всему, что ощущается как образ человека, особенно лицо. Повышенное внимание ко всему, что похоже на человеческую речь (звуки, по тембру и громкости соответствующие нормальному голосу). Эмоциональная реакция на громкость и частоту. Реакция на попытку привлечь внимание (тыкаем пальцем куда-то -- ребёнок быстро приучается туда смотреть, а вот обезьяна нет, хотя, казалось бы, не rocket science).
Я повторюсь, тут вопрос не в магии, а в том, что "база" для многих подобных явлений просто не имеет названия. Вот мы знаем, что ребёнка очень легко научить поворачивать голову туда, куда мы пальцем тычем, и это, казалось бы, гораздо проще умение, чем то, что делает дрессированная собака. Однако же собака такому научиться не может. Почему так? По моему пониманию, человеческий мозг изначально подготовлен такого рода вещь выучить. И тут явно не 10% генетики и 90% обучения, тут 90% генетики, хотя как её назвать, чтобы не казалась магией? Пусть будет "способность выучить указующий жест", отсутствующая у собаки и прочих животных. (Прочитал только что, что некоторые животные таки научаются, но это настолько экзотика, что попадает в обычную прессу).

Далее из них выделяется какое-то подмножество информации, и может быть так, что одно подмножество запомнить легче, чем другое

Ну и кто теперь магию предлагает? Попробуйте выделить подмножество для зайчиков. Я уж молчу о том, что для записи вида 111x110 вам хватит участка 4x4 пикселя на каждый символ, т.е. мы имеем картинку 28x4 ч/б точек, т.е. 112 бит информации на всё про всё.

Для схемы нужно гораздо меньше информации, а для контента надо прописать каждую связь между нейронами.

Это снова рассуждение о том, где музыка -- в проигрывателе или в пластинке. Да, конечно, иной проигрыватель очень прост. Но не вижу причин, почему не может быть наоборот -- информации с гулькин нос, а обработчик навороченный.

если информацию можно приобрести в результате обучения, незачем ее хранить в ДНК.

Вот у животных так не работает. В ДНК хранить выгодно, т.к. родившись, особь сразу может сама себя обеспечить, т.к. от природы знает, как прокормиться и согреться. Стратегия человека очень гибкая, но выгода от неё достаётся весьма высокой ценой. Поэтому в принципе в ДНК логично грузить всё, что может считаться более-менее постоянным в нашем мире.

Это все прекрасно можно оценить и составить примерный список. Если вы на это ссылаетесь без указания списка, то это списывание на магию, а потому неконструктивно.

К сожалению, это нельзя всё "прекрасно оценить", потому что лингвистика до сих пор весьма примерно представляет себе объёмы. Скажем, простой пример. Мы знаем, что в русском языке порядок слов свободный, их можно переставлять. Однако не произвольный: что-то переставлять можно, что-то нельзя. Мельчук (вроде бы) в 90-х годах пытался составить каталог правил "линеаризации", и получилось как-то много, сложно, и не факт, что исчерпывающе. Или, скажем, правила использования частиц типа "да", "же", "ну". Мы довольно мало знаем о том, как работают механизмы вспомогательных частей речи и насколько он опирается на одинаковый фундамент. Да и как проверить такое? Если в языке их нет, это может означать, что механизм в голове просто "спит".

умение его использовать не задается врожденно, значит оно приобретается в процессе обучения по входной информации.

Ну это как бы очевидно, да. Но вы можете оценить объём требуемого для этого дела обучения? Если представить себе книжку "смартфон для чайника" на 100 страниц -- это же не "100 страниц обучения" на практике, а 100 страниц обучения + та информация, которая уже заложена в мозге, в т.ч. от рождения, не так ли?

Если там нет поворотов и отзеркаливания, каким образом тогда эти примеры аналогичны?

Это вы льёте воду на мою мельницу: зайчики сложнее, потому что их ещё зеркалят.

Если вы покажете 64 зайчика, которые отличаются незначительными деталями типа формы ушей, и дадите каждому разное имя, то ребенок тоже их все не запомнит. Абсолютно аналогичное поведение, которое объясняется объемом информации и ресурсами для ее запоминания и отличия.

Это отличное соображение, но если вы и вправду хотите уйти от "магии", то давайте измерять объём информации в том, в чём его измерять полагается, а именно в битах. И попробуйте прикинуть, сколько данных хранится в таблице умножения размером 7x7 элементов (включая нулевые) а сколько в датасете с зайчиками.

Почему-то помогают быстро обучаться, фиг знает что это за знания, даже предположений никаких нет, но они точно помогают.

Во-первых, если мы чего-то не понимаем досконально, это не значит, что этого нет. Во-вторых, примеры такого "пред-знания" широко известны, например, даже очень маленькие дети боятся проползти по стеклянному полу между двумя приподнятыми поверхностями, даже если они раньше никогда не падали с высоты. То есть ребёнок от рождения "знает", что падать с высоты это плохо. "Магия" -- это как раз предполагать, что в нашей ДНК хранится информация о том, как вырастить руки, ноги, печень и глаза, а также отделы мозга, управляющие лёгкими и сердцем, но при этом по какой-то "магической" причине полностью вычищена информация, отвечающая за контент других участков мозга, напр., коры.

Да нет, мы совершенно точно знаем, что врожденного знания языка ни у кого нет.

У человека нет врождённого конкретного языка, но более чем вероятно, что есть врождённый "метаязык", о котором писали Хомский, Пинкер и иже с ними. Соответственно, обучение языку -- это настройка метаязыка под конкретную ситуацию данного региона, а это совсем не то же самое, что обучение с нуля.

А если есть что-то другое, более абстрактное, значит есть и механизм обучения по входной информации, который их связывает.

Смартфона нет, более абстрактное есть. Весь спор на самом деле исключительно про объём требуемой информации, чтобы понять о том, как использовать конкретный смартфон. С моей точки зрения этот объём значительно меньше, чем можно было бы себе вообразить.

Так откуда они появились-то?) В процессе обучения.

Прикол в том, что они появились на основе крайне маленькой, грязной и хаотически составленной выборки. Такого результата у нейросети никогда не будет, если ей не дать уже готовую "болванку", в которой есть некий "шаблон" языка.

Что у нейросети нет понятия "смартфон", что у ребенка.

Это вам / нам так кажется. Смартфон изначально разработан "под человека", чтобы быть интуитивно понятным. Да, смартфонов нет в природе, но он намеренно заточен под то, чтобы им можно было овладеть быстро, т.е. на какие-то "пред-знания" он опирается.

Если смотреть со стороны ресурсов, необходимых для запоминания, то не проще.

Я не согласен с анализом выше. Не надо обсуждать пары и сроки. У ребёнка обычно есть какие-нибудь книжки с картинками типа "животные". Вы тыкаете ему на картинку и говорите: это белочка, это зайчик! После двух зайчиков он прекрасно сам ткнёт на картинку другого размера, цвета и отзеркаленную, и скажет, что это тоже зайчик. Хотя для нейросети это будет большой вызов. И таких картинок легко с полсотни наберётся.

Если же вы дадите ему книжку, где на каждой странице будет написано что-то типа "101x011" и скажете, что это "1111", то увидите, что ситуация куда сложнее, чем с зайчиками, хотя шрифт будет один и тот же, и никаких поворотов и зеркалирования.

Ну вот, опять какая-то магия, которая непонятно как работает, но конечно же всё объясняет. Это неинтересно.

Тут нет никакой магии, достаточно принять за данность, что любая игра изначально разрабатывается под массу особенностей мозга, которые и воспринимают игру увлекательной. У тетриса низкий порог входа, но "порог входа" -- это довольно субъективное понятие, которое изначально отталкивается от того, что заложено в мозг. Собаке интересно бегать и приносить мячик, а нам с вами неинтересно. Что ж тут магического, если я скажу, что мозг у собаки другой, и интересно ему другое?..

Возможный набор таких готовых знаний крайне ограничен, поэтому обучение в любом случае играет большую роль.

Обучение играет огромную роль, но нам очень трудно отделить в случае ребёнка те знания, которые были в голове изначально, от тех, которые мы туда вложили. Как раз ссылка на то, что в голове нет "смартфона" или "глагола" довольно наивна: в голове даже у дошкольника прекрасно имеются падежи, а в школе ему уже постфактум объясняют, что же такое у него в голове. Формально обучение, реально разметка уже имеющегося.

Ну, вот у меня тут странная роль. С одной стороны, я согласен, что нынешней нейросети крайне далеко до мозга, но с другой стороны, было бы странно пенять ей на то, что в неё изначально заложены другие знания.

Ребёнок лет пяти без проблем активно знает несколько сотен слов (как минимум), а понимает ещё больше, а невербально так вообще хорошо ориентируется в сложных вещах. А вы попробуйте заставить его выучить хотя бы таблицу умножения трёхзначных двоичных чисел. Это всего-то несколько десятков элементов, а произносить надо только "ноль" и "один". Чем же это труднее условного русского языка?

Так что никакой магии: мозг исходно обладает всем готовым материалом для быстрого освоения языка и не обладает материалом для зазубривания нескольких десятков простых элементов, хотя с какой стороны ни посмотри, вторая задача куда проще.

Соответственно, дистанция до тетриса короткая потому, что тетрис объективно очень недалеко ушёл от исходной прошивки. Какое отношение тетрис имеет к ней я, естественно, не знаю, но любому из нас не составит никакого труда придумать с десяток очень сложных для ребёнка задач, которые любая нейросеть пощёлкает на раз и наоборот -- ровно потому, что для нейросети дистанция обучения в любую сторону одинакова, а мы в мир приходим уже с готовыми знаниями, которые почему-то оказываются похожими на тетрис.

А может, это некая аберрация восприятия? Вам кажется, что между китайским и каким-нибудь исландским пропасть, а на практике это всё ерунда по сравнению с тем куском мозга, который между нами и мартышкой. А любой человеческий язык, при всех их различиях, всё равно человеком придуман.

Аналогично, тетрис ровно потому и хит, что его можно освоить за пять минут, т.е. дистанция между "базовой прошивкой" и пониманием тетриса очень короткая. А можно вообразить себе "марсианский тетрис", который марсианин с нуля освоит за пять минут своим марсианским мозгом, а мы будем тыкаться и всё без толку.

Тут вопрос в том, как сказано в одной книжке, музыка в проигрывателе или в пластинке. Человека вы обучить языку можете, а вот мартышке сколько ни вдалбливай грамматику, ничего не выйдет.

Но помимо развитой структуры мозга в нём заложена ещё и какая-то врождённая "база знаний" об окружающем мире на уровне ROM. Мы об этом кое-что знаем, но явно недостаточно, и трудно сказать, сколько знаний нужно иметь в ROM, чтобы обучение человека человеком срабатывало. Может, "обучение" -- это всего лишь мелкий тюнинг, а базовое знание там уже лежит, поэтому так быстро обучиться и получается.

А вот такой вопрос: у автора статьи были проблемы сгенерировать одного и того же кролика, это как-то решается? По-моему, это совершенно напрашивающаяся функциональность для массы практических применений: вот мы путём уточнений и ещё чего-то там вышли на нужных нам персонажей, но теперь именно этих персонажей надо подставлять в разные контексты. Мне пока непонятно, как это делать.

Это довольно странное определение, потому что непонятно, что за функции "традиционно" считаются прерогативой человека. Вообще говоря, традиционно -- все, потому что даже лошадь и собаку не сразу одомашнили. Таким образом, под него можно подвести что угодно и, наоборот, выбросить из него "нетворческое" распознавание образов, например.

Не вижу в ChatGPT ничего неожиданного -- были и шашки, и шахматы, и гуглопереводчик, и распознавание рукописного текста, и даже генераторы бреда на основе входного абзаца. Да, конечно, теперь мы имеем гораздо более качественную реализацию, но странно было бы не ожидать её.

Тут нет проблемы, точнее, проблема в другом. Как преподаватель я вынужден выполнять две совершенно различные функции: образовательную и контрольную. С точки зрения образования, например, мне бы следовало всячески поощрять коллективную работу, потому это хороший способ обучения и решения проблем, заодно социализация и опыт сотрудничества. С точки зрения контроля я потом не смогу понять, кто какую оценку заслуживает. Поэтому существуют сертификаты типа IELTS, для получения которых нужно пройти экзамен, то есть чисто контрольное мероприятие. Преподаватели en masse выполнять контрольную функцию не любят. Это нетворческая трата времени, довольно скучное занятие, совсем не того типа, ради которого люди шли в профессию. Многие так откровенно на качество контроля забивают. В этом контексте проблема существует независимо от любых чат-джипити.

Ну это же ровно та логика, под которой подавался в своё время Кобол, потом всякие CASE-средства (визуальная разработка БД), SQL, графические языки программирования и т.п. Зачем нужен программист, если бухгалтер может на Коболе написать практически как на английском?

Вот практика показывает, что это так не работает по миллиону причин. Одно из очевидных соображений состоит в том, что мы живём в мире, где и так довала софта, который делает всё, что можно себе вообразить, и всё равно люди ухитряются писать что-то ещё. Потому что вариант "сделай мне красиво" -- это достаточно нишевая тема по типу "переведи хорошо на корейский" или "найди что я ищу", для которой пишется интерфейс с одним полем ввода и одной кнопкой. А есть ещё "ваш софт" с миллионом окошек (помните картинку такую?)

И вот да, есть графический фильтр для телефона, а есть фотошоп и куча конкурентов попроще, которые создаются не по команде "сделай мне клон фотошопа", а в логике "хочу как фотошоп, но вот тут список миллиона мелочей, которые хочу сделать иначе". Компьютерные игры так вообще почти все без исключения такие. И вот этот миллион мелочей и надо разжевать компьютеру, или джуну, или ещё кому. Наверно, ещё хороший пример -- это браузер или мессенджер. Подумайте, чем один отличается от другого, и какое разное у людей представление об удобном и нужном.

Да может, г-н Куликов тоже на своём месте вредит в меру возможности?

Это, безусловно так в том смысле, что если мысленно перенестись на 200 лет назад, то мы увидим, что, с одной стороны, жизнь была ровно такой же -- люди рождались, ходили в школу, искали себе занятие, заводили семьи, выходили на покой и далее по списку, а с другой стороны, очевидно, много чего изменилось за счёт постепенных изменений окружающей действительности.
Однако же обсуждение современных AI систем обычно ведётся не в том ключе, что, дескать, теперь мы можем напрямую спросить бота про интересующую тему, а не ковырять бесконечные книги, и не том ключе, что все базовые сниппеты кода будут в удобной библиотеке для повседневного использования, а именно в ракурсе "толпы безработных ходят по планете, и не найти им приюта". В том и дело, что до сих пор люди из ларьков плавно перемещались в торговые центры или на офисную работу, телефонистки шли в кассиры, секретари или администраторы гостиниц, а авторы библиотек алгоритмов переключились на использование готовых библиотек (в том числе своих). Нет этих толп безработных. Вот мне кажется, что и теперь не будет. А то, что появятся новые use cases для AI систем -- ну, видимо, да, появятся, для этого такие системы и создаются в конце концов. Правда, Watson так и не взлетел, как мы видим, но какая-нибудь следующая разработка вполне может.

Ну это довольно смелое видение, с которым я вряд ли соглашусь, да и эмоционально заряженное. Назовите тогда сегодняшнего программиста "оператором NuGet", если хочется, а по факту работа не хуже, чем была "у дедов", плюс объёмы лишь выросли.

Я вот тоже недоумеваю от хайпа. В чём принципиальная новизна ChatGPT, я понимаю, но в чём принципиальная новизна автоматизации? Вот смотрите, если бы мне лет 25 назад надо было бы вытащить метаданные из коллекции PNG файлов и сохранить в XML, я бы, скорее всего, самостоятельно писал бы разбор заголовка PNG и генератор XML. Сейчас я беру готовую библиотеку, и ничуть мне от этого не грустно, скорее, наоборот! Я занимаюсь тем, что концентрируюсь на нужном мне результате, а не на каких-то промежуточных шагах, и не ною, что авторы библиотек отбирают у меня хлеб. Более того, я в принципе не слышал, чтобы кто-то ныл, что, дескать, open source парсер XML или PNG отобрал у него работу, хотя такие люди совершенно точно есть, но, видимо, не очень они за свой труд держались.

Так и здесь, если бот сможет срезать углы и избавить меня от некоторой рутины, что тут плохого? Если посмотреть ещё с одного угла, мы же знаем, что бот обучился на существующей выборке, и, в принципе, он знает плюс-минус то же самое, что знает Гугл. Соответственно, про джуна, которого ChatGPT гипотетически заменяет, можно сказать, что он не умеет пользоваться Гуглом, а занимается велосипедостроением.

Если же рассуждать в том направлении, что, дескать, вызов функций библиотеки тоже скомпоновать уметь надо, а с чатботом любая домохозяйка программист, то я не верю, что можно обойтись вообще без технического специалиста. Допустим, где нужно было пять человек, теперь хватит и одного, но и в этом случае смотри выше -- благодаря библиотекам и опен сорсу вместо пяти уже сейчас достаточно одного, и как-то ещё программисты не перевелись.

Короче говоря, можно рассуждать о механике этого процесса, но это всё будут прогнозы и предсказания. А можно посмотреть на более-менее сходные процессы в самом недавнем прошлом и увидеть, что так оно по факту не работает.

Ну хорошо, вам не нравятся люди, которые их распространяют? Ну так не надо с ними дружить и общаться. Может, мне не нравятся люди, которые распространяют морских свинок, потому что я, допустим, не люблю морских свинок, и что теперь? Остальное остаётся в силе: нужна какая-то веская причина для запрета, кроме частной нелюбви.

Да надо просто отделять мораль от закона. Допустим, люди, которые любят убивать пешеходов в Carmageddon, вам не нравятся. Но у вас же найдутся и другие претензии к человечеству, не так ли? Грубо говоря, не надо с такими людьми дружить, если вы это не любите, но требуется какая-то более веская причина, нежели просто "нелюбовь", чтобы чего-то запрещать на законодательном уровне.

Мне кажется, у вас немного спор ни о чём. "Коммерческая организация ставит целью получение прибыли" -- это просто определение из книжки. Вот это слово означает такое понятие. Мир коммерческими организациями не ограничивается. Если руководство организации забывает о цели, то компания просто проигрывает в конкурентной борьбе, т.к. если ваш зубастый конкурент ставит целью только прибыль, он по определению выиграет и останется на рынке, в то время как вы балансируете между несколькими целями.

При этом, разумеется, компания основывается живыми людьми, у которых может быть своё представление о том, чем им хочется заниматься и какими средствами. Людям вполне может быть свойственно желать улучшить мир или, например, не совершать неэтичных поступков. Тут имеются определённые противоречия, но мы с такого рода вещами и в обычной жизни постоянно сталкиваемся. Допустим, вы мягкий и деликатный человек, но как начальник или как преподаватель должны проявить жёсткость в том или ином случае, потому что того требует профессия.

Я думаю, что цель не в том, чтобы найти смысл как таковой, а в том, чтобы человек ощущал, что его жизнь проживается не зря, и не стал бы идти топиться, если его рабочее место вдруг займёт чатбот, например.

Да все будут в пролёте. Ну спрошу я у сетки, как выйти в топ продаж мыла. И трое моих конкурентов спросят то же самое. И что, у нас будет top 3 из четырёх продуктов? В том и дело, что спрашивать придётся что-то менее тривиальное, и тут уже человеку решать. Это же его бизнес, в конце концов

Вероятно. Исходный посыл был в том, что если А лучше Б, то Б это не останавливает. Типа, не всем же быть гениями, и на меня свой клиент найдётся. И находится.

Information

Rating
2,992-nd
Location
Фукусима, Япония
Date of birth
Registered
Activity