Pull to refresh
5
Send message

Не удивительно. Это пока ни одной модели не под силу.

"Человек делает мало коммитов, значит, он ничего не делает". Это - сильно.

Сразу вспоминается история из "Совершенного кода":

Несколько лет назад я работал над проектом Минобороны, и как-то на этапе выработки требований нас посетил куратор проекта — генерал. Мы сказали ему, что работаем над требованиями: большей частью общаемся с клиентами, определяем их потребности и разрабатываем проект приложения. Он, однако, настаивал на том, чтобы увидеть код. Мы сказали, что у нас нет кода, и тогда он отправился в рабочий отдел, намереваясь хоть кого-нибудь из 100 человек поймать за программированием. Огорченный тем, что почти все из них находились не за своими компьютерами, этот крупный человек наконец указал на инженера рядом со мной и проревел: «А он что делает? Он ведь пишет код!» Вообще-то этот инженер работал над утилитой форматирования документов, но генерал хотел увидеть код, нашел что-то похожее на него и хотел, чтобы хоть кто-то писал код, так что мы сказали ему, что он прав: это код.

Не знаю на счёт o1, но 4 и 4o на вход изображения тоже принимают, не только текст. Соответственно, можно и нужный кадр из видеовопроса прикрепить, и скриншот с предметом, что я не так давно делал.

Попробовал "скормить" GPT-4 несколько вопросов из весенней серии ТелеЧГК. Вопросы брал наиболее логичные, "раскручиваемые". Хотел сравнить её с другими моделями (Gemini, Claude). Но увидел, что результаты не особо впечатляют, и не стал продолжать. Правильных ответов было сравнительно немного, и большинство были взяты за счёт эрудиции. По сравнению с моими предыдущими опытами с GPT-3.5 на вопросах из зимней серии 2022, серьёзного прогресса я не заметил.

Посмотреть, как справится с этими вопросами 1o, было бы интересно.

Почему молодежь не хочет рожать

А это доказано? Есть какая-то статистика, соцопросы, подтверждающие это утверждение? Или это просто личное мнение автора статьи?

По моему опыту, детей хотят многие. Не все могут в силу разных причин, но это уже другой вопрос.

получается, что должно быть "objom"? это ведь намного лучше, чем "objhyom".

Опять же, всё зависит от цели, для которой мы используем транслитерацию. Если для простой переписки - то, конечно, гораздо лучше, тут без вариантов. Если для кодирования последовательности кириллических символов в латинские без потерь - то нет.

На практике можно найти много примеров нестандартных сочетаний букв. Это и неологизмы, и аббревиатуры, и всякие коды - как то автомобильные номера, децимальники, наименования микросхем. И вот тогда уже заточенная под общепринятую литературную норму система забуксует, когда столкнётся с необходимостью транслитерировать какую-нибудь "Операцию Ы".

Так тут, как говорится, палка о двух концах. Ориентируемся на один показатель - приносим в жертву другие.

В моём варианте удобство чтения было принесено в жертву однозначности отображения и, по возможности, соответствия фонетике.

Максимизируем удобство чтения - значит, ориентируемся только на фонетику и краткость. Но тогда надо смириться с трудностями, которые возникнут при переводе в латиницу каких-то нестандартных слов, таких, как "Ыа" и "Ый" (реки в России), "Куанъинь" (китайский император) и т. п. Ну а, тем более, с невозможностью перевода в латиницу произвольного набора букв.

Мне интересно, если я "ошибусь" и напишу "obyom" - оно ведь будет читаться совершенно так же, по предложенным вами правилам.

Ну... нет. Это будет читаться как "обём".

Кролики кроликами, но вот когда эти модели смогут слона без хобота нарисовать, тогда и поговорим.

Ну, справедливости ради, "ya" - это не только "ыа", но и вполне общепринятое "я".

А вот с "ъ" и "ь" в принципе сложно придумать что-то хорошее.
В моём варианте логика пляшет от фонетики.
"y" в сочетаниях наподобие sya=ся, lyo=лё и т.п. можно интерпретировать как символ, обозначающий мягкость предшествующей согласной. В этом смысле "y" эквивалентно мягкому знаку.
"j", в свою очередь, можно интерпретировать как звук "й", который появляется, когда буквы "я", "ё", и пр. идут после твёрдого знака.
А "h" играет роль спецсимвола.
Отсюда и взялись сочетания "yh" и "jh".

Альтернатив здесь не так много. Или вопреки фонетике приспособить под "ъ" и "ь" какие-то неиспользованные латинские буквы, такие как "q", "x", "w". Или смириться с необходимостью использовать апострофы / прочие спецсимволы.

Я пошёл ещё дальше, и набросал программку, которая сама играет в Сапёра, и с её помощью установил рекорд 1 с.
Правда, алгоритм до ума не доводил, потому справляется она только с "новичком" и, иногда, "любителем", а вот "профессионал" ей не под силу.

Я тоже как то задумался о транслитерации, которую можно было бы однозначно перевести как из кириллицы в латиницу, так и обратно. При этом она должна быть:
- Фонетически близкой к звукам русского языка
- По возможности максимально простой. Одна русская буква в идеале должна соответствовать одной латинской, максимум - двум, но не более.
- Включать только символы латинского языка, не использовать спецсимволы и диакритические знаки.

Получилось вот что:

а = a
б = b
в = v
г = g
д = d
е = ye
ё = yo
ж = zh
з = z
и = yi
й = j
к = k
л = l
м = m
н = n
о = o
п = p
р = r
с = s
т = t
у = u
ф = f
х = kh
ц = c
ч = th
ш = sh
щ = ch
ъ = jh
ы = i
ь = yh
э = e
ю = yu
я = ya

В чём плюсы:
- Когда кириллическая буква соответствует сочетанию из 2 латинских, то одна из букв в этом сочетании обязательно используется только в паре с другими и не используется сама по себе (y, h). Причём эти буквы-"спецсимволы" во всех сочетаниях используются только на определённой позиции: y на первой, h на второй. Это позволяет избежать неоднозначности при переводе транслита в кириллицу.
- Логичная система кодирования гласных: они сгруппированы по парам с учётом их фонетики: а-я, э-е, о-ё, ы-и, у-ю.

В чём минусы:
- Слова, содержащие "ъ" или "ь", получаются не очень читаемыми.

Зато на Марс не высаживался только ленивый. Так что технологии межпланетных перелётов и посадочных модулей давно уже сделали шаг вперёд. А на Луну последнее время кроме китайцев никто толком сесть и не пытался, только индусы и евреи.

А вот я, к своему стыду, убил много времени, играя именно в первые «Дальнобойщики». Почему? Потому что там был файл, в котором прописаны характеристики всех автомобилей, и их можно было менять. А вот во второй части такой возможности уже не было.
А почему нет ни слова о том, что 25 августа в Москве ликвидировано троллейбусное движение (то ли по причине некомпетентности мэра Москвы и прочих чиновников, то ли потому, что они преследуют собственные корыстные цели)?
Вы отталкиваетесь от личного печального опыта, но почему-то хотите убедить нас при этом, что он всеобщий.
Разве? Я нигде этого не утверждал. Безусловно, я не претендую на всеобъемлющую характеристику состояния российской науки, однако, с учётом того, что нам приходилось взаимодействовать и с другими организациями, я всё-таки имею некоторое представление о положении дел и об уровне зарплат, по крайней мере, в отдельных научных учреждениях.
А вот на чём основана Ваша точка зрения, кроме некоторых неназванных фактов — это остаётся неясным…
Что в данном контексте должен сказать ваш личный пример?
Только то, что фраза «в России совершенно никаких условий нет для научной работы» соответствует действительности, как минимум, частично.
Вот я в теме, например. Опыт работы в ИФХЭ РАН более 7 лет. Это хоть и не атомная отрасль, но всё же наука. Отсутствие условий подтверждаю. Реактивы, посуда, электронные компоненты, зачастую даже измерительные приборы покупаются за свой счёт, установки для опытов приходится делать практически из подручных материалов. Результат — исследования, которые при наличии хорошего оборудования можно было бы завершить за несколько месяцев, растягиваются на годы.
имеет форму = молот (относится к = голова)
состоит из = голова (имеет форму = молот)
Одно утверждение, и два совершенно разных способа его формализации. Вот, кстати, и ещё один недостаток модели: разные пользователи будут описывать схожие утверждения по-своему, с использованием разных, но подходящих по смыслу, свойств. А это затрудняет автоматический анализ и сравнение данных.

Тут даже интересно, а с какой целью вы пытаетесь это описать именно так? Машиночитаемые данные интересны, когда их можно с чем-то сравнить, а не когда это пятиэтажная конструкция, которая возникла исключительно из текстового описания.
Так ведь этот новый проект, вроде бы, позиционируется как, своего рода, аналог ВП. Статья в ВП может содержать исчерпывающие описание предмета, тогда как в новом проекте оно ограничено наличием соответствующих свойств. Эти примеры призваны проиллюстрировать потерю информации при описании предмета, и повышение сложности в результате попыток эту потерю преодолеть.

покрытие = полые иглы (длина = 2,5±0,5 см; число = 5000±500; относится к = спина)
Для этого прийдётся создавать новую сущность — «полые иглы», а это как раз пример непропорционального роста сложности…
Да и, кстати, просто описать форму объекта, отличную от простой геометрической фигуры, тоже задача ещё та.
«У рыбы-молот голова в виде молота» — тут надо или вводить свойство «форма головы» (а свойств и так уже столько, что запутаться в них легче, чем найти нужное), или же что-то придумывать с квалификаторами, например, «состоит из»-«голова»-«имеет форму»-«молот». Если же речь идёт о более сложной форме, то тут не обойтись без квалификаторов для квалификаторов (которых сейчас нет) — вот как, например, сказать, что «спина ежа покрыта полыми внутри иглами длиной не более 3 см, их количество составляет около 5000»?
И при этом невозможно указать соотношение между отдельными частями, их взаимное расположение и т.п.

Или вот, например, как сейчас на Викиданных описана окраска зебры? Просто указано «цвет»-«белый» и «цвет»-«чёрный». Но это не говорит о том, что окраска полосатая, а не, например, пятнистая. И с тем же успехом это может означать и то, что одни особи могут иметь белую, а другие — чёрную окраску, или что их цвет меняется по мере взросления, или в зависимости от сезона. И, опять же, чтобы описать все эти детали, потребуется много специальных свойств.
А в человеческом языке их описание не представляет никаких проблем.

В общем, на мой взгляд, это тупиковый путь.
Не думаю, что для всего. Вот как, например, можно перевести на язык Викиданных следующее утверждение:
«Неопределённый интеграл функции на некотором интервале есть множество всех первообразных функций данной функции на этом интервале»?

Information

Rating
Does not participate
Registered
Activity