Обновить
@foss22read⁠-⁠only

Пользователь

-1,1
Рейтинг
Отправить сообщение

пока человек только выбирает профессию, подает документы и начинает первый семестр, ИИ успевает получить несколько крупных обновлений и частично автоматизировать специальность, которую человек собирался осваивать

Так на кого учиться/переучиваться?

мерещится тесный мир там, где работает обычная статистика совпадений.

результат такого эксперимента зависит от мотивации участников не меньше, чем от устройства сети.

Мотивацию как поднять? Существует ведь наверняка шаблон более оптимальный способ персонализации, при котором под каждого адресата подберут более успешный, чем даже для профессора известного американского университета, который собрал 44% всех дошедших цепочек.

Мне этот эксперимент важен не как теоретический а как прикладной. Профилактика доминантных генетических заболеваний могла бы здорово улучшиться, если бы оптимальный способ был найден. Сейчас из тысяч ДНК-совпаденцев на письма отвечают лишь очень небольшой процент, хотя все дальняя родня и внутри одной расы.

все айтишники релоцируются.
Этак большая часть бизнесов в России закроется.

Почему? Неужели нельзя без ВПНов и телеги?

Продолжать статьи на тему НЕпрактического применения ИИ?

Ну как бы да, оно не практично. Хотя... как бы Вы обосновали зачем?

Навскидку 2 ответа на вопрос зачем (ради прагматики и ради эстетики):

1) Смартфоны по отдельности слабее видеокарт, но их несравнимо больше. Если 7 миллиардов устройств заработают одновременно на пределе возможностей, суммарное потребление составит от 23 до 38 гигаватт (дата-центры мира потребляют порядка 40–50 ГВт). Цена плашек DDR3 стала расти вслед за скупкой DDR4 и DDR5, так почему бы не задействовать чипы смартфонов, медленно но верно пропуская через них десятки токенов (вместо тысяч)?

2) Обучение нейросети на смартфоне, использование ретро-авто и «нерентабельной» техники — это разные грани одного явления. Мы не всегда выбираем вещи по критерию максимальной эффективности. Иногда на первый план выходят приватность, эмоции, стиль, экологичность или просто привычка. Старая техника продолжает служить не потому, что она «выгодна» в экономическом смысле, а потому что она ценна по-другому — как хобби, как память, как способ самовыражения или как надёжный инструмент, который просто работает. Каллиграфия зачем, если печатаем на клавиатурах? Ужение на поплавочную удочку зачем, если эффективнее сетями или в магазе рыбу купить? Но на ужин наловить и приготовить вполне достаточно и приятно. Так же и с обучением на своих данных на старом смартфоне.

Обучение по прежнему ресурсозатратное, поэтому и был выбран самый “щадящий” корпус, что бы каждый мог попробовать обучить модель на своем железе.

Старый 32-битный телефон armv7 с одноканальной DDR3 у меня есть. Современного AVX2 компа нету, тем более с NPU. Надо статью как получилось портировать претрейн на этот телефончик?

Реализация собственных ИИ-агентов на базе LLM в рамках заказных НИОКР

Чем выдающимся могут похвастаться эти разработки препода, по сравнению с аналогами?

Всегда должна быть «физкультура» для мозга — нужно заставлять себя думать. Но человек по своей природе ленив, поэтому заниматься этим может не каждый

Проф-деформация препода от общения с “ленивыми” студентами (возможно перегруженными, а не ленивыми)

Зачем грузить лишней “физкультурой” вхолостую, когда правильнее поручит студентам создание чего-то реально полезного?

Вопросы хорошие, наболевшие. Многие ответы хороши. Но отметил спорные моменты в позиции препода.

Буду рад фидбеку и конструктивной критике

Начните со списка программ, которых пока нету под линукс. Небольшой каталог типа wine с зелеными и красными клетками. Комьюнити наполнит.

Для облегчения запуска тестов желательно понизить версию, а не как сейчас: error: cannot install package kakehashi 0.1.7, it requires rustc 1.97 or newer, while the currently active rustc version is 1.92

Немного не так. Гипер-фокус как раз характерен для этого синдрома. Дефицит не внимания, а дефицит способности управлять вниманием. По сравнению с теми, кому управлять вниманием легко (большинству легко).

sed 's/ AI / LLM, на публичных датасетах обученные/g'

LLM, на внутренних закрытых датасетах обученные если добавить, то немного поменяется смысл некоторых утверждений из статьи. Они становятся спорными. Речь не об AI в целом, а только о подмножестве LLM с подмножеством LLM, обученных на публичных датасетах.

Пример спорного утверждения:

LLM модель при обучении не ассимилирует их наработки, не проанализирует их код, не включит в свою “память” — а значит, эффективность применения AI в закрытых проектах будет ощутимо ниже.

Эффективность будет достаточной, если дообучить LLM на данных закрытого проекта.

очень приятно было понять, что ты не одинок в своей работе. Где-то в мире почти наверняка есть человек, который параллельно с тобой решает похожую задачу, сталкивается с теми же ограничениями и задаёт себе те же вопросы. Конечно, изначально немного наивно думать, что только ты крутишь LLM’ки и никто больше с такими проблемами не сталкивался. Но когда внутри твоей команды люди занимаются другими направлениями, а друзья из других компаний не встречали именно твоих кейсов, такое ощущение действительно может возникнуть.

Конференция в этом смысле работает как быстрый способ найти своих: людей с похожими интересами, задачами и болью

С другой стороны...

Гордое одиночество это хороший признак. Значит ты нащупал уникальную задачу, где тебя не заменить. Даже если задача -неуловимый Джо.

Если в мире есть человек, который параллельно с тобой решает похожую задачу - пусть он и решает. Разделение труда. Приятно еще больше.

к этому случаю претензия применяется плохо: человеческий рекорд 2.29 никогда не публиковался, вспоминать его модели было неоткуда.


Но ведь GPT-5-N обучались не только на публикациях. Ещё и на историях диалогов с живыми математиками. Кто (кроме имеющих доступы к логам чатов проприетарной модели) проверял семантическое сходство решения с миллионами диалогов?

выдать забытый чужой результат за свежее открытие — без ссылки на первоисточник.

Годный способ опенсорсить чужие ценные знания. Если отбросить негативные коннотации про “отмывание знаний”

В телеграме есть чат Генотека. Посмотреть не могу, поскольку телеграм без ВПНов уже не работает, а я не пользуюсь ВПНами. Если у Вас работает tg, то поиском найти в чате сообщения Александра про "полногеномные" сиквенсы.

Яндекс-поиск показывает контакт, ему можете написать напрямую:

elegram: Contact @alexrakitko t.me›alexrakitko

Alexander Rakitko. @alexrakitko. Genotek CSO. If you have Telegram, you can contact Alexander right away. РКН: иностранный владелец ресурса нарушает закон РФ

Вероятно, и на хабре сработает иконка Отправить сообщение @Genotek

В чатике Генотека в телеге их представитель (Александр) предлагал всем, у кого полный геном секвенирован загрузить к ним (примерно сто гигов, в индивидуальном порядке, это пока редкость) для получения их отчётов. Они заинтересованы, поскольку полный геном позволяет точнее искать родню (+ болезни исследовать), чем у кого чиповые тесты, их в Генотеке львиное большинство.То есть выигрывают все от полного сиквенса, не только тот, кого секвенировали, но и его родня (сдавшая только дешевый тест на основе чипа GSA).

Да, стриминг. Добучать постоянно не на данных, лежащих на диске, а постоянно тянущихся из сети и временно кэшированных, за последнюю неделю например из кэша браузера.

последовательности 2048 токенов.

Скорее всего появятся сотни клонов, где нашинкован датасет однажды опенсорснутый, который пытаются снова закрыть. Анонимайзером вычистить лэйблы, упоминания хабра, ПД и привязки к авторам и всё ОК ведь будет? Это уже не будет целостное произведение, не статья, не объект авторского права.

пытался обучить 7B модельку, которую с помощью многих ухищрений удалось вместить в 32Гб, но скорость обучения была 500 t/s.

Расскажите плиз про эти ухищрения. Как искали границу чтобы влезала? Какие оптимизации? Скорость медленная не так важна, главное чтобы влезала. Пусть хоть месяц или полгода учится, на нужных кастомных датасетах.

связывают с пониженным риском рака и долголетием ценой невысокого роста. Только этот «вариант невысокого роста» достался человеку заметно выше среднего — мне.

Поскольку клеток в теле высокого больше, чем в теле низкого - вероятность возникнуть и закрепиться раковым клеткам выше у высокого. Логично же? Только как в этом помогает знание геномной последовательности? Проще же определить размер человека на глаз.

T1a1

Пра*бабушку молодую красивую вывезли новгородцы или карелы/ижора (как вариант) в качестве военного трофея?

один из важнейших городов Швеции, политический и религиозный центр в эпоху ранней христианизации, крупнейший торговый центр страны в XI—начале XII вв. В 990-х годах здесь впервые в Швеции были отчеканены серебряные монеты, они носили изображение короля Олафа Шётконунга.
Считается, что 12 августа 1187 года Сигтуна была захвачена новгородцами и союзными им карелами и эстами; также иногда пишут и об участии народа ижора, архиепископ Уппсальский убит, а город опустошён настолько, что уже не оправился. Среди похищенного якобы были бронзовые церковные ворота, которые уже при жизни Эрика украшали церковь в Новгороде

https://руни.рф/Гаплогруппа_T_(мтДНК)
T1, T1a1j, T2 и T2f1 определены у обитателей Сигтуны, живших примерно в X—XII веках


Загрузите мито-сиквенс в файле .bam на yfull - получите чатик - переписка с роднёй по женской и мужской прямым веткам.

на дешёвой CMP 90HX… DeepVariant отработал на ней штатно, вызов вариантов уложился в пару часов

Команду запуска и версию добавите? И сколко ватт выставлено nvidia-smi -pl


бесплатный магазин расширений: модули оформлены в специальном формате, так что любой соберёт свой (руками или с помощью ИИ по научной статье) и выложит для других.

Хочется плагин браузера - читаешь свежую научно-популярную статью, а плагин сразу подсвечивает ответ на вопрос - твои варианты или не твои? Актуальна для тебя статья или нет... Именно по свежим статьям, котрых пока нет в базе Clinvar


>Знать слабое место заранее дешевле, чем ловить проблему по факту.

эх, если бы еще врачи превентивную медицину поддерживали, но обычно только симптомных принимают, обычно как в милиции "приходите когда убьют" )

Генотек кстати принимает полногеномные bam - загрузите - получите отчёт в том числе полигенные риски с красивыми графиками вклада каждого варианта. Плюс родственников несколько тысяч найдётся.

человека и 38 видов млек

Интересно как изменятся предсказания модели, если добавить ещё 1 или 2 вида в обучающие данные. Насколько сильно изменится? к 38 добавить пару-тройку самых отличающихся из 166.

гибко настраивать параметры монтирования (например, индивидуальное сжатие для разных каталогов)

Зачем разное сжатие может понадобиться? Есть идеи? Понять могу отсутствие сжатия и сжатие для 2 каталогов (фильмы и jpg не жать). Но разная степень сжатия зачем?

Есть список таких контор? Хочется вайбкодить не заглядывая в код. Вместо тех кто любит заглядывать в код. Приветствую "как только меня заставят писать ллмками, я просто уйду"!

Информация

В рейтинге
Не участвует
Зарегистрирован
Активность