работа с таблицами будет вестись детерменированными методами? как хотя бы примерно будет выглядеть описанный мною алгоритм.
условно - сколько токенов будет потрачено на обеспечение работы (без собственно самой работы)
p.s. еще один мультиагентный сценарий - отдельный агент держит в контекстном окне необходимые данные (таких несколько), сейчас я их форкаю, в opencode есть такой инструмент, запустить агента по id его сессии, т.е. создать нового агента с тем же контекстом и добавив к нему сообщение, по окончании получить ответ, и так можно делать много раз, невероятно быстро/дешево (если модель дешевые кешированные токены) за счет кеширования контекстного окна), как тут это будет выглядеть?
или например в letta есть встроенный инструмент для коммуникации между агентами, т.е. несколько агентов буквально могут чатиться друг с другом, один условно работает с интернетом (у него соответствующие ограничения в доступе), другой отвечает на вопросы по проекту, что бы на 100500-ый раз не проводить один и тот же анализ тех же файлов (тратя токены), третий собственно задачу работает...
Никак не могу понять применимость инструмента, какие задачи он решает.
Самый полезный скрин умудрились сделать мыльным и слаборазличимым.
Логи - непонятные, ну и что что был ReadFile, а какой?
А что будет если будет ошибка (например права доступа или применения diff к файлу)?
Тупой пример задачи - нужно заставить агента работать с табличкой (csv или sqlite) одно поле - status (выполнено / ожидает) и что бы он брал первую ожидаемую запись и запускал отдельного агента с данным в записи, обновляя по выполнению эту запись. В принципе отдельный агент справляется с такой задачей, тратя на это контекстное окно и токены. С помощью этого инструмента такой цикл можно реализовать или не париться и пилить такие скрипты и дальше отдельным агентом по ситуации.
Т.е. айтишник, который устанавливает бабе клаве программы не знает что в браузере (том же штатном гугл хром) есть возможность создания иконки на рабочий столна на сайт.
А так да, компания гугл финансово заинтересована что бы ярлык на сайт было сложнее сделать чем ярлык на приложение
ну так всю команду вынудили перейти на условную замену intelij вроде круче, только код ломает, .. а отказаться вроде бы нельзя и стоит как мидл на удаленке
Самое интересное, а оборудование какое будет закупаться? а софт? мало построить датацентр, какие бы вы не поставили бы в нем заборы, достаточно выхода в интернет и команды со стороны производителя оборудования/софта, и данные уходят куда потребуется, никого не спрашивая. И фаерволы с vlan не помогут, если обход защиты на железном уровне.
И это я не про баги, которые так же понижают шансы сохранить данные и свою инфраструктуру не тронутой.
По теме opensource, много ли ваших серверов работают на открытых реализациях bios? а прошивки сетевого оборудования? а драйвера gpu?
p.s. не смог найти закона в США на эту тему, только споры против попыток ввести таковой, ну есть старый calea, но как я понимаю он не догоняет современные технические реалии.
с другой стороны, ищу я с помощью инструментов, которые могут намеренно не помогать мне это найти, а что бы найти это самому, нужны компетенции, ресурсы и достаточная мотивация.
ооо, и даже размещение таблиц в tmpfs не повышает скорости?
p.s. есть два процесса - доставка изменений на ноды, и запрос данных с нод
вы в статье описали процесс доставки изменений между нодами, допускающий заметное отставание,.. а уже в пределах ноды, запрос идет из памяти, быстро и без проблем.
Агенты кодирования нужно исследовать не на том чего они умеют, а на том где они ломаются.
Я в шоке от слабой qwen3.6-35b-a3b (3 миллиарда активных параметров, это почти ничего!), она в режиме агента иногда способна на чудеса, но чаще - творит дичайшую дичь...
и чем больше одно относительно второго - тем круче модель.
В статье приведен пример, как художники для правки моделей запускают игру, т.е. буквально пересобирают ее с нуля что ли? особенно это актуально для архивов, где каждый ассет нужно поместить в свой контейнер, для крупных проектов это гигабайты...
Отчетливо помню из прошлого, для создания чего либо в игре, нужно брать инструмент тестирования, в идеале сам редактор, который позволяет в реальном времени править модели, текстуры, анимацию, и тут же смотреть как это будет выглядеть.
Да и для тестового запуска, нужно готовое окружение, что бы исключить всю необходимую подготовку (условно пропустить меню, не заставлять тестера вести персонажа к нужной точки в мирие, или условно - не требовать от него проходить игровой момент для достижения нужного состояния, условно боса не бить,.. помню для лентяев можно было выдать специального персонажа с админ-правами, который и телепортировался куда надо и убивал с 1 удара... так вот это неправильно, правильно - запускать игру сразу с нужным состоянием или планом его изменения).
Вы требования к win12 посмотрите, совсем весело/грустно станет.
Оптимизация - это от 'нищеты', пока проблема нехватки ресурсов существовала, оптимизировали и другого не знали, а как настало изобилие, так перестали тратить на это время.
Плюс, специалисты 'старой школы', те кто споткнулся о нехватку ресурсов, становятся все большей редкостью (точнее их изначально не хватает на стремительно растущую индустрию) вот и получаем результат.
Советы - посадить разработчиков на слабое железо, вредные, потому что там банально инструментарию требуется больше ресурсов, а если ресурсов мало, то банально работать эти инструменты начинают сильно медленно, это становится уже заметно в денежном эквиваленте. Можно конечно давать разработчику два физических устройства (условную тест машину, специально слабую) и заставлять тестировать все там,.. не уверен что это будет иметь пользу.
Делать подключение все со всеми не равно слать данные всем, это просто организация и возможность оперативно детектировать уход узла из сети и управляющие команда (так же громкость).
По поводу 'слать B что бы вычесть A+2B+C', это на случай когда схема не круг а граф, и там слать нужно только долю от общего трафика и только 1-2 узлам а не всем (но слать придется часто, суммарно будет примерно логарифм от количества нод и повышается при возникновении проблем на одной из нод)
и как же определить, ведь информация об этом исчезла, т.е. лицензия вроде была, но потом вроде бы не стало (осталась общаяя - все права хабру)... но публикации тех кто делал их на правах этой лицензии не удалили а внезапно присвоили?
p.s. считаю общепринятую практику присваивания себе пользовательского контента (особенно когда контент наполняется с миру по нитке) - порочной вредной и не правильной. Если контент создается сообществом, то этот контент должен быть общедоступным в общем смысле, включая возможность его копирования и тем более использования для ИИ.
Я отчетливо помню ощущения, когда читал про то что статьи у хабра теперь по cc by лицензии, типа молодцы, сделали что то правильно, внезапно... и вдруг оказывается то были старые времена, допущения 'по глупости'.
Человечество создало что то прекрасное - интернет и огромный датасет знаний, и вместо того что бы использовать этот датасет что бы продолжать создавать что то еще более прекрасное (тот же ИИ), оно (человечество) создает само себе кучу проблем и ограничений. Взгляните на это со стороны, вот вы видите муравья, тянущего дохлую гусеницу, и смеетесь с того как не эффективно он это делает, как выбирает неэффективный путь, условно мешает и толкает других муравьев... вот это тот самый случай.
что значит нарушает? а что по поводу лицензии на данные, которые помнится хабр заявлял про открытую CC BY? вроде бы про нее говорилось, когда подключаешься программе вознаграждения за публикации.
с практической точки зрения такие слабые модели где и как можно использовать (особенно если речь идет о текстовых?) какие-нибудь сверхбыстрые классификаторы на специфических датасетах?
работа с таблицами будет вестись детерменированными методами? как хотя бы примерно будет выглядеть описанный мною алгоритм.
условно - сколько токенов будет потрачено на обеспечение работы (без собственно самой работы)
p.s. еще один мультиагентный сценарий - отдельный агент держит в контекстном окне необходимые данные (таких несколько), сейчас я их форкаю, в opencode есть такой инструмент, запустить агента по id его сессии, т.е. создать нового агента с тем же контекстом и добавив к нему сообщение, по окончании получить ответ, и так можно делать много раз, невероятно быстро/дешево (если модель дешевые кешированные токены) за счет кеширования контекстного окна), как тут это будет выглядеть?
или например в letta есть встроенный инструмент для коммуникации между агентами, т.е. несколько агентов буквально могут чатиться друг с другом, один условно работает с интернетом (у него соответствующие ограничения в доступе), другой отвечает на вопросы по проекту, что бы на 100500-ый раз не проводить один и тот же анализ тех же файлов (тратя токены), третий собственно задачу работает...
Никак не могу понять применимость инструмента, какие задачи он решает.
Самый полезный скрин умудрились сделать мыльным и слаборазличимым.
Логи - непонятные, ну и что что был ReadFile, а какой?
А что будет если будет ошибка (например права доступа или применения diff к файлу)?
Тупой пример задачи - нужно заставить агента работать с табличкой (csv или sqlite) одно поле - status (выполнено / ожидает) и что бы он брал первую ожидаемую запись и запускал отдельного агента с данным в записи, обновляя по выполнению эту запись. В принципе отдельный агент справляется с такой задачей, тратя на это контекстное окно и токены. С помощью этого инструмента такой цикл можно реализовать или не париться и пилить такие скрипты и дальше отдельным агентом по ситуации.
Т.е. айтишник, который устанавливает бабе клаве программы не знает что в браузере (том же штатном гугл хром) есть возможность создания иконки на рабочий столна на сайт.
А так да, компания гугл финансово заинтересована что бы ярлык на сайт было сложнее сделать чем ярлык на приложение
'знакомую иконку' где вы увидели?
абсолютно весь функционал, предоставляемый приложением пользователю доступен в браузере, включая юзабилити.
Весь интернет - это 'тык в иконку'
ну так всю команду вынудили перейти на условную замену intelij вроде круче, только код ломает, .. а отказаться вроде бы нельзя и стоит как мидл на удаленке
планируете открыть наработки миру?
нет ли планов по предоставлении агрегатора как услуги, когда источники предлагаются клиентами а не площадкой?
список источников какой то грустный.
Самое интересное, а оборудование какое будет закупаться? а софт? мало построить датацентр, какие бы вы не поставили бы в нем заборы, достаточно выхода в интернет и команды со стороны производителя оборудования/софта, и данные уходят куда потребуется, никого не спрашивая. И фаерволы с vlan не помогут, если обход защиты на железном уровне.
И это я не про баги, которые так же понижают шансы сохранить данные и свою инфраструктуру не тронутой.
По теме opensource, много ли ваших серверов работают на открытых реализациях bios? а прошивки сетевого оборудования? а драйвера gpu?
p.s. не смог найти закона в США на эту тему, только споры против попыток ввести таковой, ну есть старый calea, но как я понимаю он не догоняет современные технические реалии.
с другой стороны, ищу я с помощью инструментов, которые могут намеренно не помогать мне это найти, а что бы найти это самому, нужны компетенции, ресурсы и достаточная мотивация.
ооо, и даже размещение таблиц в tmpfs не повышает скорости?
p.s. есть два процесса - доставка изменений на ноды, и запрос данных с нод
вы в статье описали процесс доставки изменений между нодами, допускающий заметное отставание,.. а уже в пределах ноды, запрос идет из памяти, быстро и без проблем.
Агенты кодирования нужно исследовать не на том чего они умеют, а на том где они ломаются.
Я в шоке от слабой qwen3.6-35b-a3b (3 миллиарда активных параметров, это почти ничего!), она в режиме агента иногда способна на чудеса, но чаще - творит дичайшую дичь...
и чем больше одно относительно второго - тем круче модель.
В статье приведен пример, как художники для правки моделей запускают игру, т.е. буквально пересобирают ее с нуля что ли? особенно это актуально для архивов, где каждый ассет нужно поместить в свой контейнер, для крупных проектов это гигабайты...
Отчетливо помню из прошлого, для создания чего либо в игре, нужно брать инструмент тестирования, в идеале сам редактор, который позволяет в реальном времени править модели, текстуры, анимацию, и тут же смотреть как это будет выглядеть.
Да и для тестового запуска, нужно готовое окружение, что бы исключить всю необходимую подготовку (условно пропустить меню, не заставлять тестера вести персонажа к нужной точки в мирие, или условно - не требовать от него проходить игровой момент для достижения нужного состояния, условно боса не бить,.. помню для лентяев можно было выдать специального персонажа с админ-правами, который и телепортировался куда надо и убивал с 1 удара... так вот это неправильно, правильно - запускать игру сразу с нужным состоянием или планом его изменения).
какие это экспериментальные нейронки интеля?
если бы у них были топовые агенты кодирования, они бы уже во всех бенчмарках бы наследили, ибо деньги от сюда полезут просто огромные.
Вы требования к win12 посмотрите, совсем весело/грустно станет.
Оптимизация - это от 'нищеты', пока проблема нехватки ресурсов существовала, оптимизировали и другого не знали, а как настало изобилие, так перестали тратить на это время.
Плюс, специалисты 'старой школы', те кто споткнулся о нехватку ресурсов, становятся все большей редкостью (точнее их изначально не хватает на стремительно растущую индустрию) вот и получаем результат.
Советы - посадить разработчиков на слабое железо, вредные, потому что там банально инструментарию требуется больше ресурсов, а если ресурсов мало, то банально работать эти инструменты начинают сильно медленно, это становится уже заметно в денежном эквиваленте. Можно конечно давать разработчику два физических устройства (условную тест машину, специально слабую) и заставлять тестировать все там,.. не уверен что это будет иметь пользу.
Делать подключение все со всеми не равно слать данные всем, это просто организация и возможность оперативно детектировать уход узла из сети и управляющие команда (так же громкость).
По поводу 'слать B что бы вычесть A+2B+C', это на случай когда схема не круг а граф, и там слать нужно только долю от общего трафика и только 1-2 узлам а не всем (но слать придется часто, суммарно будет примерно логарифм от количества нод и повышается при возникновении проблем на одной из нод)
https://habr.com/ru/companies/habr/articles/116652/
я так понимаю, что бы понять. какие 300+ генеративные модели доступны, нужно отправлять запрос на подключение, пополнять счет, или я просто не нашел..
какие самые большие модели доступны и по какой цене? какая схема оплаты, время или токены? какой интервал биллинга месяц/сутки/часы?
и как же определить, ведь информация об этом исчезла, т.е. лицензия вроде была, но потом вроде бы не стало (осталась общаяя - все права хабру)... но публикации тех кто делал их на правах этой лицензии не удалили а внезапно присвоили?
p.s. считаю общепринятую практику присваивания себе пользовательского контента (особенно когда контент наполняется с миру по нитке) - порочной вредной и не правильной. Если контент создается сообществом, то этот контент должен быть общедоступным в общем смысле, включая возможность его копирования и тем более использования для ИИ.
Я отчетливо помню ощущения, когда читал про то что статьи у хабра теперь по cc by лицензии, типа молодцы, сделали что то правильно, внезапно... и вдруг оказывается то были старые времена, допущения 'по глупости'.
Человечество создало что то прекрасное - интернет и огромный датасет знаний, и вместо того что бы использовать этот датасет что бы продолжать создавать что то еще более прекрасное (тот же ИИ), оно (человечество) создает само себе кучу проблем и ограничений. Взгляните на это со стороны, вот вы видите муравья, тянущего дохлую гусеницу, и смеетесь с того как не эффективно он это делает, как выбирает неэффективный путь, условно мешает и толкает других муравьев... вот это тот самый случай.
что значит нарушает? а что по поводу лицензии на данные, которые помнится хабр заявлял про открытую CC BY? вроде бы про нее говорилось, когда подключаешься программе вознаграждения за публикации.
с практической точки зрения такие слабые модели где и как можно использовать (особенно если речь идет о текстовых?) какие-нибудь сверхбыстрые классификаторы на специфических датасетах?
а на подбор гиперпараметров процесса обучения?
какие интересные у вас датасеты там
странно что есть яндекские вопросы и ответы но нет тостера (qna.habr.com)