Руководствуясь собственным опытом и гайдами по инфографике, я бы такое не стал показывать типичному крупному боссу.
Нужно помнить, что время контакта с документом ограничено и у разных боссов - разный уровень аналитических способностей и желания вдаваться в детали. Не будет типичный вдаваться в перегруженную визуально табличку, еще и заверстанную в ppt.
Аналитичный босс попросит нормально сделанную таблицу в экселе, где можно сразу прикинуть дополнительные показатели. Гуманитарный босс вместо цифр попросит тезисное изложение ключевых моментов из таблицы с выводами для принятия решения.
Выглядит как диссонанс между ее возможностями и вашими хотелками. Например выбрана неподходящая модель, мало инфы на входе, плохо составленный промпт, не сделана декомпозиция проблемы, отключен поиск из внешних источников и еще туча подобных моментов. В сумме они и дают похожий результат.
Главный принцип этого проекта — малый размер кода. Объем памяти не имеет значения, производительность тоже, но размер бинарного файла конечного проекта важнее всего, даже читаемость кода. Конечно, все остальные факторы следует учитывать, но никогда не в ущерб увеличению размера кода.Вы будете писать код только на ассемблере x86, совместимом со средой разработки MASM32.
Вот я начитался таких новостей про GLM-5.2 и потратил с ней 4 млн токенов, выясняя почему офис падает при установке. Ничего из им предложенного не помогало. Правда через несколько часов мы таки нашли проблему - Sandboxie подпортил DLL инъекцией, команды восстановления целостности винды этого не замечали, а инсталлятор офиса неправдиво генерировал логи с ошибками, вводя в заблуждение.
Не уверен, что с помощью того же Deepseek Pro я не решил бы проблему быстрее. Но повторять такой опыт больше не хочется.
Правильно понимаю, что если пользователь "телеги" сидел в чате из 1000 человек, то "телега" имела доступ к переписке всех в чате и могла распарсить профили его участников?
Погонял её через Hermes, качество ответов радует.
Еще и токены почти бесплатные с учетом кеширования:
Weighted Avg Input Price $0.020
Weighted Avg Output Price $0.280
Капля дёгтя - сейчас модель требует доступ к данным для тренировки.
Поставщики могут неудачно провести дистилляцию модели - тесты она проходит, а в жизни выдает некачественный результат (привет опус 5).
Провайдеры хитрят с FP8/FP4, что тоже приводит к ухудшению результата на практике относительно рекламных тестов.
На Kimi K3/GPT-5.6 вполне рыночные цены при сравнении с Openrouter.
А модели попроще раза в 2 дороже выходят.
До этого всего 15 лет назад была Pandora. И она была прекрасна.
А сейчас только Спотифай и выручает.
Нет, адрес кошелька обычно не меняется.
Видимо, это софт Леджера генерит адреса для новых операций.
У налоговой будет инфа о транзакциях, а значит будут и вопросы.
Тут точно расслабляться нельзя.
упущен нюанс: еще и на деньги, отобранные у младшего
Так повторить можно, умельцев полно, но экономика не будет сходиться.
Руководствуясь собственным опытом и гайдами по инфографике, я бы такое не стал показывать типичному крупному боссу.
Нужно помнить, что время контакта с документом ограничено и у разных боссов - разный уровень аналитических способностей и желания вдаваться в детали. Не будет типичный вдаваться в перегруженную визуально табличку, еще и заверстанную в ppt.
Аналитичный босс попросит нормально сделанную таблицу в экселе, где можно сразу прикинуть дополнительные показатели. Гуманитарный босс вместо цифр попросит тезисное изложение ключевых моментов из таблицы с выводами для принятия решения.
Только вместо реки нужно нарисовать условный воронеж, в котором заперты все мы.
И еще один реестр с реестрами ляжет на налогоплательщиков/бизнес/потребителей.
Мне из графиков непонятно в каком режиме работал DS, чтобы показать такие результаты.
Были ли включены рассуждения и какой уровень усилий был установлен?
DS v4 серьезно глупеет при отключении рассуждений, поэтому и возник вопрос о режиме сравнения.
PS кстати, и сравнения стоимости токенов нет.
Извиняюсь за офтоп перед авторами Сбера.
@Moog_Prodigy Спасибо за вашу работу.
Можно пару вопросов по gemma4 uncens:
Могло ли на качество ответов повлиять снятие цензуры?
Есть ли тесты качества в зависимости от кванта и сравнение с работой автора аналогичного проекта HauhauCS?
Есть ли в планах использовать QAT сжатие и MTP?
Выглядит как диссонанс между ее возможностями и вашими хотелками. Например выбрана неподходящая модель, мало инфы на входе, плохо составленный промпт, не сделана декомпозиция проблемы, отключен поиск из внешних источников и еще туча подобных моментов. В сумме они и дают похожий результат.
Нет волшебной кнопки "сделай мне хорошо".
На Реддите его называют печкой для сжигания токенов.
Тривиальные задачи решает в десятки вызовов, накапливая огромный кеш бездумных попыток.
Или создаем с ним скилы, прописываем когда их использовать уместно и какие скилы использовать нельзя. В новой сессии все начинается как будто с нуля.
Цитата для ЛЛ:
Главный принцип этого проекта — малый размер кода. Объем памяти не имеет значения, производительность тоже, но размер бинарного файла конечного проекта важнее всего, даже читаемость кода. Конечно, все остальные факторы следует учитывать, но никогда не в ущерб увеличению размера кода.Вы будете писать код только на ассемблере x86, совместимом со средой разработки MASM32.Вот я начитался таких новостей про GLM-5.2 и потратил с ней 4 млн токенов, выясняя почему офис падает при установке. Ничего из им предложенного не помогало. Правда через несколько часов мы таки нашли проблему - Sandboxie подпортил DLL инъекцией, команды восстановления целостности винды этого не замечали, а инсталлятор офиса неправдиво генерировал логи с ошибками, вводя в заблуждение.
Не уверен, что с помощью того же Deepseek Pro я не решил бы проблему быстрее. Но повторять такой опыт больше не хочется.
Абсолюты невыгодно при манипулировании показывать.
Правильно понимаю, что если пользователь "телеги" сидел в чате из 1000 человек, то "телега" имела доступ к переписке всех в чате и могла распарсить профили его участников?
Нет плато. Регуляция пока носит местячковый характер.
К примеру, GLM 5.2 показывает отличные результаты и находится в свободном доступе.
Кто будет огораживаться - тот начнет отставать.