Информация
- В рейтинге
- 3 750-й
- Откуда
- Москва, Москва и Московская обл., Россия
- Дата рождения
- Зарегистрирован
- Активность
Специализация
Head of AI,ML
От 1 000 000 ₽
Управление проектами
Ведение переговоров
Управление людьми
Управление разработкой
Стратегическое планирование
Стратегическое управление
Информационные технологии
Понял, абляций конечно не хватает, и будет порождать спекуляции конкурентов, что вы снова "все скопировали".
Все это понятно и я уже выше написал, что такой же инкремент был у китайцев от моделей доноров, вопрос выше про ширину, глубину остаётся в силе.
Upd. Ребята уже ответили
Это нормальный инкремент, Qwen тима также делала от llama инкремент. Как и от mistral DeepSeek. Брали за донор архитектуры (не веса отмечу), и изменяли вещи вокруг attention, qkv и тп.
Вот я и говорю об этом же.
Другой вопрос, есть ли ablation на выбор размера модели и числа активных параметров? Почему взят типо размер как у Qwen next 80b?
Почему не указано в статье, что хоть это не дотрен с инита, но архитектура взята Qwen-like? Есть же Qwen3 next 80b a3b. - _-
Или хотя бы указать, что можно подумать, но это не так?
Средний класс не вопрос профессии, как названия, а вопрос финансового положения. Если раньше считалось,что это профессии белых воротничков. То сейчас и голубые воротнички могут зарабатывать так, что попадают в средний класс. Поэтому тут вопрос не названия роли, а сколько она приносит денег.
Остаётся вопрос, зачем CALM, если есть текст диффузии, которые эту же проблему решают и схожи.
Чел, ты явно статью сгенерировал в стиле какой deatailas, path и fabric, а теперь ещё и этим пуляешь.
Материал бы мог стать хорошим, будь он не сгенеренный без постобработки. Лойс.
Спасибо, история Гоши продолжается и мы будем радовать вас.
Как раз таки для этого мы хотим дать ему git+dvc
Все так, будет добавлен Langfuse для трейса поведения и dvc для версионирования памяти и скиллов.
Глянем, спасибо.
Приветствую, спасибо, что поделились своим опытом. Мы же перешли на платную версию, хоть и базовую.
Конкурент воспримет норм.
Осталось написать такой же сервис гвардов (guardrails) от утечек данных, опасных промптов на этику и Перс Датку, и тп. А не ток атаки.
Главное, чтобы не убили институт джунов, а учили хотя бы интернов для AI coding, далее провели экзамен/тестовое и оставили тех кто ai-native, но ни институт джунов ни институт синьоров нельзя убирать. Потому, что джуны + СС не буду расти до миддла и сина без таких наставников, до тех пор пока сам СС и тп не научатся менторить джунов. А если оставить ток синов+СС, то они рано или поздно уйдут наверх или на пенсию и вы останетесь без синов и мидлов, тк джунов вы не брали и не учили.
Почему название нашей модели rosbarta? Когда она rosberta и эт не в честь компании, а в честь Robustness Sententnce RoBerta (RoSBERTa). Крч это также как sbert - SentenceBERT.
Вопрос не только в ценах, но и и в ПлановоЭкономических показателях, иных фин документов и соглашений с контр агентами о распространении такой информации в открытом доступе. Если у вас все это доступно в паблик, вопрос к конкуренции на вашем рынке.
Если конечное решение за принятие кода, который сгенерил ваш ИИ копайлот лежит на вас, то и за это вы и отвечаете. Если вы прожали тап и приняли подсказку, если не глядя тыкнули комммит и мр, вы несёте ответственность как конечное ЛПР. Сори тут слезть с ответственности и переложить все на ИИ не выйдет. И я прошу разделить генерацию кода LLM тут вы конечно не виноваты, и принятием этой генерации как части вашего проекта, если код попал по вашему согласию из генерации в проект - ответ на вас.
И автору поста: агентный, а не агентский. Агентский в ру языке только договор, а подход агентный уже 30 лет в обед в СНГ - агентный. Вы же не переводите domestic как домашнский, а как домашний, не местнеческий, а местный. Также и agentic в ру языке это агентный.