Господи, какой прод? Это домашний проект. И нейросетям больше помогает какой-нибудь настроенный GraphCode, а не модульность. Посмотрите как любая обвязка работает, она просто грепает код, подумайте какая ей разница — модульно там или нет?
Ну и прод проду рознь. Если у вас смешанная команда — люди и сети, конечно, модульность будет помогать людям, как иначе. Если у вас в команде только нейросетевые агенты, разницы нет, поверьте моему опыту.
Нет, я не вижу где я свою позицию делаю «всё более слабой и слабой». Это домашний проект, вы всерьёз думаете, что я на него сначала ТЗ готовил что ли?
Тесты есть, как я сказал, вторая версия была сделана исключительно по ним тем же «Опусом». Что же мешает повторить тот же путь?
Перепроверьте, кто вам мешает-то? Я тоже и настраиваю сети, и дообучаю, мы сюда, как будто, не письками пришли меряться. Но утверждать, что сетка в 27 миллиардов обгоняте триллионные сети?.. Ну простите, у меня опыт совсем другой.
Я давно работаю и с «Соннетом», и с «Опусом», и «Фейбл» начал использовать, когда он появился. Сейчас, правда, больше «Сол» с «Астрой».
У нас есть свой развёрнутый DS Fast (был 4, теперь 4.1), и Квены разных мастей. Я могу сравнивать как они работают.
Не всё ли вам равно — монолит там или нет? Вы просто мыслите донейросетевыми понятиями. Подумайте что даёт архитектура, комментарии, говорящие имена — это всё нужно, чтобы увеличить скорость внесения изменений. А у нейросетей она и так заоблачная для человека.
А что вас не устраивает-то и причём тут «Кобол»? Это интересная инженерная задача, очень сложная, как раз чтобы посмотреть на что способны нейросети.
Текста заданий нет, потому что нет заданий — мои мысли развивались по ходу дела. Возьмите тесты. Вторая версия (первая была на ТаймпСкрипте) как раз была написана по тестам.
Давайте я вам просто пару своих домашних проектов покажу, где на «Опусе» всё делалось, а вы попробуете что-то такое «Квеном» сделать:
https://github.com/bolknote/MKPro тут задача чтобы все программы из examples уместились в те же размеры, которые они умещаются сейчас или хотя бы в 105 байт. Из pending-optimization — это уже выше уровня существующих сейчас сетей, включая самые топовые.
Причём тут языки? На любую сеть можно найти задачи ей по зубам. Даже на однобитную BitNet. Те задачи, которые «Опус» у меня решал, DS и вышеуказынный Qwen решить не может.
Нет, ни DeepSeek V4 Flash‑0731, ни DeepSeek V4.1 Flash, которую мы вчера поставили и опробовали, ни вышеуказанный Квен не приближается к Опусу 4.5 или 4.6.
Вы, видимо, привыкли к английскому. Где нельзя «помыть волосы», а надо обязательно помыть «свои волосы». С точки зрения стилистики русского языка, не писать чей код проект открыл — нормально.
Если вы про современные монеты, то они железные с покрытием.
Господи, какой прод? Это домашний проект. И нейросетям больше помогает какой-нибудь настроенный GraphCode, а не модульность. Посмотрите как любая обвязка работает, она просто грепает код, подумайте какая ей разница — модульно там или нет?
Ну и прод проду рознь. Если у вас смешанная команда — люди и сети, конечно, модульность будет помогать людям, как иначе. Если у вас в команде только нейросетевые агенты, разницы нет, поверьте моему опыту.
Нет, я не вижу где я свою позицию делаю «всё более слабой и слабой». Это домашний проект, вы всерьёз думаете, что я на него сначала ТЗ готовил что ли?
Тесты есть, как я сказал, вторая версия была сделана исключительно по ним тем же «Опусом». Что же мешает повторить тот же путь?
Перепроверьте, кто вам мешает-то? Я тоже и настраиваю сети, и дообучаю, мы сюда, как будто, не письками пришли меряться. Но утверждать, что сетка в 27 миллиардов обгоняте триллионные сети?.. Ну простите, у меня опыт совсем другой.
Я давно работаю и с «Соннетом», и с «Опусом», и «Фейбл» начал использовать, когда он появился. Сейчас, правда, больше «Сол» с «Астрой».
У нас есть свой развёрнутый DS Fast (был 4, теперь 4.1), и Квены разных мастей. Я могу сравнивать как они работают.
И я больше верю своим глазам, а не тестам.
Не всё ли вам равно — монолит там или нет? Вы просто мыслите донейросетевыми понятиями. Подумайте что даёт архитектура, комментарии, говорящие имена — это всё нужно, чтобы увеличить скорость внесения изменений. А у нейросетей она и так заоблачная для человека.
А что вас не устраивает-то и причём тут «Кобол»? Это интересная инженерная задача, очень сложная, как раз чтобы посмотреть на что способны нейросети.
Текста заданий нет, потому что нет заданий — мои мысли развивались по ходу дела. Возьмите тесты. Вторая версия (первая была на ТаймпСкрипте) как раз была написана по тестам.
Мы как раз тестировали и обновлённый 4.0, и 4.1. Это не уровень «Опуса».
Давайте я вам просто пару своих домашних проектов покажу, где на «Опусе» всё делалось, а вы попробуете что-то такое «Квеном» сделать:
https://github.com/bolknote/MKPro тут задача чтобы все программы из examples уместились в те же размеры, которые они умещаются сейчас или хотя бы в 105 байт. Из pending-optimization — это уже выше уровня существующих сейчас сетей, включая самые топовые.
https://github.com/bolknote/Bolklets тут всё «Опусом» сделано, кроме экспериментов логики ведьмы.
Причём тут языки? На любую сеть можно найти задачи ей по зубам. Даже на однобитную BitNet. Те задачи, которые «Опус» у меня решал, DS и вышеуказынный Qwen решить не может.
Да, написание кода.
Модели полные, без квантизации. Обязка. В случае ДипСика — «ДипСик Харнесс».
Нет, ни DeepSeek V4 Flash‑0731, ни DeepSeek V4.1 Flash, которую мы вчера поставили и опробовали, ни вышеуказанный Квен не приближается к Опусу 4.5 или 4.6.
Какие ещё урезанные модели? Где вы увидели, что у меня они урезанные?
Давно. Но я помню его уровень, у меня есть проекты, им сделанные. Перечисленные выше сети с таким и не справятся.
Ни DepSeek 4.1 Flash, ни тем более Квен3.8-27Б не выигрывает у Опуса 4.5/4.6 в реальных задачах на программирования. Там про́пасть в уровне.
Что-то верится с трудом. Я на Опусе 4.6 довольно много программировал, а сейчас у нас локально стоит DeepSeek‑V4-Flash-0731, она намного слабее.
В Казани, к слову, тоже есть отличный музей Соцбыта.
Вы, видимо, привыкли к английскому. Где нельзя «помыть волосы», а надо обязательно помыть «свои волосы». С точки зрения стилистики русского языка, не писать чей код проект открыл — нормально.
Открытый исходный код и доступный исходный код. Давно уже разобрались.
А много у вас вариантов чей?
«Проект Chatto стал Open Source» → «Проект Chatto открыл код».
И короче, и по-русски.
Ничего себе, люблю такое, надо приехать как-нибудь на выходные из Казани к вам.