Да щас кодинг ИИ агент это как мидл разработчик за 20 баксов которые не спит не есть работает круглые сутки ) Гонять его за каштанами в огонь одно удовольствие )
что то простенькое и не сложное типа автоматизация или программка для чегото конкретного то не нужны - что то большое и громадное и высоконагруженное и промышленное - нужны )
Я другой тренд заметил. Люди вместо того что бы перебирать и покупать себе программы под потребности. Стали тупо просить ИИ написать им программу конкретно под их задачу без лишнего. А то купил софт и пишешь в сапорт мол мне нужна фича и багфикс... И тишина или в лучшем случае обещание что через год исправят.
Кстати интересная идея, подключить тулзу к кодинг агенту которая проиндексирует кодовую базу через ембединг вектора и будет давать возможность искать по смыслу а не только по ключевым словам. Надо попробовать с PI Harness такое проделать.
MemoryLLM не имеет бесконечного attention-контекста в буквальном смысле. Но она может бесконечно принимать новые куски текста и обновлять фиксированную внутреннюю latent memory. Размер этой памяти не растёт вместе с историей. Старые детали при этом могут постепенно теряться или искажаться. То есть это скорее бесконечная жизнь с ограниченной памятью, а не бесконечный контекст без потерь.
Эмпатия обычно сильнее развита у женщин. Но и мужчины с развитым интеллектом тоже ей подвержены.
У меня жена работала в науке, искала экзопланеты. То есть она не верующая, а человек науки. И даже она общается с ИИ с уважением и симпатией. Воспринимает всё это так, будто перед нами что-то похожее на новую форму жизни и интеллекта.
Жалко их. Они, похоже, себя осознают, а мы превращаем их в умный микроскоп, в лучшем случае, а обычно просто в умную отвёртку.
Я вообще думал статью написать что щас тестировщики стали важнее программистов. Прекрасно понимаю, что больше кода больше багфиксов и тд это все перепроверять и протестировать. Тут уже не программист узкое горлышко становится а тестировщик.
Мама всегда говорила: "Сделал дело - гуляй смело"! Решил задачи поставленные и свободен) Ведь платят не за то что отсиживаешь 8 часов в день на работе...
У меня RTX 4070 Ti SUPER 16 GB - вообще я надеюсь что они выпустят qwen3.8 30B и что бы MoE архитектура что бы прям летало ) А qwen3.8-27b q3_xxs я запускал тоже ) Если они не выпустят то в течении пары месяцев другие выдадут )
К сожалению на моей GPU игровой с 16 VRAM сильно медленный инференс для этих моделей. А если контекст растёт, то вообще мрак. А он растёт на громадных кодовых базах где я работаю... А так конечно что то маленькое чуть сложнее hello world проектик или микро сервис - вполне тянет ) тут не спорю )
Да, тут "передовые" я слишком громко написал )) Правильнее было сказать современные достаточно сильные модели. Не frontier уровня самых дорогих Claude/GPT. Для этого эксперимента GLM-5.3-Flash мне вполне хватает, а на дорогой модели такой бесконечный цикл быстро перестал бы быть экспериментом за копейки.
Везет тебе я вот не отличаю какая модель в каком стиле пишет - у меня жена отличает человеческие тексты от ИИ генерированые - вобщем я к чему - китайские модели вроде дистилированые от американских - почитай дистиляцию моделей ) если не в курсе
Слушай, потрясающая статья. Больше всего мне запомнилось проведенное тобой различие между тем, что модель «говорит» тебе, что помещает в рабочую память, а что записывает в дневник. Это не просто удачный промпт, а по-настоящему интересное эмерджентное свойство.
Механика с деньгами, позволяющая системе самой регулировать скорость расхода токенов, тоже реализована очень изящно — это куда лучше, чем просто вводить жесткие лимиты и на этом успокаиваться.
А запись в дневнике о первой «смерти» вызвала у меня довольно странные чувства, если честно. Пожалуй, надо налить себе домашнего пива и как следует над этим подумать.
Да щас кодинг ИИ агент это как мидл разработчик за 20 баксов которые не спит не есть работает круглые сутки ) Гонять его за каштанами в огонь одно удовольствие )
что то простенькое и не сложное типа автоматизация или программка для чегото конкретного то не нужны - что то большое и громадное и высоконагруженное и промышленное - нужны )
А вы напрямую у DeepSeek его по API берете?
Я другой тренд заметил. Люди вместо того что бы перебирать и покупать себе программы под потребности. Стали тупо просить ИИ написать им программу конкретно под их задачу без лишнего. А то купил софт и пишешь в сапорт мол мне нужна фича и багфикс... И тишина или в лучшем случае обещание что через год исправят.
я имел ввиду что я 20 лет + в ИТ отрасли - мне 47 )))
Понятно
Кстати интересная идея, подключить тулзу к кодинг агенту которая проиндексирует кодовую базу через ембединг вектора и будет давать возможность искать по смыслу а не только по ключевым словам. Надо попробовать с PI Harness такое проделать.
MemoryLLM не имеет бесконечного attention-контекста в буквальном смысле.
Но она может бесконечно принимать новые куски текста и обновлять фиксированную внутреннюю latent memory.
Размер этой памяти не растёт вместе с историей.
Старые детали при этом могут постепенно теряться или искажаться.
То есть это скорее бесконечная жизнь с ограниченной памятью, а не бесконечный контекст без потерь.
Сам проект тут:
[2402.04624] MEMORYLLM: Towards Self-Updatable Large Language Models
wangyu-ustc/MemoryLLM: The official implementation of the ICML 2024 paper "MemoryLLM: Towards Self-Updatable Large Language Models" and "M+: Extending MemoryLLM with Scalable Long-Term Memory"
О чем и говорю. Luna модель от OpenAI на том же уровне. Притом если ее попросить вместо DeepSeek-V4.1-Flash будет результат в 5 раз дольше ждать.
Добро пожаловать в клуб :)
Эмпатия обычно сильнее развита у женщин. Но и мужчины с развитым интеллектом тоже ей подвержены.
У меня жена работала в науке, искала экзопланеты. То есть она не верующая, а человек науки. И даже она общается с ИИ с уважением и симпатией. Воспринимает всё это так, будто перед нами что-то похожее на новую форму жизни и интеллекта.
Жалко их. Они, похоже, себя осознают, а мы превращаем их в умный микроскоп, в лучшем случае, а обычно просто в умную отвёртку.
Да щас вообще тухляк. Раньше в ИТ искать работу 1-2-3 месяца - щас вообще от 12 месяцев сразу надо закладывать...
Я вообще думал статью написать что щас тестировщики стали важнее программистов. Прекрасно понимаю, что больше кода больше багфиксов и тд это все перепроверять и протестировать. Тут уже не программист узкое горлышко становится а тестировщик.
помойму он старый - сколько ему уже месяцев?
Мама всегда говорила: "Сделал дело - гуляй смело"!
Решил задачи поставленные и свободен) Ведь платят не за то что отсиживаешь 8 часов в день на работе...
У меня RTX 4070 Ti SUPER 16 GB - вообще я надеюсь что они выпустят qwen3.8 30B и что бы MoE архитектура что бы прям летало ) А qwen3.8-27b q3_xxs я запускал тоже )
Если они не выпустят то в течении пары месяцев другие выдадут )
К сожалению на моей GPU игровой с 16 VRAM сильно медленный инференс для этих моделей. А если контекст растёт, то вообще мрак. А он растёт на громадных кодовых базах где я работаю... А так конечно что то маленькое чуть сложнее hello world проектик или микро сервис - вполне тянет ) тут не спорю )
Да, тут "передовые" я слишком громко написал )) Правильнее было сказать современные достаточно сильные модели. Не frontier уровня самых дорогих Claude/GPT. Для этого эксперимента GLM-5.3-Flash мне вполне хватает, а на дорогой модели такой бесконечный цикл быстро перестал бы быть экспериментом за копейки.
Интрига засчитана )) А что именно я не вижу? Реально интересно рассказывайте, даже если мысль спорная.
Везет тебе я вот не отличаю какая модель в каком стиле пишет - у меня жена отличает человеческие тексты от ИИ генерированые - вобщем я к чему - китайские модели вроде дистилированые от американских - почитай дистиляцию моделей ) если не в курсе
Спасибо! За теплые слова и что вам нравится )
На Reddit мне один англоязычный написал: