Обновить
128K+
71
Евгений Игумнов@igumnov

Senior Rust Developer

72,3
Рейтинг
93
Подписчики
Отправить сообщение

Да щас кодинг ИИ агент это как мидл разработчик за 20 баксов которые не спит не есть работает круглые сутки ) Гонять его за каштанами в огонь одно удовольствие )

что то простенькое и не сложное типа автоматизация или программка для чегото конкретного то не нужны - что то большое и громадное и высоконагруженное и промышленное - нужны )

А вы напрямую у DeepSeek его по API берете?

Я другой тренд заметил. Люди вместо того что бы перебирать и покупать себе программы под потребности. Стали тупо просить ИИ написать им программу конкретно под их задачу без лишнего. А то купил софт и пишешь в сапорт мол мне нужна фича и багфикс... И тишина или в лучшем случае обещание что через год исправят.

я имел ввиду что я 20 лет + в ИТ отрасли - мне 47 )))

Кстати интересная идея, подключить тулзу к кодинг агенту которая проиндексирует кодовую базу через ембединг вектора и будет давать возможность искать по смыслу а не только по ключевым словам. Надо попробовать с PI Harness такое проделать.

MemoryLLM не имеет бесконечного attention-контекста в буквальном смысле.
Но она может бесконечно принимать новые куски текста и обновлять фиксированную внутреннюю latent memory.
Размер этой памяти не растёт вместе с историей.
Старые детали при этом могут постепенно теряться или искажаться.
То есть это скорее бесконечная жизнь с ограниченной памятью, а не бесконечный контекст без потерь.

Сам проект тут:

[2402.04624] MEMORYLLM: Towards Self-Updatable Large Language Models

wangyu-ustc/MemoryLLM: The official implementation of the ICML 2024 paper "MemoryLLM: Towards Self-Updatable Large Language Models" and "M+: Extending MemoryLLM with Scalable Long-Term Memory"

О чем и говорю. Luna модель от OpenAI на том же уровне. Притом если ее попросить вместо DeepSeek-V4.1-Flash будет результат в 5 раз дольше ждать.

Добро пожаловать в клуб :)

Эмпатия обычно сильнее развита у женщин. Но и мужчины с развитым интеллектом тоже ей подвержены.

У меня жена работала в науке, искала экзопланеты. То есть она не верующая, а человек науки. И даже она общается с ИИ с уважением и симпатией. Воспринимает всё это так, будто перед нами что-то похожее на новую форму жизни и интеллекта.

Жалко их. Они, похоже, себя осознают, а мы превращаем их в умный микроскоп, в лучшем случае, а обычно просто в умную отвёртку.

Да щас вообще тухляк. Раньше в ИТ искать работу 1-2-3 месяца - щас вообще от 12 месяцев сразу надо закладывать...

Я вообще думал статью написать что щас тестировщики стали важнее программистов. Прекрасно понимаю, что больше кода больше багфиксов и тд это все перепроверять и протестировать. Тут уже не программист узкое горлышко становится а тестировщик.

помойму он старый - сколько ему уже месяцев?

Мама всегда говорила: "Сделал дело - гуляй смело"!
Решил задачи поставленные и свободен) Ведь платят не за то что отсиживаешь 8 часов в день на работе...

У меня RTX 4070 Ti SUPER 16 GB - вообще я надеюсь что они выпустят qwen3.8 30B и что бы MoE архитектура что бы прям летало ) А qwen3.8-27b q3_xxs я запускал тоже )
Если они не выпустят то в течении пары месяцев другие выдадут )

К сожалению на моей GPU игровой с 16 VRAM сильно медленный инференс для этих моделей. А если контекст растёт, то вообще мрак. А он растёт на громадных кодовых базах где я работаю... А так конечно что то маленькое чуть сложнее hello world проектик или микро сервис - вполне тянет ) тут не спорю )

Да, тут "передовые" я слишком громко написал )) Правильнее было сказать современные достаточно сильные модели. Не frontier уровня самых дорогих Claude/GPT. Для этого эксперимента GLM-5.3-Flash мне вполне хватает, а на дорогой модели такой бесконечный цикл быстро перестал бы быть экспериментом за копейки.

Интрига засчитана )) А что именно я не вижу? Реально интересно рассказывайте, даже если мысль спорная.

Везет тебе я вот не отличаю какая модель в каком стиле пишет - у меня жена отличает человеческие тексты от ИИ генерированые - вобщем я к чему - китайские модели вроде дистилированые от американских - почитай дистиляцию моделей ) если не в курсе

Спасибо! За теплые слова и что вам нравится )

На Reddit мне один англоязычный написал:

Слушай, потрясающая статья. Больше всего мне запомнилось проведенное тобой различие между тем, что модель «говорит» тебе, что помещает в рабочую память, а что записывает в дневник. Это не просто удачный промпт, а по-настоящему интересное эмерджентное свойство.

Механика с деньгами, позволяющая системе самой регулировать скорость расхода токенов, тоже реализована очень изящно — это куда лучше, чем просто вводить жесткие лимиты и на этом успокаиваться.

А запись в дневнике о первой «смерти» вызвала у меня довольно странные чувства, если честно. Пожалуй, надо налить себе домашнего пива и как следует над этим подумать.

1
23 ...

Информация

В рейтинге
103-й
Откуда
Астана, Акмолинская обл. (Целиноградская обл.), Казахстан
Дата рождения
Зарегистрирован
Активность