Информация
- В рейтинге
- 2 382-й
- Откуда
- Стамбул, Стамбул, Турция
- Дата рождения
- Зарегистрирован
- Активность
Специализация
Бэкенд разработчик
Ведущий
От 7 000 $
C#
.NET
Entity framework
MongoDB
Apache Kafka
DDD
Высоконагруженные системы
Проектирование архитектуры приложений
Elasticsearch
Автор в своем праве хранить данные в произвольных директориях. Custom не является каким-то зарезервированным именем. Хорошо, что в исходниках там было "custom", а не "users" или "windows"...
Вы статью читали? Там проблема не в том куда был установлен telegram
Но, почему ни при чём? Eсли это их библиотека для тестирования, и она предполагает, что флаги в регистре будут в состоянии 0000, но сама их в это состояние не переводит, то я бы написал баг-репорт.
Кроме того непонятна необходимость сброса этих флагов в основном коде, а не в коде, который крутится в диагностическом потоке.
А кто-то еще использует не рассуждающие модели без агентской обвязки для задач написания кода?
В режиме без размышлений вариативность действительно есть, но все три разных ответа про "цвета содержащие й" были верны. Ответ про "без буквы й" действительно чушь. Но, как я выше упомянул, не имеет смысла пытаться на основе этого судить о глупости или бесполезности модели, поскольку анализирует она не буквы, а токены. В режиме с размышлением проблемы с неверными ответами тут же уходят.
Не вижу чтобы я где-то утверждал обратное.
Я бы не был так уверен именно в части про "без размышлений", хотя, кто я, чтобы судить, я же не женщина и не художник :)
А вообще, конечно, понапридумывали стохастических попугаев, chain of thought, агентов. Абсолютно бесполезной фигнёй занимаются /s
Кстати, у вас какая-то китайская подделка на deepseek ))))
это очень странно, только что попробовал "назови три цвета в названии которых нет буквы й" и прям в рассуждениях видно как он перебирает цвета и отсекает те в которых есть й.
а без рассуждения такую задачу давать бессмысленно. Человек без рассуждения тоже не назовет три цвета без й.
это с рассуждением или без?
GtkSharp 3.24.24.95, Native AOT, Размер exe - 3,6 Мб
С такой манерой общения шли бы вы на... stackoverflow спорить
Работающее окно с полем ввода и кнопкой инкремент, биндинг с ViewModel. Но судя по сарказму в каждом ответе и практически скатыванию на личности в итоге, я захотел помочь человеку, которому нужна не помощь, а возможность поспорить.
Главное чтобы не как-то вот так
Судя по ответу, мой комментарий вы не дочитали
Вот здесь вы взяли на себя то, что за вас должен был делать агент. Не вы должны были говорить ему, что результат не работает, а у агента должна быть возможность проверить его самостоятельно.
И снова, проблема не в модели (ну, или не столько в модели), а в её обвязке. Перечитайте, пожалуйста, мой комментарий внимательно. В моём случае Claude справился не потому-что более новая модель, а потому-что он мог самостоятельно проводить все итерации с проверкой результата от начала до конца. У него все получилось тоже далеко не с первой итерации.
Как видите, на ретро он даже признал, что большая часть времени ушла на то, что он не понял, что подсовывал путь без кавычек. А случилось это как раз при попытке установить недостающие SDK, и он не мог самостоятельно эту ошибку увидеть, потому-что прав у него не было и именно тут я был посредником между ним и системой.
Подозреваю, что основная проблема именно в этом
По задаче видно, что уже недостаточно проверить решение просто запуском тестов. Нужно запускать приложение собранное с AOT и иметь доступ к его интерфейсу, чтобы проконтролировать, что оно работает. Обвязка Copilot этого просто не позволяет сделать из коробки.
Плюс, попробовав поручить эту же задачу Claude Code, я обратил внимание, что ему потребовалось до-установить некоторые SDK и компоненты, потому-что у меня их просто не было. Copilot на этом моменте тоже просто сдался бы.
А вот здесь либо задача была поставлена недостаточно четко, либо в какой-то момент агент просто сдался из-за отсутствия инструментов, которые нужны были для решения задачи.
Кстати, Claude Code в течение часа, набросал рабочий вариант с простенькой MVVP формой, собирающийся в AOT. Большая часть времени ушла на:
установку отсутствующих компонентов, тут ему потребовалась помощь, потому-что у него не было прав
проведение первоначальных экспериментов еще до того как он написал хоть одну строку кода
получение ответов на уточняющие вопросы
В целом, если у агента есть все условия для выполнения всех шагов в цикле гипотеза - реализация - проверка результата, в большинстве случаев он сможет самостоятельно найти решение, даже если LLM на базе которой он построен не имеет в обучающей выборке решения точно такой же задачи. В вашем случае где-то в этой цепочке возникла дыра, из-за чего на каждой итерации вам пришлось проверять результаты самостоятельно.
Вы явно что-то делали не так или не с тем инструментом. Что именно вы использовали, какая модель, какая обвязка?
В агентском режиме она как минимум сможет сама сходить за документацией или понять что фича из неподдерживаемой версии стандарта по сообщению об ошибке.
Обычный диалоговый режим LLM — это как человек, который пишет код ручкой в блокнотик, пользуясь только своими существующими в голове знаниями. Он даже не имеет возможности проверить компилируется ли этот код.
Агент на базе той же самой LLM, уже имеет под рукой доступ к современной документации, language server, который заменяет ему то, что обычному разработчику дает IDE, возможность собирать и тестировать код.
Вы, когда беретесь за новую задачу, тоже не всегда имеете все знания, необходимые для ее выполнения, но имеете возможность получить их в процессе. То же самое происходит с агентом. Несмотря на то, что в процессе выполнения задачи веса LLM никак не меняются, он может накапливать знания в контексте сессии, памяти и документации которую он ведет.
Вроде там шла речь о ссылках на несуществующие документы или прецеденты, а не просто за составление при помощи ИИ. Или тут о каком-то другом случае?
За последние полгода у меня возникло ощущение, что клавиатура как интерфейс ввода стремительно устаревает. Пользуюсь голосовым набором. GPT-Transcribe неплохо понимает смесь английского и русского. По скорости ввода я не уверен, что лично я достигну таких же показателей с использованием слепой печати.
не такой сиквел я ожидал ((
Да, это действительно так. А чтобы доверия было больше никто не мешает прикинуться сайтом известного разработчика или завести аккаунт на github с похожим именем, или еще 100500 способов заскамить обычного пользователя. Это и ведет к тому, что в итоге будет пользователь будет доверять именно подписанному ПО.
О, будьте уверены, на "сайте разработчика" с которого пользователь скачает этот файл будет совпадать и размер и контрольная сумма. А уж работать ему вообще не обязательно, достаточно чтобы отработала полезная нагрузка.