Pull to refresh

Comments 16

Спрашивать у нейросетки "какая она версия" (что определяется промтом, вообще-то в основном) и выкладывать это на Хабр, как оценку интеллектуальных возможностей...

А самое главное она не врёт, ведь в приложении где автор скринит, нету Грок 4.5

Я этого и не заявлял. Это исключительно о взаимосвязанности отделов xAI, и о том, что везде 4.5 уже доступна, кроме их основного продукта.

Зачем модели знать свою версию? Это не часть данных обучения. Проводить анализ новой модели только двумя сообщениями? Серьёзно? У вас подписка-то есть для запуска субагентов, а прокси не в Европе, чтобы заработал Grok 4.5?
Если по существу, то после двух дней работы с моделью могу с уверенностью сказать, что она справляется с задачами лучше, чем grok-build-0.1 и Composer 2.5. По ощущениям, явно не ниже по способностям, чем Claude Sonnet 4.6. Про Opus замахиваться пока не стану, так как нужно подольше с моделью поработать.

Имхо правильная модель должна уметь как минимум сопоставлять факты и ситуацию на текущий момент, особенно внутри собственной экосистемы.

Да это совершенно ничего не говорит о модели. Версия это просто версия. Единственное о чем это говорит - эту информацию не добавили в выборку при обучении. Ваш пост наверное один из лучших, чтобы продемонстрировать куда скатился хабр в последние годы.

Извините, но вы сейчас напоминаете мне отечественных депутатов, которые задают Алисе вопросы в духе «чей Крым?», а потом начинают выносить мозг создателям модели. То, что ответит модель на вопрос о версии и прочем, определяется системным промптом, а его задают не разработчики модели, а те, кто эту модель эксплуатирует. И вы очень удивитесь, узнав, что одна и та же модель будет давать разные ответы на вопрос о версии в зависимости от того, где она запущена: в веб-интерфейсе, VSCode, Cursor или OpenCode (я не проверял сейчас, но VSCode обычно отвечает, что он GitHub Copilot независимо от реальной модели).

Илон, занимайся лучше ракетами и Теслами, оставь ИИ в покое.

Нет уж, пусть он лучше ИИ как раз занимается, он хотя бы людей пачками не убивает.

Это пока

Глубина обзора, качество сравнения, масштаб и сложность задач автора потрясают!


А если серьезно, то зависит от задачи(если это сложное исследование, а не сайтики, конечно)

У меня полно было задач где не вывозили frontier сетки и вывозили сетки попроще. И что Opus 4.8 не вывозит, а GPT 5.5 XHIGH - легко и наоборот у меня постоянно.
Были задачи где ни Гопота ни Опус не смогли, а Грок смог.

Пока в моих ресерчах я не могу отдать первенства Fable против Sol максималках.

Sol быстрее сильно и оно решает. Fable долгий, но субъективно креативнее
Мало еще сетки доступны, чтобы делать выводы


З.Ы. Мне Грок говорит, что он 4.5 :)

Всё уже давно зависит от обвязки, если это задача с контекстом, а не абстрактное решение с нуля.

Согласен.

Когда LLM даешь инструменты, ресерчи разворачиваются в триллер и сетки способны удивлять своими выводами

Можно просто пользоваться правильно нужно моделями постановкой задач ?)) тут же на Хабре статья - о том что Grok лучше в автоматизации чем Fable)))) а у вас он вообще никакой )))

В коде у меня он не справился ни с одной из задач.

По генерации изображений - достаточно попросить Грока нарисовать плакат с какой-нибудь примитивной фразой, например "Мир, Труд, Май - Пролетарий, Давай!" чтобы все понять.

ChatGPT и прошлых версий справлялся отлично, по сравнению с тем же Гроком.

Но каждому свое, кому-то может он нравится, может человек фанат Маска и катается на Тесле - это вообще отдельный класс людей :)

Не знаю,у меня наоборот грок отлично справляется с бэкендом,запускает субагентов и в целом лучше решает задачи чем композер.
У любой ИИ если спросить просто так про новейшие ИИ,они не ответят правильно,так как БД сильно старее сегодняшнего дня,мне кажется неправильное сравнение

Sign up to leave a comment.

Articles