Обновить
4

Пользователь

0,1
Рейтинг
1
Подписчики
Отправить сообщение

поэтому и были слухи недавно про то, что openAI готовит долгосрочную модель на 100 триллионов параметров. 

Очень сомнительные слухи. На модель со 100 триллионами параметров понадобится порядка 2-х квадриллионов токенов обучающей выборки. Для сравнения - у Deepseek недавно была цифра в 45 триллионов, у американских лабораторий кол-во обучающих токенов, в зависимости от методов оценки, находится в районе 150-400 триллионов. И то, оценка в 2 квадриллиона - это буквально лучший случай, на деле же, вероятнее всего, понадобится куда больше токенов.

Учитывая, что сейчас прогнозировать приросты производительности от наращивания размера модели куда сложнее, чем было раньше, крайне сомнительно, что OpenAI действительно рассматривают такой вариант.

Замедление, по моему мнению, сейчас лучший способ и дальше получать деньги с новых моделей и каждый раз получать шумиху в инфополе. Да, они уже создали привычку и переключиться на долгосрочную модель будет перспективно, но в 2026 году ещё не готовы к данному шагу. (ИМХО)

Вариантов, почему они решили разгонять эту тему, не так и много: унылый PR; попытки срезать затраты на R&D перед IPO, чтобы их финансы выглядели лучше; приближение к плато развития моделей; давление от китайцев; отставание реальной производительности моделей от запланированной. Всё остальное крайне маловероятно.

Очень сложно оценить способности модели, пока её не попробовала широкая аудитория.

Никто не спорит, что оценка способностей модели - штука сложная и с кучей тонкостей. Но это не отменяет факта, что OpenAI прямо из всех щелей светились уверенностью. Впрочем, вспоминая легендарное "GPT-5 - это Звезда Смерти", есть подозрение, что дело совсем не в сложности оценки.

 Возможно, они даже недооценивали способности Астры, потому что ценник на неё можно было бы спокойно делать ещё выше - народ как с цепи сорвался. 

А кто конкретно сорвался? Я лично видел только бушевания всяких инфлюенсеров, и то, видимо, проплаченных (иначе сложно объяснить, почему они так пристали к 3D-моделированию - мало того, что способность нишевая, так ещё и OpenAI делали акцент на совсем других вещах). У большинства остальных реакция была от "Ну ладно, пойдет" до "Нафиг надо, остаюсь на GPT-5.6".

Я им ставлю в упрек только то, что они постоянно рассказывают истории про множество совершенных прорывов и каких-то нереально умных моделях, которые пока что сидят в лаборатории, но при этом вот-вот выйдут, а потом вместо этих "монструозных внутренних моделей" мы получаем что-то достаточно унылое.

Ну факт остаётся фактом, Навье - Стокса они сделали. 

Ну, как сказать "сделали". В лучшем случае - узнали, что есть подход, у которого имеются огромные шансы оказаться успешным, и залили туда гигатонну вычислений. В худшем - своровали работу и добили буквально последние шаги (да, это все ещё сложно, но уже на уровне, когда математики - например, Теренс Тао - после просмотра работы стали уверенными в том, что готовое решение скоро будет получено; это ещё до анонса от OpenAI).

Про другие нюансы промолчу.

Да и в реальных задачах Астра реально лучше моделей годовалой давности.

Годовалой - да, но прорыв-то обещали относительно GPT-5.6. А там уже ситуация сильно печальней, на уровне "Ну, оно получше работает, и на том спасибо".

Вопрос в том, насколько сильны эти модели

В случае OpenAI ответ простой: вспомните, сколько раз они обещали выпустить ну нереально мощную модель, а потом либо сливались полностью, либо выпускали что-то крайне сомнительное (относительно изначальных обещаний). Astra, Spud (GPT-5.5), какие-то внутренние модели с февраля (видимо, GPT-5.4), "Garlic/Shallotpet" (с которыми вообще мутновато), "Экспериментальная модель, взявшая золото на IMO" (с лета 2025, до сих пор неизвестно что это было вообще) - все это обещали как лютый прорыв, который вот-вот выйдет, а на деле...

Так что крайне сомнительно, что у OpenAI есть какие-то внутренние модели, которые при прочих равных на голову сильнее публичных.

Такого заявления Anthropic не существует.

Соглашусь, вышла ошибка. Заявление это сделал Майкл Крациос, а не Anthropic. Но сути это почти не меняет.

С чего бы им этого не делать?

Делают, кто же это отрицает. Но утверждать, что только на ней держатся все китайские модели - это отборный копиум. К масштабам дистилляции и влияние на конечные результаты тоже есть вопросы.

Потому что китайские модели живут дистилляциями с американских

Рассказы про "дистилляцию" - не более чем залив копиума для инвесторов, которые с каждым большим релизом от китайцев начинают знатно так паниковать. Да, дистилляция дает определенный прирост, но в общей картине он не настолько значим.

ладно-ладно, я вам помогу по статьям: раздватричетыре.

Разве что 3 статья является хоть сколь-нибудь внятным аргументом, но и даже тут есть нюансы. Остальные же источники - это что-то на уровне заявления Anthropic, что Kimi K3 с Fable 5 дистиллировали (и все равно, что там по времени всё это даже близко не сходится; главное инвесторов успокоить).

Всего лишь постоянное улучшение capabilities новых передовых моделей

"Постоянное улучшение способностей" - это когда Сёма Альтманов орет "Spud - это AGI!", "Astra - это AGI!" месяцами, а на выходе получаем унылые +4% на бенчмарках (и ещё хорошо, если без рандомных деградаций и проценты не забенчмакшены)?

прорывные результаты от них во всё новых областях.

"Прорывные результаты" - это "мы подворовали чужую работу" или "мы закидали гигатонной вычислений все что можно, выкинули 999 результатов и оставили 1"?

Но вот этот пафос "мы уже вот прям щас создали вундервафлю" немного несвежий.

Правильней было бы сказать "ОЧЕНЬ несвежий". OpenAI ещё с середины прошлого года постоянно рассказывают, что у них в недрах лаборатории есть супер-модель, которая будет выпущена на публику вот чуть ли не завтра. Штук 4-5 было таких моделей, и все они спустя пару недель/месяцев обещаний либо испарялись без следа, либо даже близко не оказывались каким-то супер-прорывом.

Хотя кто ж знает, быть может, настал тот самый момент, когда OpenAI все-таки не обманут и сдержут свое обещание.

На следующей неделе генеральный директор OpenAI Сэм Альтман проведет серию закрытых брифингов для представителей администрации США и законодателей. По данным Bloomberg, речь пойдет о следующем поколении моделей OpenAI и их потенциальном влиянии на рынок труда и вопросы безопасности. 

Вот эти вот утечки напоминают мне про разгоны, которые были в марте. Вот вышел GPT-5.5, который и есть Spud, но как-то обещанной супер-мощности в нём не наблюдается.

закрытое тестирование новой модели продолжается уже около двух с половиной месяцев

У OpenAI есть прямо загадочная черта: в глубинах лаборатории они совершают один прорыв за другим, которые позволяют создавать мегаумные модели, но почему-то все эти прорывы за километр обходят публичные релизы. Вот и в этот раз, судя по всему, GPT-5.6 ничего не перепало от супер-умной модели и новых прорывных методов.

Еще пишут, что GPT-6 якобы с первой попытки нашла контрпример к гипотезе Якоби. Видимо пиарщики OpenAI пропустили, что Anthropic уже сообщили об обнаружении такого контрпримера с помощью модели Fable.

Прямо-таки скопировали Anthropic с их "Mythos тоже смог решить задачу Эрдёша о единичных расстояниях!!!".

Как считаете, это и правда совпадения или все-таки маркетинговая стратегия?

Самое интересное, что правило "Чем больше OpenAI кричат о прорывах, тем хуже идут их дела на самом деле" работает как часы. Будет удивительно, если в этот раз все эти громкие крики окажутся не разведением хайпа ради хайпа.

пока похоже на рекламный рассказ в стиле "у нас есть ТАКИЕ приборы, но мы их вам не покажем"

Так OpenAI уже почти год как крайне активно крутят тему того, что у них в глубинах лабораторий вот уже есть сверхсекретная нереально умная модель, которую по тем или иным (зачастую крайне мутным) причинам нельзя выпустить публично. То "Экспериментальная модель, взявшая золото на IMO", то "Garlic/Shallotpeat", затем ещё две "Внутренние модели" (или речь шла об одной и той шла, из анонсов OpenAI неясно), то "Spud" - и все эти модели в итоге испарились без следа (кроме, быть может, "Garlic", хотя с ним тоже мутно дело). Конечно, может быть в 6 раз окажется, что OpenAI не разводит хайп и на самом деле заимели что-то прорывное, но лично я в этом сомневаюсь.

Либо же дело в том, что Anthropic очень сильно испугались релиза GPT-5.6 и решили проплатить астротурфинг на тему того, что GPT-5.6 вообще тупой и сильно уступает Fable 5. Как-то уж многовато подобного формата историй и в целом странного негатива в отношении GPT-5.6 всплыло за последние два дня (хотя, может, это мне только кажется).

Так Anthropic уже который год на публику кричат про необходимость регулирования злого и опасного ИИ, при этом выставляя себя хорошими парнями, которые вкладывают колоссальные силы в ИИ-безопасность. Думали, что регулирование навставляет палки в колеса конкурентов и обойдет самих Anthropic, но реальность оказалась такой, какой оказалась.

Проблема в том, что именно Anthropic сильнее всех проталкивали тему того, что ИИ невероятно страшен и опасен (сам по себе или в неправильных руках), и выставляли себя этакой организацией, которая этими самыми катастрофическими рисками очень озабочена. Кажется, что реальные намерения здесь крайне очевидные.

Тут весь источник - какие-то мутные типа "сливы". Потому что есть, что нет - разница отсутствует.

Вы хотя бы статью почитали перед публикацией. Единственная релевантная информация:

The San Francisco-based company had installed about half a dozen staff within the NSA as so-called forward-deployed engineers to guide the use of the technology and customise models for specific applications, two people familiar with the arrangement said.

It remains unclear whether Anthropic’s engineers are assisting the NSA in active operations. However, one person close to the situation said Mythos would be useful for infiltrating the networks of nations such as China or Iran.

Проще говоря, вся новость основывается на очень мутных словах какой-то мутной личности. Выглядит как унылый пиар, нежели что-то интересное.

Где здесь проблема инфраструктуры и экспоненциального роста, а где следствие некачественного кода написанного нейронкой?

Ну да, это точно не проблема некачественного кода. Ведь продукты от Anthropic славятся своим полным отсутствием багов, никто из пользователей не жалуется на различные поломки приложений от них, а количество issue у Claude Code близко к нулю. Или же всё-таки нет?

Ну факты в Firefox

А кто есть кроме них? В то время как на стороне скептиков имеются примеры cURL (почти ноль результатов), Palo Alto Networks (результаты хорошие, но там использовался не только Mythos; вклад ИИ в целом описан мутно; кол-во найденных уязвимостей тоже не самое большое), WolfSSL (неплохой вклад от Mythos, но далеко не настолько огромный, как в других проектах). В качестве примера "фактов" можно добавить Cloudflare и Google, но с ними тоже не все до конца понятно

там возможно не Mythos, а другие модели, но дела это не меняет

Если модели открытые, то дела как раз очень и очень сильно меняются.

Написано мол это будет mythos-class models, то есть не сама мифос, а какая-то облегченная версия что-ли

Разгадка тут куда проще, как мне кажется. Opus 4.8 уже по многим бенчмаркам находится на уровне (а иногда даже превосходит) Mythos; там же, где Opus хуже, отставание в большинстве случаев составляет порядка 3-5%.

Вероятнее всего, Anthropic забенчмаксит Opus 4.8 на эти самые проценты и через месяц-два выкатит какой-нибудь Opus 4.9/5.0, провозгласит его "Mythos-level model", и на этом всё. В другой сценарий верится слабо.

У Anthropic сейчас есть задачи поважнее: бенчмаксить модельки перед IPO. А на простых пользователей всем как обычно....

1
23 ...

Информация

В рейтинге
3 586-й
Зарегистрирован
Активность