Комментарии 73
Тут надо аккуратнее с цифрами. $8 000 «по API» это не сколько Anthropic на вас тратит, а сколько они берут по прайсу. А в API-прайсе маржа такая, что туда ещё один Эверест поместится. Реальный compute обходится им в разы дешевле, так что «подписчик жжёт на $8к» я думаю красивая страшилка для статьи, а не себестоимость.
Но вектор-то верный. $200/мес сейчас это как дешёвый станок Gillette: продают ниже себестоимости, чтобы вы подсели, а лезвия (свежие модели, длинный контекст, новые фичи) постепенно уезжают в API за настоящие деньги.
Поэтому «прикроют подписки всем» вряд ли. Их не прикроют, но могут тихо обкорнать: лимиты пожёстче, модели постарше, всё вкусное «только для API». А в какой-то момент откроешь свой тариф и поймёшь, что за те же $200 получаешь заметно меньше, чем полгода назад.
Тут надо аккуратнее с цифрами.
💯 И тут еще не стоит забывать о том, что далеко не все пользователи подписок расходуют их под ноль. Например, моя подписка Gemini Pro, недельный лимит сбросится 16 июня, а израсходовано сейчас только 4%. Подписка Claude Pro — недельный сбросится 13 июня, потрачено 7%. GitHub Copilot спустя 10 дней с начала периода 257 / 1,500 AI credits.
Я просто не адепт вайбкодинга и юзаю ИИ как инструмент избавляющий от рутины или делающий ревью моего кода, отсюда и потребление не такое активное. Чаще всего я потребляю не больше 50-70% недельного лимита.
Сейчас 11.06, Вы, должно быть, про май пишете.
[Офтоп ON]
У меня глаз дёргается от длинного тире. Может когда нибудь в будущем историки назовут наше время "Эпоха длинного тире".
Для меня маркер -> длинное тире -> 100% нейрослоп -> в мусорку. Но! У вас в казалось бы обычном ничего незначащем посте есть длинное тире! Откуда вы его взяли вообще ? На обычной клаве его нет. И что бы его поставить нужно много лишних действий. Вдруг я чего не знаю и это только на моей клаве такого нет ? Знаю что некоторые редакторы автоматом 2 тире превращают в длинное. Но! В обычном тексте никто никогда не будет таким заморачиватся.
А ещё эти смайлики 💯 и подобное - это только LLM используют. Просто я застал время до LLM (кстати это каких то пару лет). И ничего такого в нете не было.
Длинное тире доступно с помощью весьма нехитрых манипуляций, к тому же существуют специальные раскладки.
В обычном тексте никто никогда не будет таким заморачиватся
Заморачивались, заморачиваются, и будут заморачиваться. Для некоторых людей минус вместо тире — такая же ошибка, как запятая вместо точки.
Для некоторых людей минус вместо тире — такая же ошибка, как запятая вместо точки.
Где-то есть стандарт определяющий длину черточки после которой она считается тире, а не минусом?
Где-то есть стандарт определяющий длину черточки после которой она считается тире, а не минусом?
Возьму на себя смелость сказать за всех укушенных Артемием Лебедевым...
По английски оно называется em dash, то есть шириной в букву M своего шрифта, то есть примерно равно размеру шрифта. Это не стандарт, но ориентир, может зависеть от шрифта.
Ну т.е. минус вместо тире это не ошибка, но тряска почему-то присутствует
запятая вместо точки
это будет ошибкой вне зависимости от шрифта, это просто разные знаки пунктуцации.
Я давно конечно русский язык учил, но не помню там правил "длинное тире" "короткое тире", реально есть праило?
Дефис и тире точно так же разные знаки пунктуации. Разные глифы, разные коды. В каком-то шрифте тире может отсутствовать или быть не таким уж длинным, но оно никогда не будет такой же длины как дефис.
Есть дефис, для слов типа “когда-нибудь” или “пол-Москвы”. Есть тире — для прямой речи (но не только).
Откуда вы его взяли вообще ?
У меня своя кастомная раскладка для английского и русского языка, в моей раскладке поставить длинное тире просто: alt + shift + - = — 😅
Я знаю много людей, кто в текстах предпочитает использовать длинное тире, вроде бы в этом нет ничего необычного. Так что не очень достоверный маркер, на самом деле. Уж точно не "100% нейрослоп" 😅
Эмодзи тоже люблю использовать, в моем кругу общения это как-то устоялось и принято.
А так в моей раскладке есть много прикольных символов, например, Љ м Њ для межславянского 🙃
На вас влияет апофения. Я последние 8 лет пользуюсь длинными тире почти везде: в личных переписках, рабочих постах в медиа, собственных заметках. И мне никогда не казалось, что я единственный, кто их использует, и тем более я не считал это своей фишкой. Я не знаю, как это делается на Windows, но на Mac достаточно просто нажать Option + тире, чтобы получить среднее тире, или Shift + Option + тире, чтобы получить длинное. Всю жизнь этим пользовались, ни у кого это не вызывало эмоций, а теперь вдруг стало проблемой. И ещё: даже если материал сгенерирован ИИ, почему это само по себе должно быть сигналом низкого качества? Если автор обладает экспертизой, знает предмет и понимает, как раскрыть тему с помощью ИИ, то какая разница, был ли текст отформатирован ИИ или написан в соавторстве с ним? Я могу вас немного понять, потому что на Хабре действительно есть люди, которые злоупотребляют ИИ. Но, как по мне, гораздо лучше оценивать тексты по их информационной составляющей, а не до последнего тренировать в себе навык находить в тексте длинные тире.
О налетели. Даже заминусили. А я просто спросил. Ну хоть ответили и то спасибо. Понял - некоторые спецом его используют - даже не смотря на то что для этого нужно использовать доп действия. Я ещё понимаю для статьи - но для коментов... Для меня это не понятно. Ладно.
Что касается нейрохрючева - можете меня не убеждать. НИКОГДА не признаю такой текст. А знаете почему? Я сам постоянно пользуюсь LLM. Но для себя. Могу на генерировать себе любых статей если надо. Но когда habr да и весь интернет стал нейрохрючевом имеем главный эффект. Люди перестали писать статьи. Книги. Вообще всё от человека пропадает. К чему это ведёт - сейчас нейрохрючево паразитирует на хороших данных. Но уже скоро просто деградирует полностью - когда получим обучение нейрохрючева от нейрохрючева.
Вы не просто спросили, вы назвали любые тексты с длинным тире нейрослопом. Разницу надеюсь понимаете.
Я написал конкретно - для меня. Мнение своё не поменял - вижу длинное тире, даже не смотрю что это. Разумеется ничего абсолютного не бывает. И процент ложных сработок будет всегда. Но как я писал ниже - не собираюсь тратить силы выискивая эти ложные сработки.
Если есть ПОКА ЧТО очень простой способ отличить нейрохрючево - это длинное тире и списки-списки-списки, я буду пользоваться этим простым способом.
процент ложных сработок будет всегда
«Вот видите, Ваше Величество, Вы уже торгуетесь!»
Ээээ.... вы бредите? Какая торговля? Меня просто тошнит от нейрослопа - из за него я например уже год не могу аудиокнигу послушать. А раньше я их тысячи слушал. Сейчас же всё заполонили авторы пиушие "книги" 1 штука на 300 страниц в 3 дня. 20 серий по 60 книг в каждой. Есть такие уникумы. Например Сапфир автор.
А также меня тошнит от нейрослопа на хабре. Честно сказать я просто в шоке как на меня тут накинулись. Я что позарился на хлебное место чьё то?
Реально вам всем не похрен что тут какой то ноунейм про тире написал?
За живое что ли задел? Вообще бред а не ситуация....
Та проблема, которую Вы описали - вполне реальна. Но это не единственное, что существует в этом мире, помимо этого есть и другое. Например, качество генерации LLM сильно зависит от того, кто с ней разговаривает и как он это делает.
Если попросить LLM "напиши статью на хабр про X" - наверняка будет мусор (хотя лично я не проверял, но вроде это очевидно). А вот если несколько часов общаться с LLM обсуждая сложный кейс, пройти в процессе несколько осознаний обоим участникам этого обсуждения, а потом попросить написать статью про этот кейс - качество результата будет принципиально на другом уровне. А если после этого вручную сделать серьёзную редактуру, то от собственноручно написанной статьи отличить станет сложно даже "автору". Если работать в таком стиле, то LLM из "автора нейрослопа" превращается в "очень быструю печатную машинку" - ровно та же ситуация, что и при написании кода, когда ты либо в браузерном чате просишь "напиши мне код для фичи X" либо тот же запрос отправляешь агенту, который имеет доступ к коду проекта, получил море контекста из AGENTS.md и обвешан скиллами "как делать X правильно". В первом случае будет фигня, во втором не всегда можно отличить код от собственного.
Смотрите - я очень плотно сижу на LLM. В програминге. И я знаю что они из себя представляют. Я не против них. Это отличный инструмент. Это отличный поисковик.
Но! Статьи например для habr - вы думаете их будут писать неделю или месяц с LLM? Как показывает практика - это так не работает.
Большинство пишутся за пару часов. И главное - автор который раньше тратил силы и время на качественную статью - смотрит на это, и думает а нахера мне это вообще надо. Тратить кучу сил. И получаем то что получаем.
Кому нравится во что превращается хабр - да ради бога! Я вам слова не сказал против. Просто есть и другие - которые не хотят нейрохрючево.
И да. Текст LLM - как правило рафинированное среднее по больнице. Это мы не обсуждаем воду и галлюцинации. Авторский контент - всегда уникальный. Имеет стилистическую подпись человека. Это так - к слову. А то люди скоро реально забудут разницу.
Я ещё понимаю для статьи - но для коментов...
Дело в привычке, я использую его везде, даже в общении с друзьями в мессенджерах. Это происходит на полном автомате. Даже если с телефона текст набираю.
Ну это не сложно, если много работать с документацией, то привыкаешь жать ctrl+<NUMPAD -> и ctrl+alt<NUMPAD ->
вот как-то так – и —
часто используется как дефолт для маркированных списков. Я бы не сказал, что это признак ИИ
Для меня маркер → длинное тире → 100% нейрослоп
Ну зачем же так сразу расписываться с собственном незнании хабровской функции «Типограф» или комбинации Alt+0151...
Я прекрасно знаю как вводить юникод на клаве. А так же я знаю одну истину - человек всегда стремится меньше работать. Так эволюционно сложилось. Отклонения тоже всегда есть. Но их мало - на то они и отклонения. И отсюда мне непонятна была одна вещь - откуда вдруг появились тонны длинных тире, когда для них нужно делать лишние действия.
Но мне в панамку за банальный вопрос тут напихали минусов. Ладно. Писать и читать тут что то желания ещё меньше.
Не минусовал, но на маковской клаве длинное тире сделать не сильно больше действий, чем заглавные буквы делать. У вас, например, заглавные буквы есть, хоть вы и стремитесь меньше работать. :)
Да и заглавные буквы мне лень писать. А переключение языков лень в двойне. Пока что с этим справляется punto-switcher. Прога которая это всё делает автоматически. И да лень не потому что ленивый - просто есть вещи программинг - который забирает все силы. Чем больше сэкономлю везде где можно, тем больше потрачу на полезное. Которое я считаю полезным. А то щас прицепятся - что моё полезное не совпадает с полезным общественным.
А так же я знаю одну истину - человек всегда стремится меньше работать. Так эволюционно сложилось.
Также животные боятся огня. Так эволюционно сложилось. Однако пожарные почему-то всё ещё есть.
Также животные почему-то имеют тенденцию опрятно выглядеть (эволюционную причину спросите сами — ну, хоть у павлина).
Не превращайте вполне конкретную ситуацию в бред похожий на нейрослоп. Сами то поняли что написали? Я вполне конкретно спросил про длинное тире - потому что есть вполне конкретная проблема. 90% статей это тупой нейрослоп. И каждая статья как раз и определяется по этому самому длинному тире. Спискам. И общей бессмысленности содержания. И привёл пример - обычно никто не пишет длинное тире в комментах. И комментов явно сгенерированых LLM я тут уже встречаю тучи. Просто явно тупые - люди сразу выкупают и заминусовывают - но проблема никуда не делась. Просто стали чуть лучше промт писать - что бы сразу такой коммент не выкупали.
Ладно - происходит какая то дичь. Вообще никому ничего доказывать не собирался. Мне просто фиолетово кто что думает. Это вообще ни на что не влияет. На то что хочеш-не хочешь а теория мёртвого интернета уже реальность.
Так пожарных чествуют как героев и превозносят их храбрость 24/7 не просто так.
Хахха. Даже карму начали сливать ))) Оставайтесь со своим нейрослопом )))
Для меня маркер → длинное тире → 100% нейрослоп → в мусорку. Но! У вас в казалось бы обычном ничего незначащем посте есть длинное тире! Откуда вы его взяли вообще? На обычной клаве его нет. И что бы его поставить нужно много лишних действий. Вдруг я чего не знаю и это только на моей клаве такого нет?
Выделяете тест нажимаете — «типограф» и все ваши минусы превращаются в тире и заодно кавычки превращаются в кавычки-ёлочки. Больше никаких лишних действий!
У меня глаз дёргается от длинного тире. Может когда нибудь в будущем историки назовут наше время "Эпоха длинного тире".
Назовут эпохой пользователей не осиливших «типограф» habr-a. Но мне правда интересно: как в IT можно работать, не замечая новых фишек и инструментов, которые буквально созданы для того, чтобы сделать нашу жизнь проще, а работу продуктивнее? Ведь умение адаптировать новое под себя — это двигатель нашей профессии.
Где вы видите 4% gemini pro, или это про чатик?
Недельный лимит не видно пока он не станет < 5-часового

Да, забыл уточнить, что имел ввиду именно лимиты чата Gemini. Antigravity 2.0 пока не удавалось вообще хотя бы одно деление заполнить прогресс бара пятичасового лимита (даже с учётом, что модель по умолчанию 3.1 Pro High), теперь хоть знаю, каким он цветом выделяться будет если что, так что спасибо за скрин 🤝 правда я думал, что лимиты там общие, ведь один аккаунт используется, но по видимому все же нет.
Gemini Chat: Usage limits

Только обсудили этот момент в интерфейсе Antigravity, как сегодня же прилетел апдейт изменяющий отображение прогресс бара. Теперь вот так:
Стало видно точные %, только разбивка по конкретным моделям пропала

А в API-прайсе маржа такая, что туда ещё один Эверест поместится. Реальный compute обходится им в разы дешевле, так что «подписчик жжёт на $8к» я думаю красивая страшилка для статьи, а не себестоимость.
А что вы в себестоимость включаете?
Очевидно стоимость электричества и амортизацию серверов. Во сколько обходится юнит экономика токена для самой антропик
Если я не путаю, то там еще много чего должно быть включено. В том числе человеко-часы, которые были потрачены на многие связанные бизнес процессы, включая разработку. Не думаю, что все упирается в железо/электричество.
Безусловно, тоже своего рода амортизация.
Конечно считают по разному.
Но есть важные параметры, относящиеся к юнит экономике - именно во сколько обойдется одна копия, потому что R&D и маркетинг не масштабируются, когда мы масштабируем сервис (маркетинг на самом деле может входить в unit экономику еще как, если привлечение клиента включено во flow).
Если у тебя дорогой R&D - это решается масштабированием.
Если у тебя дорогая юнит экономика - масштабирование только ухудшает ее.
А там модели копеечного deepseek’а подтянутся если не до opus, то до sonnet. ¯_(ツ)_/¯
Уже и сейчас под некоторые простые задачи проще использовать слабые, но дешёвые модели. Результат чуть хуже за на порядок меньшие деньги.
Если не ошибаюсь, разница DeepSeek V4 Flash и Sonnet не порядок - а два порядка. А разница в качестве, на глазок, процентов 15. Я из-за этого вообще перестал Sonnet использовать - на подписке Pro лимиты жёсткие, так что либо Opus/Fable для архитектурных вопросов, либо DeepSeek V4 Flash для "набрать код".
Кто вообще решил, что токены в апи идут по себестоймости и с чего он это взял? Откуда информация, что миллион токенов антропикам на самом деле не стоит 2 бакса?
Все забывают про стоимость инференса на свежих кластерах и зарплаты датасаентистов. Там не только электричество в цену заложено, но и окупаемость всего R&D
Скорее всего новый вид монетизации придет: новые модели будут появляться в подписке иногда и не на долго. Таким образом все их увидят, дадут информацию для дообучения, а потом все.
В целом это логично: основной доход - энтерпрайз, но избавляться полностью от подписки нельзя: популяризация и та самая информация для дообучения.
У меня ощущение что подписки для ллм это как пиратство для игр: вроде убыток, но супер хиты получаются во многом благодаря доступности и популярности, которые приносит пиратство
Подписки Anthropic и OpenAI убыточнее, чем считалось
Кликбейт на уровне бреда.
Какие еще убытки, в вопросе о том какой тариф выгоднее для пользователя?
Желтушный кликбейт и в новости и в заголовке. Реальная экономика любой подписки совсем другая - она рассчитана на то, что большинство пользователей подписки потребят намного меньше, чем теоретически с ней можно предельно потребить.
Это как шведский стол - вроде можно есть сколько хочешь без лимитов, но в реальности вы ограничены размерами своего желудка.
То же самое и с "безлимитным" интернетом.
Реальной экономики их подписок никто извне не знает, но выше уже человек приводил в пример расходование в районе 5% лимита.
Вполне возможно, что с развитием агентского кодирования среднее потребление на подписках вырастет и их придется менять, но сравнивать напрямую с ценами на api полностью бессмысленно.
Я вообще не понял смысла статьи. То есть взяли публичные расценки на разные сервисы, и поделили одно на другое. Что значит «реальные»? Они в антропик работает и точно знают сколько на самом деле это стоит? Скажу по секрету, это может стоить в реале даже в 100 раз меньше, чем продается в виде АПИ. Что с того? Как хотят, так и продают. При чем тут «реальность»?
Статья исходит из совершенно безумного предположения, что антропик за производство токена платит столько же, за сколько продает его через апи, что разумеется не правда.
Это конечно же не означает само по себе, что подписки не продаются в убыток, но и ничего нового нам не говорит
Ну почему ничего? Можно предположить, что цена подписки это +-себестоимость и прикинуть маржу по API, например.
Безусловно о порядке величин говорить можно, но порядок величин можно и посчитать, зная цену оборудования и экплуатации.
Цену по подпискам нельзя посчитать ультимативно потому, что мы не знаем хорошей статистики использования плюс это все же может быть субсидирование в надежде на захват рынка, а так же манипуляции с тарифами и оптимизацию моделей в будущем
GPU стоят 2 доллара в час. Допустим для новых моделек нужны две новые карточки сразу. Явно не больше. Итого 5 баксов в час.
100 баксов это 20 часов работы GPU. Кажется на подписке можно заметно больше потратить. Если считать время пока моделька думает и рассчитывать что карточки в это время полностью твои.
Эту статью нет смысла анализировать. Лучше гуглом перевести это https://businessengineer.ai/p/the-subsidized-agi-economy
У меня в прикидках получалось такое, что эти подписки вполне себе могут окупаться, если среднестатистический пользователь пользуется ими умеренно.
Это уравнение со множеством неизвестных. Начиная с того, что зависимость ресурса оборудования от нагрузки нелинейная. Неизвестно насколько отличается ресурс GPU при 50% и 100% загрузке. Неизвестно в какой степени используются SSD, и как изношенные SSD работают в режиме с малым временем хранения данных (когда не требуется хранить данные долго, и проблема утечки заряда не проявляется). Если обработка идет только в ОЗУ, то картина будет отличаться еще больше.
Это все прекрасно, но забывают упомянуть одну "мелочь": считают максимальное количество токенов, тоесть полностью использовать подписку. И тут внимание вопрос:
а какой % пользователей полностью в ноль использует свои лимиты? В случае клода, не просто один раз в 5 часовый лимит упереться, а постоянно в упиратсья в недельные?
А сколько процентов пользователей и 3% недельного лимита регулярно не выжирают? Ась?
Чтобы упереться в 5-ти часовой лимит у меня уходит 1.5-2 часа на Opus - это примерно до 5 запросов, иногда успеваю одну задачу сделать, но далеко не всегда. Про Fable вообще говорить нечего - 3 запроса и привет лимит. Да, задачи у меня сложные, контекста относительно много набегает за одну такую сессию (под 200K), но эти модели и нужны для сложных вопросов, простые за копейки делает DeepSeek V4 Flash.
Это все прекрасно, но забывают упомянуть одну “мелочь”: считают максимальное количество токенов, тоесть полностью использовать подписку.
Еще имеет значение длительность подписки. Если в течении действия подписки цена за токены будет снижена, то получится что часть токенов окажется купленной “с переплатой”.
Жду, недождусь, чтобы поскорее накрутили 200$ за 1M токенов, когда "корпорации" и псевдопогромеры подсядут на нейроиглу. Тогда посмотрим, кто был прав...
Минусуйте малолетки вайбкодерские, минусуйте. Вы просто задолбали уже со своим нейроговном, своими сетями, моделями. Просто хочу старые, добрые времена. Когда мы все учились, думали, рассуждали, и не нужно было запускать приложуху, чтобы узнать, смогу ли я сегодня снять кого-нибудь. Вы отупели по самое немогу. Вы не можете решить элементарные задачи. У вас одна цель - написать промпт - выложить - получить "прибыль" - минусовать всех, кто не по вашу сторону
Минусуйте малолетки высокоуровневые, минусуйте. Вы просто задолбали уже со своими компиляторами, своими языками, автопроверками. Просто хочу старые, добрые времена. Когда мы все учились, думали, рассуждали, и не нужно было запускать приложуху, чтобы узнать, смогу ли я сегодня скомпилировать кого-нибудь. Вы отупели по самое немогу. Вы не можете решить элементарные задачи. У вас одна цель - написать программный код - выложить - получить "прибыль" - минусовать всех, кто не по вашу сторону
Эх вот бы вернуть времена железного программирования, когда было нужно каждую машинную команду физически выставлять рычажками! /S
Вы не можете решить элементарные задачи. У вас одна цель - написать промпт - выложить - получить "прибыль" - минусовать всех, кто не по вашу сторону
Да не будет у них какой «прибыли». Их просто никто не увидит. Каждый станет сам себе «программист»-«режиссёр»-«художник»-«композитор»-«писатель», но кому будут нужны их поделки, когда миллионы точно таких же появляются быстрее, чем даже поисковые роботы успевают их переварить.
Ждем тариф "Просто посмотреть" за 500 баксов
А если захочешь чтобы сгенерированный код реально работал - придется открывать кредитную линию
Построенные дата центры и инвестиции сами себя не окупят. Ожидаются триллионные суммы.



Подписки Anthropic и OpenAI убыточнее, чем считалось