Обновить

Русский текст в Claude Opus 5 стоит в 3,9 раза дороже, чем в GPT-5.5, при одинаковой цене за токен

Уровень сложностиСредний
Время на прочтение8 мин
Охват и читатели22K
Всего голосов 30: ↑28 и ↓2+31
Комментарии36

Комментарии 36

Ещё бы какой-то коэффициент получить от вас, смысл/ru и смысл/en. Для входа и выхода, чтобы была картинка очевидна. И ещё можно как человек сам преобразует с родного языка в чужой, сколько теряет этого смысла.

Лайфхак вы всегда можете это спросить у моделей и даже у нескольких и сделать пост.

vot I dumaite golovoi

Думается (проверять я конечно не буду), что транслит - это максимально дорого. Буквосочетания не типичные для английского - нарежет на атомы.

Так там от уровня владения языка все зависит. Ели, Ландан из зе кэпитал оф ГритБритан, то лучше наверное переплатить.

Это не проблема. Разрабатываешь системный промт с моделью на русском. Когда он готов, говоришь модели перевести его на инглиш. Она хорошо знает контекст, оба языка, хорошо переводит текст, и хорошо делает промты на английском для самой себя. Какой-нибудь Opus 5.5 отлично с этим справляется.

Проблема остаётся с чтением глазами английских md файлов. А читать и дорабатывать их желательно. Для этого разные потенциальные решения. На пример, всякие плагины для vs code. Которые добавляют перевод md файлов прямо туда. Так можно относительно удобно читать английские md файлы на русском. Какой-нибудь гугловый переводчик по api хорошо с этим справляется в 95% случаев.

Надо развивать это направление. Экономия токенов на системных промтах и файлах памяти это важная тема. Надо работать над тем чтобы английские md файлы было удобнее читать на других языках. Проблема вполне решаемая.

Интересно бы было 5.5 опус увидеть ... 5ка уже не актуальна

Ничего особо не поменялось =)

Как в том анекдоте? Русский мат сокращает длину команды от командира в критический момент в среднем до 3,2 символов.

Поэтому уже запилили такой скилл: https://github.com/smixs/pohuy

Вы хотите сказать Мойша, что 1М токенов Выхода на Опусе стоит 125$ вместо 25?

Теперь я понимаю куда исчезают мои Шекели, словно вода... Это какой-то языковой фрод.

Чем реже язык, тем меньше на нем текстов, чем меньше текстов, тем менее вероятно, что они попадут на обучение, если обучение не проводится на этом языке. Поэтому русский я думаю не предел горя

Интересно было бы такие расчеты сделать для иероглифических языков типа китайского. Что-то мне подсказывает, что там будет обратная ситуация.

Картинка мая этого года. Ссылки на исследование нет.

Китайский дешевле только на китайских моделях.

Kimi k3 к тому же русский запрос ещё и переводит сначала на англ. И думает на англ.

В цепочке рассуждений это вот так выглдяит: """first translate into English (сначала переводит на англ)."""

Во первых, нужно понимать, что чисто работа с русским текстом в LLM - случай редкий. Ибо, делать чат бота, который прибит гвоздями к американской модели ( с серверами в США ) для работы в государстве, где доступ в международный интернет выпиливают целенаправленно - быть самому себе злобным Буратино.

Так что, в production только Local Run Self hosted модели - единственно приемлемое решение для РФ .

И смотреть на модель Genini Flash 3.7 смысла нет, когда выпущена модель Gemini Flash 3.8 , у которой и API доступ в 2 раза дешевле, и уровень нейронки существенно выше ( в задачах кодирования она на одном уровне с Antropic Sonnet 5 , в задачах рисования UI ,IMHO , топовая среди всех сегодня существующих ).

Если говорить про задачи разработки п/о, то русский текст американские модели сначала переводят на английский, потом с переводом задачи работают. Так что, существенной разницы в цене разработки при промпте на английском и русском языке не будет, на "размышления" модели потратят существенно больше токенов, чем на перевод текста с русского языка.

Увы но Gemini рядом не стоял с последними моделями Антропиков.

В кодировании сложного, но в принципе стандартного софта - возможно. В поиске неочевидных решений для не очень стандартных задач - не факт.

русский текст американские модели сначала переводят на английский, потом с переводом задачи работают

С чего вы взяли?

Лично мне для моих задач возможностей Gemini 3.8 Flash пока хватает, из нейронка от гугла в разы дешевле Sonnet 5.5. Использую через Antigravity , чтобы платить за нейронку подпиской, а не по API . Я плачу 20 $ / месяц за подписку Google Pro, лимитов Gemini flash мне хватает, ни разу не смог выбрать 5 часовой и недельный лимит . За Sonnet 5 выходило порядка 20-50 $ за задачу, коих не одна за месяц была ( использовал через opencode, через Api доступ).

Сейчас выглядит логичнее использовать openAI codex для использования по подписке GPT6.1 Astra и GPT 6 sol для задач, с которыми Gemini не справляется.

Antropic - нейронки мошные, но дороговато стоят, относительно цен конкурентов.

Так у Клода тоже есть подписка - 24 бакса в месяц (с учетом налога) и тоже пока лимиты не выбирал.

Какого налога? У меня налог был лишь на европейской карте. На американской нет.

Сейчас оплачиваю Claude 20$. Через Cashinout. Курс выходит примерно 90 Р/$. На данный момент.

Я в Молдове и карта у меня молдавская. При оплате подписки Pro отображается стоимость + VAT: $24.

Нахрена ты в третьем абзаце дублируешь текст из первого и второго? Вы хоть вычитывайте свой нейроослоп

Т.е. сначала переводишь на англ простой моделькой - потом скармливаешь Opus-у. Они могли бы и сами это сделать автоматом.

Ну кажется куча моделей так и делает в размышлениях. Мой запрос, “надо будет ответить на русском”, портянка размышлений на английском, ответ мне на русском. На опусе не проверял.

И опус и фейбл размышления ведут почти всегда на английском и только ответ на русском, есть такое.

Иногда даже ответ перескакивает на английский (очень редко).

За дипсиком такое замечал. А квен так вообще злоупотребляет и порой думает на китайском - что облачный большой, что локальный маленький. Но отвечает нормально на русском.

Если речь о программировании, то сам промпт занимает минимум контекста. И особой экономии не будет. С моделью лучше общаться на том языке, который сам лучше всего понимаешь. Хотя бы чтобы не тратить усилия на перевод.

Главное на 1С не писать :) 10кк строк (среди которых пара сотен твоих по задаче) и все на русском.

А я давно уже перешел на английском общаться с ними и прокачиваешься в языке и токенов тратишь меньше))

В вот не факт что ломанный английский будет лучше русского.

Не воспроизводится. Перепроверил цифры по Claude и OpenAI API на вашем же корпусе. В итоге Opus 5 против GPT-5.5 на русском тексте дороже в 1,6 раза, а не в 3,9. Английский вышел 1,42x. То есть эффект есть, но он значительно меньше.

При этом новый более "прожорливый" токенизатор (с Opus 4.7) Антропик ввели не просто так: он улучшает то, как модель обрабатывает текст, в целом на задачу токенов уходит не факт что больше за счет более эффективных рассуждений.

Опять слоп, опять выводы которые не воспроизводятся. Хз, как вы считали, что опус х4 получился, я насчитал симв/токен на русском 2,49, и относительно гпт х1,61, как у комментатора выше. Очень удобно конечно забраковать соннет и 4.8, но оставить 5 опус, потому что надо же из чего-то делать жареный заголовок.

Большое спасибо за отличное исследование. Да, оно уже не первое такое. Об этом уже писали. Но тема всё равно важная. Будем больше работать над экономией и удобством.

md файлы надо держать на английском. Если есть проблемы с английским, читать их надо через что-то, что умеет переводить их вживую. Как функция перевода всей страницы в браузерах.

И надо думать над интеграцией живого перевода в интерфейсах агентов:

Чтобы можно было писать на русском -> тут же быстрый перевод на английский -> отправка английского сообщения агенту.

Думает и работает агент на английском.

Когда агент пишет пользователю, это сообщение автоматически переводится на язык пользователя. И пользователь читает его с удобством.

В итоге, мы получаем и удобство работы на своём языке, и экономию токенов. Потому что агент делает всё на английском языке.

Это для отдельных кейсов имеет значение, а так первый же анализ лога или проблемы сервиса перекроют месячную экономию токенов, добытую через запросы на английском вместо русского

Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Публикации