Комментарии 36
Ещё бы какой-то коэффициент получить от вас, смысл/ru и смысл/en. Для входа и выхода, чтобы была картинка очевидна. И ещё можно как человек сам преобразует с родного языка в чужой, сколько теряет этого смысла.
Лайфхак вы всегда можете это спросить у моделей и даже у нескольких и сделать пост.
vot I dumaite golovoi
Так там от уровня владения языка все зависит. Ели, Ландан из зе кэпитал оф ГритБритан, то лучше наверное переплатить.
Это не проблема. Разрабатываешь системный промт с моделью на русском. Когда он готов, говоришь модели перевести его на инглиш. Она хорошо знает контекст, оба языка, хорошо переводит текст, и хорошо делает промты на английском для самой себя. Какой-нибудь Opus 5.5 отлично с этим справляется.
Проблема остаётся с чтением глазами английских md файлов. А читать и дорабатывать их желательно. Для этого разные потенциальные решения. На пример, всякие плагины для vs code. Которые добавляют перевод md файлов прямо туда. Так можно относительно удобно читать английские md файлы на русском. Какой-нибудь гугловый переводчик по api хорошо с этим справляется в 95% случаев.
Надо развивать это направление. Экономия токенов на системных промтах и файлах памяти это важная тема. Надо работать над тем чтобы английские md файлы было удобнее читать на других языках. Проблема вполне решаемая.
Интересно бы было 5.5 опус увидеть ... 5ка уже не актуальна
Как в том анекдоте? Русский мат сокращает длину команды от командира в критический момент в среднем до 3,2 символов.
Поэтому уже запилили такой скилл: https://github.com/smixs/pohuy
Вы хотите сказать Мойша, что 1М токенов Выхода на Опусе стоит 125$ вместо 25?
Теперь я понимаю куда исчезают мои Шекели, словно вода... Это какой-то языковой фрод.
Интересно было бы такие расчеты сделать для иероглифических языков типа китайского. Что-то мне подсказывает, что там будет обратная ситуация.
Во первых, нужно понимать, что чисто работа с русским текстом в LLM - случай редкий. Ибо, делать чат бота, который прибит гвоздями к американской модели ( с серверами в США ) для работы в государстве, где доступ в международный интернет выпиливают целенаправленно - быть самому себе злобным Буратино.
Так что, в production только Local Run Self hosted модели - единственно приемлемое решение для РФ .
И смотреть на модель Genini Flash 3.7 смысла нет, когда выпущена модель Gemini Flash 3.8 , у которой и API доступ в 2 раза дешевле, и уровень нейронки существенно выше ( в задачах кодирования она на одном уровне с Antropic Sonnet 5 , в задачах рисования UI ,IMHO , топовая среди всех сегодня существующих ).
Если говорить про задачи разработки п/о, то русский текст американские модели сначала переводят на английский, потом с переводом задачи работают. Так что, существенной разницы в цене разработки при промпте на английском и русском языке не будет, на "размышления" модели потратят существенно больше токенов, чем на перевод текста с русского языка.
Увы но Gemini рядом не стоял с последними моделями Антропиков.
русский текст американские модели сначала переводят на английский, потом с переводом задачи работают
С чего вы взяли?
Лично мне для моих задач возможностей Gemini 3.8 Flash пока хватает, из нейронка от гугла в разы дешевле Sonnet 5.5. Использую через Antigravity , чтобы платить за нейронку подпиской, а не по API . Я плачу 20 $ / месяц за подписку Google Pro, лимитов Gemini flash мне хватает, ни разу не смог выбрать 5 часовой и недельный лимит . За Sonnet 5 выходило порядка 20-50 $ за задачу, коих не одна за месяц была ( использовал через opencode, через Api доступ).
Сейчас выглядит логичнее использовать openAI codex для использования по подписке GPT6.1 Astra и GPT 6 sol для задач, с которыми Gemini не справляется.
Antropic - нейронки мошные, но дороговато стоят, относительно цен конкурентов.
Так у Клода тоже есть подписка - 24 бакса в месяц (с учетом налога) и тоже пока лимиты не выбирал.
Нахрена ты в третьем абзаце дублируешь текст из первого и второго? Вы хоть вычитывайте свой нейроослоп
Т.е. сначала переводишь на англ простой моделькой - потом скармливаешь Opus-у. Они могли бы и сами это сделать автоматом.
Ну кажется куча моделей так и делает в размышлениях. Мой запрос, “надо будет ответить на русском”, портянка размышлений на английском, ответ мне на русском. На опусе не проверял.
И опус и фейбл размышления ведут почти всегда на английском и только ответ на русском, есть такое.
Если речь о программировании, то сам промпт занимает минимум контекста. И особой экономии не будет. С моделью лучше общаться на том языке, который сам лучше всего понимаешь. Хотя бы чтобы не тратить усилия на перевод.
А я давно уже перешел на английском общаться с ними и прокачиваешься в языке и токенов тратишь меньше))
Не воспроизводится. Перепроверил цифры по Claude и OpenAI API на вашем же корпусе. В итоге Opus 5 против GPT-5.5 на русском тексте дороже в 1,6 раза, а не в 3,9. Английский вышел 1,42x. То есть эффект есть, но он значительно меньше.
При этом новый более "прожорливый" токенизатор (с Opus 4.7) Антропик ввели не просто так: он улучшает то, как модель обрабатывает текст, в целом на задачу токенов уходит не факт что больше за счет более эффективных рассуждений.
Опять слоп, опять выводы которые не воспроизводятся. Хз, как вы считали, что опус х4 получился, я насчитал симв/токен на русском 2,49, и относительно гпт х1,61, как у комментатора выше. Очень удобно конечно забраковать соннет и 4.8, но оставить 5 опус, потому что надо же из чего-то делать жареный заголовок.
Большое спасибо за отличное исследование. Да, оно уже не первое такое. Об этом уже писали. Но тема всё равно важная. Будем больше работать над экономией и удобством.
md файлы надо держать на английском. Если есть проблемы с английским, читать их надо через что-то, что умеет переводить их вживую. Как функция перевода всей страницы в браузерах.
И надо думать над интеграцией живого перевода в интерфейсах агентов:
Чтобы можно было писать на русском -> тут же быстрый перевод на английский -> отправка английского сообщения агенту.
Думает и работает агент на английском.
Когда агент пишет пользователю, это сообщение автоматически переводится на язык пользователя. И пользователь читает его с удобством.
В итоге, мы получаем и удобство работы на своём языке, и экономию токенов. Потому что агент делает всё на английском языке.
Это для отдельных кейсов имеет значение, а так первый же анализ лога или проблемы сервиса перекроют месячную экономию токенов, добытую через запросы на английском вместо русского


Русский текст в Claude Opus 5 стоит в 3,9 раза дороже, чем в GPT-5.5, при одинаковой цене за токен