Обновить

Нашёл модель в 8 раз дешевле. Она начала писать иероглифы в русских новостях

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели7.7K
Всего голосов 5: ↑3 и ↓2+3
Комментарии15

Комментарии 15

У меня то же самое делает Fable иногда 😀

хм, ни разу не встречалась такая проблема

Напишите в системном промте запрет "Не используй иероглифы", это проще чем извращаться с 2 моделями. А чем вас российские AI роутеры не устраивают, это же дешевые модели или просто хотите бесплатно?

не знаю, даже как то не рассматривал + врятли достучусь с европейских серверов

Так делают и Opus/Sonnet, да и Fable. Привык уже ))

А вообще под «быстро и не дорого» я обычно беру google flash. Причем не всегда самую новую

Gemini Flash офигенен. После этого берешь "какой-нибудь" 5.6 Sol и удивляешься тормознутости.

По этом разница в стоимости огромная. А для чего попроще можно взять gemini-flash-lite - там цена еще ниже, в скорость как будто реалтайм.

кстати я слышал, что claude медленнее, чем codex

Меняйте модель в лучшем случае, пытаться решить это - мазохизм.

может быть и правда, но слишком много уходит $ на запросы. Возможно сделаю основой deepseek

Можно извернуться, и использовать Opencode. Там бесплатный deepseek-v4-flash, с лимитами примерно 50млн токенов за 5 часов, но у вас похоже примерно столько и тратится в день. А если не хватает - то нужно всего лишь сменить айпишник, и лимиты снова пустые.

api endpoint-а там не будет (для бесплатного использования, так то можно подписку взять за $10/месяц, и гонять флеш на $60 по api-calls ценам), но через CLI все вызывается, дополнительная обертка будет (вместо отправления данных сразу по API - вызывать консольный opencode run c указанием промта, ну или что-то в этом роде, я сам не запускал, просто изучал, на VPS загрузить и скрипты настроить).

Ну и там выбор бесплатных моделей получше и поумнее, в том числе ling-3.0-flash) Hy3 был неплохим на опенроутере, просто ограниченное время. Ну и там нужен держать больше $10, чтобы он давал 1000 запросов в день к бесплатным моделям.

имел опыт с opencode, но показалось, что дешевле openrouter юзать

Мне кажется, что гонять Дипсик для убирания иероглифов это слишком жирно:)
У вас на каких мощностях бот работает?
Если у вас китайские иероглифы просто повторяют текст на русском, то проще всего их вырезать регуляркой.
Если иероглифы это часть осмысленного текста, то можно их выкусывать и отправлять на перевод, потом вставлять обратно.
- MyMemory API - 1000 слов в день на один IP или 5000 при авторизации через емэйл.
Но он какой-то капризный и с серверами, которые ему "не нравятся", не работает.
- "DeepL API Free" - 500 000 символов в месяц бесплатно. Но нужно привязывать карту и там есть какой-то лимит по частоте вызова.
- Есть библиотечка на питоне "deep-translator" которая типа роутер к сервисам переводчиков. Но там надо проверять, что в данный момент работает.
- Локальный лёгкий переводчик - Argos Translate.
- Лёгкая локальная нейросеть - MarianMT (файлы лежат на Hugging Face). Это не генеративная нейросеть, а сеть типа Seq2Seq, т.е. декодер +энкодер, для простого перевода слов достаточно.
Это всё конечно надо тестировать, я не знаю Ваши объёмы:)
Есть ещё подобные программы для простого перевода слов, думаю, сообщество подскажет.

Gemini тоже страдает иероглифами
Gemini тоже страдает иероглифами
Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Публикации