Обновить

Контекстное окно длиной 4 миллиона токенов в Llama-3 8B (V0.1) ?‍?

8 мая 2024 г. представители Gradient AI опубликовали в X (*запрещена в России) следующий пост:

"Мы активно расширяем границы возможностей моделей с большими контекстными окнами, поэтому мы с радостью представляем раннюю версию нашей модели Llama-3 8B на 4 млн токенов, которую мы выложили на huggingface.


Несмотря на то, что её совершенствование потребует времени, на сегодняшний день, из всех моделей с исходным кодом в открытом доступе, Llama-3 8B имеет контекстное окно, которое вмещает самое большое количество токенов.

Если вам нравится то, что вы видите, следите за нами и нашими друзьями@CrusoeEnergyтак как мы продолжаем оказывать помощь сообществу!"

Также следует отметить, что контекстное окно на 4 миллиона токенов примерно соответствует тексту длиной 3 миллиона слов.

Для справки, во всех книгах серии Гарри Поттер на языке оригинала суммарно содержится порядка 1,084,170 слов.

Gradient AI: Искусственный интеллект для бизнеса

Gradient AI представляет собой платформу искусственного интеллекта (AI), специально разработанную для работы с данными и корпоративными задачами. Она предлагает быстрый и простой способ интеграции AI в бизнес, обеспечивая максимальную ценность с минимальными усилиями.


Теги:
Всего голосов 2: ↑2 и ↓0+3
Комментарии0

А все-таки Qwen3.8-27B — думает меньше и быстрее чем 3.6

В пятницу вышла Qwen3.8-27B. Скажу честно, с середины мая я отказался от подписок и сидел исключительно на локальной Qwen3.6 (для всех своих домашних проектов), у меня даже статья была на эту тему. Поэтому мне было очень интересно увидеть на что способна новая Qwen3.8-27B.

Тут на Хабре было несколько статей о том, что 3.8 слишком долго думает и что у 3.8 слишком много галлюцинаций (что, как мне кажется, не совсем корректно), поэтому я решил поделиться настройками, которые работают (у меня), надеюсь они будут кому-нибудь полезны. Qwen3.8-27B превзошла мои самые смелые ожидания, и уж что-что, а задумчивой ее никак не назовешь.

А все-таки Qwen3.8-27B — думает меньше и быстрее чем 3.6

Публикации