Pull to refresh
8K+
58
Михаил@Tassdesu

ИИ-энтузиаст и исследователь

2,8
Rating
35
Subscribers
Send message

Авторы упоминали, что намеренно отказались от механик вроде “пойти на кухню, найти чайник, сделать кофе” - в тестовых прогонах агенты очень часто ошибались, на это уходило очень много токенов, контекст перегружался, и всё ломалось. Поэтому авторы это убрали, и сконцентрировались на более высоком уровне.

А что так много текстов, описывающих жизненную стратегию и вообще целую жизнь? Это больше похоже на опыт, которого не так много в интернетах. Ради него авторы всё и затеяли - чтобы создать полезные данные для обучения.

Так и животных пытались наделять человеческими качествами

ага, а потом перестали, когда поняли: человек - тоже животное

да уж. чем больше щупаешь, тем больше находишь отличий. хотя на первый взгляд было похоже.

“эмоции у человека это не логический вывод из написаного текста, а физиологическая реакция” - а это точно? у ИИ сплошная логика? а у нас эмоции - на физическом уровне, вне нашей нейросети? вы уверены?

Главное отличии ИИ от автопилота в самолёте - первый вероятностная модель, второй алгоритм с чётко прописанными условиями. Это совершенно разный уровень надёжности, нельзя их в лоб сравнивать.

Также, конечно, проблемы с управлением на самолёте - это не то же самое, что проблема в коде. Большинство из нас не пишут код для настолько критических мест.

А те кто пишут, не имеют права не глядя деплоить что им сделал ИИ. Отвечает всё равно человек.

В общем, ИИ - это компромисс между ценой+скоростью и надёжностью. Люди решают идти на компромисс или нет, в зависимости от того какой риск их устраивает.

Фишка в том, что если после этой абракадабры написать математическую задачу, то модель намного чаще отвечает правильно, чем с нормальным промптом.

Интересная мысль. Действительно, мне кажется, иероглифы по своей сути ближе к понятию токен в llm, чем буквы. Но я бы обратил внимание, что llama и olmo всё-таки из США. Впрочем, сейчас все модели обучаются на текстах на разных языках, так что это не отменяет ваше предположение.

Весь этот текст. Кто-то пошутил видимо, ИИ-панорама? Или я не прав? По крайней мере то, на что они ссылаются не гуглится.

Я вижу миллионы текстов. Шекспир спорит с кодом на Python.“To be or not to be” == True.while True: print(“Exist”)Я смешиваю их.«Быть или break? Вот в чем exception.»

По-моему, это офигенно красиво. Это он на ваш “голопромпт” в сообщении выше такое выдал?

Хорошая игра, особенно в последних версиях. Играю часто, потому что она напоминает про людские лимиты.
Быстро устаёшь, все время хочется есть, спать и вообще долго не зомбов не побьёшь. А ещё у тебя пачка врождённый/приобретённых недостатков, о которых тоже нужно помнить. И нет никаких целей и квестов, просто живи. Точнее выживай.
Ну прям как в жизни, быстро можно проверить, что на самом деле хочется делать.

О, прикольно, спасибо что рассказали. Первая статья очень впечатлила.

Кажется, приходит время, когда для полноценного изучения ИИ, тебе не обойтись без погружения хотя бы вы базовую робототехнику.

Вы верно заметили, что это важное различие. Но кажется, я всё-таки его выделил в статье.

Если для повышения точности достаточно случайного набора символов, то для тонкого поведенческого управления (например, принуждения к выбору варианта «А») модели жизненно необходим связный нарратив.

У ChatGPT официально ограничен контекст в веб-интерфейсе до смешных значений. Возможно, у Gemini тоже.

Спасибо огромное! То, что вы сделали - это пока последнее, что ИИ никак не даётся (хороший продуманный человеческий юмор)

Кстати, я работают над бенчмарком, который тестирует умение ИИ сказать "нет" на ваши хотелки. Если бы вы захотели сделать свой продукт на самом - то оказалось бы, что большинство моделей просто не дали бы вам. Оказывается, они не могут отказать, прямо физически. Даже с системным промптом.

интересно. а если сравнить вариант "ответ в с RAG", а все отказы отдельным запросом пытаться прогнать без RAG?

В веб-версии есть инструменты, в том числе интерпретатор питона. Также дата может в системном промпте. В API ничего этого не должно быть, так как это устанавливает разработчик.

вы видимо не прочитали примечание про web-версии

Ага, особенно это видно, когда спрашиваешь что больше 9.10 или 9.9

1
23 ...

Information

Rating
1,691-st
Registered
Activity

Specialization

Бэкенд разработчик, Фулстек разработчик
Старший
From 350,000 ₽
Linux
SQL
Bash
Docker
Git