Pull to refresh

Comments 19

Просто берём и делаем вид, что не существуют уже ChatBox, Cherry Studio, LibreChat...

Вам так ещё не поздно и текстовый редактор изобрести.

Изобрести что-то полезное отдельно взятой группе людей - никогда не поздно. Даже если это будет нишевой текстовый редактор. Всё озвученное вами я пробовал, и большинства озвученных мной функций в совокупности - там просто нет. Иначе - можно вообще ничего не делать, и довольствоваться существующим устраивающим слабо или не устраивающим вовсе.

Не, просто когда пишут клон чего-то общеупотребимого, то в описании принято сравнивать с тем, что есть: "В отличие от аналогов, у нас тут нескучные обои". И сразу вопросов нет - пишите на здоровье. А то сравниваете с не совсем аналогом и заведомо не самым лучшим, оставляя вопросы "зачем?"

Кстати, всё, что вы описали в статье, в opencode либо есть, либо реализуется в пару строк на английском матерном в виде сохранённой команды.

Как раз вы сравниваете не совсем с аналогом.

AI-агент для программирования. Какое он отношение имеет к веб-интерфейсу для LLM?

Я же в материале речь веду об упрощённом аналоге aistudio.google.com, и привожу конкретный feature-list чем моя "студия" отличается от гугловской - отсутствие бекенда, автоматическое и ручное срезание токенов, поддержка ollama. Разделы "общее", раздел "фичи", раздел "чего мне не хватает".

Неужели название статьи не отражает её и ПО сути? я сделал нормальную субъективно альтернативу именно студии. Ни опенкоду, ни OUI, ни чему-то ещё.

Вы как будто читали по диагонали, причём очень выборочно - без названия, без ключевых разделов, и дочитываете по ходу дня постепенно. Лучше сразу полностью, и вот тогда критика уже получится очень мне полезная - и за неё буду как раз очень благодарен.

ChatBox существует – и отлично справляется с задачей "написать в чат и получить ответ". Автор же хотел отладчик API: structured output, Function Calling, grounding. Предлагать ChatBox вместо Google AI Studio – примерно как посоветовать Notepad вместо IDE: буквы те же, остального нет. Кто-то из перечисленного умеет ограничивать вывод Gemini JSON-схемой?

Сложно понять изначальную проблему. Сейчас они закрывают firebase studio в 27м, там полноценный редактор с промтом и возможностью комитить. А локально куча разных плагинов под VS Code от всех ИИшек. Ну и сами редакторы по типу Antigravity

Гугл всегда страдал продуктовым СДВГ - закрыть одно, открыть три похожих, проинвестировать в конкурентов (тот же Zed), выпустить Gemini Code CLI, Antigravity, а потом всё это закопать. Диверсификация рисков, туда-сюда) а сама студия для них - просто часть воронки и витрина, чтобы продавать апи и токены.

Аи студио привлекает только огромной халявой, и это же отбрасывает не бесконечно большое расстояние всех конкурентов. Никто не будет пользоваться никаким Cherry Studio если за джемини в нем придется платить полную цену, по доллару за каждый запрос с контекстом на 200т токенов например.

абсолютно верно) ещё добавим что большинство продуктов по типу Cherry Studio могут собирать телеметрию, сложно её тихонько не интегрировать в electron, имеют кучи свистоперделок которыми большинство в жизни никогда не воспользуется, сотни провайдеров когда буквально все включая гугл уже поддерживают формат openai, да и в целом я не вижу буквально никакого смысла ставить это себе в виде бинарника - зачем? Что из того что в них есть нельзя было реализовать в вебе...

что удобно - в лабе можно указать openai-compatible gemini эндпоинт, вставить бесплатный ключик полученный в студии, и всё будет прекрасно работать:

https://generativelanguage.googleapis.com/v1beta/openai

без слеша в конце обязательно.

То есть это натурально альтернатива гугловской студии. Только у меня ещё можно попросить ключики у друзей и тихонько балансировать между ними запросы вручную. Можно даже над этим поработать, и реализовать лёгкий балансировщик прям внутри lab - буду рад issue feature requests на гитхабе если такое кому актуально. Условно, вплоть до переноса и унификации под все провайдеры их вкладки usage к нам, чтоб к любому провайдеру нужно было зайти исключительно один раз для create new api key.

API Gemini это не совсем openai-интерфейс.

так такого никто и не говорил... но сам по себе гугл давным давно держит openai-compatible эндпоинт: https://generativelanguage.googleapis.com/v1beta/openai

Я имел ввиду исключительно это, возможно где-то вы меня не так поняли, либо я как-то витиевато выразился в статье.

Аналогичная статья на Хабре пылится в песочнице и ожидает модерации:)

Дайте ссылку / пришлите сам материал? Возможно, смогу дать полезные редакторские правки. Я и пишу достаточно долго, и перед песочницей очень подробно ознакомился с её механизмами. Если статья не чрезмерно сложная, не содержит явных проблем, чётко форматирована - песочница не становится преградой перед полноправным акком. Не думаю, что по правилам Хабра это большой секрет - меня аппрувнули где-то дня за 3-4, возможно ожидали выходных - в статье про песочницу есть информация об этом, что модератор может попридержать до выходных некоторые посты, т.к. чисто по их опыту на выходных они будут более релевантны. И как будто бы так оно и получилось по итогу.

на фронте можно было прикрутить assistant-ui

Можно, а зачем?)) чисто ради textarea и sendbutton стилизованных под всех?

слишком поверхностное предположение

  1. там больше компонентов

  2. маркдауны, графики сами собой же в HTML рендерятся, я вас понял

По маркдауну - пока с лихвой хватило react-markdown, react-gfm.

Хоть assistant-ui и выглядит красиво - множество лучших решений перетекут из него в более общие библиотеки компонентов рано или поздно, в тот же shadcn/tailwind. Да и тут прям особенного специфичного ничего реализовывать не пришлось, так что кардинальной разницы пока не вижу. В любом случае, посмотрим как дело пойдёт - внедрить никогда не поздно.

Гугл поднимает виртуалку для работы с файлами? Я вот не понял. Клод запускает код и прогоняет данные через него, а вот гемини я не понял

А я вот совсем не понял вопрос. Это просто лёгкий интерфейс, даже без бекенда - никаких виртуалок он не поднимает и не может. А что там клод в точке инференса делает - утверждать не возьмусь, но в любом случае очень сомневаюсь что кто-либо из провайдеров докидывает к инференсу execute бесплатно.

Кими поднимает виртуалку, клод поднимает виртуалку

Большой апдейт 🧪lab (v1.2.0) + Выкатил обещанный ToolHub!

Всем привет! За прошедшее время проект заметно вырос: переработана архитектура управления контекстом, добавлена работа с префиксными папками, мобильный PWA-режим и, главное, - выкатил обещанный тулхаб.

Релиз 🛠️toolhub (управление локальными скриптами и навыками агентов)

Как и обещал в статье, я довёл до ума и полностью открыл движок исполнения навыков toolhub, который работает в связке с 🧪lab. Теперь можно прямо из браузерного интерфейса давать моделям доступ к локальным скриптам (Bash, Bun, Python, Go) через древовидную файловую навигацию вместо сжигания контекста на килобайты JSON-схем.

👉 Подробный разбор архитектуры, бенчмарки и исходники расписал в новой статье: Хорош хардкодить кривые MCP: превращаем любой скрипт в инструмент LLM за 2 секунды

А что нового появилось в 🧪lab:

  1. Иерархические Radix-папки (Virtual Prefix Folders)

  2. Точечный контроль контекста и защита от вымывания правил:

    • Message Pinning: Закрепление якорных сообщений (системные правила, важные вводные) — закрепленные сообщения имеют иммунитет к автоочистке скользящего окна (Sliding Window).

    • Глубокая аналитика токенов: Раздельный подсчет User / Assistant / Tool + System, визуальные бейджи веса веток, детектор самых «тяжелых» сообщений и коэффициент расширения ответов (xN).

    • Хирургическая очистка: Оставить последние N сообщений, срезать верхушку или сжать весь код в диалоге до плейсхолдеров, сохранив текстовую нить рассуждений.

  3. PWA, автономность и мобайл:

    • Полноценная установка как standalone PWA-приложения (iOS, Android, macOS, Windows) с фоновым кэшированием статики.

    • Web Push: Системные уведомления по завершению тяжелых фоновых генераций.

  4. Голосовой движок (для любителей и побаловаться):

    • STT (Push-to-Talk): Быстрый голосовой ввод по горячей клавише с автодобавлением в поле ввода.

    • Streaming TTS: Потоковое воспроизведение ответов модели по предложениям с санитаризацией (фильтрация блоков кода, LaTeX и эмодзи) и контролем скорости.

  5. LaTeX Math & Export:

    • Нативный рендеринг inline/block математических формул.

    • Экспорт диалогов в чистый Markdown со всеми блоками кода и форматированием.

Все настройки, чаты и ключи по-прежнему хранятся исключительно локально в вашем браузере (IndexedDB via Dexie.js), без сторонних бэкендов.

Sign up to leave a comment.

Articles