Привет, Хабр!
Локальные модели обычно сравнивают по скорости и длине контекста. Мне хотелось проверить более приземлённый сценарий: сможет ли агент собрать и запустить первую линию технической поддержки, а не просто сгенерировать красивый README. Я дал Hermes Agentпустую директорию и подробную спецификацию. Qwen3.6-27B на инфраструктуре GPUGO сначала выступила кодовым агентом, а затем стала отвечать на безопасные обращения через отдельный профиль Hermes.
Получился работающий MVP: почта по IMAP/SMTP, ответы по базе знаний из документации GPUGO, правила риска, ручная модерация и экспорт одобренных ответов в JSONL. Я собирал его как экспериментальное создание основы, которую можно масштабировать для собственного сервиса до привлечения дорогого SaaS. В статье расскажу, какая архитектура для MVP оказалась достаточной, где проходит граница автоматизации и почему не стал начинать с полноценного helpdesk или файн-тюнинга.