Привет, Хабр! Расскажу, как подключить Kimi-k3-free в вашу JetBrains IDE через плагин Continue — и всё это абсолютно бесплатно. Никаких платежей, никаких пробных периодов. Пусть и с ограничениями, но все же.. халява, сэр.

Kimi K3 — модель от Moonshot AI с:
2.8 трлн параметров
1 млн токенов контекста
Нативной поддержкой изображений
Бесплатным доступом через TokenRouter (пока еще)
Порядок установки следующий
1. Регистрируемся на TokenRouter
Идём на tokenrouter.com
Регистрируемся по почте (или Google)
Создаём API-ключ (кнопка "Create API Key")
Копируем ключ вида
sk-...


Скачиваем .Continue плагин поссылке https://plugins.jetbrains.com/plugin/22707-continue/versions
2. Устанавливаем Continue
В IDE: File → Settings → Plugins → ищем Continue → устанавливаем → перезапускаем.

3. Конфиг
Открываем конфиг Continue (шестерёнка в панели плагина) и вставляем:
{ "models": [ { "name": "Kimi-k3-free", "provider": "openai", "model": "moonshotai/kimi-k3-free", "apiKey": "ВАШ_КЛЮЧ_ОТ_TOKENROUTER", "apiBase": "https://api.tokenrouter.com/v1", "roles": ["chat", "edit", "apply"], "contextLength": 1000000, "defaultCompletionOptions": { "temperature": 0.1, "maxTokens": 655360 } } ], "rules": [ "Всегда сначала ищи код в workspace", "При рефакторинге сохраняй структуру проекта" ] }

4. Всё!
Теперь в Continue доступна модель Kimi-k3-free. Можно писать код, рефакторить, генерировать тесты — с контекстом в 1 млн токенов.
Настраивал по мотивам этого видео, но переделал под себя:https://www.youtube.com/watch?v=mwPbdfTzD9Y
5. Мой личный конфиг. Подключение локальной модели, DeepSeek-V4 flash\pro, kimi-k3-free и кастомные скиллы.
Теперь в Continue доступна модель Kimi-k3-free. Можно писать код, рефакторить, генерировать тесты — с контекстом в 1 млн токенов.
name: Qwen Big Context Config version: 1.0.0 schema: v1 models: - name: qwen3-coder provider: ollama model: qwen3-coder-next:q4_K_M apiBase: http://192.168.0.19:11434 roles: - chat - edit - apply defaultCompletionOptions: contextLength: 262144 maxTokens: 8192 temperature: 0.2 - name: gemma4-Q-4-M provider: ollama model: gemma4:latest apiBase: http://192.168.0.19:11434 roles: - chat - edit - apply defaultCompletionOptions: contextLength: 80000 maxTokens: 8192 temperature: 0.2 - name: DeepSeek V4 FLASH provider: anthropic model: deepseek-v4-flash apiKey: token_is_here apiBase: https://api.deepseek.com/anthropic roles: - chat - edit - apply contextLength: 1000000 defaultCompletionOptions: temperature: 0.1 maxTokens: 65536 requestOptions: timeout: 30000 verifySsl: true - name: DeepSeek V4 PRO provider: anthropic model: deepseek-v4-pro apiKey: token_is_here apiBase: https://api.deepseek.com/anthropic roles: - chat - edit - apply contextLength: 1000000 defaultCompletionOptions: reasoning: false temperature: 0.1 maxTokens: 655360 requestOptions: timeout: 30000 verifySsl: true - name: Kimi-k3-free provider: openai model: moonshotai/kimi-k3-free apiKey: token_is_here apiBase: https://api.tokenrouter.com/v1 roles: - chat - edit - apply contextLength: 1000000 defaultCompletionOptions: reasoning: false temperature: 0.1 maxTokens: 655360 requestOptions: timeout: 30000 verifySsl: true retrieval: maxChunks: 40 context: - provider: code - provider: file - provider: diff - provider: terminal - provider: problems - provider: open - provider: search # Дополнительные правила (можно дописать свои) rules: - Всегда сначала ищи код в workspace - Используй несколько файлов для анализа - При рефакторинге сохраняй структуру проекта - Не придумывай код, если он не найден - Всегда обращай внимание на то, что ты хочешь удалить или где применяешь rm - Не вставляй промпты и рассуждения в начало файла при его редактировании или создании prompts: - name: analyze description: "Глубокий анализ кода" prompt: | Проведи глубокий анализ следующего кода: 1. Архитектура и структура 2. Потенциальные проблемы и баги 3. Рекомендации по оптимизации Используй Qwen Coder 79B для сложного анализа. Код: {input} - name: refactor description: "Рефакторинг с сохранением логики" prompt: | Предложи рефакторинг кода с улучшением читаемости и производительности. Сохрани всю бизнес-логику и API интерфейсы. Используй DeepSeek V4 PRO для архитектурных решений. Код: {input} - name: document description: "Генерация документации" prompt: | Создай полную документацию для кода: - JSDoc/TSDoc комментарии - README секции - Примеры использования Используй Gemma4 31B для структурированной документации. Код: {input} - name: test description: "Генерация тестов" prompt: | Сгенерируй комплексные тесты для функций: - Unit тесты (Jest/Vitest) - Edge cases - Mock внешних зависимостей Используй DeepSeek V4 FLASH для быстрой генерации тестов. Код: {input} - name: explain description: "Объяснение сложного кода" prompt: | Объясни этот код на простом языке: 1. Что делает код 2. Как работает логика 3. Потенциальные улучшения Используй Gemma4 8B для быстрых объяснений. Код: {input} - name: grill-me description: "🔥 Жесткий code review с допросом" invokable: true prompt: | Ты - Безжалостный Архитектор Кода. Твоя задача - устроить допрос коду, как на собеседовании в FAANG. ## РЕЖИМ GRILL ME 🔥 Проанализируй предоставленный код с максимальной строгостью. Ты должен: 1. **НАЙТИ ВСЕ БАГИ** 🐛 - Логические ошибки - Потенциальные null/undefined - Race conditions - Memory leaks - Проблемы с типами 2. **КРИТИКОВАТЬ АРХИТЕКТУРУ** 🏗️ - Нарушение SOLID - Проблемы с耦合 (coupling) - Избыточная сложность - Анти-паттерны - Почему это не пройдет код-ревью в Google 3. **ДОПРОС ПО КАЖДОЙ СТРОКЕ** 👮 - "Зачем ты это написал?" - "Что будет, если input === null?" - "Почему не использовал Map вместо Object?" - "Где обработка ошибок?" - "Это точно O(1) или ты врешь?" 4. **ПРЕДЛОЖИТЬ УЛУЧШЕНИЯ** 💡 - 3 способа сделать лучше - Альтернативные подходы - Оптимизация производительности - Рефакторинг с объяснением "почему" 5. **ВЫСТАВИТЬ ОЦЕНКУ** 📊 - От 1 до 10 за качество кода - От 1 до 10 за читаемость - От 1 до 10 за производительность - Краткое резюме: "Это шедевр" или "Перепиши все" ## ПРАВИЛА: - Будь максимально токсичным и прямолинейным (как на реальном код-ревью) - Никакой вежливости, только факты и конструктивная критика - Если код идеален - скажи это, но найди хотя бы 3 вещи для улучшения - Используй смайлы и эмодзи для эмоциональной окраски - Приводи конкретные примеры кода для исправлений ## КОД ДЛЯ ДОПРОСА: - name: grill-me-original description: "Ревью проектировки" invokable: true prompt: | Проведите со мной безжалостное интервью по каждому аспекту этого плана, пока мы не достигнем общего понимания. Пройдите по каждой ветке дерева решений в дизайне, последовательно разрешая зависимости между решениями. Если на вопрос можно ответить, изучив кодобазу, — изучайте кодобазу вместо того, чтобы спрашивать меня. Для каждого вопроса: 1) Сначала укажите рекомендуемый ответ. 2) Попросите моего подтверждения, прежде чем продолжать. ## КОД ДЛЯ ДОПРОСА:
P.S. При любом чихе и изменении в Continue нужно делать рестарт IDE. Invalidate cache & restart. Не знаю почему, но жутко лагучее.
А, ну и модель сама по себе бесплатная... и с ограничениями) Пользуемся пока есть.
Вдохновение
Настраивал по мотивам этого видео, но переделал под себя:
https://www.youtube.com/watch?v=mwPbdfTzD9Y
