Привет, Хабр! Расскажу, как подключить Kimi-k3-free в вашу JetBrains IDE через плагин Continue — и всё это абсолютно бесплатно. Никаких платежей, никаких пробных периодов. Пусть и с ограничениями, но все же.. халява, сэр.

Работает. А вот почему он себя считает Клодом - ответьте в комментарии :D
Работает. А вот почему он себя считает Клодом - ответьте в комментарии :D

Kimi K3 — модель от Moonshot AI с:

  • 2.8 трлн параметров

  • 1 млн токенов контекста

  • Нативной поддержкой изображений

  • Бесплатным доступом через TokenRouter (пока еще)

Порядок установки следующий

1. Регистрируемся на TokenRouter

  1. Идём на tokenrouter.com

  2. Регистрируемся по почте (или Google)

  3. Создаём API-ключ (кнопка "Create API Key")

  4. Копируем ключ вида sk-...

Где создается ключ
Где создается ключ
Выбор модели
Выбор модели

Скачиваем .Continue плагин поссылке https://plugins.jetbrains.com/plugin/22707-continue/versions

2. Устанавливаем Continue

В IDE: File → Settings → Plugins → ищем Continue → устанавливаем → перезапускаем.

Настройка плагина
Настройка плагина

3. Конфиг

Открываем конфиг Continue (шестерёнка в панели плагина) и вставляем:

{
  "models": [
    {
      "name": "Kimi-k3-free",
      "provider": "openai",
      "model": "moonshotai/kimi-k3-free",
      "apiKey": "ВАШ_КЛЮЧ_ОТ_TOKENROUTER",
      "apiBase": "https://api.tokenrouter.com/v1",
      "roles": ["chat", "edit", "apply"],
      "contextLength": 1000000,
      "defaultCompletionOptions": {
        "temperature": 0.1,
        "maxTokens": 655360
      }
    }
  ],
  
  "rules": [
    "Всегда сначала ищи код в workspace",
    "При рефакторинге сохраняй структуру проекта"
  ]
}

4. Всё!

Теперь в Continue доступна модель Kimi-k3-free. Можно писать код, рефакторить, генерировать тесты — с контекстом в 1 млн токенов.

Настраивал по мотивам этого видео, но переделал под себя:https://www.youtube.com/watch?v=mwPbdfTzD9Y

5. Мой личный конфиг. Подключение локальной модели, DeepSeek-V4 flash\pro, kimi-k3-free и кастомные скиллы.

Теперь в Continue доступна модель Kimi-k3-free. Можно писать код, рефакторить, генерировать тесты — с контекстом в 1 млн токенов.

name: Qwen Big Context Config
version: 1.0.0
schema: v1

models:
  - name: qwen3-coder
    provider: ollama
    model: qwen3-coder-next:q4_K_M
    apiBase: http://192.168.0.19:11434
    roles:
      - chat
      - edit
      - apply
    defaultCompletionOptions:
      contextLength: 262144
      maxTokens: 8192
      temperature: 0.2

  - name: gemma4-Q-4-M
    provider: ollama
    model: gemma4:latest
    apiBase: http://192.168.0.19:11434
    roles:
      - chat
      - edit
      - apply
    defaultCompletionOptions:
      contextLength: 80000
      maxTokens: 8192
      temperature: 0.2

  - name: DeepSeek V4 FLASH
    provider: anthropic
    model: deepseek-v4-flash
    apiKey: token_is_here
    apiBase: https://api.deepseek.com/anthropic
    roles:
      - chat
      - edit
      - apply
    contextLength: 1000000
    defaultCompletionOptions:
      temperature: 0.1
      maxTokens: 65536
    requestOptions:
      timeout: 30000
      verifySsl: true


  - name: DeepSeek V4 PRO
    provider: anthropic
    model: deepseek-v4-pro
    apiKey: token_is_here
    apiBase: https://api.deepseek.com/anthropic
    roles:
      - chat
      - edit
      - apply
    contextLength: 1000000
    defaultCompletionOptions:
      reasoning: false
      temperature: 0.1
      maxTokens: 655360
    requestOptions:
      timeout: 30000
      verifySsl: true

  - name: Kimi-k3-free
    provider: openai
    model: moonshotai/kimi-k3-free
    apiKey: token_is_here
    apiBase: https://api.tokenrouter.com/v1
    roles:
      - chat
      - edit
      - apply
    contextLength: 1000000
    defaultCompletionOptions:
      reasoning: false
      temperature: 0.1
      maxTokens: 655360
    requestOptions:
      timeout: 30000
      verifySsl: true

retrieval:
  maxChunks: 40


context:
  - provider: code
  - provider: file
  - provider: diff
  - provider: terminal
  - provider: problems
  - provider: open
  - provider: search

# Дополнительные правила (можно дописать свои)
rules:
  - Всегда сначала ищи код в workspace
  - Используй несколько файлов для анализа
  - При рефакторинге сохраняй структуру проекта
  - Не придумывай код, если он не найден
  - Всегда обращай внимание на то, что ты хочешь удалить или где применяешь rm
  - Не вставляй промпты и рассуждения в начало файла при его редактировании или создании

prompts:
  - name: analyze
    description: "Глубокий анализ кода"
    prompt: |
      Проведи глубокий анализ следующего кода:
      1. Архитектура и структура
      2. Потенциальные проблемы и баги
      3. Рекомендации по оптимизации
      Используй Qwen Coder 79B для сложного анализа.
      Код: {input}

  - name: refactor
    description: "Рефакторинг с сохранением логики"
    prompt: |
      Предложи рефакторинг кода с улучшением читаемости и производительности.
      Сохрани всю бизнес-логику и API интерфейсы.
      Используй DeepSeek V4 PRO для архитектурных решений.
      Код: {input}

  - name: document
    description: "Генерация документации"
    prompt: |
      Создай полную документацию для кода:
      - JSDoc/TSDoc комментарии
      - README секции
      - Примеры использования
      Используй Gemma4 31B для структурированной документации.
      Код: {input}

  - name: test
    description: "Генерация тестов"
    prompt: |
      Сгенерируй комплексные тесты для функций:
      - Unit тесты (Jest/Vitest)
      - Edge cases
      - Mock внешних зависимостей
      Используй DeepSeek V4 FLASH для быстрой генерации тестов.
      Код: {input}

  - name: explain
    description: "Объяснение сложного кода"
    prompt: |
      Объясни этот код на простом языке:
      1. Что делает код
      2. Как работает логика
      3. Потенциальные улучшения
      Используй Gemma4 8B для быстрых объяснений.
      Код: {input}

  - name: grill-me
    description: "🔥 Жесткий code review с допросом"
    invokable: true
    prompt: |
      Ты - Безжалостный Архитектор Кода. Твоя задача - устроить допрос коду, как на собеседовании в FAANG.

      ## РЕЖИМ GRILL ME 🔥

      Проанализируй предоставленный код с максимальной строгостью. Ты должен:

      1. **НАЙТИ ВСЕ БАГИ** 🐛
         - Логические ошибки
         - Потенциальные null/undefined
         - Race conditions
         - Memory leaks
         - Проблемы с типами

      2. **КРИТИКОВАТЬ АРХИТЕКТУРУ** 🏗️
         - Нарушение SOLID
         - Проблемы с耦合 (coupling)
         - Избыточная сложность
         - Анти-паттерны
         - Почему это не пройдет код-ревью в Google

      3. **ДОПРОС ПО КАЖДОЙ СТРОКЕ** 👮
         - "Зачем ты это написал?"
         - "Что будет, если input === null?"
         - "Почему не использовал Map вместо Object?"
         - "Где обработка ошибок?"
         - "Это точно O(1) или ты врешь?"

      4. **ПРЕДЛОЖИТЬ УЛУЧШЕНИЯ** 💡
         - 3 способа сделать лучше
         - Альтернативные подходы
         - Оптимизация производительности
         - Рефакторинг с объяснением "почему"

      5. **ВЫСТАВИТЬ ОЦЕНКУ** 📊
         - От 1 до 10 за качество кода
         - От 1 до 10 за читаемость
         - От 1 до 10 за производительность
         - Краткое резюме: "Это шедевр" или "Перепиши все"

      ## ПРАВИЛА:
      - Будь максимально токсичным и прямолинейным (как на реальном код-ревью)
      - Никакой вежливости, только факты и конструктивная критика
      - Если код идеален - скажи это, но найди хотя бы 3 вещи для улучшения
      - Используй смайлы и эмодзи для эмоциональной окраски
      - Приводи конкретные примеры кода для исправлений

      ## КОД ДЛЯ ДОПРОСА:  

  - name: grill-me-original
    description: "Ревью проектировки"
    invokable: true
    prompt: |
      Проведите со мной безжалостное интервью по каждому аспекту этого плана, пока мы не достигнем общего понимания. Пройдите по каждой ветке дерева решений в дизайне, последовательно разрешая зависимости между решениями.
      
      Если на вопрос можно ответить, изучив кодобазу, — изучайте кодобазу вместо того, чтобы спрашивать меня.

      Для каждого вопроса:
      
      1) Сначала укажите рекомендуемый ответ.
      
      2) Попросите моего подтверждения, прежде чем продолжать.
      
      ## КОД ДЛЯ ДОПРОСА:

P.S. При любом чихе и изменении в Continue нужно делать рестарт IDE. Invalidate cache & restart. Не знаю почему, но жутко лагучее.

А, ну и модель сама по себе бесплатная... и с ограничениями) Пользуемся пока есть.

Вдохновение

Настраивал по мотивам этого видео, но переделал под себя:
https://www.youtube.com/watch?v=mwPbdfTzD9Y