Привет, Хабр! Расскажу, как подключить Kimi-k3-free в вашу JetBrains IDE через плагин Continue — и всё это абсолютно бесплатно. Никаких платежей, никаких пробных периодов. Пусть и с ограничениями, но все же.. халява, сэр.

Работает. А вот почему он себя считает Клодом - ответьте в комментарии :D
Работает. А вот почему он себя считает Клодом - ответьте в комментарии :D

Kimi K3 — модель от Moonshot AI с:

  • 2.8 трлн параметров

  • 1 млн токенов контекста

  • Нативной поддержкой изображений

  • Бесплатным доступом через TokenRouter (пока еще)

Порядок установки следующий

1. Регистрируемся на TokenRouter

  1. Идём на tokenrouter.com

  2. Регистрируемся по почте (или Google)

  3. Создаём API-ключ (кнопка "Create API Key")

  4. Копируем ключ вида sk-...

Где создается ключ
Где создается ключ
Выбор модели
Выбор модели

Скачиваем .Continue плагин поссылке https://plugins.jetbrains.com/plugin/22707-continue/versions

2. Устанавливаем Continue

В IDE: File → Settings → Plugins → ищем Continue → устанавливаем → перезапускаем.

Настройка плагина
Настройка плагина

3. Конфиг

Открываем конфиг Continue (шестерёнка в панели плагина) и вставляем:

{
  "models": [
    {
      "name": "Kimi-k3-free",
      "provider": "openai",
      "model": "moonshotai/kimi-k3-free",
      "apiKey": "ВАШ_КЛЮЧ_ОТ_TOKENROUTER",
      "apiBase": "https://api.tokenrouter.com/v1",
      "roles": ["chat", "edit", "apply"],
      "contextLength": 1000000,
      "defaultCompletionOptions": {
        "temperature": 0.1,
        "maxTokens": 655360
      }
    }
  ],
  
  "rules": [
    "Всегда сначала ищи код в workspace",
    "При рефакторинге сохраняй структуру проекта"
  ]
}

4. Всё!

Теперь в Continue доступна модель Kimi-k3-free. Можно писать код, рефакторить, генерировать тесты — с контекстом в 1 млн токенов.

Настраивал по мотивам этого видео, но переделал под себя:https://www.youtube.com/watch?v=mwPbdfTzD9Y

5. Мой личный конфиг. Подключение локальной модели, DeepSeek-V4 flash\pro, kimi-k3-free и кастомные скиллы.

Теперь в Continue доступна модель Kimi-k3-free. Можно писать код, рефакторить, генерировать тесты — с контекстом в 1 млн токенов.

name: Qwen Big Context Config
version: 1.0.0
schema: v1

models:
  - name: qwen3-coder
    provider: ollama
    model: qwen3-coder-next:q4_K_M
    apiBase: http://192.168.0.19:11434
    roles:
      - chat
      - edit
      - apply
    defaultCompletionOptions:
      contextLength: 262144
      maxTokens: 8192
      temperature: 0.2

  - name: gemma4-Q-4-M
    provider: ollama
    model: gemma4:latest
    apiBase: http://192.168.0.19:11434
    roles:
      - chat
      - edit
      - apply
    defaultCompletionOptions:
      contextLength: 80000
      maxTokens: 8192
      temperature: 0.2

  - name: DeepSeek V4 FLASH
    provider: anthropic
    model: deepseek-v4-flash
    apiKey: token_is_here
    apiBase: https://api.deepseek.com/anthropic
    roles:
      - chat
      - edit
      - apply
    contextLength: 1000000
    defaultCompletionOptions:
      temperature: 0.1
      maxTokens: 65536
    requestOptions:
      timeout: 30000
      verifySsl: true


  - name: DeepSeek V4 PRO
    provider: anthropic
    model: deepseek-v4-pro
    apiKey: token_is_here
    apiBase: https://api.deepseek.com/anthropic
    roles:
      - chat
      - edit
      - apply
    contextLength: 1000000
    defaultCompletionOptions:
      reasoning: false
      temperature: 0.1
      maxTokens: 655360
    requestOptions:
      timeout: 30000
      verifySsl: true

  - name: Kimi-k3-free
    provider: openai
    model: moonshotai/kimi-k3-free
    apiKey: token_is_here
    apiBase: https://api.tokenrouter.com/v1
    roles:
      - chat
      - edit
      - apply
    contextLength: 1000000
    defaultCompletionOptions:
      reasoning: false
      temperature: 0.1
      maxTokens: 655360
    requestOptions:
      timeout: 30000
      verifySsl: true

retrieval:
  maxChunks: 40


context:
  - provider: code
  - provider: file
  - provider: diff
  - provider: terminal
  - provider: problems
  - provider: open
  - provider: search

# Дополнительные правила (можно дописать свои)
rules:
  - Всегда сначала ищи код в workspace
  - Используй несколько файлов для анализа
  - При рефакторинге сохраняй структуру проекта
  - Не придумывай код, если он не найден
  - Всегда обращай внимание на то, что ты хочешь удалить или где применяешь rm
  - Не вставляй промпты и рассуждения в начало файла при его редактировании или создании

prompts:
  - name: analyze
    description: "Глубокий анализ кода"
    prompt: |
      Проведи глубокий анализ следующего кода:
      1. Архитектура и структура
      2. Потенциальные проблемы и баги
      3. Рекомендации по оптимизации
      Используй Qwen Coder 79B для сложного анализа.
      Код: {input}

  - name: refactor
    description: "Рефакторинг с сохранением логики"
    prompt: |
      Предложи рефакторинг кода с улучшением читаемости и производительности.
      Сохрани всю бизнес-логику и API интерфейсы.
      Используй DeepSeek V4 PRO для архитектурных решений.
      Код: {input}

  - name: document
    description: "Генерация документации"
    prompt: |
      Создай полную документацию для кода:
      - JSDoc/TSDoc комментарии
      - README секции
      - Примеры использования
      Используй Gemma4 31B для структурированной документации.
      Код: {input}

  - name: test
    description: "Генерация тестов"
    prompt: |
      Сгенерируй комплексные тесты для функций:
      - Unit тесты (Jest/Vitest)
      - Edge cases
      - Mock внешних зависимостей
      Используй DeepSeek V4 FLASH для быстрой генерации тестов.
      Код: {input}

  - name: explain
    description: "Объяснение сложного кода"
    prompt: |
      Объясни этот код на простом языке:
      1. Что делает код
      2. Как работает логика
      3. Потенциальные улучшения
      Используй Gemma4 8B для быстрых объяснений.
      Код: {input}

  - name: grill-me
    description: "? Жесткий code review с допросом"
    invokable: true
    prompt: |
      Ты - Безжалостный Архитектор Кода. Твоя задача - устроить допрос коду, как на собеседовании в FAANG.

      ## РЕЖИМ GRILL ME ?

      Проанализируй предоставленный код с максимальной строгостью. Ты должен:

      1. **НАЙТИ ВСЕ БАГИ** ?
         - Логические ошибки
         - Потенциальные null/undefined
         - Race conditions
         - Memory leaks
         - Проблемы с типами

      2. **КРИТИКОВАТЬ АРХИТЕКТУРУ** ?️
         - Нарушение SOLID
         - Проблемы с耦合 (coupling)
         - Избыточная сложность
         - Анти-паттерны
         - Почему это не пройдет код-ревью в Google

      3. **ДОПРОС ПО КАЖДОЙ СТРОКЕ** ?
         - "Зачем ты это написал?"
         - "Что будет, если input === null?"
         - "Почему не использовал Map вместо Object?"
         - "Где обработка ошибок?"
         - "Это точно O(1) или ты врешь?"

      4. **ПРЕДЛОЖИТЬ УЛУЧШЕНИЯ** ?
         - 3 способа сделать лучше
         - Альтернативные подходы
         - Оптимизация производительности
         - Рефакторинг с объяснением "почему"

      5. **ВЫСТАВИТЬ ОЦЕНКУ** ?
         - От 1 до 10 за качество кода
         - От 1 до 10 за читаемость
         - От 1 до 10 за производительность
         - Краткое резюме: "Это шедевр" или "Перепиши все"

      ## ПРАВИЛА:
      - Будь максимально токсичным и прямолинейным (как на реальном код-ревью)
      - Никакой вежливости, только факты и конструктивная критика
      - Если код идеален - скажи это, но найди хотя бы 3 вещи для улучшения
      - Используй смайлы и эмодзи для эмоциональной окраски
      - Приводи конкретные примеры кода для исправлений

      ## КОД ДЛЯ ДОПРОСА:  

  - name: grill-me-original
    description: "Ревью проектировки"
    invokable: true
    prompt: |
      Проведите со мной безжалостное интервью по каждому аспекту этого плана, пока мы не достигнем общего понимания. Пройдите по каждой ветке дерева решений в дизайне, последовательно разрешая зависимости между решениями.
      
      Если на вопрос можно ответить, изучив кодобазу, — изучайте кодобазу вместо того, чтобы спрашивать меня.

      Для каждого вопроса:
      
      1) Сначала укажите рекомендуемый ответ.
      
      2) Попросите моего подтверждения, прежде чем продолжать.
      
      ## КОД ДЛЯ ДОПРОСА:

P.S. При любом чихе и изменении в Continue нужно делать рестарт IDE. Invalidate cache & restart. Не знаю почему, но жутко лагучее.

А, ну и модель сама по себе бесплатная... и с ограничениями) Пользуемся пока есть.

Вдохновение

Настраивал по мотивам этого видео, но переделал под себя:
https://www.youtube.com/watch?v=mwPbdfTzD9Y

Комментарии (14)


  1. Savandos
    04.08.2026 11:59

    беспаттно 1000 токенов?))
    ты под чем?


    1. killersssurprise Автор
      04.08.2026 11:59

      Откуда взята цифра 1000?

      Free compute capacity is limited. ENDS AUG 12. Service stability and concurrency are not guaranteed - это все, что сказано об ограничениях.


  1. Bardakan
    04.08.2026 11:59

    она у вас работает? Попробовал подключиться через opencode - даже на "привет" не реагирует


    1. pewpew
      04.08.2026 11:59

      я подключил к курсору - работает


    1. killersssurprise Автор
      04.08.2026 11:59

      Да, но очень плохо. Думать может по 40-50 секунд на вопрос элементарный. Токены выдаются медленно.


    1. Barnaby
      04.08.2026 11:59

      Раз через два отвечает, ну и 5-8 TPS это не серьезно.


    1. criminalist
      04.08.2026 11:59

      Пропиши правильно модель с перфиксом, а не просто название модели, у меня все работает


  1. Khronic1979
    04.08.2026 11:59

    Это сделали чтоб хайпануть и в новости попасть.


  1. stuxnetix
    04.08.2026 11:59

    Серьезные модели через API бесплатно , это прям редкость .. обычно пару раз работает и все .. на следующий день уже Forbidden или прочие ошибки.


    1. criminalist
      04.08.2026 11:59

      Не так давно закончился бесплатно mimo code, очень интересная моделька, с большими задачами мне нравилась как справлялась 1 млн контекста, на пол дня хватало, и в целом 80% задач решала с первого раз криво косо но решала. Вот платная подписка не знаю на сколько хорошо, в общем больше месяца ежедневно пользовался.


  1. Oeaoo
    04.08.2026 11:59

    Эх, помню были времена.. Открываешь, хош gemini-cli, хош qwen-code, хош шо хош.. и все бесплатно!


  1. ojaghjkh
    04.08.2026 11:59

    я
    я

    пытался подключить но у меня выдало ошибку


    1. killersssurprise Автор
      04.08.2026 11:59

      Почитай внимательно на код ошибки) Инструмент на три буквы в помощь


      1. ojaghjkh
        04.08.2026 11:59

        не понел