Бесплатный Kimi-k3 в JetBrains: настройка Continue за 5 минут

от автора

Привет, Хабр! Расскажу, как подключить Kimi-k3-free в вашу JetBrains IDE через плагин Continue — и всё это абсолютно бесплатно. Никаких платежей, никаких пробных периодов. Пусть и с ограничениями, но все же.. халява, сэр.

Работает. А вот почему он себя считает Клодом - ответьте в комментарии :D

Работает. А вот почему он себя считает Клодом — ответьте в комментарии 😀

Kimi K3 — модель от Moonshot AI с:

  • 2.8 трлн параметров

  • 1 млн токенов контекста

  • Нативной поддержкой изображений

  • Бесплатным доступом через TokenRouter (пока еще)

Порядок установки следующий

1. Регистрируемся на TokenRouter

  1. Идём на tokenrouter.com

  2. Регистрируемся по почте (или Google)

  3. Создаём API-ключ (кнопка «Create API Key»)

  4. Копируем ключ вида sk-...

Где создается ключ

Где создается ключ
Выбор модели

Выбор модели

Скачиваем .Continue плагин поссылке https://plugins.jetbrains.com/plugin/22707-continue/versions

2. Устанавливаем Continue

В IDE: File → Settings → Plugins → ищем Continue → устанавливаем → перезапускаем.

Настройка плагина

Настройка плагина

3. Конфиг

Открываем конфиг Continue (шестерёнка в панели плагина) и вставляем:

{  "models": [    {      "name": "Kimi-k3-free",      "provider": "openai",      "model": "moonshotai/kimi-k3-free",      "apiKey": "ВАШ_КЛЮЧ_ОТ_TOKENROUTER",      "apiBase": "https://api.tokenrouter.com/v1",      "roles": ["chat", "edit", "apply"],      "contextLength": 1000000,      "defaultCompletionOptions": {        "temperature": 0.1,        "maxTokens": 655360      }    }  ],    "rules": [    "Всегда сначала ищи код в workspace",    "При рефакторинге сохраняй структуру проекта"  ]}

4. Всё!

Теперь в Continue доступна модель Kimi-k3-free. Можно писать код, рефакторить, генерировать тесты — с контекстом в 1 млн токенов.

Настраивал по мотивам этого видео, но переделал под себя:https://www.youtube.com/watch?v=mwPbdfTzD9Y

5. Мой личный конфиг. Подключение локальной модели, DeepSeek-V4 flash\pro, kimi-k3-free и кастомные скиллы.

Теперь в Continue доступна модель Kimi-k3-free. Можно писать код, рефакторить, генерировать тесты — с контекстом в 1 млн токенов.

name: Qwen Big Context Configversion: 1.0.0schema: v1models:  - name: qwen3-coder    provider: ollama    model: qwen3-coder-next:q4_K_M    apiBase: http://192.168.0.19:11434    roles:      - chat      - edit      - apply    defaultCompletionOptions:      contextLength: 262144      maxTokens: 8192      temperature: 0.2  - name: gemma4-Q-4-M    provider: ollama    model: gemma4:latest    apiBase: http://192.168.0.19:11434    roles:      - chat      - edit      - apply    defaultCompletionOptions:      contextLength: 80000      maxTokens: 8192      temperature: 0.2  - name: DeepSeek V4 FLASH    provider: anthropic    model: deepseek-v4-flash    apiKey: token_is_here    apiBase: https://api.deepseek.com/anthropic    roles:      - chat      - edit      - apply    contextLength: 1000000    defaultCompletionOptions:      temperature: 0.1      maxTokens: 65536    requestOptions:      timeout: 30000      verifySsl: true  - name: DeepSeek V4 PRO    provider: anthropic    model: deepseek-v4-pro    apiKey: token_is_here    apiBase: https://api.deepseek.com/anthropic    roles:      - chat      - edit      - apply    contextLength: 1000000    defaultCompletionOptions:      reasoning: false      temperature: 0.1      maxTokens: 655360    requestOptions:      timeout: 30000      verifySsl: true  - name: Kimi-k3-free    provider: openai    model: moonshotai/kimi-k3-free    apiKey: token_is_here    apiBase: https://api.tokenrouter.com/v1    roles:      - chat      - edit      - apply    contextLength: 1000000    defaultCompletionOptions:      reasoning: false      temperature: 0.1      maxTokens: 655360    requestOptions:      timeout: 30000      verifySsl: trueretrieval:  maxChunks: 40context:  - provider: code  - provider: file  - provider: diff  - provider: terminal  - provider: problems  - provider: open  - provider: search# Дополнительные правила (можно дописать свои)rules:  - Всегда сначала ищи код в workspace  - Используй несколько файлов для анализа  - При рефакторинге сохраняй структуру проекта  - Не придумывай код, если он не найден  - Всегда обращай внимание на то, что ты хочешь удалить или где применяешь rm  - Не вставляй промпты и рассуждения в начало файла при его редактировании или созданииprompts:  - name: analyze    description: "Глубокий анализ кода"    prompt: |      Проведи глубокий анализ следующего кода:      1. Архитектура и структура      2. Потенциальные проблемы и баги      3. Рекомендации по оптимизации      Используй Qwen Coder 79B для сложного анализа.      Код: {input}  - name: refactor    description: "Рефакторинг с сохранением логики"    prompt: |      Предложи рефакторинг кода с улучшением читаемости и производительности.      Сохрани всю бизнес-логику и API интерфейсы.      Используй DeepSeek V4 PRO для архитектурных решений.      Код: {input}  - name: document    description: "Генерация документации"    prompt: |      Создай полную документацию для кода:      - JSDoc/TSDoc комментарии      - README секции      - Примеры использования      Используй Gemma4 31B для структурированной документации.      Код: {input}  - name: test    description: "Генерация тестов"    prompt: |      Сгенерируй комплексные тесты для функций:      - Unit тесты (Jest/Vitest)      - Edge cases      - Mock внешних зависимостей      Используй DeepSeek V4 FLASH для быстрой генерации тестов.      Код: {input}  - name: explain    description: "Объяснение сложного кода"    prompt: |      Объясни этот код на простом языке:      1. Что делает код      2. Как работает логика      3. Потенциальные улучшения      Используй Gemma4 8B для быстрых объяснений.      Код: {input}  - name: grill-me    description: "🔥 Жесткий code review с допросом"    invokable: true    prompt: |      Ты - Безжалостный Архитектор Кода. Твоя задача - устроить допрос коду, как на собеседовании в FAANG.      ## РЕЖИМ GRILL ME 🔥      Проанализируй предоставленный код с максимальной строгостью. Ты должен:      1. **НАЙТИ ВСЕ БАГИ** 🐛         - Логические ошибки         - Потенциальные null/undefined         - Race conditions         - Memory leaks         - Проблемы с типами      2. **КРИТИКОВАТЬ АРХИТЕКТУРУ** 🏗️         - Нарушение SOLID         - Проблемы с耦合 (coupling)         - Избыточная сложность         - Анти-паттерны         - Почему это не пройдет код-ревью в Google      3. **ДОПРОС ПО КАЖДОЙ СТРОКЕ** 👮         - "Зачем ты это написал?"         - "Что будет, если input === null?"         - "Почему не использовал Map вместо Object?"         - "Где обработка ошибок?"         - "Это точно O(1) или ты врешь?"      4. **ПРЕДЛОЖИТЬ УЛУЧШЕНИЯ** 💡         - 3 способа сделать лучше         - Альтернативные подходы         - Оптимизация производительности         - Рефакторинг с объяснением "почему"      5. **ВЫСТАВИТЬ ОЦЕНКУ** 📊         - От 1 до 10 за качество кода         - От 1 до 10 за читаемость         - От 1 до 10 за производительность         - Краткое резюме: "Это шедевр" или "Перепиши все"      ## ПРАВИЛА:      - Будь максимально токсичным и прямолинейным (как на реальном код-ревью)      - Никакой вежливости, только факты и конструктивная критика      - Если код идеален - скажи это, но найди хотя бы 3 вещи для улучшения      - Используй смайлы и эмодзи для эмоциональной окраски      - Приводи конкретные примеры кода для исправлений      ## КОД ДЛЯ ДОПРОСА:    - name: grill-me-original    description: "Ревью проектировки"    invokable: true    prompt: |      Проведите со мной безжалостное интервью по каждому аспекту этого плана, пока мы не достигнем общего понимания. Пройдите по каждой ветке дерева решений в дизайне, последовательно разрешая зависимости между решениями.            Если на вопрос можно ответить, изучив кодобазу, — изучайте кодобазу вместо того, чтобы спрашивать меня.      Для каждого вопроса:            1) Сначала укажите рекомендуемый ответ.            2) Попросите моего подтверждения, прежде чем продолжать.            ## КОД ДЛЯ ДОПРОСА:

P.S. При любом чихе и изменении в Continue нужно делать рестарт IDE. Invalidate cache & restart. Не знаю почему, но жутко лагучее.

А, ну и модель сама по себе бесплатная… и с ограничениями) Пользуемся пока есть.

Вдохновение

Настраивал по мотивам этого видео, но переделал под себя:
https://www.youtube.com/watch?v=mwPbdfTzD9Y

ссылка на оригинал статьи https://habr.com/ru/articles/1066502/