Kimi K2.8 Preview: контекст на 1 млн токенов и уровни reasoning для разработчиков
GPT и Gemini спорят: старый ID может скрывать K2.7 вместо K2.8
11 сентября 2026 года в Kimi Code появилась предварительная версия Kimi K2.8 Preview. Идентификатор модели kimi-for-coding не изменился, поэтому перенастраивать запросы не нужно. Разработчикам обещают улучшенные навыки кодинга и агентной работы по сравнению с K2.7 Code. Контекст теперь достигает 1 048 576 токенов, и он доступен на всех уровнях подписки Kimi Code. Можно выбирать уровни рассуждений low, high или max, по умолчанию используется max. Модель принимает изображения и видео. K2.8 позиционируется для повседневной разработки, а K3 остаётся флагманским вариантом.
Kimi K2.8 Preview появилась в Kimi Code 11 сентября 2026 года. Это предварительное обновление от Moonshot, которое обслуживается под тем же идентификатором модели kimi-for-coding. Для тех, кто уже вызывал Kimi Code через этот идентификатор, переход не требует изменения конфигурации. По заявлению Moonshot, общая производительность приближается к K3, а способности к кодингу и агентной работе стали сильнее, чем у K2.7 Code. При этом в анонсе не опубликованы новые бенчмарки и нет независимого тестирования APIMaster, поэтому оценка близости к K3 остаётся утверждением производителя, а не результатом замера. Для практической работы важны три вещи: контекст, режимы рассуждения и маршрутизация. K2.8 Preview поддерживает контекст до 1 048 576 токенов. Это позволяет удерживать в одном окне больше исходных файлов, спецификаций, результатов тестов и истории обсуждения. Все уровни подписки Kimi Code получают доступ к окну на миллион токенов. В отличие от этого, в K3 доступ к миллиону токенов требует уровня Allegretto или выше, а обычный K3 открывается начиная с Moderato. По режимам рассуждений модель принимает low, high и max. По умолчанию для K2.8 Preview выбран max, тогда как у K3 по умолчанию high. Это удобно для баланса между скоростью и качеством: простые задачи можно отправлять в лёгком режиме, а сложную отладку или рефакторинг — в усиленном. Ввод может включать изображения и видео. Для K3 основная версия также принимает изображения и видео, а k3-256k работает только с изображениями. Стоит учитывать маршрутизацию внутри Kimi Code: если отключить рассуждение, запросы K2.8 и K3 обслуживаются K2.8 Preview без thinking. Это правило не нужно переносить на другие эндпоинты без проверки документации. Кроме того, kimi-for-coding-highspeed — это отдельная высокоскоростная ветка K2.7 Code HighSpeed, а не быстрая версия K2.8. Если вы подключаете Kimi Code через APIMaster, идентификатор модели нужно брать из текущего списка провайдера. Проверка каталога от 13 сентября 2026 года не показала явного K2.8 Preview: в нём были kimi-k3, kimi-k2.6 и kimi-k2.7-code. Поэтому перед выбором модели стоит проверить актуальный маркетплейс, потому что старый идентификатор сам по себе не гарантирует переход на K2.8. Для подключения можно импортировать registry.json с API-ключом APIMaster и выбрать доступную модель; оплата стороннего API идёт через APIMaster, а не через членство Kimi Code. На практике K2.8 Preview уместно пробовать на небольших изменениях и автодополнении, а затем сравнивать более сложные задачи в репозитории с K3. Основной вопрос для команды — не только производительность в абстрактном тесте, а стоимость завершённой задачи: решает ли модель проблему, проходят ли тесты и укладывается ли она в разумное время. Анонс предварительной версии сам по себе не определяет, какая модель лучше подойдёт вашей кодовой базе.