North Mini Code 1.0 — это бесплатная LLM-модель для создания AI-агентов с 30B (3B активных) параметрами.
North Mini Code 1.0 предустановлена на серверах в Нидерландах, Финляндии, Германии, Исландии, США, Турции, Польше, Англии, Франции, Испании, Швейцарии и России.
Арендуйте виртуальный (VPS) или выделенный сервер с North Mini Code 1.0 — бесплатной LLM-моделью для создания AI-агентов. Выберите North Mini Code 1.0, сконфигурируйте сервер и приступите к работе уже через 15 минут.
North Mini Code 1.0 предоставляется только для арендованных серверов HOSTKEY. Для автоматической установкиNorth Mini Code 1.0 выберите это ПО во вкладке «Маркетплейс приложений» при заказе услуги.
Арендуйте надежный VPS в Европе, США и Турции.
Готовность: ≈15 минут.
Арендуйте выделенный сервер в Европе, США и Турции.
Готовность: ≈15 минут.
North Mini Code распространяется бесплатно согласно лицензии Apache 2.0. Вы можете загрузить веса модели, запустить ее локально, а также использовать в коммерческих или некоммерческих целях при условии соблюдения Политики допустимого использования Cohere Labs.
Мы гарантируем, что на сервере установлено безопасное оригинальное программное обеспечение.
Чтобы установить North Mini Code 1.0, нужно выбрать это приложение во время заказа сервера на сайте HOSTKEY. Наша система автоматического деплоя произведет установку программного обеспечения на ваш сервер.
Если у вас возникли вопросы или затруднения при использовании North Mini Code 1.0, внимательно изучите документацию на официальном сайте разработчика или обратитесь в службу поддержки Cohere Labs.
North Mini Code 1.0 — это большая языковая модель (LLM), оптимизированная для задач агентской разработки и написания кода. Несмотря на относительно малый размер, модель эффективно подходит для рабочих процессов, связанных с использованием и разработкой AI-агентов, таких как агентная инженерия на уровне репозитория, работа с окружением и т. п.
North Mini Code 1.0 — открытая модель Cohere Labs, опубликованная 9 июня 2026 года. В ней 30 млрд параметров, из которых на каждый токен работают около 3 млрд: разреженная смесь из 128 экспертов, где на токен активируются восемь. Модель сделана под одну задачу — писать код, работать с терминалом и вести автономные сценарии разработки. Контекст 256 тысяч токенов, вывод до 64 тысяч. Помещается в карту на 24 ГБ, то есть это самая скромная по требованиям модель для кода в маркетплейсе.
Это первая модель семейства North у канадской компании Cohere, выпущенная как исследовательский релиз с открытыми весами.
|
Параметр |
Значение |
|
Разработчик |
Cohere Labs |
|
Дата выхода |
9 июня 2026 |
|
Всего параметров |
около 30 млрд |
|
Активных на токен |
около 3 млрд |
|
Экспертов |
128, из них 8 активных |
|
Контекст |
256 тысяч токенов |
|
Максимальный вывод |
64 тысячи токенов |
|
Лицензия |
Apache 2.0 с политикой допустимого использования |
Внимание в модели устроено чередованием: три слоя с окном скользящего внимания на каждый слой полного глобального. Такая схема снижает расход памяти на длинном контексте, не теряя связей между удалёнными частями кода. Полное техническое описание разработчик выложил в карточке модели на Hugging Face.
Дообучение шло в два этапа: сначала обучение с учителем, затем обучение с подкреплением на проверяемых наградах — то есть на задачах, где результат можно автоматически проверить запуском. Отсюда и специализация.
По индексу качества кода независимого рейтинга Artificial Analysis модель набирает 33,4 балла и обходит открытые модели сопоставимого размера, включая Qwen3.5 на 35 млрд параметров и Gemma 4 на 26 млрд, а также ряд существенно более крупных. Оговорка по честности: сравнение проводилось с поколением Qwen3.5, а не с более свежим Qwen3.6.
Для универсальных задач — переписки, работы с документами, перевода — модель подходит хуже специализированных под это. Она узкая, и в этом её смысл.
Расчёт от 30 млрд параметров. Цифры относятся к весам, кеш внимания считается отдельно.
|
Разрядность |
Вес модели |
Нужно видеопамяти |
Карта |
|
16 бит |
около 60 ГБ |
от 70 ГБ |
две карты по 48 ГБ |
|
8 бит |
около 30 ГБ |
от 40 ГБ |
RTX A6000 48 ГБ |
|
4 бита |
около 19 ГБ |
от 25 ГБ |
RTX A5000 24 ГБ, RTX 5090 32 ГБ |
Разработчик выпустил официальный квантованный вариант, где до четырёх бит ужаты только эксперты, а слои внимания, плотный слой и маршрутизатор оставлены в большей разрядности. Веса при этом занимают порядка 18–20 ГБ, а качество на задачах с кодом почти не проседает. Это лучший вариант для старта: он даёт рабочую модель на карте среднего класса без самостоятельного подбора квантования.
Надёжный минимум — 24 ГБ видеопамяти. Полный контекст на 256 тысяч токенов добавляет к расходу ещё десятки гигабайт, поэтому под длинные сценарии берут карту на 48 ГБ либо ограничивают рабочую длину окна.
Модель рассчитана на работу внутри инструментов разработчика, а не в окне переписки. Она поднимается локально на сервере, и клиенты обращаются к ней по сети как к обычному интерфейсу программирования.
Три момента, которые стоит учесть при настройке:
Запустить модель проще всего через библиотеку Ollama: она же обеспечивает совместимый интерфейс для клиентских инструментов разработки.
Модель обучена с чередующимися рассуждениями и работает лучше всего, когда этот режим включён. Отключать его ради экономии токенов — типичная ошибка, которая заметно роняет качество на задачах с кодом.
Второй момент менее очевиден. Сгенерированные рассуждения нужно передавать дальше — в следующие шаги сценария и в следующие реплики диалога. Модель опирается на собственный ход мысли из предыдущих шагов, и если обрезать его при формировании запроса, она начинает разбираться в задаче заново на каждом шаге.
На практике это означает, что при интеграции нельзя просто отбрасывать служебную часть ответа. Проверьте, как ваш клиент собирает историю: многие по умолчанию оставляют только итоговый текст.
Веса опубликованы под Apache 2.0, которая разрешает коммерческое использование, изменение и распространение производных моделей. Но есть дополнение: разработчик требует соблюдать также собственную политику допустимого использования.
Это отличает North Mini Code от моделей с чистой Apache 2.0. Практического ограничения для обычной разработки здесь нет, но юридической службе документ показать стоит — особенно если у компании есть внутренние правила по лицензиям на программное обеспечение. Ситуация ровно та, из-за которой раньше тормозили внедрение открытых моделей: сама лицензия свободная, а рядом лежит отдельный документ с условиями.
|
Критерий |
North Mini Code 1.0 |
Qwen3.6 35B A3B |
|
Всего параметров |
около 30 млрд |
35 млрд |
|
Минимум видеопамяти |
24 ГБ |
24 ГБ |
|
Контекст |
256 тысяч |
262 тысячи, расширяется до 1 млн |
|
Специализация |
только код и терминал |
код плюс общие и мультимодальные задачи |
|
Ввод изображений |
нет |
есть |
|
Лицензия |
Apache 2.0 с политикой использования |
Apache 2.0 |
Если нужен один инструмент под разработку и ничего кроме — берите North Mini Code, он для этого и сделан. Если та же карта должна закрывать ещё и разбор документов, изображений или переписку, практичнее Qwen3.6 35B. Обе модели помещаются в одну карту на 24 ГБ, так что сравнить их на своих задачах можно на одном сервере.
Аренда начинается от 7500 руб. в месяц, доступна почасовая оплата — удобно, чтобы сравнить несколько моделей за один вечер и оставить подходящую. Подобрать конфигурацию можно в разделе серверов с видеокартами.