Gemma-4-31B¶
В этой статье
Информация
Gemma 4 31B — это крупнейшая и самая мощная модель в семействе Gemma 4, предназначенная для решения самых сложных задач. В отличие от MoE-версии, эта модель использует классическую Dense-архитектуру с 30.7 миллиардами параметров, что обеспечивает исключительную стабильность и глубину рассуждений. Развертывание осуществляется на базе Ubuntu 22.04 и требует существенных вычислительных ресурсов: для работы в полном объеме необходимо около 62 ГБ VRAM, однако при 4-битном квантовании модель успешно запускается на системах с 20 ГБ памяти. Интеграция с Open Web UI обеспечивает удобный интерфейс для взаимодействия с моделью при сохранении полного контроля над данными.
Основные возможности Gemma-4-31B¶
- Мощная Dense-архитектура: модель является лидером в категории плотных открытых моделей, предлагая высочайшее качество генерации и анализа;
- Нативная мультимодальность: архитектура поддерживает одновременную обработку текстового и графического ввода с выдачей текстового результата;
- Огромное контекстное окно: поддержка до 256K токенов позволяет загружать в память целые кодовые репозитории или длинные документы;
- Режим мышления (Thinking Mode): модель способна генерировать промежуточные шаги рассуждения перед формированием финального ответа;
- Агентские возможности: встроенная поддержка нативного вызова функций (function calling) упрощает создание автономных AI-агентов;
- Интеграция с Open Web UI: предоставляет современный веб-интерфейс для удобного взаимодействия с моделью через порт 8080, обеспечивая полный контроль над данными и обработкой запросов;
- Масштабируемость: поддержка многокарточных конфигураций и возможность распределения нагрузки между несколькими GPU для оптимальной производительности;
- Безопасность и контроль: полное локальное развертывание обеспечивает конфиденциальность данных, а настройки
OLLAMA_HOSTиOLLAMA_ORIGINSгарантируют сетевую безопасность; - Производительность: использование технологии
LLAMA_FLASH_ATTENTIONдля ускорения обработки запросов и оптимизации работы модели; - Отказоустойчивость: встроенная система автоматического перезапуска контейнеров и сервисов обеспечивает стабильную работу.
Особенности сборки¶
| ID | Имя ПО | ОС | VPS | BM | VGPU | GPU | Мин. ЦПУ (Ядер) | Мин. ОЗУ (ГБ) | Мин. HDD/SDD (ГБ) | Свой домен | Доступно |
|---|---|---|---|---|---|---|---|---|---|---|---|
Информацию по особенностям развертывания данного ПО можно посмотреть по ссылке
Примечание
Если не указано иное, по умолчанию мы устанавливаем последнюю релиз версию программного обеспечения с сайта разработчика или репозиториев операционной системы.
Начало работы после развертывания Gemma-4-31B¶
После оплаты заказа на указанную при регистрации электронную почту придет уведомление о готовности сервера к работе. В нем будет указан IP-адрес VPS, а также логин и пароль для подключения к серверу и ссылка для доступа к панели OpenWebUI. Управление оборудованием клиенты нашей компании осуществляют в панели управления серверами и API — Invapi.
-
Данные для авторизации для доступа к операционной системе сервера (например по SSH) придут к вам в присланном e-mail.
-
Ссылка для доступа к панели управления Ollama c Open WebUI с веб-интерфейсом: в теге webpanel во вкладке Конфигурация >> Теги панели управления Invapi. Точная ссылка вида
https://gemma<Server_ID_from_Invapi>.hostkey.inприходит в письме, отправляемом при сдаче сервера.
После перехода по ссылке из тега webpanel будет открыто окно авторизации Get started with Open WebUI, где вам необходимо создать имя, электронную почту и пароль администратора чат бота, а затем нажать на кнопку Create Admin Account:

Внимание
После регистрации первого пользователя, система автоматически присваивает ему роль администратора. Для обеспечения безопасности и контроля над процессом регистрации, все последующие заявки на регистрацию нужно одобрять в интерфейсе OpenWebUI из аккаунта администратора
Примечание
Подробное описание особенностей работы с панелью управления Ollama c Open WebUI можно найти в статье ИИ чат-бот на собственном сервере
Примечание
Для оптимальной работы рекомендуется использовать GPU с объемом видеопамяти больше минимального требования в 24 ГБ, что обеспечит запас для обработки больших контекстов и параллельных запросов. Подробная информация по основным настройкам Ollama и Open WebUI содержится в документации разработчиков Ollama и в документации разработчиков Open WebUI.
Заказ сервера с Gemma-4-31B с помощью API¶
Установка данного ПО с использованием API описана в данном руководстве.