Перейти к содержанию

Gemma-4-26B

В этой статье

Информация

Gemma-4-26B — это мультимодальная языковая модель нового поколения от Google, доступная для локального развертывания через Ollama. Архитектура Mixture of Experts (MoE) с 26 миллиардами параметров, из которых только ~3.8B активно используется на каждый токен, обеспечивает производительность на уровне 4B-модели при интеллекте, сопоставимом с крупными dense-моделями . Модель поддерживает 256K контекстное окно, режим мышления (Thinking Mode), нативный вызов функций и работу с изображениями. Развертывание на Ubuntu 22.04 с интеграцией Open Web UI гарантирует полный контроль над данными и удобный интерфейс взаимодействия.

Основные возможности Gemma-4-26B

  • Архитектура Mixture of Experts (MoE): модель содержит 25.2B активных параметров при 26B общих, активируя лишь ~3.8B параметров на каждый токен, что обеспечивает скорость работы плотной 4B-модели при интеллекте уровня 26B;
  • Мультимодальность: нативная поддержка обработки текстового и графического ввода с генерацией текстового вывода;
  • Огромное контекстное окно: поддержка до 256K токенов позволяет работать с длинными документами, большими кодовыми базами и сложными диалогами;
  • Режим мышления (Thinking Mode): настраиваемый режим рассуждения для решения сложных логических и аналитических задач;
  • Агентские возможности: нативная поддержка function calling и структурированного вывода для интеграции с внешними инструментами и API;
  • Гибкость развертывания: полная версия требует ~80GB VRAM, но Q4-квантизация позволяет запускать модель на 24GB GPU, а оптимизированные сборки — на 16GB VRAM;
  • Интеграция с Open Web UI: современный веб-интерфейс для взаимодействия через порт 8080 с полным контролем над данными и обработкой запросов;
  • Масштабируемость: поддержка многокарточных конфигураций и распределения нагрузки между несколькими GPU;
  • Безопасность и контроль: локальное развертывание обеспечивает конфиденциальность данных, настройки OLLAMA_HOST и OLLAMA_ORIGINS гарантируют сетевую безопасность;
  • Производительность: использование LLAMA_FLASH_ATTENTION и эффективной архитектуры MoE для ускорения обработки запросов;
  • Отказоустойчивость: встроенная система автоматического перезапуска контейнеров и сервисов для стабильной работы.

Особенности сборки

ID Имя ПО ОС VPS BM VGPU GPU Мин. ЦПУ (Ядер) Мин. ОЗУ (ГБ) Мин. HDD/SDD (ГБ) Свой домен Доступно

Информацию по особенностям развертывания данного ПО можно посмотреть по ссылке

Примечание

Если не указано иное, по умолчанию мы устанавливаем последнюю релиз версию программного обеспечения с сайта разработчика или репозиториев операционной системы.

Начало работы после развертывания Gemma-4-26B

После оплаты заказа на указанную при регистрации электронную почту придет уведомление о готовности сервера к работе. В нем будет указан IP-адрес VPS, а также логин и пароль для подключения к серверу и ссылка для доступа к панели OpenWebUI. Управление оборудованием клиенты нашей компании осуществляют в панели управления серверами и APIInvapi.

  • Данные для авторизации для доступа к операционной системе сервера (например по SSH) придут к вам в присланном e-mail.

  • Ссылка для доступа к панели управления Ollama c Open WebUI с веб-интерфейсом: в теге webpanel во вкладке Конфигурация >> Теги панели управления Invapi. Точная ссылка вида https://gemma<Server_ID_from_Invapi>.hostkey.in приходит в письме, отправляемом при сдаче сервера.

После перехода по ссылке из тега webpanel будет открыто окно авторизации Get started with Open WebUI, где вам необходимо создать имя, электронную почту и пароль администратора чат бота, а затем нажать на кнопку Create Admin Account:

Внимание

После регистрации первого пользователя, система автоматически присваивает ему роль администратора. Для обеспечения безопасности и контроля над процессом регистрации, все последующие заявки на регистрацию нужно одобрять в интерфейсе OpenWebUI из аккаунта администратора

Примечание

Подробное описание особенностей работы с панелью управления Ollama c Open WebUI можно найти в статье ИИ чат-бот на собственном сервере

Примечание

Для оптимальной работы рекомендуется использовать GPU с объемом видеопамяти больше минимального требования в 24 ГБ, что обеспечит запас для обработки больших контекстов и параллельных запросов. Подробная информация по основным настройкам Ollama и Open WebUI содержится в документации разработчиков Ollama и в документации разработчиков Open WebUI.

Заказ сервера с Gemma-4-26B с помощью API

Установка данного ПО с использованием API описана в данном руководстве.

question_mark
Я могу вам чем-то помочь?
question_mark
ИИ Помощник ×