Технологии искусственного интеллекта развиваются головокружительными темпами, и компания Google занимает одну из лидирующих позиций в формировании глобального ландшафта генеративных систем.
В рамках своей стратегии Google развивает два параллельных направления: флагманские закрытые мультимодальные модели семейства Gemini и открытое семейство легковесных моделей Gemma, созданных на базе тех же передовых исследований лабораторий Google DeepMind.
Выпуск второго поколения — Gemma 2 — стал важной вехой для сообщества открытого ИИ, предложив разработчикам и исследователям исключительную производительность, безопасность и энергоэффективность.
Что представляет собой семейство Gemma 2?
Gemma 2 — это семейство современных открытых языковых моделей от Google, спроектированных специально для гибкой локальной интеграции, академических исследований и коммерческой разработки.
В отличие от тяжелых серверных моделей, требующих кластеров из сотен графических процессоров, архитектура Gemma 2 оптимизирована для запуска на потребительских компьютерах, мобильных чипсетах и единичных облачных ускорителях: — Модели обучены на колоссальных датасетах объемом до нескольких триллионов токенов. — В архитектуре применены технологии sliding window attention и передовые методы дистилляции знаний (Knowledge Distillation), позволившие моделям меньшего размера демонстрировать интеллектуальные результаты на уровне моделей предыдущего поколения в разы большего веса.
Модельный ряд семейства Gemma 2
Google представила модели в ключевых весовых категориях и специализированные модули безопасности:
1. Gemma 2 9B и 27B
— Gemma 2 9B: Компактная модель, установившая новые мировые рекорды в своем классе параметров, опережая многие модели 13B и 70B на стандартных академических бенчмарках (MMLU, HumanEval).
— Gemma 2 27B: Полноразмерная модель, способная на одном GPU конкурировать по качеству рассуждений и написанию кода с вдвое более крупными открытыми нейросетями.
2. ShieldGemma
Специализированная защитная модель, обученная распознавать и фильтровать нежелательный контент, язык вражды, домогательства и токсичные запросы. Она служит защитным шлюзом (Guardrail) при создании публичных пользовательских сервисов.
3. Gemma Scope
Инновационный открытый исследовательский инструментарий, основанный на разреженных автоэнкодерах (Sparse Autoencoders), позволяющий исследователям буквально «заглянуть внутрь» нейросети и изучить, какие группы нейронов активируются при формировании тех или иных понятий.
Главные преимущества Gemma 2 для разработчиков
- Исключительное соотношение качества и размера: Модель 9B легко запускается на ноутбуках с 16 ГБ оперативной памяти или видеокартой RTX 3060/4060.
- Широкая доступность и открытая лицензия: Модели доступны для скачивания на платформах Kaggle и Hugging Face, оптимизированы для платформ Google Cloud Vertex AI, а также фреймворков llama.cpp, Ollama, vLLM, TensorRT-LLM и Hugging Face Transformers.
- Интеграция в Google AI Studio: Возможность бесплатного быстрого тестирования модели 27B через веб-интерфейс и API.
Gemma 2 стала наглядным свидетельством того, что будущее открытых инноваций Google открывает перед независимыми разработчиками широчайшие возможности для создания собственных интеллектуальных приложений.
This post is also available in: