Что это
Llama.com — витрина открытых моделей Meta: Llama 4 (Scout и Maverick) и более ранние версии линейки Llama 3. Модели построены на архитектуре mixture-of-experts, Scout нативно мультимодальный и заявлен с контекстным окном до 10 млн токенов, Maverick — с контекстом около 512 тыс. токенов и 128 экспертами. Веса моделей можно скачать бесплатно с сайта или Hugging Face и запускать на своём железе или в облаке. Лицензия — кастомная Llama Community License: коммерческое использование разрешено, но с ограничениями (порог 700 млн активных пользователей в месяц, запрет использовать выдачу модели для обучения конкурирующих моделей, обязательная атрибуция "Built with Llama"). Отдельный сервис Llama API от Meta (публичное превью) закрывается 6 июля 2026 года — Meta рекомендует переходить на сторонних провайдеров инференса.
Для участника клуба Llama интересна как бесплатная база для локальных и приватных сценариев: можно поднять модель на своём сервере или через провайдеров вроде Groq, Together AI, Fireworks, Deepinfra и получить контроль над данными без привязки к OpenAI или Anthropic. Это подходит для вайб-кодинга агентов и n8n-воркфлоу, где важна цена за токен (у сторонних провайдеров от $0.1 до $0.9 за 1M токенов) или офлайн-режим. Для контентных задач мультимодальность Scout/Maverick (текст + изображения) даёт альтернативу платным API при генерации описаний, обработке текста и простой автоматизации без раскрытия данных третьим лицам.
Возможности
- Llama 4 Scout: 17B активных параметров (109B всего, 16 экспертов), контекст заявлен до 10 млн токенов
- Llama 4 Maverick: 17B активных параметров (400B всего, 128 экспертов), контекст около 512 тыс. токенов
- Нативная мультимодальность моделей семейства Llama 4 (текст и изображения на входе)
- Веса моделей скачиваются бесплатно с llama.com и Hugging Face для локального запуска
- Кастомная коммерческая лицензия Llama Community License с ограничением по 700 млн MAU
- Доступ через сторонних инференс-провайдеров: Groq, Together AI, Fireworks, Deepinfra и другие
- Собственный сервис Llama API от Meta закрывается 6 июля 2026 (публичное превью сворачивается)
- Также доступны более ранние модели линейки Llama 3.x для менее требовательных задач
Цена: Веса моделей бесплатны для скачивания и локального запуска (при соблюдении лицензии). Официальный Llama API от Meta прекращает работу 6 июля 2026. Инференс через сторонних провайдеров платный: ориентировочно $0.1-0.9 за 1M токенов в зависимости от провайдера и модели