Llama

Открытые языковые модели Meta для скачивания и локального запуска

llama.com ↗
 Публичный пост

Что это

Llama.com — витрина открытых моделей Meta: Llama 4 (Scout и Maverick) и более ранние версии линейки Llama 3. Модели построены на архитектуре mixture-of-experts, Scout нативно мультимодальный и заявлен с контекстным окном до 10 млн токенов, Maverick — с контекстом около 512 тыс. токенов и 128 экспертами. Веса моделей можно скачать бесплатно с сайта или Hugging Face и запускать на своём железе или в облаке. Лицензия — кастомная Llama Community License: коммерческое использование разрешено, но с ограничениями (порог 700 млн активных пользователей в месяц, запрет использовать выдачу модели для обучения конкурирующих моделей, обязательная атрибуция "Built with Llama"). Отдельный сервис Llama API от Meta (публичное превью) закрывается 6 июля 2026 года — Meta рекомендует переходить на сторонних провайдеров инференса.

Для участника клуба Llama интересна как бесплатная база для локальных и приватных сценариев: можно поднять модель на своём сервере или через провайдеров вроде Groq, Together AI, Fireworks, Deepinfra и получить контроль над данными без привязки к OpenAI или Anthropic. Это подходит для вайб-кодинга агентов и n8n-воркфлоу, где важна цена за токен (у сторонних провайдеров от $0.1 до $0.9 за 1M токенов) или офлайн-режим. Для контентных задач мультимодальность Scout/Maverick (текст + изображения) даёт альтернативу платным API при генерации описаний, обработке текста и простой автоматизации без раскрытия данных третьим лицам.

Возможности

  • Llama 4 Scout: 17B активных параметров (109B всего, 16 экспертов), контекст заявлен до 10 млн токенов
  • Llama 4 Maverick: 17B активных параметров (400B всего, 128 экспертов), контекст около 512 тыс. токенов
  • Нативная мультимодальность моделей семейства Llama 4 (текст и изображения на входе)
  • Веса моделей скачиваются бесплатно с llama.com и Hugging Face для локального запуска
  • Кастомная коммерческая лицензия Llama Community License с ограничением по 700 млн MAU
  • Доступ через сторонних инференс-провайдеров: Groq, Together AI, Fireworks, Deepinfra и другие
  • Собственный сервис Llama API от Meta закрывается 6 июля 2026 (публичное превью сворачивается)
  • Также доступны более ранние модели линейки Llama 3.x для менее требовательных задач

Цена: Веса моделей бесплатны для скачивания и локального запуска (при соблюдении лицензии). Официальный Llama API от Meta прекращает работу 6 июля 2026. Инференс через сторонних провайдеров платный: ориентировочно $0.1-0.9 за 1M токенов в зависимости от провайдера и модели

Разбираем в материалах Академии

Откомментируйте первым 👇

😎

Автор поста открыл его для большого интернета, но комментирование и движухи доступны только участникам Клуба

Что вообще здесь происходит?


Войти  или  Вступить в Клуб