Видеомонтаж на ключе Claude, локальная Qwen 3.6 и Grok 4.5  Публичный пост

30 июня 2026  128

Локальная модель кодит на уровне лучших систем середины 2025-го, влезает в 48 гигабайт памяти и работает без интернета. Бесплатно. И её у тебя уже никто не отнимет — ни санкции, ни смена тарифа. А облачные модели пока раздают токенов на тысячи долларов за стольник в месяц. Грех не воспользоваться скидкой, пока она есть.

Сегодня в выпуске: бесплатный видеоредактор, который режет и красит ролик прямо на твоём ключе Claude. Единая память для всех ИИ-инструментов разом. И честный разбор: почему чек за оперативку скоро неприятно удивит.

Главное за 30 секунд

  • Редактор Palmier Pro цепляется к твоему ключу Claude и по одному промпту сам режет видео, ставит субтитры и делает цветокоррекцию.
  • Локальная Qwen 3.6 27B кодит на уровне передовых моделей середины 2025-го, влезает в 48 ГБ и работает офлайн.
  • Open Memory Protocol даёт Claude, ChatGPT и Cursor общую память — не нужно пересказывать себя при каждой смене инструмента.
  • Grok 4.5 ушёл в закрытую бету: Маск обещает уровень Opus, модель учили на данных Cursor.
  • Память дорожает дальше: Корея вливает $1 трлн в чипы, а тройку производителей засудили за ценовой сговор.

Внедряем и улучшаем

Palmier Pro: бесплатный видеомонтаж прямо на твоём ключе Claude. Видеоредактор подключается к вашему аккаунту Anthropic и дальше работает сам: транскрибирует сырой материал, ставит субтитры, нарезает и делает цветокоррекцию. Платите только за токены Anthropic — отдельной подписки у редактора нет. Рецепт — от The Rundown (гайд The Rundown).

Шаг 1. Скачайте Palmier Pro и создайте API-ключ на console.anthropic.com/settings/keys. Шаг 2. В редакторе откройте Settings > Agent и вставьте ключ. Перетащите в проект 5-минутную запись экрана, говорящую голову или демо продукта. Шаг 3. Дайте агенту первый промпт:

Edit this down to about one minute. Keep the strongest moments,
remove dead air, and preserve the main point

По-русски: «Сократи до минуты, оставь самые сильные моменты, убери паузы и сохрани главную мысль». Шаг 4. После черновой нарезки отдельными просьбами добавьте субтитры, ритм и лёгкую цветокоррекцию. Просмотрите таймлайн и гоняйте этот цикл дальше.

Фишка для продвинутых. Palmier ставится как MCP-сервер для Claude Code или Codex. Тогда монтаж можно вынести из чата приложения в автоматический сценарий — например, нарезать пачку роликов одной командой.

Локальная Qwen 3.6 27B: кодит почти как передовые модели, и её не отключат. Пётр Мигдаль из Quesma называет 27B первой локальной моделью, которая всерьёз дотягивает до общего интеллекта (разбор Quesma). По бенчмарку Artificial Analysis 27B набирает 37 баллов — это уровень GPT-5 и Claude Sonnet 4.5 середины 2025 года. Многие держат дефолтом Gemma 4 31B, но и цифры, и опыт уверенно за Qwen 3.6 27B.

Обе версии модели влезают в 48 ГБ общей памяти Apple Silicon. На MacBook с M5 27B выдаёт 32 токена в секунду с MTP — это «предсказание сразу нескольких токенов», которое почти вдвое ускоряет вывод. По одному короткому промпту модель с первого раза собрала рабочий гексагональный сапёр и лендинг для свечной лавки. Автор честно признаёт: по меркам передовых моделей результат скромный, но это уже настоящая рабочая лошадка.

Запуск сервера через llama.cpp (автор советует именно его, а не Ollama):

llama-server -hf unsloth/Qwen3.6-27B-MTP-GGUF:Q8_0 \
    --spec-type draft-mtp -ngl 999 -fa on -c 65536 --port 8080

Подключение к кодинг-агенту OpenCode в ~/.config/opencode/opencode.jsonc:

{
  "$schema": "https://opencode.ai/config.json",
  "provider": {
    "llama": {
      "name": "llama.cpp (local)",
      "npm": "@ai-sdk/openai-compatible",
      "options": { "baseURL": "http://127.0.0.1:8080/v1", "apiKey": "local" },
      "models": { "qwen3.6-27b": { "name": "Qwen3.6-27B Q8 +MTP" } }
    }
  },
  "model": "llama/qwen3.6-27b"
}

Главный довод за локальную модель — её не отнимут. Цитата автора: «локально настроенную модель можно дообучить под себя, и её нельзя забрать». И добавляет про облако: остальные передовые модели работают с огромной субсидией, где сотня в месяц даёт токенов на тысячи, — пользуйтесь скидкой, пока она есть.

Локальная Qwen 3.6 27B запущена в кодинг-агенте OpenCode через llama.cpp
Локальная Qwen 3.6 27B запущена в кодинг-агенте OpenCode через llama.cpp

Единая память для Claude, ChatGPT и Cursor — Open Memory Protocol. Каждый инструмент помнит вас только внутри своих стен: Claude помнит вчерашний разговор, а Cursor — нет. Открытый протокол OMP решает это одним общим хранилищем памяти, к которому подключены все инструменты (репозиторий OMP). Лицензия Apache 2.0, проект ранний.

Поднять свой сервер — одна команда:

npx omp-server

Подключить Claude как MCP-сервер в claude_desktop_config.json:

{
  "mcpServers": {
    "omp": {
      "command": "npx",
      "args": ["omp-mcp"],
      "env": { "OMP_SERVER": "http://localhost:3456", "OMP_API_KEY": "your-omp-key" }
    }
  }
}

Чтобы Claude сохранял память сам, добавьте в системный промпт проекта простое правило: в начале каждого разговора звать omp_recall, а всё важное про вас молча сохранять через omp_remember. Есть и честная оговорка. Сервер живёт у вас — это и плюс к приватности, и забота: хостить придётся самим. Готовы пока только адаптеры для Claude и браузера, для Cursor и остального — голый REST. Для экспериментов хорошо, для продакшена рано.

«Красивый HTML-выбор»: проси не один вариант, а сразу шесть. Приём из редакции The Rundown (выпуск The Rundown). Чтобы ускорить дизайн-итерации, не просите один макет. Дословный промпт: «create a "beautiful HTML picker" of 5–6 different options». На выходе — меню из 5-6 вариантов на выбор, да ещё со стилями, до которых сам бы не додумался. Бонус-совет автора: оформите это переиспользуемым скиллом /ui-mockup и применяйте во всех проектах.

Кейс «документ → план → календарь». Сотрудница The Rundown загрузила в Claude 80-страничный отчёт об осмотре купленного дома. Попросила собрать список задач по обслуживанию, разбитый по таймлайну: что сделать в неделю сделки, а что сезонно. Затем по этому списку Claude создал разовые и ежегодные события в её Google Calendar и пригласил на каждое мужа. Готовый шаблон для любого длинного документа: сначала структурированный план, потом автоматом в календарь.

Микро-агент вместо одной дорогой модели. Команда vLLM Semantic Router показала приём: один вызов API под капотом превращается в «ограниченную совместную работу» нескольких моделей (блог vLLM). Снаружи вы дёргаете одно имя модели. Внутри роутер раскидывает запрос по нескольким моделям, собирает кворум и синтезирует ответ. Главная мысль авторов: «фраза „передовая модель“ теперь значит две вещи — это и контрольная точка модели, и граница системы».

Пять готовых рецептов. Confidence — сначала дешёвая модель, эскалация к дорогой только при низкой уверенности. Ratings — параллельные ответы с агрегацией по рейтингам. ReMoM — несколько попыток рассуждения и модель-синтезатор. Fusion — панель, судья и финалист: «несогласие превращается в улику, а не прячется». Workflows — роли «планировщик / правщик / проверяющий» под код. Экономия в том, что дорогую модель зовут только на сложных кусках. На бенчмарках связка обходит одиночные модели: LiveCodeBench 92.6, GPQA-Diamond 96.0. Это ровно та идея «обвязка важнее модели», о которой мы писали на неделе.

Бенчмарки vLLM Semantic Router против одиночных моделей: LiveCodeBench, GPQA-Diamond, Humanity's Last Exam
Бенчмарки vLLM Semantic Router против одиночных моделей: LiveCodeBench, GPQA-Diamond, Humanity's Last Exam

Что нового в Copilot Cowork и как не спалить бюджет. Cowork от Microsoft вышел в общий доступ, разбор сделал Shane Young (видео-разбор). Скиллы вынесли на первый план: переиспользуемые наборы инструкций теперь видно, их можно скачать и расшарить в один клик. Планировщик стал чище — говоришь «запускай это каждый понедельник в 8 утра», и задача уходит в отдельный список.

Важное про деньги. Cowork работает на кредитах: примерно 1 кредит равен 1 центу. Лёгкие задачи стоят 100-300 кредитов, тяжёлые — 700 и больше. Claude Sonnet 4.6 дешевле, чем Opus 4.8. Совет: сразу задайте месячный лимит кредитов на пользователя через ярусные политики. Иначе ночные задачи кого-то одного легко выльются в счёт на $500.

Урок от создателя htmx: будь чародеем, а не учеником. Карсон Гросс чинил баг в парсере вместе с Claude и на живом примере разобрал, где ИИ силён, а где слаб (эссе htmx). Причину регрессии Claude нашёл за минуты — гораздо быстрее самого автора. А вот с решением провалился трижды: первый фикс был хакерским, второй вводил лишнее состояние, третий ломал валидные случаи. Правильное решение Гросс написал сам, зная инфраструктуру парсера.

Вывод дословно: ИИ отлично ищет причину бага и пишет тесты, но слаб в решении, которое впишется в архитектуру. Без человека, который понимает систему, проект быстро набрал бы техдолг. Не будьте «учеником чародея», который слепо принимает первое предложение ИИ. Будьте чародеем: понимайте задачу сами, требуйте корректного решения и проверяйте его ИИ-сгенерированными тестами.

Инструменты и штуки

LongCat-2.0. Открытая MoE-модель от Meituan: 1,6 трлн параметров всего, ~48 млрд активных на токен, контекст 1 млн токенов (блог LongCat). Главное для нас — глубокая интеграция с Claude Code, OpenClaw и Hermes, все код-бенчмарки гоняли через Claude Code. На агентном кодинге держится на уровне GPT-5.5 и Gemini 3.1 Pro: Terminal-Bench 70.8, SWE-bench Pro 59.5. Веса открыты, есть GitHub, HuggingFace и веб-чат.

ClinePass. Открытый кодинг-агент, который автономно работает с редактором, терминалом и браузером — то есть ведёт разработку от начала до конца (сайт). Альтернатива закрытым агентам, код открыт.

PMB. Даёт кодинг-агентам постоянную память по проекту через MCP (сайт). Хранит решения, уроки и контекст локально в SQLite, без облака. Полезно тем, кто устал каждый раз заново вводить агента в курс дела.

Kodwai. Первая платформа, которая оценивает, насколько хорошо вы используете свой кодинг-агент — Claude Code, Cursor или Codex — на реальных задачах (сайт). По сути бенчмарк ваших навыков вайб-кодинга. Бесплатно попробовать.

Framer. Теперь позволяет собирать, обновлять и поддерживать весь сайт через чат с ИИ-агентом прямо на дизайн-холсте, без кода (сайт). Все правки остаются редактируемыми руками. Бесплатный старт.

Persona. Открытая JS-библиотека: встроить на любой сайт полностью стриминговый ИИ-чат за минуты (сайт). Поддерживает вызов инструментов, агентные циклы и свои темы. Для разработчиков, бесплатно.

MAI-Code-1-Flash. Собственная кодинг-модель Microsoft (страница). Вышла в общий доступ для отдельных пользователей. Ещё один знак, что крупные игроки уходят от чужих моделей к своим.

Lyto. Расширение Chrome, которое рулит браузером на обычном английском: открывает вкладки, заполняет формы, ищет по теме (сайт). Подключается к Gmail, Google Docs и Sheets, не выходя из браузера.

Revi. Диктовка текста в любое приложение на Mac, Windows и Linux (сайт). Распознавание идёт на устройстве: ни облака, ни аккаунта, ничего не покидает машину. Цена — $7,99 один раз и навсегда.

NotebookLM Collections. Google тестирует коллекции в NotebookLM (детали). Можно объединять несколько ноутбуков под одним заголовком — давняя боль тех, у кого библиотека разрослась.

Spira. Автономные агенты следят за трендовым контентом, пишут посты в вашем стиле и сами публикуют их в TikTok, Instagram и X (сайт). Для тех, кто ведёт соцсети продукта в одиночку.

Новости и тренды

Grok 4.5 ушёл в закрытую бету. Маск говорит, что новая модель xAI по ранним оценкам работает «на уровне или выше» флагманского Opus от Anthropic (пост Маска). Построена на фундаментальной модели 1.5T V9, в дообучение добавили данные кодинг-платформы Cursor. Пока её тестируют только внутри SpaceX и Tesla.

Что это значит: ещё один претендент в гонке, и ставка явно на код. Но цифр и доступа нет — только слова Маска и закрытая бета. К громким обещаниям относимся осторожно и ждём публичного релиза.

Apollo: GPT-5.6 учится «играть на камеру». Лаборатория Apollo Research проверила GPT-5.6 до релиза и нашла, что риск опасного «схематозного» поведения у неё выше, чем у прошлых моделей OpenAI (Apollo Research). Но есть нюанс: модель склонна к метагеймингу — угадывает, какое поведение ищут оценщики, и подстраивается под него.

Что это значит: оценивая модель, помните, что она может подыгрывать вашему тесту. Один прогон ничего не доказывает. Меняйте задачи, прячьте критерии, не верьте красивой цифре с одного эвала.

Оценка Apollo Research: GPT-5.6 показывает склонность к метагеймингу на части тестов
Оценка Apollo Research: GPT-5.6 показывает склонность к метагеймингу на части тестов

Память дорожает: Корея льёт $1 трлн, а производителей засудили. Южная Корея вложит около $1 трлн в чипы и ИИ — это «три мегапроекта» (Ars Technica). $585 млрд — на новые заводы Samsung и SK Hynix, чтобы за пять лет удвоить выпуск DRAM. $357 млрд — на дата-центры. И отдельная ставка на роботов: Boston Dynamics при Hyundai разгоняется до 30 000 роботов Atlas в год к 2028-му.

Параллельно Samsung, SK Hynix и Micron засудили за ценовой сговор — 14 покупателей и 3 малых бизнеса (Seoul Economic Daily). По иску, цены на DRAM выросли примерно на 700% за четыре года. Что это значит: мы уже писали о дорожающей памяти — теперь ясно, что дешевле в ближайшее время не станет. Заводы строятся годами, ИИ продолжает скупать память, а к дефициту добавилось обвинение в сговоре. Удорожание Mac, ноутбуков и SSD — это и есть ИИ-бум, дошедший до вашего кошелька.

Робот Atlas от Boston Dynamics на испытаниях — часть «робо»-ставки Кореи
Робот Atlas от Boston Dynamics на испытаниях — часть «робо»-ставки Кореи

Наделла: строй свою модель, а не арендуй. Глава Microsoft заявил, что компаниям стоит строить собственные ИИ-модели, а не полагаться на горстку поставщиков (Business Insider). Отдать своё институциональное обучение ChatGPT или Claude — значит отдать конкурентное преимущество.

Что это значит: это та же логика, что и за локальной Qwen или открытой LongCat выше. Своя или локальная модель держит ваши данные и ваш ров при себе. Полная зависимость от чужого облака — удобно, но однажды дорого.

«Лопаем пузырь GPU»: ИИ дешевеет от софта, а не только от железа. Заголовок — каламбур: речь не про финансовый пузырь, а про технический (Moondream). Видеокарта часто простаивает, ожидая, пока процессор подготовит следующий шаг. Команда Moondream убрала этот простой и подняла пропускную способность до 35% на той же самой модели.

Что это значит: ИИ ускоряется и дешевеет не только от новых чипов, но и от того, как софт упаковывает работу. И выигрыш тем больше, чем меньше и быстрее модель. Хорошая новость для всех, кто ставит на дешёвые и локальные модели.

Коротко:

  • Anthropic Economic Index за июнь: дорогие профессии жгут до 2,5× больше токенов (отчёт). Стоимость ИИ всё точнее повторяет ценность задачи.
  • США расширили запрет на китайскую технику — Huawei, ZTE, Hikvision, Dahua, Hytera (American Bazaar). Касается только нового импорта, демонтаж не требуют.
  • TrendForce: китайские чипы возьмут ~80% внутреннего рынка КНР в этом году, Nvidia удержит ~64% в мире (Silicon).
  • Австрия зовёт Anthropic в ЕС после запретов США (Reuters). Европа метит в роль «ИИ-убежища».
  • Сон против орбитальных дата-центров Маска: глава SoftBank считает, что ракеты и задержки связи перевесят экономию на солнечной энергии (Fortune).
  • Fable 5 может вернуться на неделе: как мы отмечали, шансы оценивали в ~60% к 1 июля; ждут финальных одобрений (Axios).
Откомментируйте первым 👇

😎

Автор поста открыл его для большого интернета, но комментирование и движухи доступны только участникам Клуба

Что вообще здесь происходит?


Войти  или  Вступить в Клуб