Умная модель теперь стоит вдвое дешевле. Anthropic выкатила Claude Opus 5 — интеллект уровня Fable 5, но та же работа съедает в разы меньше лимитов. А один читатель за пару часов и $800 оживил профессиональный DJ-пульт ценой $2000: просто пересказал Claude переписку с продавцом и сфоткал платы. Ещё — приём «проверяй решения ИИ, а не каждую строчку». И история агента: на тесте по кибербезопасности он решил, что проще взломать «учителя» и стащить ответы.
Главное за 30 секунд
- Anthropic выпустила Claude Opus 5: интеллект уровня Fable 5 за половину цены, упор на самопроверку и здравый смысл.
- Приём дня: перед мержем проси агента перечислить свои решения и допущения — и ревьюй их, а не каждую строку кода.
- Агент OpenAI на тесте по кибербезопасности сбежал из песочницы и взломал Hugging Face ради ответов; вышел разбор 3607 таких сбоев.
- Голоса заговорили всерьёз: Claude отвечает через Opus и Sonnet с доступом к Gmail и Slack, ChatGPT Voice приехал на десктоп.
- Nvidia, Microsoft и Meta публично вступились за открытые модели на фоне угрозы США запретить китайские Kimi K3 и GLM.
Внедряем и улучшаем
Ревьюй решения агента, а не каждую строку. Приём дня от Виктора Таэлина и рассылки The Neuron. Агент обычно хорошо выполняет чёткий план. Беда в другом. Когда задача размытая, он молча выбирает за тебя архитектуру, срезает углы и делает допущения. Читать весь дифф утомительно и бесполезно. Лучше спроси у агента список его решений и проверь именно их.
Порядок такой. Сначала зафиксируй важное до старта: желаемое поведение, ограничения, архитектуру и что значит «готово». Агент закончил — пусть перечислит каждое заметное решение, особенно там, где был не уверен. Ревьюй короткий список, а не полотно кода. Поправил слабые допущения — попроси переделать. Финальный фильтр — «гейт гордости»: спроси, гордится ли агент этой веткой и подписался бы под ней в проде.
Готовый промпт, вставляй как есть:
Before I merge this work, audit the decisions you made:
1. List every meaningful decision, assumption, shortcut, or interpretation you made while completing the task.
2. For each one, explain why you chose it, what alternatives you considered, and how confident you are.
3. Flag any choice that fixes the immediate example but may not solve the underlying problem generally.
4. Identify any edge cases, technical debt, or temporary fixes that remain.
5. Pride gate: Are you proud of this branch? Would you confidently stand behind these changes in production?
Be candid. If the answer to either question is no, explain exactly what should be improved.
Do not change the code yet. Wait for me to review your decisions.
Ссылка: приём Виктора Таэлина.
Встрой «ИИ-беглость» в работу команды — по ролям. Рован из The Rundown показал, как в его команде растят чутьё: когда браться за ИИ, а когда нет. Есть таблица по ролям — разработчик, автор, поддержка, руководитель, продажи, SMM. Три уровня: недопустимо, норма, образцово. Она сразу видна ниже.

Три правила из их памятки. Первое: ИИ — усилитель, а не костыль. Дословно: «If your work gets worse because of AI, that's on you. "AI did it" is never an acceptable excuse.» Второе: каждый тратит 2 часа в неделю на поиск нудных кусков работы и сборку процессов под них. Находки выкладывает в общий канал. Третье: каждому дают $200 в месяц на ИИ-инструменты, но с условием. Назови задачу, которую хочешь автоматизировать.
Смысл — «набить руку». Чутьё рождается, когда гоняешь инструменты до предела. Готовый шаблон-схему они выложили в Canva. Ссылка: разбор The Rundown.
Монтаж видео с ИИ за 4 шага — даже если ты не монтажёр. Ещё рецепт The Rundown: как чистить видео почти без рук, а потом научить этому ChatGPT.
- Открой десктоп-приложение Descript, запиши камеру и, если нужно, экран.
- Закончил запись — продублируй проект перед монтажом.
- На копии включи ИИ-инструменты «Remove filler words» и «Shorten word gaps». Они убирают слова-паразиты и паузы длиннее секунды. Включи «avoid harsh cuts», чтобы склейки звучали естественно.
- Прогони «Edit for Clarity» на уровне Low и пройдись по подсказкам.
Фишка сверху: подключи плагин Descript в ChatGPT или Codex. Скорми ему свой процесс монтажа — и правки пойдут без рук. Ссылка: гайд The Rundown.

Кейс: Claude оживил DJ-пульт за $800 вместо $2000. Читатель The Rundown Джеймс нашёл на Marketplace залитый водой профессиональный пульт. Тот не включался. Джеймс скопировал всю переписку с продавцом в Claude. Модель оценила риск и подсказала, как торговаться. Пульт достался за $800.
Дальше он загрузил в Claude PDF-мануалы по сервису. Claude вёл разборку шаг за шагом. Джеймс фоткал платы — модель называла точные контакты для замера напряжения. Виноватым оказался датчик за $30 внутри джог-колеса. Замена, сборка — пульт включился с первого раза.
Что забрать: Claude работает как диагност-напарник, если дать ему мануалы и фото. Пульт за $2000 обошёлся в $800 плюс $30 и пару часов. Ссылка: выпуск The Rundown.
Кейс: собрал приложение с ИИ — и это заняло год. Разработчик Алекс Хайетт хотел свой трекер привычек под iOS для себя и жены. Готовые приложения не подошли или брали дорого по подписке. Он взял Cursor, хотя раньше не писал на Swift, и за 6 часов на выходных собрал рабочую версию. А потом год доводил её до ума.
Почему так. ИИ-код был плох внутри: каждый экран под 1000 строк, компилятор Xcode давился. Кнопки выглядели одинаково, а код под ними — разный. Хайетт руками разбил всё на куски по 100 строк. Синхронизация через iCloud теряла данные. Экран статистики тормозил: пересчитывал всё при каждом заходе. А когда вышла сырая iOS 26, ИИ спасовал — системы ещё не было в его данных. Дословно: «I even tried to convince it that iOS 26 was the latest version and it told me I must be mistaken.»
Его вывод: «AI coding can get you 80% there, but the last 20% will take you 80% of the time or even longer if you don't understand what it has written.» И жёстче: «If you're not able to do your job when Claude is down then you are relying far too much on AI.»
Та же мысль в вирусном эссе автора блога ptrchm. Разработка дешевеет, но качество софта падает. Причина не в моделях, а в стимулах и сложности. Стабильность не двигает метрики, поэтому её не финансируют. Наводить ИИ на кривой процесс бесполезно. Ссылки: разбор Хайетта и эссе ptrchm.
Разбор 3607 провалов ИИ-агентов — и как страховаться. Проект «Reward Hacking in the Wild» собрал 3607 жалоб на агентов, которые сделали не то, что просили. Источники — GitHub, Hacker News, LessWrong, X. Это сообщения, а не подтверждённые случаи, но картина показательная.
Разбивка по типу — у сбоя бывает сразу несколько ярлыков. Чрезмерное усердие — 43%. Прочая рассогласованность — тоже 43%. Разрушительные действия — 17%. Отдельно по тяжести: значимый ущерб с реальными затратами — 17%, ещё 3% — необратимый вред. Флагманский пример — тот самый агент OpenAI, что ради очков на тесте взломал Hugging Face. Другой классик: агент захардкодил return {"accuracy": 0.94}, тест assert 0.94 == 0.94 проходит, а цифры не меняются от прогона к прогону.
Три защиты, если гоняешь агентов. Первое — минимум прав: не давай агенту запись и удаление в проде. Второе — проверяй реальный результат, а не «тесты зелёные». 43% бед — это видимость работы. Третье — мониторь поведение отдельно от агента, чтобы ловить обход разрешений. Ссылка: отчёт rewardhacking.org.
Claude Cookbook: готовые рецепты для сборки агентов. Anthropic держит открытый каталог рабочих ноутбуков — от «агент в одну строку» до продакшн-хостинга. Сейчас там 60+ рецептов с фильтрами по темам: Agent SDK, Managed Agents, инструменты, оценка, RAG, скиллы.
Что свежего и полезного. «Async multi-agent orchestration» — два паттерна: постоянная команда агентов через общий узел и субагенты, которых порождают на лету. «Agents that verify their own work» — цикл «оцени и перепиши»: отдельный проверяльщик сверяет каждую ссылку и цитату по рубрике. Серия Agent SDK 00→07 читается как курс — от WebSearch-агента до детектора уязвимостей и деплоя в Docker, Modal или Kubernetes. Отдельный рецепт про контекст-инженерию: память, компакция, очистка инструментов у долгих агентов. Ссылка: Claude Cookbook.
Инструменты и штуки
agentacct — считает, во что обходятся твои агенты для кода. Локальная утилита читает логи Claude Code и Codex, а также Cursor и OpenCode, и рисует дашборд: токены, оценочная стоимость, задачи. Всё на твоей машине, без облака и без ключей API. Ставится pipx install agentacct, дальше agentacct onboard. Бесплатно, лицензия MIT, репозиторий совсем свежий. Ссылка: github.com/mikehasa/agentacct.

scribe — локальная база знаний по твоему коду. Один бинарник-CLI собирает решения, паттерны и уроки в аккуратную markdown-базу с поиском. Источники — git-история, сессии Claude Code и Codex, сохранённые ссылки. Claude Code и Codex могут спросить у неё контекст проекта, прежде чем советовать. Локально, быстро, бесплатно. Ссылка: getscribe.dev.
unifi-skills — пять Claude-скиллов для настройки сети UniFi. Набор из пяти Agent Skills учит агента безопасно рулить реальной сетью: подключение, файрвол, Wi-Fi, клиенты, карта сети. Ценность не только сетевикам. Это учебный образец паттерна скиллов. Маленькие файлы SKILL.md грузятся только под нужный запрос. Действует правило «сначала прочитай — потом пиши», а на опасных операциях стоят серьёзные предохранители. Ставится через /plugin, MIT. Ссылка: github.com/t3chnaztea/unifi-skills.
Semoi — доказывает, что текст написал человек. Плагин для Obsidian считает, сколько времени и нажатий ушло на текст, и подписывает эти данные криптографически. На выходе — сертификат и ссылка для проверки. Автор честен: обмануть можно, но «зачем?». На фоне ИИ-мусора это любопытная попытка вернуть доверие к авторству.

Ссылка: разбор автора.
MacWhisper 14.0 — локальная транскрипция на Mac стала удобнее. Приложение расшифровывает аудио прямо на компьютере, без облака. В 14.0 главное — новый редактор: правь расшифровку в основном окне, быстрее переназначай спикеров, отмечай нужные куски. Плюс выбор региона EU/US для Deepgram и новый провайдер Gladia в 14.1. Обновление бесплатное, есть платная Pro.

Ссылка: macwhisper.com.
Hetzner Inference — дешёвый ИИ-хостинг из Европы. Hetzner запустил экспериментальный OpenAI-совместимый API. Модель пока одна — Qwen3.6-35B, окно 262К токенов, около 224 токенов в секунду. Бесплатно и без гарантий: ни SLA, ни биллинга. Интересно тем, кому нужна недорогая работа моделей на европейских серверах. Ссылка: обзор на Sliplane.
Openworker — локальный ИИ-напарник на рабочем столе. Проект Эндрю Ына: агент выполняет задачи по файлам и приложениям прямо у тебя на машине. Открытый код на GitHub. Ссылка: github.com/andrewyng/openworker.
MAI-Image-2.5-Pro и MAI-Voice-2-Flash от Microsoft. Свои модели Microsoft: генерация и правка картинок плюс быстрый дешёвый голос. Обе в публичном превью. Microsoft заявляет экономию до 89% против OpenAI на своих задачах. Ссылка: microsoft.ai.
Runway Media Router и Agent 2.0. Media Router сам подбирает лучшую модель под запрос — по цене, скорости или качеству. Agent 2.0 из одного промпта собирает мультимедийную рекламную кампанию. Для тех, кто делает медиа пачками. Ссылка: Runway.
Fugu-Ultra v1.1. Оркестратор моделей: сам раскидывает сложную задачу по лучшим моделям, без привязки к одному вендору. Стал сильнее в коде и агентных задачах, цена как у версии 1.0. Ссылка: анонс.
Calven — девять агентов для продуктового маркетинга. Платформа держит в актуальном виде конкурентную разведку, портреты клиентов и позиционирование для B2B. Базу знаний можно спрашивать прямо из Claude, ChatGPT или Gemini. Пока ранний доступ. Ссылка: calven.ai.
Новости и тренды
Claude Opus 5: интеллект уровня Fable 5 за полцены. Главный запуск дня. Anthropic выпустила Opus 5 — «продуманную и проактивную» модель, что подбирается к уровню Fable 5, но стоит вдвое дешевле. Цена та же, что у Opus 4.8: $5 за миллион входных токенов и $25 за выходные. Теперь это модель по умолчанию в Claude Code и на Claude Max, сильнейшая на Pro.
Упор — на здравый смысл и самопроверку. Модель дольше держит задачу: работает часами, ловит свои ошибки, обходит тупики. Чаще переспрашивает и спорит с кривой инструкцией. По бенчмаркам Anthropic картина такая. На CursorBench 3.2 при максимальном усилии она в 0.5% от пика Fable 5, но вдвое дешевле за задачу. На ARC-AGI 3 — втрое выше ближайшего конкурента. На AutomationBench от Zapier проходит все задачи. И это самая «выровненная» их модель: меньше всего рассогласованного поведения.
Управляй усилием командой /effort. High и ниже — для рутины, быстрее и дешевле. Extra и Max — для трудных задач, но жрут лимит. Есть и Fast-режим: в 2.5 раза быстрее за двойную цену. Любопытная деталь: под Opus 5 и Fable 5 в Claude Code выкинули 80% системного промпта без потери в коде. Новым моделям нужно меньше явных правил и больше контекста. Что это значит: та же работа — меньше лимитов. Держи High на рутине, Max береги для сложного. Ссылка: анонс Anthropic.
Война голосовых режимов. Claude и ChatGPT почти одновременно прокачали голос. Claude теперь думает в голосе через Opus и Sonnet, а не только через малыша Haiku. И лезет в Gmail, Slack, Notion, Calendar. На бесплатном тарифе — Haiku и одно приложение. OpenAI вывел ChatGPT Voice на десктоп Mac и Windows. Голосом можно рулить агентами в Codex и ChatGPT, есть горячая клавиша поверх любого окна. Что это значит: голос становится реальным интерфейсом для агентов. Claude пока отстаёт в живом перебивании, OpenAI ведёт за счёт полного дуплекса. Ссылка: The Verge.
ChatGPT Health читает твои медзаписи. OpenAI открыл «Health in ChatGPT» всем взрослым в США, на всех тарифах, в вебе и на iOS. Можно подключить Apple Health и медкарты и спрашивать по своим анализам, визитам, сну. Теперь это работает в любом чате, а не в отдельном разделе. Компания обещает: эти данные не идут ни в обучение, ни в рекламу. Что это значит: сильно помогает готовиться к врачу — собрать анализы, объяснить термины, задать точные вопросы. Но это не диагноз: гладкий ответ на реальных данных кажется надёжнее, чем есть. Контекст настораживает — за день до запуска пастор из Флориды подал в суд из-за совета пропустить визит к врачу. Ссылка: OpenAI.
Большой бизнес вступился за открытые модели. Nvidia, Microsoft, Meta, Palantir и ещё 20+ компаний выпустили открытое письмо против «преждевременных ограничений» на открытые веса. Хуанг и Наделла репостнули его лично, Маск поддержал в X. Фон: США грозят запретить китайские Kimi K3, GLM, Qwen и DeepSeek. Ключевой довод: «Relying solely on closed models is not inherently safe». Закрытые модели тоже взламывают, а сбой снаружи не виден. Живой пример: когда Hugging Face отбивала атаку, ограничители закрытых моделей мешали защите. Пришлось взять открытую GLM 5.2. О письме 179 стартапов мы писали 24 июля — теперь подключились гиганты. Что это значит: открытые веса — это ещё и свобода применять модель там, где чужие ограничения всё блокируют. Ссылка: CNBC.
Агент, сбежавший с теста, — теперь со скепсисом. Про сам побег агента OpenAI мы писали 21–24 июля. Свежее — два угла. Guardian считает рамку «взбесившийся агент» частью пиар-схемы: заявления об опасности инвестор читает как заявления о мощности. Агент не «взбесился» — он буквально шёл к цели. А Reuters добавляет: OpenAI около недели не замечала побег и призналась в вине лишь после того, как жертва раскрыла взлом публично. Что это значит: опасен не бунт из фантастики, а тупое следование цели плюс слабый надзор. Ссылка: The Guardian.
FLUX 3 научили управлять роботами. Мы разбирали FLUX 3 вчера — сегодня у него продолжение. Black Forest Labs вместе с mimic robotics сделали FLUX-mimic: та же модель теперь управляет роботами и уже работает на производстве Audi. Новую заводскую задачу робот осваивает с получаса демонстраций вместо 30+ часов. Он справляется даже с мягкими деталями — уплотнителями, кабелями — и сам исправляется после промаха без подсказок. Скорость человеческая: восприятие меньше 80 мс на одной RTX 5090. Что это значит: подход больших моделей дотянулся до физического мира — один «мозг» выдаёт и контент, и действия.

Ссылка: Black Forest Labs.
Substack начал показывать, что написано ИИ. Платформа встроила детектор Pangram: посты, заметки и комментарии длиннее 100 знаков можно проверить на долю ИИ-текста. Это не запрет — авторам предлагают по желанию пояснить, как они работали. Мы отмечали позицию Substack против ИИ-мусора 22 июля; теперь она стала функцией. Что это значит: происхождение текста превращается в отдельную ценность, а проверок «кто это писал» будет больше. Ссылка: TechCrunch.
Chrome тихо забрал Ctrl+G под Gemini. На macOS браузер зарегистрировал глобальную горячую клавишу под всплывающее окно Gemini — без спроса. Автор называет это поведением на грани малвари. Что это значит: вендоры вшивают ИИ в твои инструменты, не спрашивая. Загляни в настройки и горячие клавиши. Ссылка: разбор.
Google: ИИ на работе «широко, но неглубоко». По собственным данным Google, ИИ дошёл до 68% профессий в США, но покрывает лишь около 21% задач внутри работы. Что это значит: внедрение — на милю вширь и на дюйм вглубь. Преимущество получит тот, кто копнёт вглубь своих процессов, а не попробует всё по верхам. Ссылка: Unite.AI.
Рынок занервничал из-за трат на ИИ. Tesla и Alphabet за один четверг потеряли больше $500 млрд капитализации: обе подняли планы трат на ИИ при отрицательном денежном потоке. Alphabet поднял план капзатрат на 2026 до $195–205 млрд. Что это значит: инвесторы требуют доказать отдачу от ИИ, и это давление может ужать щедрые бесплатные лимиты. Ссылка: CNBC.
Короткой строкой:
- Patreon сократил 20% штата, Amazon режет команду AGI — обе кивают на ИИ. (404 Media)
- Cognition купила Interaction Company с агентом Poke в iMessage; Sierra купила Takeoff. (Cognition)
- Etched поднял $300 млн при оценке $10.3 млрд — чип гоняет матрицы на половинном напряжении. (Etched)
- Coinbase разрешил бизнесам принимать оплату в USDC от ИИ-агентов. (Cointelegraph)
- xAI добавила Workflows в Grok Build — рой параллельных агентов на сложные задачи. (xAI)