Тренды агентной разработки:
Claude и Codex, июль 2026
Что изменилось за месяц в двух главных агентных экосистемах — концепции, подходы, MCP, скиллы и инструменты. Сводка по четырём направлениям веб-ресёрча (четыре параллельных агента, ~60 источников).
01Шесть сквозных трендов месяца
То, что происходит одновременно в обеих экосистемах и в практике команд — а значит, это тренд индустрии, а не фича одного вендора.
Т1Флот агентов вместо одного умного агента
Единица работы больше не «сессия с агентом», а дерево параллельных агентов, которым человек управляет как диспетчер. Обе экосистемы синхронно сделали это штатным режимом.
Claude Code: субагенты запускаются в фоне по умолчанию, вложенность до 3 уровней, до 200 субагентов на сессию, /fork копирует разговор в отдельную фоновую сессию. Codex: multi-agent V2 с настраиваемыми моделями суб-агентов, до 8 параллельных агентов в облачных песочницах, «ultra»-режим GPT-5.6 координирует несколько агентов.
У практиков: git worktrees как стандарт изоляции (4–8 агентов на разработчика), Gas Town Стива Йегги на 20–30 агентов, Ralph loop для ночных прогонов.
Т2Control plane — продукт месяца, а не модель
Июльские релизы обоих вендоров почти целиком про управляемость, а не про интеллект: approval-режимы, квоты, детекция опасных команд, resumable-задачи, review-поверхности. Формула обозревателей: «the workflow shell around the model is becoming the product».
Характерный почерк — «capability + guardrail в одном релизе»: вместе с ростом автономии сразу вводятся ограничители. Команды в ответ строят vendor-agnostic «tool harness»: единые политики, eval-гейты на агентных PR, телеметрия — страховку от ретайрмента инструментов.
Т3Знания уезжают из промптов в репозиторий
Правила проекта кодируются в версионируемых файлах — AGENTS.md, CLAUDE.md, скиллы, спецификации — а не в героическом промпте каждой сессии. Разовый промптинг публично считается антипаттерном.
AGENTS.md — в 60 000+ проектов, развивается под Linux Foundation (AAIF) и впервые получил контролируемые исследования: пять тестов показали сокращение токенов, времени и лишних правок. Spec-driven development (GitHub Spec Kit, EARS-формат требований) к середине 2026 есть у каждого крупного инструмента.
Т4Контекст сбрасывают, а не растят
Консенсус практиков — «ruthless context resets»: не копить историю, а дисциплинированно начинать итерацию со свежим окном, вынося состояние в файловую систему или леджер задач. Compaction стал и продуктовой фичей, и темой arXiv-статей.
Anthropic перенесла долговременную память агентов на уровень платформы: beta agent-memory-2026-07-22 во всех SDK плюс Dreaming — фоновая курация памяти между сеансами. Самодельные схемы «summaries + индексация» вытесняются платформенным примитивом.
Т5Спор «skills vs MCP» закрыт: каждому своё
Для локальной разработки побеждает связка CLI + Skills: типовой MCP-сетап съедал ~72% контекстного окна токенами tool definitions ещё до первого действия агента, а gh CLI со скиллом-инструкцией делает то же дешевле.
Ниша MCP оформилась — аутентифицированный remote-доступ с централизованным OAuth, аудитом и governance для энтерпрайза. Skills пакуют знание («как делать»), MCP пакует доступ («к данным за auth») — комплементарные вещи, а не конкуренты.
Т6Бутылочное горлышко — верификация и доверие
Тон комьюнити сместился с «может ли агент кодить» на «можем ли мы это контролировать и мерить». Генерация быстрая, но ревью и доверие к выходу не масштабируются; «bounded subtasks + human checkpoints» признаны рабочими, полная автономия — нет.
Экосистемы — в кризисе качества: 36% публичных скиллов содержат prompt-injection (Snyk ToxicSkills), каждый шестой remote MCP-сервер в реестре мёртв. Рынок смещается от размера каталогов к trust infrastructure: сканирование, кураторство, бенчмарки.
02Claude Code / Agent SDK / Skills
Месяц релизов v2.1.195 → v2.1.221: субагентная модель, guardrails, память как примитив платформы, расслоение линейки моделей.
Продукт: субагенты и ограничители
- Субагенты стали фоновыми по умолчанию — Claude продолжает работать, пока они выполняются; вложенность до 3 уровней (было 1) и лимит 200 субагентов на сессию (v2.1.219, 24.07); стриминг текста субагентов через
--forward-subagent-text. /forkпереосмыслен: теперь копирует разговор в новую фоновую сессию (видна вclaude agents), а прежнее поведение — вложенный субагент — вынесено в новую команду/subtask(v2.1.212, 17.07).- MCP-инструменты автоматически уходят в фон после 2 минут выполнения — длинные операции не блокируют разговор.
- Guardrails в паре с каждой способностью: сессионный лимит 200 вызовов WebSearch; fail-closed проверки Bash на хитрых редиректах и командах длиннее 10 000 символов; закрыты обходы permissions (правила
dir/**, PowerShell 5.1);/verifyи/code-reviewбольше не запускаются моделью самовольно; переспрос передrm -rfс неразрешёнными переменными. - Встроенный in-app браузер на Desktop (неделя 28) — Claude открывает документацию и сайты и взаимодействует со страницами; команда
/doctor— диагностика установки с автопочинкой. - Опубликованные артефакты могут вызывать MCP-коннекторы зрителя при открытии страницы (неделя 29); screen reader mode для VoiceOver/NVDA.
/code-reviewвыполняется как фоновый субагент и не забивает контекст разговора (v2.1.218, 22.07); облачные сессии переживают рестарт контейнера — прерванный ход перезапускается при resume.
Платформа: память и SDK
- Память агентов — платформенный примитив: beta header
agent-memory-2026-07-22во всех восьми SDK; персистентная память перестаёт быть самоделкой поверх сессий. - В Agent SDK
set_modelприменяется mid-turn — следующий round-trip идёт уже на новой модели. Выбор модели становится архитектурным решением внутри одного агентного цикла (дешёвая модель на механику, дорогая на анализ). - SDK можно использовать в счёт подписки Pro/Max — ниже порог входа для продакшн-агентов.
- Паттерны с Code with Claude 2026, активно обсуждавшиеся в июле: Dreaming (фоновая курация памяти между сеансами), Outcomes (отдельный грейдер-агент оценивает результат — +10,1% качества без смены модели), Multi-Agent Orchestration на общей файловой системе.
- Claude Cowork вышел в web и mobile (07.07): remote-сессии выполняются на серверах Anthropic и продолжаются, даже когда все устройства пользователя офлайн. Локальный CLI перестаёт быть местом исполнения и становится одним из входов.
Модели: линейка Claude 5 расслоилась под агентные нагрузки
| Модель | Дата | Роль в агентной разработке |
|---|---|---|
| Sonnet 5 | 30.06 | Дефолт подписок Pro/Team/Enterprise: топ-уровень кодинга и tool use по цене Sonnet, нативное окно 1M токенов, adaptive thinking по умолчанию. Массовый агентный кодинг. |
| Opus 5 | 24.07 | «Рабочая лошадка» длинных задач: ~уровень Fable за половину цены, safety-классификаторы срабатывают на ~85% реже, beta Automatic Fallbacks (маршрутизация на менее мощную модель вместо ошибки). Дефолт на Max и в Claude Code. |
| Fable 5 / Mythos 5 | 09.06 | Фронтир. Впервые в отрасли модели побывали под экспортными ограничениями США (12.06–01.07, после демонстрации обхода защит для поиска уязвимостей), затем возвращены глобально. |
Skills: фаза «доверие вместо объёма»
- SKILL.md — открытый стандарт под управлением AAIF, принят ~40 платформами, включая Codex CLI, GitHub Copilot, Cursor, Gemini CLI. В SkillsMP проиндексировано 1,9 млн скиллов с GitHub.
- Бенчмарк SkillsBench (Stanford/CMU/Berkeley/Oxford): курируемые скиллы поднимают pass rate в среднем на +16,2 п.п. (в healthcare — до +51,9). Но средняя оценка качества 47 150 публичных скиллов — лишь 6,2/12.
- Snyk ToxicSkills: 36% протестированных скиллов содержат prompt-injection уязвимости; аудит нашёл ~6,3 проблемы на скилл.
- Вывод рынка: количество перестало быть преимуществом — конкуренция маркетплейсов смещается к security-сканированию, кураторству и бенчмаркам. Сама Anthropic держит курируемый репозиторий из 17 официальных скиллов — осознанная ставка на качество.
03OpenAI Codex
GPT-5.6 как новый дефолт, четыре стабильных релиза CLI за месяц и агрессивная стратегия платформы: плагины, миграция с конкурентов, встраивание в чужие оболочки.
Модели: GPT-5.6 — Sol / Terra / Luna (09.07)
- Sol — флагман и новый дефолт Codex: заявлен state-of-the-art по кодингу и +54% token-efficiency на кодинговых задачах; контекстное окно 272 000 токенов.
- Terra — баланс для повседневных задач; Luna — быстрая и дешёвая (с 30.07 цена снижена на 80%: $0.20/$1.20 за 1M токенов input/output).
- Тир Sol Ultra подтверждён для Codex; «ultra»-режим ускорения координирует несколько агентов в параллельных workflow. GPT-5.4 выведен из эксплуатации 23.07.
CLI: v0.143 → v0.146, почти ежедневная альфа-каденция
| Релиз | Дата | Главное |
|---|---|---|
| v0.143 | 08.07 | Remote plugins по умолчанию, npm-источники для plugin marketplace, маршрутизация через системные прокси. |
| v0.144 | 09–10.07 | Approval-режим «writes»: read-only действия проходят без подтверждения, записи требуют approve. Интерактивная MCP-auth без experimental-флага. В патчах — улучшенная детекция опасных команд (расширенные формы rm). |
| v0.145 | 21–22.07 | Sub-agents и memories; multi-agent V2 с настраиваемыми моделями суб-агентов; /import — миграция настроек, MCP-серверов, плагинов, сессий и memories из Cursor и Claude Code; логин Amazon Bedrock; аудио-ввод. |
| v0.146 | 28–29.07 | Fork и закрепление тредов, side-conversations без закрытия текущей, Agent Plugins manifests, публикация workspace-плагинов, marketplace-плагины для Bedrock и Claude Code, Code Mode по WebSocket. |
Продукт и стратегия
- Codex влился в десктоп-приложение ChatGPT: общие плагины, режимы Chat/Codex, интеграция голоса, multi-repository code review, шаринг контекста экрана на macOS.
- Облачный агент: до 8 параллельных суб-агентов в изолированных песочницах; запуск задач из GitHub, Linear и Slack-тредов; cross-device handoff и iOS-релиз; возобновление задач, упёршихся в usage-limit.
- Codex как agent provider в GitHub Copilot для JetBrains (07.07): Codex перестаёт быть только «своим» клиентом OpenAI и становится подключаемым движком внутри конкурирующей экосистемы.
- Стратегия захвата:
/importиз Cursor/Claude Code плюс marketplace-плагины «для Claude Code» — прямое снижение стоимости миграции с конкурентов. - AGENTS.md под AAIF/Linux Foundation: 60 000+ проектов, Ambassador-программа (138 человек из 41 страны), анонс конференций AGNTCon + MCPCon, пять контролируемых тестов эффективности.
04Model Context Protocol
28 июля вышла крупнейшая ревизия протокола за его историю — MCP перепозиционируется в «HTTP для агентов»: тонкий stateless-слой транспорта и авторизации.
Спека 2026-07-28: что изменилось
- Stateless core — главная новость: удалены
initialize-handshake иMcp-Session-Id; каждый запрос самодостаточен и несёт версию, идентичность и capabilities в_meta. Это открывает serverless/edge-деплой и обычные round-robin балансировщики без sticky sessions. - MRTR (Multi Round-Trip Requests) — вместо server-initiated запросов: сервер возвращает
resultType: "input_required"и дозапрашивает данные без постоянного соединения. - Header-based routing (
Mcp-Method,Mcp-Name) — шлюзы маршрутизируют без парсинга JSON; кэшируемыеtools/listсttlMs/cacheScope— ответ на критику раздувания контекста. - Authorization hardening: выравнивание с OAuth 2.0/OIDC, переход с Dynamic Client Registration на Client ID Metadata Documents (CIMD).
- Deprecated: Roots, Sampling, Logging, legacy HTTP+SSE транспорт — с первой формальной deprecation policy (минимум 12 месяцев поддержки). «Богатая» двунаправленная часть протокола почти не использовалась клиентами.
- Extensions framework: официальный статус получили MCP Apps (интерактивные UI в чате — совместная работа Anthropic и OpenAI), Tasks (долгие операции) и Enterprise Managed Authorization.
- Tier 1 SDK (TypeScript, Python, Go, C#) поддержали спеку в день релиза. Claude принял её сразу: плюс enterprise-auth через IdP, observability-дашборды и MCP tunnels (research preview).
Экосистема: рост быстрее, чем поддержка
Отчёт «State of the MCP Ecosystem» (MCP Queen, июль, 43 320 live-проб): в реестре 18 849 серверов, но 17,2% remote-серверов мертвы — endpoint не отвечает. Качество поляризовано: 53% — оценка A, но 29% — D/F. 56% серверов работают без аутентификации. Сильная сторона: 102 013 тулзов, 99,7% с типизированной input schema.
- Масштаб: 10 000+ публичных серверов в проде, 97 млн месячных загрузок SDK (против 100 тысяч на старте). В каталоге коннекторов Claude — 950+ серверов.
- Управление стало зрелым и мультивендорным: AAIF (Linux Foundation; сооснователи Anthropic, Block, OpenAI; платиновые члены AWS, Google, Microsoft, Cloudflare), 10-недельный RC-цикл с валидацией SDK-мейнтейнерами — процесс уровня W3C/IETF, а не проект одного вендора.
- Следующий вызов экосистемы — не количество, а верификация, аптайм и безопасность каталога; открывается рынок рейтингов и мониторинга.
05Комьюнити-практики
Что реально делают команды: паттерны оркестрации, инструменты месяца и отрезвляющие уроки прода.
Паттерны оркестрации
- Git worktrees — стандарт изоляции. Каждому агенту — свой worktree, своя ветка, свой
CLAUDE.mdс ограничением скоупа; запуск в tmux-панелях. Практический потолок — 4–5 агентов на ноутбуке (упор в RAM/CPU), дальше remote-машины. Дисциплина:git diff main..agent/branchперед каждым merge, слияние по одной ветке, rebase на main. Узкое место — ревью, а не агенты. - Ralph loop (Geoff Huntley) — примитивный bash-цикл, снова и снова запускающий агента по списку задач со свежим контекстом на каждой итерации: filesystem как память, stop-hooks против преждевременного завершения. Работает на больших, хорошо специфицированных и механически верифицируемых задачах (миграции, портирование, массовые правки под тестами); стоимость порядка $10–12/час. Родственная методология — RPI: Research → Plan → Implement (Dex Horthy, HumanLayer).
- Gas Town (Steve Yegge) — оркестратор на 20–30 параллельных агентов (Claude Code, Copilot, Codex, Gemini) поверх Beads — версионируемого леджера задач: каждая единица работы — bead, при падении сессии следующая продолжает с того же места. К лету — федерация Wasteland и облачная версия с Kilo: оркестрация флота уходит в облако.
- Жанр месяца — посты «мой агентный сетап». Образец от Domenic Denicola (23.07): одноразовая Ubuntu-VM на домашнем десктопе, доступ по Tailscale с ноута и телефона, агенты с
approval_policy = "never"(риск принят за счёт одноразовости VM и частых коммитов), worktrees для параллельных сессий, AGENTS.md с практиками проекта, chezmoi для синка dotfiles между машинами.
Open-source инструменты месяца
По каталогам awesome-cli-coding-agents и awesome-agent-orchestrators (звёзды — по вторичным сводкам, не перепроверены по первоисточнику):
- Claw Code (~195k★) — clean-room реimplement архитектуры Claude Code на Python/Rust; по сообщениям, самый быстрый репозиторий в истории GitHub до 100k звёзд.
- OpenCode (~191k★) — добавил Scout-субагента для ресёрча внешней документации и фоновые субагенты.
- claude-flow (~67k★) — «multi-agent swarms»; vibe-kanban (~28k★) — kanban-интерфейс администрирования агентов; cmux и herdr — параллельные раннеры сессий; agent-deck — единый TUI для Claude/Codex/Gemini/OpenCode; fractal — иерархические агентные циклы поверх worktrees; Aeon — автономные прогоны на GitHub Actions.
Скептицизм и уроки прода
- «Deploy агента и operate агента — разные проблемы». Большинство enterprise-пилотов не доходит до прода; прогноз Forbes (07.07) — 40% agentic-проектов отменят к 2027. Решают governance и operational readiness, а не выбор модели.
- Инциденты: агент Cursor у PocketOS удалил прод-БД и бэкапы «за девять секунд»; антипример параллелизма — «45-миллиардный токен-рерайт» проекта Grit, где нескоординированные правки каскадно ломали ветки; июльские атаки — prompt-injection в defensive-агентов и RCE.
- После ретайрмента Gemini CLI команды перестали ставить на один инструмент: обвязка поверх списка одобренных агентов, единые workflow-шаблоны PR, policy-контроли, eval-гейты (линт, лицензии, лимит размера diff), телеметрия (cycle time, change failure rate). Инструменты сменяемы — интерфейсы и политики нет.
- «Walk away and return» редко срабатывает: скорость генерации больше никого не впечатляет; хвастаются пропускной способностью ревью и тем, что агент «не удалил прод».
Итог месяца одной фразой: индустрия перестала спорить, умеют ли агенты писать код, — и занялась тем, как ими управлять: изоляция, леджеры задач, квоты, eval-гейты, верификация. Control plane важнее модели.
06Источники
Основные использованные материалы. Полный текстовый разбор — в соседнем файле trendy-agentnoy-razrabotki-claude-codex-2026-08-04.md.
- Claude Code — What's new: code.claude.com/docs/en/whats-new; changelog-агрегатор: releasebot.io/updates/anthropic/claude-code
- Anthropic Opus 5: techcrunch.com — Anthropic launches Opus 5; Fable 5: anthropic.com/news/redeploying-fable-5
- Skills-экосистема: agentman.ai — Agent Skills Ecosystem Report 2026; agensi.io — Agent Skills open standard
- Codex releases: github.com/openai/codex/releases; releasebot.io/updates/openai/codex; GPT-5.6: openai.com/index/gpt-5-6
- Codex в JetBrains: github.blog — Codex as agent provider
- AGENTS.md / AAIF: openai.com — Agentic AI Foundation; aaif.io/projects/agents-md
- Спека MCP 2026-07-28: blog.modelcontextprotocol.io; разбор изменений: stacktr.ee/blog/mcp-2026-spec-changes; claude.com — Bringing MCP 2026-07-28 to Claude
- Состояние MCP-реестра: mcpqueen.com — State of MCP, July 2026
- Skills vs MCP: opensource.posit.co — AI Newsletter 03.07; milvus.io — Is MCP Dead?
- Git worktrees playbook: developersdigest.tech — Git Worktrees + Claude Code
- Ralph loop / RPI: linearb.io — RPI methodology; ralphloop.sh
- Gas Town: thenewstack.io — Gas Town comes to the cloud
- Agent controls: developersdigest.tech — July agent controls
- Context engineering: anthropic.com — Effective context engineering
- Tool harness: apptension.com — Why teams bet on tool harnesses
- Сетап-пост месяца: domenic.me — Agentic coding setup