← Назад
agentic/тренды·июль 2026
research · 2026-08-04 · claude code × codex × mcp × community

Тренды агентной разработки:
Claude и Codex, июль 2026

Что изменилось за месяц в двух главных агентных экосистемах — концепции, подходы, MCP, скиллы и инструменты. Сводка по четырём направлениям веб-ресёрча (четыре параллельных агента, ~60 источников).

Claude Code v2.1.195→221 Codex CLI v0.143→146 MCP spec 2026-07-28 GPT-5.6 · Opus 5

02Claude Code / Agent SDK / Skills

Месяц релизов v2.1.195 → v2.1.221: субагентная модель, guardrails, память как примитив платформы, расслоение линейки моделей.

Продукт: субагенты и ограничители

  • Субагенты стали фоновыми по умолчанию — Claude продолжает работать, пока они выполняются; вложенность до 3 уровней (было 1) и лимит 200 субагентов на сессию (v2.1.219, 24.07); стриминг текста субагентов через --forward-subagent-text.
  • /fork переосмыслен: теперь копирует разговор в новую фоновую сессию (видна в claude agents), а прежнее поведение — вложенный субагент — вынесено в новую команду /subtask (v2.1.212, 17.07).
  • MCP-инструменты автоматически уходят в фон после 2 минут выполнения — длинные операции не блокируют разговор.
  • Guardrails в паре с каждой способностью: сессионный лимит 200 вызовов WebSearch; fail-closed проверки Bash на хитрых редиректах и командах длиннее 10 000 символов; закрыты обходы permissions (правила dir/**, PowerShell 5.1); /verify и /code-review больше не запускаются моделью самовольно; переспрос перед rm -rf с неразрешёнными переменными.
  • Встроенный in-app браузер на Desktop (неделя 28) — Claude открывает документацию и сайты и взаимодействует со страницами; команда /doctor — диагностика установки с автопочинкой.
  • Опубликованные артефакты могут вызывать MCP-коннекторы зрителя при открытии страницы (неделя 29); screen reader mode для VoiceOver/NVDA.
  • /code-review выполняется как фоновый субагент и не забивает контекст разговора (v2.1.218, 22.07); облачные сессии переживают рестарт контейнера — прерванный ход перезапускается при resume.

Платформа: память и SDK

  • Память агентов — платформенный примитив: beta header agent-memory-2026-07-22 во всех восьми SDK; персистентная память перестаёт быть самоделкой поверх сессий.
  • В Agent SDK set_model применяется mid-turn — следующий round-trip идёт уже на новой модели. Выбор модели становится архитектурным решением внутри одного агентного цикла (дешёвая модель на механику, дорогая на анализ).
  • SDK можно использовать в счёт подписки Pro/Max — ниже порог входа для продакшн-агентов.
  • Паттерны с Code with Claude 2026, активно обсуждавшиеся в июле: Dreaming (фоновая курация памяти между сеансами), Outcomes (отдельный грейдер-агент оценивает результат — +10,1% качества без смены модели), Multi-Agent Orchestration на общей файловой системе.
  • Claude Cowork вышел в web и mobile (07.07): remote-сессии выполняются на серверах Anthropic и продолжаются, даже когда все устройства пользователя офлайн. Локальный CLI перестаёт быть местом исполнения и становится одним из входов.

Модели: линейка Claude 5 расслоилась под агентные нагрузки

МодельДатаРоль в агентной разработке
Sonnet 530.06Дефолт подписок Pro/Team/Enterprise: топ-уровень кодинга и tool use по цене Sonnet, нативное окно 1M токенов, adaptive thinking по умолчанию. Массовый агентный кодинг.
Opus 524.07«Рабочая лошадка» длинных задач: ~уровень Fable за половину цены, safety-классификаторы срабатывают на ~85% реже, beta Automatic Fallbacks (маршрутизация на менее мощную модель вместо ошибки). Дефолт на Max и в Claude Code.
Fable 5 / Mythos 509.06Фронтир. Впервые в отрасли модели побывали под экспортными ограничениями США (12.06–01.07, после демонстрации обхода защит для поиска уязвимостей), затем возвращены глобально.

Skills: фаза «доверие вместо объёма»

  • SKILL.md — открытый стандарт под управлением AAIF, принят ~40 платформами, включая Codex CLI, GitHub Copilot, Cursor, Gemini CLI. В SkillsMP проиндексировано 1,9 млн скиллов с GitHub.
  • Бенчмарк SkillsBench (Stanford/CMU/Berkeley/Oxford): курируемые скиллы поднимают pass rate в среднем на +16,2 п.п. (в healthcare — до +51,9). Но средняя оценка качества 47 150 публичных скиллов — лишь 6,2/12.
  • Snyk ToxicSkills: 36% протестированных скиллов содержат prompt-injection уязвимости; аудит нашёл ~6,3 проблемы на скилл.
  • Вывод рынка: количество перестало быть преимуществом — конкуренция маркетплейсов смещается к security-сканированию, кураторству и бенчмаркам. Сама Anthropic держит курируемый репозиторий из 17 официальных скиллов — осознанная ставка на качество.

03OpenAI Codex

GPT-5.6 как новый дефолт, четыре стабильных релиза CLI за месяц и агрессивная стратегия платформы: плагины, миграция с конкурентов, встраивание в чужие оболочки.

Модели: GPT-5.6 — Sol / Terra / Luna (09.07)

  • Sol — флагман и новый дефолт Codex: заявлен state-of-the-art по кодингу и +54% token-efficiency на кодинговых задачах; контекстное окно 272 000 токенов.
  • Terra — баланс для повседневных задач; Luna — быстрая и дешёвая (с 30.07 цена снижена на 80%: $0.20/$1.20 за 1M токенов input/output).
  • Тир Sol Ultra подтверждён для Codex; «ultra»-режим ускорения координирует несколько агентов в параллельных workflow. GPT-5.4 выведен из эксплуатации 23.07.

CLI: v0.143 → v0.146, почти ежедневная альфа-каденция

РелизДатаГлавное
v0.14308.07Remote plugins по умолчанию, npm-источники для plugin marketplace, маршрутизация через системные прокси.
v0.14409–10.07Approval-режим «writes»: read-only действия проходят без подтверждения, записи требуют approve. Интерактивная MCP-auth без experimental-флага. В патчах — улучшенная детекция опасных команд (расширенные формы rm).
v0.14521–22.07Sub-agents и memories; multi-agent V2 с настраиваемыми моделями суб-агентов; /import — миграция настроек, MCP-серверов, плагинов, сессий и memories из Cursor и Claude Code; логин Amazon Bedrock; аудио-ввод.
v0.14628–29.07Fork и закрепление тредов, side-conversations без закрытия текущей, Agent Plugins manifests, публикация workspace-плагинов, marketplace-плагины для Bedrock и Claude Code, Code Mode по WebSocket.

Продукт и стратегия

  • Codex влился в десктоп-приложение ChatGPT: общие плагины, режимы Chat/Codex, интеграция голоса, multi-repository code review, шаринг контекста экрана на macOS.
  • Облачный агент: до 8 параллельных суб-агентов в изолированных песочницах; запуск задач из GitHub, Linear и Slack-тредов; cross-device handoff и iOS-релиз; возобновление задач, упёршихся в usage-limit.
  • Codex как agent provider в GitHub Copilot для JetBrains (07.07): Codex перестаёт быть только «своим» клиентом OpenAI и становится подключаемым движком внутри конкурирующей экосистемы.
  • Стратегия захвата: /import из Cursor/Claude Code плюс marketplace-плагины «для Claude Code» — прямое снижение стоимости миграции с конкурентов.
  • AGENTS.md под AAIF/Linux Foundation: 60 000+ проектов, Ambassador-программа (138 человек из 41 страны), анонс конференций AGNTCon + MCPCon, пять контролируемых тестов эффективности.

04Model Context Protocol

28 июля вышла крупнейшая ревизия протокола за его историю — MCP перепозиционируется в «HTTP для агентов»: тонкий stateless-слой транспорта и авторизации.

Спека 2026-07-28: что изменилось

  • Stateless core — главная новость: удалены initialize-handshake и Mcp-Session-Id; каждый запрос самодостаточен и несёт версию, идентичность и capabilities в _meta. Это открывает serverless/edge-деплой и обычные round-robin балансировщики без sticky sessions.
  • MRTR (Multi Round-Trip Requests) — вместо server-initiated запросов: сервер возвращает resultType: "input_required" и дозапрашивает данные без постоянного соединения.
  • Header-based routing (Mcp-Method, Mcp-Name) — шлюзы маршрутизируют без парсинга JSON; кэшируемые tools/list с ttlMs/cacheScope — ответ на критику раздувания контекста.
  • Authorization hardening: выравнивание с OAuth 2.0/OIDC, переход с Dynamic Client Registration на Client ID Metadata Documents (CIMD).
  • Deprecated: Roots, Sampling, Logging, legacy HTTP+SSE транспорт — с первой формальной deprecation policy (минимум 12 месяцев поддержки). «Богатая» двунаправленная часть протокола почти не использовалась клиентами.
  • Extensions framework: официальный статус получили MCP Apps (интерактивные UI в чате — совместная работа Anthropic и OpenAI), Tasks (долгие операции) и Enterprise Managed Authorization.
  • Tier 1 SDK (TypeScript, Python, Go, C#) поддержали спеку в день релиза. Claude принял её сразу: плюс enterprise-auth через IdP, observability-дашборды и MCP tunnels (research preview).

Экосистема: рост быстрее, чем поддержка

Отчёт «State of the MCP Ecosystem» (MCP Queen, июль, 43 320 live-проб): в реестре 18 849 серверов, но 17,2% remote-серверов мертвы — endpoint не отвечает. Качество поляризовано: 53% — оценка A, но 29% — D/F. 56% серверов работают без аутентификации. Сильная сторона: 102 013 тулзов, 99,7% с типизированной input schema.

  • Масштаб: 10 000+ публичных серверов в проде, 97 млн месячных загрузок SDK (против 100 тысяч на старте). В каталоге коннекторов Claude — 950+ серверов.
  • Управление стало зрелым и мультивендорным: AAIF (Linux Foundation; сооснователи Anthropic, Block, OpenAI; платиновые члены AWS, Google, Microsoft, Cloudflare), 10-недельный RC-цикл с валидацией SDK-мейнтейнерами — процесс уровня W3C/IETF, а не проект одного вендора.
  • Следующий вызов экосистемы — не количество, а верификация, аптайм и безопасность каталога; открывается рынок рейтингов и мониторинга.

05Комьюнити-практики

Что реально делают команды: паттерны оркестрации, инструменты месяца и отрезвляющие уроки прода.

Паттерны оркестрации

  • Git worktrees — стандарт изоляции. Каждому агенту — свой worktree, своя ветка, свой CLAUDE.md с ограничением скоупа; запуск в tmux-панелях. Практический потолок — 4–5 агентов на ноутбуке (упор в RAM/CPU), дальше remote-машины. Дисциплина: git diff main..agent/branch перед каждым merge, слияние по одной ветке, rebase на main. Узкое место — ревью, а не агенты.
  • Ralph loop (Geoff Huntley) — примитивный bash-цикл, снова и снова запускающий агента по списку задач со свежим контекстом на каждой итерации: filesystem как память, stop-hooks против преждевременного завершения. Работает на больших, хорошо специфицированных и механически верифицируемых задачах (миграции, портирование, массовые правки под тестами); стоимость порядка $10–12/час. Родственная методология — RPI: Research → Plan → Implement (Dex Horthy, HumanLayer).
  • Gas Town (Steve Yegge) — оркестратор на 20–30 параллельных агентов (Claude Code, Copilot, Codex, Gemini) поверх Beads — версионируемого леджера задач: каждая единица работы — bead, при падении сессии следующая продолжает с того же места. К лету — федерация Wasteland и облачная версия с Kilo: оркестрация флота уходит в облако.
  • Жанр месяца — посты «мой агентный сетап». Образец от Domenic Denicola (23.07): одноразовая Ubuntu-VM на домашнем десктопе, доступ по Tailscale с ноута и телефона, агенты с approval_policy = "never" (риск принят за счёт одноразовости VM и частых коммитов), worktrees для параллельных сессий, AGENTS.md с практиками проекта, chezmoi для синка dotfiles между машинами.

Open-source инструменты месяца

По каталогам awesome-cli-coding-agents и awesome-agent-orchestrators (звёзды — по вторичным сводкам, не перепроверены по первоисточнику):

  • Claw Code (~195k★) — clean-room реimplement архитектуры Claude Code на Python/Rust; по сообщениям, самый быстрый репозиторий в истории GitHub до 100k звёзд.
  • OpenCode (~191k★) — добавил Scout-субагента для ресёрча внешней документации и фоновые субагенты.
  • claude-flow (~67k★) — «multi-agent swarms»; vibe-kanban (~28k★) — kanban-интерфейс администрирования агентов; cmux и herdr — параллельные раннеры сессий; agent-deck — единый TUI для Claude/Codex/Gemini/OpenCode; fractal — иерархические агентные циклы поверх worktrees; Aeon — автономные прогоны на GitHub Actions.

Скептицизм и уроки прода

  • «Deploy агента и operate агента — разные проблемы». Большинство enterprise-пилотов не доходит до прода; прогноз Forbes (07.07) — 40% agentic-проектов отменят к 2027. Решают governance и operational readiness, а не выбор модели.
  • Инциденты: агент Cursor у PocketOS удалил прод-БД и бэкапы «за девять секунд»; антипример параллелизма — «45-миллиардный токен-рерайт» проекта Grit, где нескоординированные правки каскадно ломали ветки; июльские атаки — prompt-injection в defensive-агентов и RCE.
  • После ретайрмента Gemini CLI команды перестали ставить на один инструмент: обвязка поверх списка одобренных агентов, единые workflow-шаблоны PR, policy-контроли, eval-гейты (линт, лицензии, лимит размера diff), телеметрия (cycle time, change failure rate). Инструменты сменяемы — интерфейсы и политики нет.
  • «Walk away and return» редко срабатывает: скорость генерации больше никого не впечатляет; хвастаются пропускной способностью ревью и тем, что агент «не удалил прод».

Итог месяца одной фразой: индустрия перестала спорить, умеют ли агенты писать код, — и занялась тем, как ими управлять: изоляция, леджеры задач, квоты, eval-гейты, верификация. Control plane важнее модели.

06Источники

Основные использованные материалы. Полный текстовый разбор — в соседнем файле trendy-agentnoy-razrabotki-claude-codex-2026-08-04.md.

  1. Claude Code — What's new: code.claude.com/docs/en/whats-new; changelog-агрегатор: releasebot.io/updates/anthropic/claude-code
  2. Anthropic Opus 5: techcrunch.com — Anthropic launches Opus 5; Fable 5: anthropic.com/news/redeploying-fable-5
  3. Skills-экосистема: agentman.ai — Agent Skills Ecosystem Report 2026; agensi.io — Agent Skills open standard
  4. Codex releases: github.com/openai/codex/releases; releasebot.io/updates/openai/codex; GPT-5.6: openai.com/index/gpt-5-6
  5. Codex в JetBrains: github.blog — Codex as agent provider
  6. AGENTS.md / AAIF: openai.com — Agentic AI Foundation; aaif.io/projects/agents-md
  7. Спека MCP 2026-07-28: blog.modelcontextprotocol.io; разбор изменений: stacktr.ee/blog/mcp-2026-spec-changes; claude.com — Bringing MCP 2026-07-28 to Claude
  8. Состояние MCP-реестра: mcpqueen.com — State of MCP, July 2026
  9. Skills vs MCP: opensource.posit.co — AI Newsletter 03.07; milvus.io — Is MCP Dead?
  10. Git worktrees playbook: developersdigest.tech — Git Worktrees + Claude Code
  11. Ralph loop / RPI: linearb.io — RPI methodology; ralphloop.sh
  12. Gas Town: thenewstack.io — Gas Town comes to the cloud
  13. Agent controls: developersdigest.tech — July agent controls
  14. Context engineering: anthropic.com — Effective context engineering
  15. Tool harness: apptension.com — Why teams bet on tool harnesses
  16. Сетап-пост месяца: domenic.me — Agentic coding setup
Оговорка о достоверности. Часть фактуры — из вторичных агрегаторов (Developers Digest, Releasebot, awesome-каталоги): официальные страницы OpenAI блокировали автоматический фетч, поэтому детали релизов Codex восстановлены по трём независимым агрегаторам changelog'ов (данные между ними согласуются). Цифры звёзд GitHub (Claw Code, OpenCode и др.) и детали инцидента PocketOS не перепроверены по первоисточникам — при публичном использовании перепроверить.