← Назад

Agent Briefing · выпуск 02

Скиллы и плагины недели

Неделя, на которой выяснилось, что каталог прошлых выпусков не был топом по звёздам.

Период18 – 26 августа
Прошли отбор86 репозиториев
Скиллы ★30+26
Плагины ★30+14

Что вышло и что обсуждали

Релизы и обсуждения

Версии платформы за окно и сюжеты, вокруг которых шёл разговор. Каталог находок — в разделах ниже.

Claude Code 2.1.236 → 2.1.246 — одиннадцать версий

  • promptCacheTtl и subagentPromptCacheTtl — TTL промпт-кэша отдельно для сессии и для сабагентов.
  • Разбивка по /loop в /usage, а в /tasks — модель и уровень effort у каждого сабагента.
  • Частичный результат сабагента вместо «готово» на упоре в maxTurns.
  • Встроенный стиль «Concise», ANTHROPIC_DEFAULT_MODEL, headersHelper для плагин-маркетплейсов и починенная утечка памяти на результатах сабагентов.
Остальные изменения CLI

Claude Code CLI 2.1.236 → 2.1.238 выжимка по агент-разработке

  • 2.1.238 — headersHelper на url-маркетплейсе или записи каталога: команда, выдающая HTTP-заголовки (например, короткоживущий токен) для запросов каталога и архивов; запускается только при install/update и после показа команды, с подтверждением [y/N]. Плюс требование принятого trust-диалога для headersHelper в проектном .mcp.json и запуск без унаследованных credential-переменных окружения — модель доверия для плагинов и MCP подтянули заметно.
  • 2.1.238 — починена неограниченная утечка памяти в длинных интерактивных сессиях: результаты инструментов сабагентов освобождаются, как только уходят из окна отображения. Для долгих мульти-агентных прогонов это самое полезное в релизе.
  • 2.1.238 — claude self-hosted-runner --defer-shutdown-max-min: по SIGTERM раннер продолжает обслуживать прикреплённые сессии заданное число минут. Плюс исправление, из-за которого здоровый раннер отбирался сервером после одного медленного поллинга.
  • 2.1.237 — встроенный output style «Concise»: ответ начинается с результата, без преамбул и нарратива, при той же полноте работы.
  • 2.1.236 — ANTHROPIC_DEFAULT_MODEL (модель для новых сессий, /model по-прежнему перебивает); notify_when_idle в кросс-сессионном SendMessage — одноразовое уведомление, когда соседняя сессия освободится, без поллинга; ограничение /recap 400 символами против разрастания рекапов; auth-режим больше не обманывается настройкой status.showUntrackedFiles=no.

Claude Code CLI 2.1.239 → 2.1.246

Восемь версий за окно, из них 2.1.240 и 2.1.241 — «bug fixes and reliability improvements» без деталей. Существенное для агент-разработки:

  • Многоагентность и сабагенты. Сабагент, упёршийся в лимит maxTurns, теперь возвращает результат с пометкой «частичный» и подсказкой продолжить через SendMessage, а не выглядит завершившимся. В /tasks показываются модель и уровень effort каждого сабагента. ← или /background во время динамического workflow больше не перезапускают его законченных сабагентов молча — сначала спрашивают и говорят, сколько будет перезапущено. Починены фоновые сабагенты, не просыпавшиеся после завершения последней фоновой Bash-задачи.
  • Кэш и стоимость. Настройки promptCacheTtl и subagentPromptCacheTtl — часовой prompt-кэш на основном диалоге при пятиминутном у сабагентов. Managed-настройка modelPricing: /cost, статус-строка и телеметрия считают по контрактным ставкам организации, а не по прайс-листу. В /usage — разбивка по Loops: число прогонов, токены, токены на прогон и время последнего.
  • Плагины и скиллы. /reload-plugins больше не рапортует 0 скиллов для плагинов, объявляющих их как skills/*/SKILL.md. Плагин-скиллы с префиксом <plugin>: в name перестали дублировать его в меню. claude plugin update работает по голому имени. Починены установка при plugin.json с BOM и дубликаты SHA-каталогов в кэше плагинов.
  • Модели. Настройка modelPicker — курируемый упорядоченный список моделей в /model с любым написанием id, включая Vertex/Bedrock. Исправлено, что /model молча игнорировал выбор Ultracode.
  • Прочее. Неинтерактивные сессии (-p, SDK, облачные) автоматически продолжают ответ, оборванный ошибкой сервера или обрывом связи. /cd применяет настройки, хуки, .mcp.json, скиллы и агентов нового каталога сразу, а не после --resume. Прерванные MCP-вызовы в headless/remote больше не рапортуются модели как «завершились без вывода». Аргументы MCP-инструмента с пустой схемой отправляются в своём настоящем типе, а не строкой JSON.

Модели — релизов в окне нет

Новых моделей за 18–26 августа не выходило. Официальная работа шла в другом месте: Claude Managed Agents получили два релиза, 18 и 19 августа — бюджет на сессию, роль advisor в мульти-агентном ростере, загрузка скиллов прямо из .claude/skills примонтированного репозитория и memory stores в self-hosted-песочницах. Разбор — в блоке «Claude Managed Agents» ниже.

Сюжеты недели

Разборы — в «Исследованиях и наблюдениях» в конце выпуска.

От разработчиков платформы

Официальные скиллы и плагины

Изменения официальных каталогов за окно: что добавилось в anthropics/skills и в маркетплейс плагинов. Релизы CLI — в начале выпуска.

anthropics/skills — переименование academy-guide и гайд по переезду Python SDK

За окно в репозиторий официальных скиллов ушёл ровно один коммит — 3b3fad9 от 21.08 17:10 UTC, merge PR #1623 «Update claude-api skill: Python SDK 0.x to 1.x upgrade guide». Изменено 4 файла, +303/−6 строк:

  • новый skills/claude-api/python/claude-api/sdk-upgrade.md (+286) — пошаговое руководство переезда;
  • skills/claude-api/SKILL.md (+3) — маршрутизация на новую подкоманду;
  • skills/claude-api/python/claude-api/README.md (+6/−6) — HTTP-слой 1.x;
  • skills/claude-api/shared/live-sources.md (+8).

Повод описан в самом PR: anthropic 1.0.0 вышел на PyPI, HTTP-слой переехал с httpx на поддерживаемый форк httpx2, минимальный Python поднят до 3.10, удалён давно устаревший API (Text Completions, LegacyAPIResponse). Автор PR отдельно объясняет, почему это не механическая правка: httpx.Timeout или httpx.Client, переданные в клиент 1.x, падают не на импорте, а на запросе, а мокирование и трейсинг, патчащие httpx, тихо перестают видеть трафик SDK. Существовавшая подкоманда migrate покрывает миграции моделей, а не апгрейды пакета, — маршрутизировать такие запросы было некуда.

Структура руководства, по описанию PR: шаг 0 подтверждает область работ и проверяет, что 1.x вообще опубликован, прежде чем писать пин; шаг 1 — таблица инвентаризации, строка на каждый сигнал для грепа (import httpx, with_raw_response, completions.create, инструментовка respx / pytest_httpx / OpenTelemetry), и та же таблица, прогнанная в конце, работает проверкой; шаги 2–8 — бамп зависимости, замена объектов httpx на httpx2, await у асинхронного .with_raw_response, удаление Text Completions и выпиленных параметров сэмплинга.

Релиз самого SDK — запись от 20 августа в release notes платформы, то есть за сутки до начала окна; сам migration guide живёт в репозитории SDK.

claude-plugins-official — первые за два окна новые плагины: unity и два NetSuite

8 коммитов за окно, и в отличие от прошлого прогона это не только бампы версий. В marketplace сейчас 289 плагинов.

  • unity (merged 24.08 20:52 UTC) — партнёрский листинг Unity Technologies, 18 скиллов: геймдев, монетизация, локализация, мультиплеер, Shader Graph. Только скиллы, без .mcp.json, лицензия Unity Companion, источник запинен на коммит 36052397 репозитория Unity-Technologies/unity-agent-plugin.
  • netsuite-ai-companion и netsuite-finance-analyst (merged 25.08 03:14 UTC) — Oracle NetSuite перешёл на публикацию из ветки ai-plugins-dist репозитория oracle/netsuite-suitecloud-sdk, по плагину на подкаталог. Старый сводный бандл заменён тремя реальными плагинами; netsuite-suitecloud сохранил слаг, поэтому установленные копии обновятся на месте. Оба новых требуют NetSuite AI Connector Service.
  • claude-security 0.10.2 → 0.10.2.3 — два релиза собственного плагина Anthropic за окно (21.08 и 24.08), тела PR пустые, кроме номера версии: содержание изменений публично не раскрыто.
  • Атрибуция unity и qodo — обеим записям добавлено поле author, которого не хватало для отображения партнёра.
  • Бампы версий партнёрских плагинов (carta: три плагина) — одной фоновой строкой.

Claude Managed Agents — где на самом деле шла официальная работа релизы 18 и 19 августа

Самое существенное для агент-разработки за окно — не скиллы и не плагины, а два релиза платформы. 18 августа (релиз-ноты):

  • Бюджет на сессию — жёсткий потолок трат по публичному прайсу; дошедшая до него сессия встаёт на паузу со стоп-причиной budget_reached и возобновляется при изменении бюджета (Session budgets).
  • Advisor в ростере — запись {"type": "advisor"} в мульти-агентной конфигурации: модель не слабее самого агента, к которой основной тред может обратиться посреди хода за стратегическим советом (Give the session an advisor). Это ровно тот паттерн «второе мнение сильной модели», который сообщество собирало руками — теперь он часть платформы.
  • Скиллы из GitHub-репозитория — при монтировании репозитория скиллы из его корневого .claude/skills подхватываются автоматически на старте сессии (Load skills from a GitHub repository).
  • inference_geo — пин географии инференса на уровне агента или отдельной сессии.

19 августа:

  • Memory stores в self-hosted-песочницах — воркеры Python/TypeScript/Go скачивают подключённое хранилище в песочницу по mount_path и синхронизируют изменения агента обратно (Use memory stores).
  • Ограничение доменов для web-инструментов — allowed_domains/blocked_domains на записи инструмента в configs, плюс max_content_tokens для web_fetch (Restrict web search and web fetch domains).
  • Переработанный просмотрщик сессий в Console: таймлайн-миникарта, транскрипт, сгруппированный по запросам к модели, панель Inspector со стоимостью, сырыми событиями и статистикой по инструментам.

Запись от 18 августа стоит ровно на кромке окна (прошлый прогон закончился в 09:11 UTC того же дня, а релиз-ноты датированы днём без времени) — включена, потому что в предыдущий дайджест не попала.

Новые практики

Скиллы 10 из 26 · ★30+

★3294

s1dashu/ip-as-logo-skillмедиа

Компактный скилл в открытом формате Agent Skills для генерации предельно упрощённых, скруглённых маскотов-логотипов с лёгкой нео-скевоморфной глубиной. Содержательно интересен не предметом, а тем, как жёстко зашита процедура: силуэт из 4–7 крупных примитивов, ровно три семантических цвета (два цвета IP плюс фон), сначала три направления на утверждение — потом шесть независимо сгенерированных кандидатов, «одна пачка за проход» без фильтрации и автоматических ретраев. Отдельное правило — промпты генерации никогда не упоминают слова «логотип», «бренд-марка», «иконка приложения», чтобы модель не скатывалась в иконочную стилистику. Формально возглавляет каталог окна и при этом дальше всех в нём от агент-разработки; см. «Оговорку о сигнале».

★940

nateherkai/scroll-craftдизайн

Скилл Claude Code для скролл-ориентированных сайтов, и интересен он не темой, а устройством контроля качества. Автор формулирует проблему как две крайности типового AI-вывода: либо приличная и забываемая страница, либо «яркая скролл-анимация с контрастом текста 2.1:1 и заголовком, который на телефоне переносится на шесть строк». Внутри — восемь взаимоисключающих «грамматик страницы» (filmic one-shot, chaptered editorial и другие): не темы, а разные модели навигации и разные концовки, так что три демо-сборки в README не делят общий скелет. Ключевая механика вынесена прямо в описание репозитория: скилл верифицирует себя, снимая скриншоты собственного скролла. MIT.

★927

Leutenegger/watermarks-removerмедиа

Скилл плюс Python-сервис на стандартной библиотеке, снимающий провенанс-метки AI из текста и файлов. Три слоя: (A) детерминированные скрипты против невидимого Unicode, экзотических пробелов, bidi и tag-символов; (B) статистические метки уровня token-sampling — переписыванием силами агента; (Files) C2PA/EXIF/XMP и свойства документов для двух десятков форматов от PNG до DOCX и MP4. Скилл — тонкий клиент, гоняющий сервис по HTTP, так что на хосте агента Python не нужен. Заявлено покрытие меток Claude, Gemini/SynthID-Text, OpenAI и открытых моделей класса Кирхенбауэра.

Важная оговорка. По метаданным GitHub это не форк (fork: false, создан 19.08), но README, включая CI- и релиз-бейджи, ссылается на guillaumemeyer/watermarks-remover — репозиторий, созданный 11.08 и набравший ★16227. То есть перед нами переопубликованная копия чужого проекта, собравшая ★927 собственных звёзд. Оригинал в окно не попадает по дате создания; ссылка на него дана, чтобы читатель шёл к первоисточнику.

★795

ShadowAqueduct/watermark-removerмедиа

Agent skill плюс сервис на stdlib Python, снимающий AI-провенанс-метки из текста и файлов: невидимый Unicode и bidi-символы детерминированной обработкой, статистические переписывающие хуки, C2PA и метаданные из PNG, JPEG, SVG, PDF, DOCX, HTML, MD. Скилл — тонкий HTTP-клиент, Python на хосте агента не нужен.

Это продолжение сюжета прошлого прогона, и оно поучительнее самого скилла. README сохранил CI-бейджи и ссылки на релизы оригинала — guillaumemeyer/watermarks-remover, у которого ★18380 и дата создания 11.08, — но поле «Author» переписано, а сам репозиторий не помечен как форк. В прошлом дайджесте в этой же роли фигурировал Leutenegger/watermarks-remover ★927; на момент этого прогона он отдаёт 404. За одно окно копия исчезла и её место заняла новая, набравшая ★795 за трое суток.

★303

bam-bam-2/solo-skillsпроцесс

Корейский набор из 26 скиллов «производственного кита одиночного предпринимателя»: продуктовые видео, вёрстка PDF электронных книг, блог-посты, протоколы встреч, клиентские переписки, ответы на комментарии. Автор утверждает, что автоматизировал 49 задач, ведя сообщество шесть наборов подряд, и выложил те 26, которые можно забрать как есть; остальные завязаны на его аккаунты и серверы и оставлены списком в fleet.md. Формат — обычный SKILL.md, работает в Claude Code, Codex, OpenCode; у восьми скиллов приложены исполняемые скрипты. MIT.

★279

alchaincyf/huashu-excelданные

Сквозной скилл анализа данных и Excel: диагностика грязной таблицы → чистка → согласование с постановкой задачи → анализ → сверка → выдача. Аргумент автора сформулирован через вопрос «а как ты это число посчитал?»: ответить обычно мешает не память, а то, что число с самого начала нельзя было проследить. И отдельно — что ошибающийся AI не бросает исключение: неверный код падает, неверный анализ данных молча выдаёт цифру. Заявлен как agent-agnostic, единственная зависимость — openpyxl. MIT. Найден только исправленным запросом.

★216

adnanakil/nobuzzпроцесс

Скилл /debuzz, который берёт последний ответ Claude и прогоняет его через другую модель (Gemini через CLI Antigravity), чтобы перевести с «миллениального кликбейта» на обычный язык. Автор описывает проблему как неизлечимое состояние хорошего инженера, который «говорит так, будто читает TED-доклад о собственном пул-реквесте»: спрашиваешь, почему тест флакует, получаешь «несущее допущение», три пронумерованных откровения и торжественную ремарку, что третье — самое поучительное. Конструктивно важна одна деталь: скилл обязан печатать перевод дословно, потому что если дать Claude «причесать» результат, ровно тот голос, который убирали, возвращается. Репозиторий занял 360 очков на HN 21.08 и в GitHub-поиск этого прогона не попал.

★156

yizhiyanhua-ai/fireworks-open-eli5медиа (организация)

Интерактивные визуальные объяснялки «с опорой на доказательства» для Codex и Claude Code, Apache-2.0, аккаунт-организация. Заявка — генерировать объяснение, у которого видно, на чём оно основано; проверить эту заявку по README в рамках прогона не удалось, поэтому здесь она приведена как заявка автора, а не как факт.

★125

itshen/source-reading-methodologyпроцесс

Методология превращения незнакомого большого репозитория в учебный курс: выбрать открытый проект, прочитать его исходники вместе с AI и выпустить результат, в котором каждое утверждение проверяемо. Четыре фазы, переиспользуемые шаблоны, список из 28 типовых граблей. Проверяемая часть: по этой методологии выпущены два курса разбора исходников — DeepSeek Harness и OpenAI Codex, суммарно 61 занятие, и автор утверждает, что в главах по Codex 1270 ссылок на исходники с номерами строк, выверенных побайтово. Книга-образец выложена онлайн. Цифры про курсы — заявление автора, в рамках прогона не перепроверялись. MIT.

★118

bendrape1-byte/silk-designдизайн

Скилл Claude Code для веб-интерфейсов, которые «хорошо двигаются». Диагноз тот же, что у scroll-craft: сгенерированные страницы выходят статичными — дефолтные скроллбары, секции, которые просто появляются, hover-состояния, которые ничего не делают. Решение проще: каталог приёмов анимации и дизайн-токенов плюс инструкция агенту тянуться к ним по умолчанию, а не только по просьбе. В README — семь реально задеплоенных сайтов, собранных этим скиллом. MIT, репозиторий на 81 КБ — самый лёгкий в верхней десятке. Найден только исправленным запросом.

Показать остальные 16 позиций и 28 строк ★ 10–30
★91

sidkh/term-radarпроцесс

Самый маленький содержательный скилл окна: весь он — 16 строк markdown. Идея — распознавать в собственных формулировках пользователя устоявшиеся термины предметной области и дописывать их под ответом агента со ссылкой на Google Images: «практическое знание, которым люди пользуются, но не могут внятно сформулировать» → tacit knowledge. Так словарь области набирается по ходу работы. Автор специально отмечает, что скилл спроектирован ненавязчивым и пропускаемым — длинных описаний в контекст он не кладёт. Лицензии в репозитории нет. Найден только исправленным запросом.

★79

KurosawaGeeker/femboy-skillвне темы

Китайский agent skill для MTF, кроссдресс- и гендерно-разнообразных взрослых, на базе открытой базы знаний, с медицинскими предохранителями. К агент-разработке отношения не имеет; в каталоге — только потому, что каталог ранжируется по звёздам, и как иллюстрация к «Оговорке о сигнале».

★61

OpenLabs-so/oa-designдизайнорганизация

Дизайн-язык продукта Open Analytics, упакованный тремя способами сразу: агентный скилл, типизированные рецепты компонентов и CLI (npx getopen-design). Каждый hex-код, радиус, easing и константа пружины взяты из отгруженного продукта, и к каждому приложено обоснование — репозиторий возник как ответ на вопрос «почему у вас дашборд так выглядит и двигается». Структура скилла показательна: SKILL.md с десятью правилами, таблицей пружин и индексом, _root.css с токенами, на который ссылается всё остальное, и по одному файлу-рецепту на компонент со встроенным исходником. Плюс DESIGN-SKILL.md — весь язык одним файлом для агентов, не читающих формат скиллов.

★57

pbshgthm/arc-skillпроцесс

Скилл, играющий в ARC-AGI-3 — 25 видеоигр, которые не объясняют своих правил, — имея на входе только идентификатор игры. Единственное правило: прежде чем нажать кнопку, агент обязан письменно предсказать, что изменится на сетке; харнесс отклоняет нажатие без предсказания и затем сверяет его с пришедшим кадром. Восемь форм утверждения (cell X,Y=V, move, region, vanish, level+1/win и др.), каждая оценивается отдельно, одна неверная часть — промах. По README: 7 627 оценённых предсказаний, 443 промаха, и промах ценнее попадания — он датирует точное нажатие, на котором модель мира разошлась с реальностью.

Результат — заявление автора: 25 игр из 25, 183 уровня из 183, RHAE 100.00 при 7 645 действиях против медианных 17 135 у человека, на Claude Code с Opus 5 без модификаций; приведена ссылка на скоркарту ARC 24ddb219. Сам скилл — 129 строк инструкции плюс CLI на 4 343 строки, и ни там, ни там ни одна из 25 игр не упоминается. Как метод «предсказание до действия» переносится далеко за пределы ARC.

★56

Cripacx/mediagenмедиа

Скилл генерации изображений и видео для Claude Code и других кодинг-агентов: Gemini, OpenAI и Kie AI за одним CLI и MCP-сервером. Отдельно заявлена маркировка контента по EU AI Act — редкий случай, когда медиа-скилл сразу учитывает регуляторику. MIT.

★56

nevertoday/xxd-panel-028вне темы

Превращение фотографий в «тихие» изометрические бумажные миниатюры в исходной палитре, четыре комбинируемые схемы вывода. Лицензии нет. К агент-разработке отношения не имеет.

★51

appeeky/ua-skillsинтеграция (организация)

Скиллы платного роста мобильных приложений, работающие поверх живых данных через APPEEKY MCP. Ещё один случай, когда организация упаковывает предметную экспертизу как скилл и раздаёт её как маркетинговый канал к собственному MCP-сервису.

★48

amElnagdy/review-skillsкод-качество

Один из двух самых практичных скиллов окна. debate-review устраивает разбор PR двумя моделями: основной ревьюер читает изменения, второй пытается сбить его находки, основной выносит окончательное решение. На PR ложится одна ревью с инлайн-комментариями, опубликованная из вашего же аккаунта gh, glab или az. Находки, пережившие спор, публикуются как согласованные; те, что второй ревьюер опроверг, а основной оставил, — как спорные, с аргументами обеих сторон. Второй скилл, babysit-pr, ведёт раунды дальше: проверяет каждую находку, чинит блокеры, отвечает в треде, резолвит и перезапускает ревью. Оба явно ограничены в правах: не редактируют код, не аппрувят, не реквестят изменения и не публикуют дважды для одного head sha. Работают через любой уже используемый агент. Ставится через npx skills add, в репозитории есть CI с тестами. MIT.

★48

mkanat/skillsкод-качество (сигнал вне звёзд: известный автор)

Автор — Макс Канат-Александер, Executive Distinguished Engineer в Capital One, до этого LinkedIn и Google, автор книг «Code Simplicity» и «Understanding Software». Единственный содержательный скилл в наборе — cleanup: он многократно ищет дублирование информации, повторную работу, лишний защитный код и случайную сложность.

Ценно здесь измерение, а не описание. Автор попросил Codex собрать полностью покрытую тестами инкрементальную систему сборки minibuild на GPT-5.6 Sol — с basedpyright в strict, ruff с включёнными ALL-проверками и 100% покрытием без моков, — и код сам не правил. Затем прогнал cleanup: пять раз подряд скилл отработал сам и сделал 9 значимых рефакторингов, ещё пять запусков вручную дали 23. На бенчмарке в 10 001 задачу вычищенная версия оказалась в 1.34 раза быстрее при меньшем потреблении памяти. Репозиторий содержит before/, after/, полный дифф и харнесс замера производительности — редкий случай, когда заявку скилла можно проверить, не устанавливая его. CC0-1.0.

★45

Neeeophytee/agent-stylebooksпроцесс

Шестнадцать редакционных систем, оформленных как переносимые Agent Skills: $google-developer-docs, $govuk, $gitlab-docs, $github-docs, $mdn-web-docs, $kubernetes-docs, $nhs-health-content, $cdc-clear-communication и другие. Тезис в подзаголовке: «выбери систему письма раньше, чем её выберет модель» — вместо «напиши лучше» агенту выдаётся конкретный свод. Каждый стайлбук задаёт, с чего начинать, в каком порядке подавать информацию, какие различения обязаны пережить редактуру, какая двусмысленность недопустима и как проверить результат. Выбор — по задаче читателя и типу артефакта, а не по организации, упомянутой в тексте. Есть PROVENANCE.md: это community-версии, выведенные из публично опубликованных руководств, а не официальные продукты.

★43

WalrusQuant/sports-analytic-skillsданные

Библиотека Agent Skills по спортивной аналитике для нескольких видов спорта. Формулировка автора — «переносимое суждение для спортивного моделирования»: доктрина, валидация, контроль утечек данных и честная оценка. Тот же жанр, что huashu-excel: предметная дисциплина, упакованная в скилл, чтобы агент не выдавал правдоподобные, но непроверяемые числа.

★39

liangdabiao/deepseek-v4-flash-vision-video-ragмедиа

Video RAG на визуальной модели DeepSeek: разбор видео по таймлайну с одноразовой индексацией кадров, затем локальный грубый отбор → визуальное переранжирование → развёрнутый ответ со ссылками вида [MM:SS] и автогенерируемой самодостаточной HTML-страницей с вырезанным фрагментом и ключевыми кадрами. Лицензии нет. Парная работа того же автора для PDF — ниже, на ★14.

★38

Neko3000/deepseek-whalechanвне темы

Спецификация консистентного дизайна персонажа, библиотека визуальных ассетов и набор для создания агентов вокруг маскота Whale-chan. Лицензии нет. К агент-разработке отношения не имеет.

★35

atinux/docsterдокументация (сигнал вне звёзд: известный автор)

Автор — Себастьен Шопен, создатель Nuxt, сейчас работает над open source в Vercel. Скилл помогает агентам писать документацию лучше, с поддержкой компонентов Comark. Репозиторий демонстративно минимальный — 17 КБ, README на 651 байт, всё содержание в SKILL.md; ставится через npx skills add atinux/docster. В credits честно указаны источники: скилл docs-writer из Gemini CLI и руководство по написанию документации Vue. MIT. Полезен здесь не столько сам скилл, сколько образец жанра: известный автор кладёт один файл и не делает вокруг него инфраструктуры. Найден только исправленным запросом.

★34

oil-oil/oil-skill-creatorпроцесс

Скилл для создания, ревью, доработки и публикации других скиллов — «писать скилл как продукт». Тезис вынесен в README цитатой: «прохождение статической проверки доказывает только отсутствие проблем в известной структуре, но не то, что скилл действительно полезен». Три режима: создание, Review (только чтение, отчёт по P0/P1/P2, файлы не трогает) и доработка (сохраняет неизменяемый снимок до правок, затем меняет точечно и перепроверяет). Заявленные проверки — границы срабатывания в обе стороны, читаемость для слабых моделей, расход токенов, нейтральность к хосту, кроссплатформенность; на выходе — тесты триггеров, агрегация результатов, локальная страница ревью и воспроизводимый пакет публикации. MIT.

★32

About-Intelligence/OpenCMOпроцессорганизация

Growth-плейбуки шестнадцати практиков (Cursor, Notion, Linear, Deel, Canva, Lovable, Grammarly, Wispr Flow) как устанавливаемый скилл. Ценность для агент-разработки — в дисциплине источников: каждый эксперт дистиллирован из первоисточников (транскрипты подкастов, подписанные эссе, собственные посты), и каждое утверждение несёт ссылку на то место, где оно было сказано. Это ровно тот приём, которого не хватает большинству «скиллов-сводок»: знание в скилле проверяемо по ссылке, а не выдаётся за общее место.

★10–30 — одной строкой

  • ★28blavkgokuvnn/single-agent-skillsпроцесс — два скилла Codex для дисциплины одиночного агента: anti-over-engineering и statem-single-agent; README на 288 байт — содержимое тоньше, чем звёздный вес.
  • ★28bydtesla1609/intent-debuggerпроцесс — прояснение требований и выравнивание намерения: превращает сырую идею в проверяемую постановку.
  • ★26angelwzr/linux-phone-portingинтеграция — скилл для портирования mainline Linux на Android-телефон; CC-BY-4.0.
  • ★26kharmanskyi/open-stepsпроцесс — переводит вывод кодинг-агента на человеческий: честные отчёты, прямые вердикты, выполнимые шаги. MIT.
  • ★26xjli360/sealeap-amazon-ad-skillsинтеграция — 9 «evidence-first» скиллов по рекламе Amazon: диагностика, архитектура кампаний, листинги, таргетинг, AMC.
  • ★23YinsenW/feishu-ppt-skillинтеграция — сборка слайдов Lark/Feishu через lark-cli: библиотека из 51 шаблона, бренд-токены, генерация XML и автопроверка вёрстки.
  • ★21musoyangrigor/scroll-video-website-skillмедиа — превращает видео в управляемый скроллом canvas с WebP-кадрами и прогрессивной загрузкой.
  • ★20ra1nyxin/immersive-vibration-response-skillвне темы — скилл управления носимым устройством из Codex/Claude Code/Cursor; к агент-разработке отношения не имеет.
  • ★19Tranz007/ux-skillsдизайн — набор скиллов для практикующих UX-дизайнеров: оспорить идею, найти слепые зоны, работать с реальной дизайн-системой и донести UX-намерение до разработки.
  • ★18leftzzzz/agents-spec-skillпроцесс — один канонический скилл для аудита AGENTS.md и наведения порядка в спеках, требованиях и техрешениях; принципиально без платформенных плагин-обёрток.
  • ★18RandalSchwartz/dart-sdk-skillsкод-качество — скиллы по версиям Dart и Flutter, языковым фичам, миграциям виджетов и поиску minSdk; автор — Рэндал Шварц (сигнал вне звёзд: известный автор). MIT.
  • ★16liangdabiao/xhs-business-validator-skillинтеграция — проверка бизнес-идеи по заметкам и комментариям Xiaohongshu с оценкой 0–100 и HTML-отчётом.
  • ★15CanerKocak/clanker-skillsпроцесс — «evidence-first» скиллы для Codex, Claude Code, OpenCode, Pi и Grok: планирование, ревью, анализ цепочек вызовов, аудит безопасности, качество данных.
  • ★15chyiiiiiiiiiiii/yiibuмедиа — папка телефонных клипов → готовый к публикации ролик 9:16 за один шаг, планка качества держится гейтами, а не памятью. MIT.
  • ★15johncattrall/keymap-aiинтеграция — аудит раскладок ZMK/QMK, настройка home row mods, слоевые трекболы, генерация диаграмм в CI. MIT.
  • ★14Avtr99/antidoteкод-качество — заставляет агента чинить причину, а не симптом: валидация один раз на границе вместо проверок вниз по стеку; упакован как плагин для семи хостов сразу.
  • ★14liangdabiao/deepseek-v4-flash-vision-ragмедиа — парная работа к video-RAG выше: вопросы к PDF с указанием страницы и показом её оригинала, включая сканы.
  • ★13whyrnld/banco-inter-api-skillинтеграция — неофициальный скилл по API Banco Inter (Pix, boleto, вебхуки, OAuth 2.0 + mTLS).
  • ★13seoskillsai/seo-skills-aiинтеграция — SEO-набор, заявленный сразу под Claude Code, Antigravity, Cursor, Windsurf, Copilot и Cline.
  • ★13398894496-arch/runtime36память — «второй мозг» для кодинг-агентов: закрыть день, дистиллировать в Obsidian, вернуться к странице завтра. MIT.
  • ★13Arnie936/ai-brand-kitдизайн — четыре немецкоязычных скилла Claude Code: установка → бренд-интервью → бренд-кит → сайты в фирменном стиле. Найден только исправленным запросом.
  • ★12NateBJones-Projects/developer-documentation-skillпроцесс — скилл техписателя, который сначала читает работающую систему, отделяет реализованное поведение от предложенного и проверяет итоговый Markdown встроенным валидатором.
  • ★12Boring-Stuff-Club/the-scribble-thing-skillмедиа — превращение штриховых иллюстраций в scribe-анимации; аккаунт-организация. MIT.
  • ★11NicholasSpisak/excalidrawмедиа — Claude Code и Codex рисуют настоящие диаграммы Excalidraw: флоучарты, вайрфреймы, слайды, SWOT, Lean Canvas. MIT.
  • ★11aiopshwang/goal-to-proofпроцесс — заставляет агента доводить нетривиальную работу до конца и подтверждать результат прямыми доказательствами по размеру задачи. MIT.
  • ★10MartinPuli/createAnAppпроцесс — evidence-gated набор для доведения Apple-приложения до релиза: агент обязан доказать каждый этап, успешная сборка не считается релизом, а апрув — не PMF; база требований перепроверена по первоисточникам 19.08.
  • ★10anhe2021212-spec/Turritopsisпамять — общее знание о проекте и передача контекста между кодинг-агентами на длинных проектах. MIT.
  • ★10automateyournetwork/pyATS_skillsинтеграция — скиллы pyATS для агентов: сетевая автоматизация Cisco. Найден только исправленным запросом.

Инструменты

Плагины и проекты 10 из 14 · ★30+

Инструменты вокруг агента: оркестраторы, интеграции, измерение работы и контроль расхода.

★1429

duty1g/x64dbg-mcp-serverинтеграция

Топ окна с большим отрывом и самый далёкий от скиллов пункт каталога. Нативный MCP-плагин для отладчика x64dbg, выставляющий всю его функциональность по HTTP: брейкпоинты, пошаговое исполнение, чтение памяти, дамп регистров. Подключается любой MCP-совместимый ассистент. Написан на Zig: без зависимостей, один бинарник, кросс-компиляция под x32 и x64 с любого хоста — ни.NET, ни Python, ни рантайма, плагин просто кладётся в каталог плагинов x64dbg. Транспорты — streamable HTTP и SSE, MCP 2024-11-05. MIT. Жанрово это не «скилл для Claude», а показатель того, куда расходится MCP: реверс-инжиниринг и ред-тим как обычный потребитель протокола.

★385

kgoedecke/doopдизайн

Открытая альтернатива Paper.design: многопользовательский дизайн-холст для людей и агентов. Каждый дизайн живёт на разделяемом Canvas (/c/<id>), внутри — Frames, артборды, рендерящие настоящий HTML в песочных iframe. Люди правят в браузере, агенты — через встроенный MCP-сервер, стримя свои дизайны вживую; курсоры, присутствие, правки фреймов, статус агента и лента активности видны всем одновременно. AGPL-3.0, есть облачная версия. Интересен как редкий пример, где агент — не отдельный режим работы, а ещё один участник на общем холсте.

★343

rome-os/romeпроцесс (сигнал вне звёзд: организация)

Заявка сформулирована прямо против доминирующей: «основной прогресс в AI даёт масштабирование моделей — Rome масштабирует другую ось, среду»: инструменты, рабочие процессы, память и интерфейсы, внутри которых агент работает. Практически это огороженная среда, где человек и агент работают вместе, а агенты строят собственные харнессы, проектируют собственные SOP и оркестрируют процессы под управлением человека; доказавшие себя способности закрепляются. Есть сайт, документация, «App Store» и облачная версия. MIT, TypeScript, аккаунт-организация.

★248

sodiumsun/agenttrailнаблюдаемость

Локальный открытый слой наблюдаемости для кодинг-агентов, и его центральная идея — сопоставление двух сигналов: declared (компонент и задача, над которыми агент говорит, что работает) против observed (файлы, которые он меняет прямо сейчас, включая правки уже «законченного»). Когда сигналы расходятся, видно, куда смотреть. Карта показывает 5–9 реальных компонентов со стрелками зависимостей и честными состояниями done / working / blocked; законченная карточка подсвечивается, если её файлы снова тронули. Работает с Claude Code, OpenAI Codex, Cursor и вообще любым агентом, который правит файлы. Запуск — npx agenttrail --open, без аккаунта, глобальной установки и телеметрии. MIT.

★84

jinzijian/EvoTraceпамять

Локальный компилятор траекторий: импортирует сессии Claude Code и Codex, уже лежащие на машине, отбирает те, что стоят сохранения, и компилирует их в preference-данные с доказательствами, воспроизводимые кодовые задачи, RL-окружения и кандидатов на execution-reward. Построен на DeepSeek Harness (продолжение волны, отмеченной в прошлом дайджесте), но сам не кодинг-агент и не требует менять привычный рабочий процесс. Автор честно помечает состояние: ранняя альфа, сгенерированные задачи и верификаторы остаются кандидатами, пока не пройдут документированные evidence- и Docker-гейты.

Сюжетно EvoTrace встаёт рядом с прошлонедельным Stealing Reasoning Traces: там трассы рассуждений вытаскивали из чужого API, здесь собственные траектории объявляются активом, который можно верифицировать и передавать.

★73

ADScanPro/Claude-ADбезопасность

Плагин Claude Code с методологией внутреннего пентеста Active Directory: скиллы, агенты и слэш-команды, задающие порядок фаз, ограничения среды, которые ломают инструментарий, телеметрию, которую оставляет каждая техника, и связь находки с контролем комплаенса (DORA/NIS2/ENS). Покрытые техники — Kerberoasting, ADCS ESC1-17, DCSync, злоупотребление ACL, NTLM relay, делегирование; управляет стандартным инструментарием: netexec, impacket, certipy, bloodyAD, BloodHound CE. Формулировка авторов про распределение ролей точная: «вы всё ещё ведёте проект — Claude несёт метод». MIT, версия 0.1.0.

★70

only-cli/ocинтеграция

oc open <url> забирает страницу и отдаёт компактный нумерованный вид вместо сырого HTML или скриншота: заголовок, пронумерованные ссылки и строка действий do <n> | read <n> | next | raw. Типичная страница — десятки тысяч токенов разметки; такой вид укладывается в несколько сотен. Ни адаптеров под сайты, ни расширения браузера, ни демона; запросы имперсонируют Chrome через impers, что заодно проходит блокировки, на которых спотыкаются наивные фетчеры. Поставляется тремя способами — npm-пакет, скилл web-browsing-cli и плагин-маркетплейс Claude Code; в репозитории есть llms.txt.

★68

addyosmani/factoryпроцессизвестный автор

Референсная «программная фабрика» — повторяемый цикл поставки, устанавливаемый в существующий GitHub-проект на стоковом Claude Code, с тонким адаптером под Codex. Ключевой тезис: никакого фонового процесса и своего оркестратора в репозитории нет. GitHub Issues становятся очередью работ, cloud-routines дают такт и вычисления, GitHub держит durable-очередь и pull request'ы, а каждый запуск стартует с чистого листа, обрабатывает одну стадию и записывает доказательства.

Что фабрика умеет: маршрутизировать новую issue в реализацию, спецификацию, именованный вопрос или известный блокер; брать разрешённую уставом мелкую работу, «застолбить» её без гонки с другим запуском и открыть draft-PR; прогонять детерминированные проверки типов, линта, тестов, сборки, аудита и архитектуры, падая закрыто, если обязательная проверка отсутствует; просить свежего верификатора прочитать диф вхолодную и доказать, что новый тест падает без реализации; останавливать производство, когда очередь ревью упирается в лимит. Формулировка автора: ценность начинается после генерации кода — это версионируемый метод решать, что агенту позволено брать без присмотра и какое доказательство человек получит перед финальным решением.

★68

Stupidoodle/swissdevjobs-cliинтеграция

Поиск и отклик по ~4700 вакансиям с открытыми зарплатами в семи странах из терминала или из агента: Python-CLI без зависимостей плюс MCP-сервер плюс плагин Claude Code. MIT. Пример уже сложившегося паттерна упаковки: один источник данных раздаётся сразу тремя интерфейсами, из которых агентный — не главный, а равноправный.

★65

forcewake/hermes-conductorмульти-агентность

Самый содержательный материал окна по многоагентной оркестрации. Продакшн-паттерны запуска внешних кодинг-агентов — Claude Code, OpenCode, Codex CLI, MiMo, agy и любых других, правящих файлы, — под одним kanban-контроллером Hermes Agent. Дирижёр работает в профиле «route-only» с явной установкой «не делай работу, только маршрутизируй»: декомпозиция, веерный запуск, верификация, интеграция. Каждый агент сидит в собственной worktree-полосе, а диффы, тесты и коммиты проверяет контроллер — принципиально не доверяя самоотчёту агента («zero trust in self-reports»). Заявленная основа — 18 продакшн-досок, 367 карточек, 566 диспатчей агентов и разборы инцидентов; цифры проверить в рамках прогона нельзя, это заявление автора. MIT.

Показать остальные 4 позиции и 18 строк ★ 10–30
★47

Bil0000/agents-fleetпроцесс

Пустой рабочий «источник правды» для Claude Code и Codex на macOS и Linux: согласованно держит правила, настройки, скиллы, команды, хуки, плагины, MCP-серверы, секреты, обновления и настройку Claude-Mem. В репозитории только движок и пустые каталоги — конфигурации автора там нет. Отдельно ценна инструкция по безопасности: форкать запрещено (форк публичного репозитория публичен), нужно делать приватный репозиторий из шаблона, а в стартовом промпте агенту явно предписано сперва проверить, что git remote get-url origin не указывает на исходный репозиторий. MIT.

★41

DavidCarliez/coverбезопасность

Двусторонний прокси приватности для кодинг-агентов на Go. Подобранные чувствительные значения заменяются локально на реалистичные детерминированные подстановки до того, как запрос уйдёт с машины, а в обычных и потоковых ответах совпадающие «фейки» переводятся обратно в оригиналы. Модель получает связный контекст, агент и инструменты продолжают работать с настоящим окружением. Политики — pseudonymize и placeholder (обратимые), а также mask, redact, block и allow. Apache-2.0, есть CI. Прямой ответ на вопрос, который в корпоративном контуре встаёт раньше всех остальных.

★37

yeswehack/claude-kitбезопасность (сигнал вне звёзд: организация)

Плагин от баг-баунти-платформы YesWeHack для отчётов, которые триажер может быстро проверить. Заявленный риск сформулирован точно и относится далеко не только к баг-баунти: AI ускоряет написание отчёта, но может дописать технические детали, которые никто не проверял. Поэтому инструмент составляет, структурирует и валидирует отчёт только из фактов, которые дал пользователь — реальные URL, пейлоады, ответы, наблюдаемое поведение, — а при нехватке спрашивает, а не догадывается. Одна установка добавляет постоянно действующий слой дисциплины на каждую сессию и три скилла по запросу: написание, триаж и проверки по классам уязвимостей. Плагин сам себе marketplace. GPL-3.0; есть разбор от платформы. Найден только исправленным запросом.

★27

janwilmake/agent-codemodeинтеграциясигнал вне звёзд: известный автор

Code mode для агента, которого вы уже запускаете: он уже залогинен во все ваши MCP-серверы, и этот пакет позволяет ему перестать дёргать их по одному инструменту за раз, а написать скрипт. Автор приводит измерение на живом воркспейсе из 39 тикетов Linear (задача — вытащить все In Progress тикеты с телами и посчитать вхождения «mcp»): путь через tool-call'ы — 262 159 символов (~65 500 токенов) и 40 последовательных round-trip'ов; путь через один скрипт — 903 символа (~226 токенов) и один round-trip. Оговорки автора важны и приведены им самим: счёт символов точен, токены — по грубой эвристике 4 символа на токен, и переносима именно пропорция, а не абсолютные числа. Второй аргумент сильнее первого: сорок последовательных вызовов каждый ждут решения модели, скрипт делает те же сорок запросов не останавливаясь на раздумья. Третий — точность: подсчёт вхождений в 262 159 символах модель делает приблизительно, скрипт — точно.

★10–30 — одной строкой

  • ★282005selene2005-a11y/susu-phone-agentинтеграция — мост к Android-устройству для Claude Code через MCP и Shizuku, без рута и без опроса модели. MIT.
  • ★23mcarlssen/claude-adversarial-reviewкод-качество — плагин, прогоняющий состязательное многоагентное ревью незакоммиченного диффа до коммита. Найден только исправленным запросом.
  • ★22VincentHHY/big-pictureпроцесс — плагины, держащие детали реализации ниже явной черты: ответ, который можно оценить и по которому можно действовать, не читая код. По умолчанию выключены, включаются на сессию. MIT.
  • ★22alhinawi/telegram-notifierинтеграция — универсальные уведомления в Telegram для Antigravity, Claude Code, Codex, Cursor и Windsurf, с удалённым управлением. Найден только исправленным запросом.
  • ★21dbl8005/sitrep-panelнаблюдаемость — живой локальный HTML-отчёт, который Claude обновляет по ходу работы: статус-борд, повествование, скриншоты, лог свежим сверху, live-reload. Без облака и сборки. MIT.
  • ★21shoebpate1/ai-agent-hacking-writeupsбезопасность — подборка публичных разборов атак на агентов: prompt injection, злоупотребление инструментами, отравление памяти, утечка данных. Найден только исправленным запросом.
  • ★19Akimiya-z/codex-guardкод-качество — GitHub Action и CLI, отбивающие PR от агентов с забытыми TODO, утёкшими секретами, неряшливыми коммитами и красным CI; работает с Codex, Claude Code и Copilot.
  • ★19SinghAbhinav04/dev-houseмульти-агентность — «команда разработки» внутри Claude Code: участники, которых вы создаёте, на выбранных моделях, со своими ролями, скиллами и правами. Найден только исправленным запросом.
  • ★17MrMarudi/academy-coachпроцесс — бесплатный плагин: изучение продуктов Anthropic по официальной программе Claude Academy плюс ревью вашей настройки и привычек против best practices Anthropic.
  • ★16bashebr/ai-native-sdlcпроцесс — скилл и плагин для Codex и Claude Code, реализующие AI-Native SDLC от Anthropic: Plan → Design → Build → Test → Deploy → Maintain с человеческими гейтами на каждой передаче. MIT.
  • ★15keli-wen/agy-staffмульти-агентность — нанимает Antigravity CLI (Gemini 3.7 Flash) как быстрого исполнителя для Claude Code и Codex: пять персон (/agy:staffer, researcher, reviewer, implementer, ask) плюс model-facing скилл управления фоновыми задачами.
  • ★15legoambarish/portable-handoffпамять — перенос работы между сессиями, моделями и инструментами без потери решений и поправок; схемы, скиллы и интеграции в одном пакете.
  • ★15l3a0/claude-pluginsинтеграция — личный marketplace с одним плагином kindle-highlights: дословное извлечение заметок Kindle с восстановлением обрезанных мест. Взял 45 очков на HN 24.08. MIT.
  • ★12nerdlab-dev/crmинтеграция — корейский установщик удалённого MCP для CRM-кампаний: Cafe24, KakaoTalk brand message, купоны, UTM; аккаунт-организация. MIT.
  • ★12ptmrio/harness-subagentмульти-агентность — вызвать Codex из Claude Code, Grok Build из Codex и так далее: родитель пишет бриф, диспатчит другой харнесс одноразовым сабагентом и синтезирует результат. Аргумент автора: модель, ревьюящая собственную работу, воспроизводит собственные слепые зоны, а иначе обученный харнесс — нет. MIT.
  • ★11Milkdomeda/ai-mechanical-3dcad-design-agentинтеграция — детерминированные процессы механического 3D-CAD, инженерные знания, валидация и MCP-инструменты для кодинг-агента. Не скилл: пакет, CLI и MCP-сервер, собственного LLM-клиента внутри нет.
  • ★11Jason-smithy/claude-certified-architect-foundations-ccao-fпроцесс — материалы подготовки к сертификации Anthropic Claude Certified Architect Foundations: пять доменов, 25 сценарных вопросов, гайд по MCP. MIT.
  • ★10montezuma-p/harkenмедиа — один статический бинарник 13 МБ на whisper.cpp: полностью офлайн-транскрипция экспорта чата WhatsApp или любого аудио, без Python, ffmpeg и API-ключа.

В завершение

Исследования и наблюдения 4 из 13

Короткие наблюдения, научные статьи и подходы — без попытки сделать их главной темой выпуска.

36HN

Show HN: Frugal Tokensпроцесс

Инструмент для разбора стоимости и расхода токенов сразу по нескольким кодинг-агентам. Тема окна повторяется третий прогон подряд (прошлый дайджест — tokentab, ★222): наблюдаемость трат превратилась в самостоятельную нишу с несколькими независимыми реализациями. Ссылка ведёт на демо, поданное на HN автором.

310HN

fx — tiny, open, native coding agent18.08

Кодинг-агент от Vercel Labs, написанный на Zig и выложенный под Apache-2.0. Позиционируется как фреймворк для исследований и встраивания в большие системы, а не как замена интерактивному CLI: бинарник 6,39 МБ, заявленный холодный старт 10 мкс, однозначные мегабайты памяти, сборки в WebAssembly и подключаемый сетевой стек. Интерфейс — shell-подобный, в духе Unix, а не тяжёлый TUI. Идея архитектуры прямо противоположна нынешнему тренду: минимальный системный промпт и минимум встроенных инструментов ради экономии токенов, а всё остальное приезжает через скиллы, плагины и MCP. Версия 0.0.4, авторы явно помечают проект как экспериментальный. Для дайджеста важно не «ещё один агент», а то, что модель «маленькое ядро + расширение скиллами» получила референсную реализацию у заметного вендора.

289HN

Huzzah — a novel approach to coding with AI20.08

Экспериментальный редактор Дэниела Вона, отталкивающийся от трёх претензий к чат-ориентированным агентам: нет надёжной записи человеческого намерения, императивные инструкции повторяются и жгут токены, многословный естественный язык прячет плотность информации. Предложение: промпт должен быть псевдокодом, декларативным и постоянным, а не длинным, императивным и одноразовым. Разработчик пишет файл .hz с упрощённым псевдокодом (в примере автора — fizz_buzz(n) / loop n / modulo 3 ? "fizz" / 5 ? "buzz"), и при сохранении система генерирует настоящий код. При правках Huzzah берёт дифф .hz и использует именно его как промпт, чтобы не пересылать неизменную часть. Автор сам называет ограничения: масштабируемость и работа с уже существующими кодовыми базами. Ценность — в постановке вопроса: спецификация намерения как версионируемый артефакт рядом с кодом.

19.08simonw

Conceptual integrity and counting lines of codeпроцесс

Саймон Уиллисон по мотивам выпуска подкаста Talking Postgres «How AI is Changing Software Development». Три тезиса. Первый: строки кода как метрика производительности для агентов внезапно осмысленны — объём, который агент выдаёт за день, несопоставим с ручным, и это реальный выигрыш, если качество держится. Второй, важнее: узкое место сместилось с производства на когнитивную ёмкость человека — один инженер физически не удерживает в голове кратно выросший объём кода, и команда остаётся нужна как способ распределить эту нагрузку. Третий: риск потери концептуальной целостности в смысле «Мифического человеко-месяца» — когда добавить фичу стоит одного промпта, исчезает трение, которое раньше принуждало к дисциплинированным решениям, и софт зарастает пристройками.

Конкретные числовые оценки в посте приводились через пересказ подкаста и здесь намеренно не воспроизводятся — по вторичным источникам, не подтверждено; тезисы взяты в той формулировке, которая стоит в самом посте.

Показать остальные 9 материалов
19.08simonw

smolmachines untrusted sandboxпроцесс

Он же: проверка smolvm 1.8.3 как песочницы для исполнения недоверенного кода — Python и JavaScript в аппаратно изолированных VM, а не в контейнерах. Заявлены офлайн-исполнение, сетевая изоляция, лимиты CPU/RAM, таймауты, квоты хранилища и read-only-монтирование входных данных; холодный старт 0,6–1,5 с, тёплый запуск около 50 мс. Для дайджеста интереснее метод, чем результат: работу вёл Claude Fable 5, и когда в окружении не оказалось поддержки виртуализации, агент переключился на прогон тестов через GitHub Actions — Уиллисон называет это «неустанно проактивным» поведением. Все материалы выложены отдельным исследовательским репозиторием: результаты, заметки и конфигурации воркфлоу.

414HN

My agent.md to improve LLM-assisted code quality21.08

Лучший результат окна на HN (обсуждение). Фабьен Сангляр описывает конкретную проблему: агентные IDE дали скорость, но качество вывода — «спагетти без структуры и комментариев», и он раз за разом повторял одни и те же замечания в каждой новой сессии, так что после чистки выигрыш в скорости обнулялся. Ответ — файл agent.md, который вкладывается в промпт в начале сессии. Правила конкретные и проверяемые, а не декларативные: минимум слов в текстах для человека; магические числа — в именованные константы; меньше вложенности, ранние возвраты; имена функций короче 30 символов; перечисления вместо булевых параметров; программирование по уровням абстракции с явными границами слоёв; семь правил на сообщения коммитов; починка бага начинается с теста.

Результат он формулирует сам: качество «резко улучшилось» и стало «очень близко к тому, что я написал бы руками». И тут же ставит границу: «LLM постоянно галлюцинируют, и доверять им нельзя. Я всё ещё много проверяю и итерирую, но теперь сосредоточен на архитектуре и дизайне, а не на стиле кода». Отдельно — приём против размывания контекста: держать сессии короткими и явно просить перечитать agent.md, когда качество поехало.

244HN

A week of using Codex more than Claude21.08

Лучан Гинда неделю вёл рабочие задачи в двух TUI параллельно: Codex на gpt-5.6-sol xhigh против Claude Code на opus-5 xhigh, macOS (обсуждение). Наблюдения конкретные: Codex писал на Ruby/Rails меньше комментариев и давал более простые, самодостаточные решения, тогда как Claude строил более сложные архитектуры с дополнительными абстракциями; Codex быстрее выдавал первые изменения, но дольше доводил PR до конца и ошибался с ветками, где Claude лучше понимал намерение разветвиться и держать работу синхронной. Вывод автора: «Claude пытается сделать больше, чем просили, и угадать, что тебе может понадобиться», а «Codex — скорее напарник, который делает, что сказали, но не переусердствует».

120HN

Headlong: A microharness for persistent agents24.08

Laude Institute и MIT выпустили открытый харнесс, в котором агент не реактивный, а непрерывный (обсуждение, репозиторий). Обычный харнесс замирает между задачами; Headlong держит агента в петле внутреннего монолога, даже когда внешнего ввода нет, так что агент сам расставляет приоритеты, ведёт собственные проекты и сводит несколько параллельных разговоров в один поток мысли. Авторы называют это «микрохарнессом» и настаивают на простоте и прозрачности: ядро — «меньше 10 тысяч строк Bash».

73HN

Your Agent Is Not the Model23.08

Джо Райт разводит понятия, которые в разговоре обычно слипаются (обсуждение). Модель — только математическое ядро, обученная сеть. Агентная система — три взаимозависимых слоя: модель, инференс-сервис, который её хостит, и харнесс, слой прикладной логики, формирующий вход, трактующий выход и подключающий инструменты. Практическая польза диагностическая: плохие рассуждения обычно означают, что харнесс не дал модели контекста; медленный инференс — проблема инфраструктуры; сорванная интеграция инструментов — почти всегда харнесс. Формулировка автора: «Когда ты можешь назвать слой, ты можешь починить слой». Одна и та же модель ведёт себя по-разному в Claude Desktop, Cursor, ChatGPT и самописном LangChain именно из-за различий харнесса.

—блог

More than just code review22.08

Саймон Уиллисон: ключевой навык продуктивной работы с кодинг-агентами — уметь уверенно поручить изменение и уверенно проверить, что оно сделано правильно, — и это не обязательно означает прочитать каждую строку. Его аргумент в пользу: построчное ревью и исторически было недостаточным способом валидации изменений. Цитата: «Ключевой навык продуктивного использования кодинг-агентов — уметь уверенно поручить им, как внести изменения, и затем уверенно проверить, что эти изменения внесены правильным образом». Прямо рифмуется с agent.md Сангляра, который перенёс внимание со стиля кода на архитектуру.

—блог

Fable & The End of the Free Lunch23.08

Уиллисон цитирует Дрю Бройнига (оригинал): с появлением премиальных моделей вроде Fable больше нельзя рассчитывать, что следующая модель решит проблему сама. Приходится решать, какая работа уходит на дорогую фронтир-модель, а какая — на дешёвую, и внимание смещается со «подождём следующего релиза» на стратегию контекста и способ работы. Цитируемая фраза Бройнига: «Мы стали думать, какая работа куда идёт». Для практики это ровно та рамка, в которой стоит читать появившиеся в этом же окне настройки promptCacheTtl/subagentPromptCacheTtl и modelPricing в CLI.

51HN

Agentic Context Management: Memory and Cost as Architecture Problems26.08

Препринт arXiv, поднявшийся на HN в последний день окна (обсуждение). Заявленный тезис — рассматривать память и стоимость агента как архитектурные задачи, а не как параметры настройки. Содержание работы в рамках прогона не читалось, здесь приведены только название, ссылка и факт попадания в окно; по вторичным источникам не пересказывается.

79HN

Characterizing Agentic Flooding of Government Services24.08

Препринт про заваливание государственных сервисов агентным трафиком (обсуждение). Не читался; включён как сигнал о том, что тема «агенты как источник нагрузки на публичную инфраструктуру» вышла на HN, а не как пересказ выводов.

Замечено, но не подтверждено

  • A/B-тест сниженных уровней effort в Claude Code — 215 очков на HN 22.08 (обсуждение). Первоисточник — пост в X, то есть наблюдение одного пользователя. Официального подтверждения нет, в CHANGELOG за окно ничего соответствующего не появилось. По вторичным источникам, не подтверждено.
  • Agent Lightning v1.0 — 55 очков на HN 24.08; релиз Microsoft, содержание релиза в рамках прогона не разбиралось.
  • Сбои Claude и API — 76 и 32 очка на HN 24.08 (статус-страница): повышенный уровень ошибок на нескольких моделях. Для агент-разработки значимо только как фон, но окно им задето.

Проверка

Источники

Ссылки на первичные материалы, поисковые запросы и данные, использованные в выпуске.

Открыть полный список источников

github.com/anthropics/skills/pull/1605 · github.com/anthropics/skills — skills/academy-guide · github.com/anthropics/claude-plugins-official/pull/5424 · raw.githubusercontent.com — claude-code CHANGELOG.md · platform.claude.com — Claude Platform release notes · platform.claude.com — Managed Agents: Session budgets · platform.claude.com — Managed Agents: advisor · platform.claude.com — Managed Agents: skills from GitHub · platform.claude.com — Managed Agents: memory stores · platform.claude.com — Managed Agents: restrict web domains · fx.sh · danielvaughn.dev — Huzzah · demo.frugaltokens.com · machine0.io · simonwillison.net — Conceptual integrity and counting lines of code · simonwillison.net — smolmachines untrusted sandbox · github.com/simonw/research — smolmachines-untrusted-sandbox · oreilly.com/radar — The AI Agents Stack (2026 Edition) · arcprize.org — скоркарта 24ddb219 · github.com/guillaumemeyer/watermarks-remover · github.com/anthropics/skills/pull/1623 · claude-plugins-official/pull/5595 · /5597 · /5598 · /5600 · github.com/anthropics/claude-code — CHANGELOG.md · anthropic-sdk-python — MIGRATION.md · fabiensanglard.net — My agent.md · allaboutcoding.ghinda.com — A week of using Codex more than Claude · laude.org — Headlong · code.joejag.com — Your Agent Is Not the Model · simonwillison.net — More than just code review · simonwillison.net — Fable & The End of the Free Lunch · dbreunig.com — Fable & the end of Moore's Law · arxiv.org/abs/2607.21503 · arxiv.org/abs/2608.16603 · status.claude.com — инцидент vgz5psbjmt1h · yeswehack.com — Triager-grade reports with Claude Code