Anthropic: Claude Tag уже закрывает 65% PR в Claude Code

Независимый обозреватель Саймон Уиллисон опубликовал транскрипт беседы, которую он вёл на конференции AI Engineer World's Fair с Cat Wu и Thariq Shihipar, сотрудниками команды Claude Code в Anthropic. Полное видео разговора выложено на YouTube, текст ниже, сокращённая и отредактированная версия с примечаниями Уиллисона.
Главный факт разговора: Claude Tag, новая коллективная интеграция Claude в Slack, запущенная примерно за неделю до беседы, уже закрывает 65% PR продуктовой инженерии в самой команде Claude Code, то есть больше половины всех PR команды. Cat Wu объяснила механику инструмента. Claude Tag живёт в Slack-канале команды и по умолчанию работает многопользовательски: над одним PR по очереди могут высказываться разные коллеги. Он умеет действовать проактивно, можно один раз попросить его следить за багрепортами в канале, самому открывать PR с исправлением и отмечать инженера, который последним трогал этот участок кода, и Claude Tag будет делать это без повторных команд, пока существует канал. Третье отличие, командная память: если сказать Claude Tag в канале о своих предпочтениях (например, разбираться с авариями, но не с предупреждениями), он запомнит это на будущее для всей команды. По словам Thariq Shihipar, Claude Tag используют и непрограммисты: например, маркетинг задаёт вопросы о статусе фич и метриках, а Claude Tag ищет ответы по истории Slack-канала и по коду продукта.
Оба собеседника описали, как изменился процесс разработки внутри Anthropic. Cat Wu: новые функции Claude Code сначала выкатываются только сотрудникам Anthropic, этот процесс внутри компании называют dogfooding, а в шутку ещё и "ant fooding", и наружу идут только те функции, что показывают удержание пользователей в этой внутренней когорте. Так у каждого инженера есть чёткая планка, к которой стремиться. Критические изменения в Claude Code по-прежнему проходят ручное ревью, но для "внешних слоёв" продукта команда всё больше полагается на автоматизированное ревью кода.
Изменились и рекомендации по промптингу. По словам собеседников, добавлять примеры в системный промпт больше не считается лучшей практикой для моделей уровня Fable 5 или даже Opus 4.8, как и длинные списки запретов вида "не делай X, не делай Y", на новых моделях это может даже снижать качество ответов. В результате системный промпт самого Claude Code недавно сократили на 80% по объёму.
Thariq Shihipar заявил, что классическое правило разработки "никогда не переписывай кодовую базу с нуля" (из книги The Mythical Man-Month) больше не работает: при хорошем наборе тестов переписывание теперь оправдано, а сама кодовая база, по сути единственная реальная спецификация системы, которую можно перегнать в новую версию. В качестве примера он привёл переписывание Bun на Rust: внутри Anthropic эта версия уже используется, а с 17 июня Claude Code официально перевели на переписанную на Rust версию Bun для всех пользователей.
Ещё из разговора: в Anthropic верят в автономный auto-режим (агент действует без ручного подтверждения каждого шага) как в технологию, которая делает возможным Claude Tag; Thariq посоветовал компенсировать то, что он назвал "эффектом Deep Blue", риск ослабления собственных инженерных навыков при постоянной работе с кодинг-агентами, тем, чтобы браться за более амбициозные задачи. Fable, ещё один упомянутый инструмент Anthropic, умеет монтировать видео, и Thariq использовал его для монтажа ролика о запуске самого Fable. Собеседники связали успехи Anthropic с культурой открытой работы внутри компании, тем, что сотрудники используют Claude Tag в общедоступных для всей компании Slack-каналах.
Ключевые факты
- Саймон Уиллисон опубликовал транскрипт беседы с Cat Wu и Thariq Shihipar из команды Claude Code (Anthropic) с конференции AI Engineer World's Fair.
- Claude Tag, слэк-интеграция, запущенная примерно за неделю до беседы, уже закрывает 65% PR продуктовой инженерии команды Claude Code.
- Новые функции Claude Code сначала выходят только для сотрудников Anthropic и попадают к внешним пользователям, лишь если показывают удержание у этой внутренней аудитории.
- Системный промпт Claude Code сократили на 80%: добавление примеров и списков запретов больше не лучшая практика для моделей вроде Fable 5 и Opus 4.8.
- По словам Thariq Shihipar, команда переписала Bun на Rust, и с 17 июня Claude Code у всех пользователей работает на этой переписанной версии.
Почему это важно
За полтора года с запуска Claude Code (он начинался как один пункт в анонсе Claude Sonnet 3.7) команда Anthropic прошла путь от ручной проверки каждого действия агента до почти полностью автономного auto-режима, а теперь и до коллективного агента Claude Tag, который берёт на себя большинство рутинных PR. Это конкретный, с цифрами, пример того, как быстро внутри одной команды меняется сам процесс разработки софта под влиянием ИИ-агентов.
Кому это важно
Инженерным и продуктовым командам, которые оценивают, стоит ли внедрять коллективных ИИ-агентов в командные чаты вроде Slack; тимлидам, пересматривающим политику ревью кода и промпт-инжиниринга под новые модели; всем, кто планирует крупное переписывание legacy-кода и раздумывает, оправдано ли оно.
Как это применить
Из рассказа команды Claude Code можно вынести практические ходы: выкатывать новые функции сначала внутренней команде и мерить удержание, прежде чем показывать их всем; заводить агента в Slack-канал с правом проактивно реагировать на баг-репорты и открывать PR, а не только отвечать на прямые команды; для современных моделей, убирать из системных промптов длинные списки примеров и запретов "не делай X"; при переписывании кода с нуля в первую очередь заботиться о полном тестовом покрытии.
Можно ли доверять
Материал, прямой транскрипт беседы, которую независимый и известный в AI-сообществе автор Саймон Уиллисон лично вёл на публичной конференции AI Engineer World's Fair с двумя названными поимённо сотрудниками Anthropic; полное видео выложено на YouTube, слова можно сверить с оригиналом. При этом собеседники, сами сотрудники Anthropic, рассказывающие о собственных продуктах (Claude Code, Claude Tag, Fable), поэтому цифры вроде "65% PR" и выводы вроде "при хорошем наборе тестов переписывание кода теперь оправдано" стоит воспринимать как внутренний опыт одной команды, а не как независимо проверенную статистику.
Риски и подводные камни
Показатель "65% PR" относится только к продуктовой инженерии команды Claude Code внутри Anthropic, переносить его на любую другую команду или компанию без такого же масштаба dogfooding и таких же топовых моделей нет оснований. Советы вроде "при хорошем наборе тестов переписывание кода оправдано" или "примеры в промпте больше не нужны" сформулированы для моделей уровня Opus 4.8 и Fable 5 и могут не сработать с моделями послабее. Сами собеседники признают риск деградации собственных инженерных навыков при постоянной работе с кодинг-агентами ("эффект Deep Blue") и предлагают компенсировать его лишь личной установкой браться за более амбициозные задачи, а не системным изменением процесса.
«Claude Tag сейчас закрывает 65% наших PR по продуктовой инженерии, и это огромный сдвиг, это больше половины всех наших PR.»
— Cat Wu, команда Claude Code, Anthropic