Утечка Claude 3.5 и появление Gemini 3.5 в чат-боте Arena изменили расстановку сил в гонке ИИ-моделей

Крупная утечка, связанная с еще не выпущенной моделью Anthropic Claude Sonnet 4.8, свежие спекуляции вокруг нового семейства моделей Claude «Cardinal» и тихое появление вариантов Gemini 3.5 от Google в популярном бенчмарке LMSYS Arena превратили эту неделю в поворотный момент для наблюдателей за рынком ИИ, аналитиков и создателей контента, отслеживающих такие каналы, как новостная серия об ИИ от Джейлина Уильямса (Jaylin Williams).
Claude Sonnet 4.8: что на самом деле раскрывает утечка
История с Claude Sonnet 4.8 началась с ошибки при упаковке npm-библиотеки Anthropic @anthropic-ai/claude-code. Разработчики обнаружили, что файл source-map объемом 59,8 МБ был случайно опубликован как часть обновления от 31 марта 2026 года. Это открыло доступ примерно к 512 000 строк внутреннего кода на TypeScript и более чем 1900 исходным файлам, связанным с продуктом Claude Code. Хотя данные клиентов, учетные данные или работающие системы не пострадали, отладочный пакет содержал внутренние ссылки, которые никогда не должны были стать публичными.
Среди этих ссылок оказалась строка «sonnet-4-8», указанная во внутреннем списке «запрещенных строк» или фильтре Undercover Mode, предназначенном для того, чтобы инженеры случайно не упоминали невыпущенные версии моделей в логах, текстах интерфейса или сообщениях коммитов. Согласно сообщениям, в том же списке значились «opus-4-7» и кодовые имена, такие как «mythos», что намекает на более широкую «дорожную карту» флагманского семейства Claude от Anthropic.
Важно отметить, что утечка содержала инфраструктурный код и конфигурации, а не чекпоинт модели или веса. Не было ни публичной карточки модели, ни документации API для эндпоинта Sonnet 4.8, ни таблиц с результатами тестирования. Это означает, что единственный подтвержденный факт, вытекающий из утечки, — это то, что Anthropic использует строку версии Sonnet 4.8 внутри своих инструментов, а компания как минимум планирует или тестирует новое поколение линейки среднего уровня Sonnet.
Тем не менее, этот инцидент вызвал бурные спекуляции. В ИИ-сообществе начали циркулировать утверждения о таких улучшениях, как двузначный прирост производительности в задачах программирования, значительный скачок в точности распознавания визуальных данных и новые фоновые «агентные» возможности для выполнения длительных задач. Хотя эти заявления, по-видимому, основаны на упоминаниях в отладочном коде и экстраполяции данных из недавних релизов Claude 4.x, ни одно из них не было подтверждено Anthropic.
По состоянию на середину августа 2026 года официального релиза Claude Sonnet 4.8 через API Anthropic, Amazon Bedrock или Google Cloud Vertex AI все еще нет. Anthropic охарактеризовала событие как человеческую ошибку при упаковке, потребовала удалить тысячи зеркальных копий пакета из публичных репозиториев и не давала публичных обещаний выпустить модель под брендом Sonnet 4.8.
Кодовые имена моделей Anthropic: Cardinal, Capybara и другие
Дискуссия вокруг Sonnet 4.8 привлекла внимание к растущей сети внутренних кодовых имен моделей Claude от Anthropic. Более ранний анализ утекшего исходного кода Claude Code выявил такие названия, как Fennec (связанное с моделью класса Opus 4.6), Capybara (связанное с экспериментальным уровнем, который, как сообщается, по своим возможностям превосходит Opus) и Numbat для моделей, находящихся на стадии тестирования.
В этом контексте разговоры в сообществе о линейке, предварительно названной Claude «Cardinal», усилились. Хотя подробностей по-прежнему мало, комментаторы описывают Cardinal как потенциальное новое семейство или подкатегорию, которая может занять нишу между существующими предложениями Sonnet и Opus, либо как внутреннее направление, ориентированное на инструменты, программирование и постоянных агентов. На данном этапе Cardinal выглядит скорее как предполагаемое кодовое имя и намек на планы развития, чем как готовый продукт с публичной карточкой модели.
Намеренное молчание Anthropic подтверждает закономерность, которой компания следовала в предыдущих циклах: внутренние строки версий и кодовые имена часто появляются в инструментах и утечках за месяцы до любого официального анонса. Присутствие названий вроде Sonnet 4.8 или Cardinal в коде не гарантирует, что эти модели будут запущены под именно такими именами или что все они вообще дойдут до публичного релиза.
Gemini 3.5 выходит на арену
Пока Anthropic разбирается с последствиями утечки исходного кода, новейшие модели Google производят фурор совсем иным способом: появляясь в Chatbot Arena от LMSYS — краудсорсинговом бенчмарке, где большие языковые модели соревнуются друг с другом в слепых сравнениях.
В последние недели в таблице лидеров Arena появились новые варианты, помеченные как Gemini 3.5. Хотя Arena обычно использует анонимные идентификаторы для моделей, проходящих слепое тестирование, накопилось достаточно метаданных и тенденций производительности, чтобы наблюдатели могли связать несколько высокорезультативных участников с новым поколением Gemini от Google.
Первые впечатления сообщества говорят о том, что Gemini 3.5 сохраняет или улучшает сильные стороны Gemini 1.5 в работе с длинным контекстом и мультимодальностью, при этом делая упор на более строгое следование инструкциям и улучшенную производительность при написании кода. Во многих «слепых» матчах Arena пользователи отмечают, что модели класса 3.5 более отзывчивы в повседневных чатах и задачах на рассуждение, демонстрируя конкурентные результаты по сравнению с топовыми системами от Anthropic и OpenAI.
Поскольку Chatbot Arena опирается на добровольные краудсорсинговые оценки, ее рейтинги не имеют такого веса, как формальные академические бенчмарки. Тем не менее, таблица лидеров стала важным реальным индикатором того, как модели ведут себя «в дикой природе», фиксируя качественные факторы, такие как стиль, ясность и надежность, которые сложно свести к единому числовому показателю.
Как создатели контента освещают эти изменения
Череда быстрых событий — утечки, кодовые имена и новые записи в бенчмарках — дала много материала создателям контента в сфере ИИ. Среди них Джейлин Уильямс, чей новостной контент (включая эпизод, упомянутый в списке Mshale) объединяет такие истории, как утечка Claude Sonnet 4.8, слухи о линейке Claude Cardinal и появление Gemini 3.5 в Arena, в доступные сводки для разработчиков и энтузиастов.
В этих обзорах создатели обычно выделяют три темы:
- Усиление конкуренции между пограничными моделями, поскольку Anthropic, Google и OpenAI развиваются быстрыми темпами, используя как официальные запуски, так и тихую оценку в публичных бенчмарках для проверки своих возможностей.
- Непрозрачность и утечки как повторяющиеся проблемы, когда внутренние инструменты и отладочные артефакты становятся неожиданным окном в «дорожные карты» компаний задолго до официальных заявлений.
- Практическое влияние на пользователей: от разработчиков, задающихся вопросом, когда они смогут получить доступ к производительности уровня Sonnet 4.8, до бизнеса, оценивающего, стоит ли строить свои решения на базе Claude, Gemini или их комбинации.
На что обратить внимание дальше
Заглядывая вперед, можно выделить основные вопросы для пользователей и наблюдателей. Анонсирует ли Anthropic официально модель Sonnet 4.8 или Cardinal в ближайшие месяцы, и если да, то как она будет позиционироваться по отношению к Opus и конкурирующим системам от Google и OpenAI? Трансформируются ли возможности, намеки на которые содержатся во внутреннем коде — от более мощного программирования и анализа изображений до более устойчивых агентов — в доступные, готовые к промышленному использованию функции?
Что касается Google, все внимание приковано к тому, как быстро линейка Gemini 3.5 перейдет от экспериментов в Arena и ограниченного внедрения к широкой доступности в Google Cloud и потребительских продуктах. Любое изменение цен, длины контекста или возможностей дообучения может перекроить рынок выбора провайдеров стартапами и предприятиями.
На данный момент ландшафт характеризуется контрастом: непреднамеренная утечка от Anthropic дает представление о том, куда может двигаться Claude, в то время как Gemini 3.5 от Google ищет подтверждения в открытой конкуренции. Вместе они сигнализируют о создании ИИ-экосистемы, где «дорожные карты» продуктов становятся все более заметными — не только через пресс-релизы, но и через код, кодовые имена и коллективное суждение пользователей, испытывающих эти системы на прочность.


