allnewscastallnewscast
Срочные новости
AI & Tech

ИИ испытали на истребителе F-16, а на выставке Chelsea Flower Show представили садовые технологии

Nic Reeve4 мин чтения
ИИ испытали на истребителе F-16, а на выставке Chelsea Flower Show представили садовые технологии

Этим летом искусственный интеллект совершил очередной заметный скачок от лабораторных демонстраций к реальным системам: одна программа управляла полетом истребителя F-16, а другая стала центральным элементом выставки цветов в Челси. В этот же период появились новые продукты и обновления платформ в сфере дизайна с поддержкой ИИ и потребительских инструментов, что подчеркивает скорость распространения этой технологии в оборонной сфере, творчестве и повседневном программном обеспечении.

В ходе наиболее впечатляющих военных испытаний компания Lockheed Martin сообщила, что ИИ-агент управлял глубоко модифицированным F-16 в 27 перехватах реальных целей в рамках восьми вылетов на базе ВВС Эдвардс в Калифорнии. Самолет использовал контейнер Lockheed Martin Legion Pod для отслеживания цели, а данные целеуказания передавались бортовому ИИ, который затем выводил истребитель в позицию для перехвата. По заявлению компании, тест продемонстрировал ускорение цикла «датчик-действие» в боевых условиях, при этом пилот оставался частью системы безопасности на протяжении всех испытаний.

В отдельном отчете о работе ВВС США и DARPA по проекту VENOM говорится, что модифицированный F-16 совершил полет под управлением ИИ на базе ВВС Эглин во Флориде, при этом в кабине находился пилот, готовый в любой момент взять управление на себя. Программа началась с проверочных полетов в июне 2026 года для тестирования оборудования и обновления программного обеспечения, а в июле перешла к миссиям, в которых ИИ брал на себя часть полетных задач. Эти испытания вместе показывают, как автономность выходит за рамки симуляций и переходит к контролируемым операциям в воздухе на реальных летательных аппаратах.

Оборонная значимость заключается не просто в том, что алгоритм может пилотировать самолет, а в том, что он может делать это неоднократно в ограниченных операционных условиях. Согласно отчетам, ИИ-система была интегрирована с модернизированным оборудованием и датчиками, а не с полностью переработанным самолетом, что говорит о текущем акценте на интеграции и надежности, а не на прямой замене пилотов. Это различие важно, поскольку оно показывает, что технология позиционируется как инструмент повышения боевой эффективности, а не как самостоятельная замена человеческому суждению.

В то же время выставка цветов в Челси представила совершенно иную картину расширения сферы влияния ИИ. Репортажи с выставки 2026 года выделили инструменты для ландшафтного дизайна и мониторинга растений с поддержкой ИИ, включая платформу Spacelift, представленную как систему, помогающую домовладельцам планировать, проектировать и обустраивать открытые пространства. Дебют этой платформы отразил более широкую тенденцию выставки: искусственный интеллект все чаще используется для формирования ландшафтов, а не просто для их анализа.

При этом история с ИИ в Челси не ограничилась только дизайнерским софтом. В репортажах BBC о событии 2026 года описывалась технология сканирования здоровья растений, получившая признание на выставке, а другие материалы отмечали ИИ-инструменты, помогающие садоводам понимать уровень стресса растений, их потребность в поливе и долгосрочном уходе. Королевское садоводческое общество также связывают с планами по более широкому внедрению ИИ в базы данных растений и планирование садов, что предполагает, что технология может стать частью практического инструментария мероприятия, а не просто разовой новинкой.

Реакция в садоводческом сообществе оказалась неоднозначной. Некоторые дизайнеры рассматривают ИИ как полезное вспомогательное средство, ускоряющее верстку проектов, улучшающее визуализацию и помогающее принимать решения по уходу. Другие опасаются, что технология может привести к созданию шаблонных дизайнов или обесценить мастерство ландшафтных дизайнеров. Это напряжение было заметно в освещении выставки в Челси 2026 года, где сады, созданные или спроектированные с помощью ИИ, стали отдельной темой для дискуссий.

Что объединяет испытания F-16 и выставку в Челси, так это не сама технология, а этап, которого она достигла. В обоих случаях ИИ переходит из области теоретических презентаций в прикладные среды с реальными ограничениями: в одном случае это сложная динамика полета, в другом — живые экосистемы и ожидания клиентов. Основной посыл один: ИИ становится все меньше абстрактным обещанием и все больше — прикладным инструментом.

Этот сдвиг также поднимает более широкий отраслевой вопрос. Поскольку ИИ-системы развертываются в таких разных областях, как военная авиация и ландшафтный дизайн, критерий успеха смещается от базовых возможностей к надежности выполнения задач. Может ли система действовать безопасно, предсказуемо и последовательно при изменении условий? Могут ли люди эффективно ее контролировать? Может ли технология давать результаты, которые действительно нужны пользователям? Последние примеры показывают, что эти вопросы теперь являются центральными при оценке ИИ.

На данный момент мы наблюдаем стремительную диверсификацию. Истребитель может частично управляться ИИ-агентом. На выставке цветов могут быть представлены инструменты дизайна и мониторинга здоровья растений с поддержкой ИИ. Потребительское программное обеспечение претендует на то, чтобы помогать людям создавать и управлять открытыми пространствами с помощью машинных алгоритмов. Общая нить заключается в том, что ИИ больше не ограничивается демонстрациями программного обеспечения; он все чаще тестируется в физическом мире, где последствия очевидны, а стандарты значительно выше.

Читать далее

Похожие материалы

Совет директоров Microsoft столкнулся с иском акционеров из-за авторских прав в ИИ и нераскрытия информации
AI & Tech

Совет директоров Microsoft столкнулся с иском акционеров из-за авторских прав в ИИ и нераскрытия информации

AInews: Совет директоров Microsoft столкнулся с производным иском из-за авторских прав на ИИ и раскрытия информации 30 июня 2026 года в Западном окружном суде Вашингтона был подан производный иск от имени акционеров, в котором директора и должностные лица Microsoft обвиняются в дезинформации инвесторов относительно стратегии компании в области ИИ и подвергании компании рискам, связанным с авторским правом и биометрической конфиденциальностью. Юридические аналитики отмечают, что это дело может изменить подход к оценке рисков на уровне совета директоров для компаний, ориентированных на ИИ, и уже отслеживается под рубрикой AInews. В чем суть нового иска против руководства Microsoft? В производном иске «Андерсон против Наделлы» утверждается, что высшие руководители и директора Microsoft нарушили фидуциарные обязанности, утвердив публичные заявления, которые искажали информацию о том, как обучались и развертывались продукты компании в сфере ИИ, в то время как компания якобы полагалась на защищенные авторским правом произведения и голосовые данные без законных лицензий. Основные претензии касаются того, как Microsoft представляла инвесторам свою дорожную карту развития искусственного интеллекта начиная с 1 января 2022 года. Истец, акционер Эрик Андерсон, подает иск от лица компании, а не от собственного имени — такая структура иска направлена на взыскание убытков в пользу самой Microsoft. В иске фигурируют такие высокопоставленные лица, как: Сатья Наделла — председатель и генеральный директор Microsoft, ответственный за продвижение стратегии компании «ИИ прежде всего». Эми Худ — финансовый директор, которая подписывала финансовую отчетность и прогнозы, связанные с ИИ. Джаред Спатаро — руководитель, курирующий маркетинг Copilot и ИИ для бизнеса (AI at Work). Раджеш Джа — исполнительный вице-президент по устройствам и сервисам, связанный с интеграцией Copilot в продукты компании. Другие директора Microsoft, утвердившие доверенности и публичные отчеты. Согласно обзору Bloomberg Law от 1 июля 2026 года, в иске утверждается, что руководство и совет директоров Microsoft «ввели акционеров в заблуждение, скрыв тот факт, что инструменты искусственного интеллекта обучались на материалах, защищенных авторским правом». Мониторинг политики от Mishcon de Reya описывает это дело как направленное против «ложных и вводящих в заблуждение заявлений о стратегии в области ИИ, семействе продуктов Copilot и финансовых результатах». Почему вопросы авторского права и использования данных оказались в центре иска? В иске утверждается, что директора Microsoft поддержали стратегию ИИ, которая зависела от обучения моделей на нелицензированных произведениях, защищенных авторским правом, и коммерциализации голосовых отпечатков, в то время как инвесторам сообщалось о соблюдении компанией мировых правил в области авторского права и интеллектуальной собственности. В жалобе приводятся несколько областей предполагаемого незаконного использования данных: Обучение ИИ-программного обеспечения, включая Copilot и другие генеративные модели, на защищенных авторским правом книгах и текстах без лицензионных соглашений (например, произведения из набора данных Books3, используемого OpenAI и связанными проектами). Использование защищенного авторским правом новостного и издательского контента в Copilot/Bing Chat, что стало предметом исков со стороны издателей, включая жалобу июня 2026 года, обвиняющую Microsoft в «прямом нарушении» авторских прав через генеративный вывод контента. Сбор и коммерциализация голосовых отпечатков через определенные ИИ-сервисы способами, которые, как утверждается, противоречат законам штатов о биометрической конфиденциальности. В анализе The D&O Diary от 5 июля 2026 года теория дела описывается так: Microsoft «сообщала своим акционерам и рынку, что не нарушает федеральные законы об авторском праве в отношении разработки и обучения ИИ-программного обеспечения, генеративных моделей ИИ и продуктов», в то время как сама сталкивалась с исками от авторов и издателей, заявляющих о нелицензионном копировании для обучения моделей. Августовский отчет Mishcon de Reya подтверждает, что в иске руководство обвиняется в принуждении Microsoft к «нарушению законов об авторском праве и интеллектуальной собственности» путем обучения на произведениях и голосовых отпечатках без лицензий. Какая хронология событий привела к подаче производного иска? Иск был подан после двух лет активных инвестиций в ИИ, запусков продуктов и соответствующих судебных разбирательств, начавшихся в 2022 году и усилившихся с появлением исков от авторов, издателей и защитников биометрической приватности в период с 2023 по середину 2026 года. Ключевые даты и события: 1 января 2022 г. – настоящее время: Производный иск определяет этот период как релевантный временной интервал, когда заявления Microsoft о стратегии ИИ и соблюдении норм якобы были вводящими в заблуждение. Сентябрь 2023 г.: По данным The D&O Diary, Microsoft и ее партнеры начали сталкиваться с исками от авторов, издателей и других правообладателей, утверждающих, что защищенный авторским правом материал копировался без лицензий для обучения больших языковых моделей. 2023–2024 гг.: Продолжающийся судебный процесс Doe v. GitHub Copilot обвиняет GitHub, Microsoft и OpenAI в использовании кода разработчиков без разрешения для создания Codex и Copilot, что дополняет контекст рисков нарушения авторских прав, на который ссылается новый иск. 5 февраля 2026 г.: В производном иске отмечается, что на Microsoft подали в суд за предполагаемые нарушения Закона штата Иллинойс о биометрической информации (BIPA), начиная с дела Basich v. Microsoft Corp. (№ 2:26-cv-00422 в Западном округе Вашингтона). 12 июня 2026 г.: В том же суде был подан отдельный коллективный иск по ценным бумагам, обвиняющий Microsoft и ключевых руководителей в искажении данных о производительности и внедрении продуктов Copilot AI. 30 июня 2026 г.: Эрик Андерсон подал свой производный иск от имени акционеров (Anderson v. Nadella, № 2:26‑cv‑02281) в Западном округе Вашингтона. 1 июля 2026 г.: Bloomberg Law сообщил об этом деле, назвав его иском, в рамках которого «руководители и члены совета директоров Microsoft Corp. ввели акционеров в заблуждение» относительно ИИ-инструментов, обученных на материалах, защищенных авторским правом. 13–17 августа 2026 г.: Юридические и аналитические сводки CCH и Mishcon de Reya добавили это дело в списки мониторинга рисков авторского права в сфере ИИ и акционерных судебных споров. Как этот производный иск взаимодействует с отдельным коллективным иском по ценным бумагам? Производный иск рассматривается параллельно с коллективным иском по ценным бумагам в том же округе, который затрагивает схожие предполагаемые ложные заявления о Copilot и инвестициях в ИИ, однако иски различаются в части того, кто, по их мнению, пострадал и кто должен получить возмещение. По данным юридической фирмы Levi & Korsinsky, коллективный иск по ценным бумагам от июня 2026 года утверждает, что Microsoft и некоторые руководители «сделали существенно ложные заявления об инициативах компании в области ИИ, скрывая при этом серьезные операционные проблемы с продуктами Copilot», включая проблемы с позиционированием бренда, изоляцией данных и вычислительными мощностями. Иск подан от имени инвесторов, которые приобрели акции Microsoft и якобы понесли убытки, когда всплыли подробности о расходах на ИИ-инфраструктуру и проблемах с продуктами. Напротив, производный иск Андерсона направлен на возмещение ущерба самой Microsoft за вред, который компания якобы понесла, преследуя стратегию ИИ, подвергшую ее искам об авторских правах и регуляторным рискам. В анализе CCH, опубликованном 13 августа, поясняется, что производный иск Андерсона требует от суда привлечь должностных лиц и директоров к ответственности «за нарушение фидуциарных обязанностей, принуждение компании к масштабному нарушению законов об авторском праве и утверждение ложных и вводящих в заблуждение заявлений». В комментариях на Substack описывается, что этот иск превращает «риски авторского права в ИИ в риски для совета директоров и ценных бумаг», связывая решения об источниках данных и лицензировании с раскрытием информации для акционеров. Какие конкретно ложные заявления и упущения вменяются в вину? Иск оспаривает доверенности Microsoft, финансовые отчеты и публичные высказывания, которые, по мнению истца, представляли Copilot и другие ИИ-инструменты как законно обученные и полностью соответствующие правилам авторского права, при этом игнорируя текущие юридические риски и спорные методы работы с данными. Предполагаемые искажения фактов, основанные на резюме иска, включают: Заявления о том, что Microsoft «полностью соблюдает глобальные законы об авторском праве» при разработке и обучении своего ИИ-программного обеспечения, даже когда компания столкнулась с исками от авторов и издателей из-за нелицензионного копирования. Раскрытие информации, в котором подчеркивались успех, внедрение и возможности Copilot в продуктах Office, Windows и облачных сервисах, без упоминания технических ограничений, таких как изоляция данных и нехватка вычислительных мощностей, описанных в материалах коллективного иска по ценным бумагам. Описания партнерства Microsoft с OpenAI и использования инфраструктуры Azure, которые, согласно иску, не раскрывали предполагаемую зависимость от наборов данных типа Books3, содержащих книги, защищенные авторским правом и скопированные в больших масштабах. Финансовые результаты и прогнозы, основанные на быстром внедрении ИИ, представленные без подробного обсуждения потенциальных обязательств по искам BIPA по поводу голосовых отпечатков и данных о лицах. Анализ на Substack от 1 июля резюмирует теорию так: руководство Microsoft «выстроило и продвигало стратегию в области ИИ, вводя акционеров в заблуждение относительно законности получения данных, производительности Copilot и юридических рисков». The D&O Diary отмечает, что производный иск критикует риски «молчаливого ИИ» (Silent AI), при которых решения по обучению и инфраструктуре оставались непрозрачными для инвесторов, создавая при этом угрозу нарушения авторских прав. Кто затронут этим делом и что может произойти дальше? Иск напрямую направлен против директоров и высшего руководства Microsoft, но его исход может сформировать ожидания по раскрытию информации о стратегиях в области ИИ во всем технологическом секторе и повлиять на то, как советы директоров контролируют поиск данных и лицензирование в проектах машинного обучения. Непосредственные заинтересованные стороны включают: Совет директоров и руководство Microsoft: Сталкиваются с обвинениями в нарушении фидуциарных обязанностей, возможными требованиями о возмещении ущерба и призывами к реформам корпоративного управления или изменениям в надзоре за ИИ-инициативами. Акционеры: В производном иске акционеры затронуты косвенно, так как любое возмещение пойдет на пользу компании; в коллективном иске по ценным бумагам инвесторы могут получить компенсацию, если докажут убытки, связанные с предполагаемыми ложными заявлениями. Авторы, издатели и разработчики: Их споры об авторских правах и лицензировании создают фактический фон, который, по мнению истца, должен был быть раскрыт более полно. Другие компании, ориентированные на ИИ: Эксперты указывают на дело «Андерсон против Наделлы» как на часть «новой волны» производных исков, которые расширяют риски авторского права и данных до уровня обязанностей совета директоров, сигнализируя о схожих рисках для компаний, использующих большие наборы данных для обучения моделей. Юридические обозреватели ожидают несколько возможных путей развития событий: Суд может разрешить производному иску пройти стадию ходатайств об отклонении, открыв этап раскрытия доказательств того, как Microsoft оценивала риски авторского права и биометрии в своих ИИ-программах. Ответчики могут добиваться отклонения иска, утверждая, что их заявления были точными или защищенными как прогнозные утверждения, а также что советы директоров полагались на экспертные советы относительно лицензирования. Дело может быть урегулировано мировым соглашением, потенциально включающим изменения в практике управления, внутреннем контроле за данными для обучения ИИ и расширении раскрытия информации о рисках авторского права и конфиденциальности. Независимо от исхода, сочетание производного и коллективного исков в Западном округе Вашингтона знаменует собой новый этап в том, как суды и инвесторы изучают бизнес-модели ИИ. Как отмечает один из мониторинговых сервисов, эти иски рассматривают вопросы авторского права и конфиденциальности в ИИ не только как технические и регуляторные проблемы, но и как вопросы законодательства о ценных бумагах и ответственности совета директоров за стратегию развития технологий.

Nic Reeve·
Anthropic добавила в Claude функцию «памяти» для сохранения контекста переписки
AI & Tech

Anthropic добавила в Claude функцию «памяти» для сохранения контекста переписки

Anthropic выпускает масштабное обновление для своего ИИ-помощника, предоставляя Claude Cowork возможность беспрепятственно использовать информацию, полученную в ходе обычных чатов. Компания объединила системы памяти интерфейса чата Claude и настольного агента Cowork, поэтому детали, которыми вы делитесь в одном из них, теперь могут автоматически использоваться в другом. Единая память для чата и Cowork Ранее долговременная память Claude была в основном ограничена сеансами чата и обновлялась периодически: это означало, что могло потребоваться до суток, прежде чем информация переносилась в новые диалоги. Cowork, который выполняет сложные многоэтапные задачи на рабочем столе пользователя или в облаке, полагался на собственный фоновый файл памяти и объединение промптов для имитации непрерывности. С обновлением от 25 августа Anthropic объединила эти механизмы в единую общую систему памяти, которая обслуживает как чат, так и Cowork. Anthropic описывает это изменение просто: одна и та же память теперь обеспечивает работу и чата Claude, и Cowork. Когда пользователи поручают Cowork задачу — например, составление отчетов, обновление электронных таблиц или координацию проектной документации — контекст, накопленный Claude за месяцы общения, становится доступен мгновенно. Аналогичным образом, любые новые факты или предпочтения, выявленные во время работы Cowork, записываются в общую память и становятся доступными в последующих сеансах чата. Память в реальном времени, а не только итоговые сводки Еще одно важное изменение касается того, как именно Claude обновляет память. Вместо того чтобы ждать завершения всего разговора для создания сводки, Claude теперь добавляет темы в память в режиме реального времени по мере общения пользователей. Это означает, что если пользователь упоминает о переносе дедлайна проекта на сентябрь, это обновление практически сразу отражается в памяти и появляется в следующем же взаимодействии — будь то в чате или в Cowork — без необходимости давать команду «запомни это» вручную. В справочных материалах Anthropic поясняется, что при работе Cowork в облаке то, что Claude запомнил из предыдущих чатов, становится доступным автоматически, а информация, полученная в ходе выполнения задач Cowork, возвращается в память чата. За кулисами каждый промпт Cowork формируется из текущего запроса пользователя, его глобальных инструкций и соответствующего фрагмента общей памяти, что позволяет ИИ вести себя так, будто он обладает постоянным пониманием ролей, проектов и предпочтений. Что получают пользователи: меньше повторений, больше непрерывности На практике для пользователей это означает, что им больше не нужно каждый раз при переключении между чатом и Cowork заново вводить Claude в курс дела: кто они такие, над чем работают и как предпочитают выполнять задачи. Anthropic и независимые эксперты выделяют несколько типичных сценариев: Постоянный контекст проекта: Текущие детали, такие как квартальные цели, имена клиентов и статус проекта, могут сохраняться в течение недель или месяцев и быть доступными как в чате, так и в Cowork. Стабильные роли и предпочтения: Если пользователь определил себя как инвестиционного аналитика, преподавателя или представителя конкретной творческой профессии, Claude запомнит эту роль и будет адаптировать ответы соответствующим образом, даже если отдельные чаты короткие или посвящены разным задачам. Согласованность между устройствами: Общая память работает в веб-версии, на рабочем столе и в мобильных приложениях, поэтому переход от браузерного чата к настольному агенту Cowork больше не приводит к потере контекста. Отраслевые наблюдатели отмечают, что это обновление позиционирует Claude скорее как ИИ-«коллегу», который может отслеживать среднесрочные и долгосрочные рабочие процессы, а не просто как ограниченный рамками сессии чат-бот. Прозрачность и контроль пользователя над памятью Система общей памяти внедряется параллельно с расширением контроля со стороны пользователей. Теперь Anthropic отображает всё, что помнит Claude, в специальном разделе Темы (Topics) в настройках памяти, где пользователи могут просматривать, редактировать или удалять отдельные записи. Память хранится в виде дискретных, категоризированных записей, а не в виде единой непрозрачной сводки, что облегчает удаление устаревшей или неточной информации. Пользователи также могут приостановить работу памяти или полностью сбросить её, если больше не хотят, чтобы Claude сохранял предыдущий контекст. Кроме того, Anthropic предоставляет инструкции по импорту и экспорту памяти, поэтому информация, которую Claude хранит о пользователе, не является «запертой» и в принципе может быть скопирована или перенесена. Работа с конфиденциальными темами Anthropic подчеркивает, что система по умолчанию спроектирована так, чтобы минимизировать сбор высокочувствительной информации. Такие темы, как данные о здоровье, убеждения и другие потенциально чувствительные категории, исключаются из памяти, если пользователи явно не активируют настройку «Включать конфиденциальные темы в память». Для бизнес-клиентов администраторы команд или предприятий могут централизованно управлять тем, включена ли память вообще, и выбирать более строгие политики в соответствии с требованиями корпоративного управления. Согласно внешним отчетам, создание памяти включено по умолчанию для бесплатных планов, а также планов Pro и Max, однако сам Cowork недоступен в бесплатных аккаунтах. Для организаций, которые хотят разделять разные рабочие потоки, Anthropic указывает, что единственный способ сохранить полностью раздельные области памяти для чата и Cowork — это использовать разные учетные записи, поскольку новая система рассматривает их как единое пространство. Доступность и ограничения Новая функция общей памяти начала внедряться 25 августа 2026 года в веб-версии, настольных и мобильных приложениях Claude, а также для Cowork, работающего в облаке. Ранее в этом году поддержка памяти ограничивалась только чатом, и некоторые сторонние аналитики отмечали, что Cowork не имел доступа к этому долгосрочному контексту. Последние примечания к выпуску и справочный центр Anthropic теперь прямо указывают, что память работает как в чате, так и в Cowork, когда последний запущен в облачной среде. Технические ограничения сохраняются. Использование памяти в Cowork зависит от облачного выполнения, а не только от локальной обработки, а сеансы в режиме инкогнито или с отключенной памятью остаются без сохранения состояния по определению. Как и в случае с другими ИИ-системами, Anthropic предупреждает, что память Claude избирательна: она отдает приоритет высокоуровневым предпочтениям и повторяющимся темам, а не хранению каждой детали каждого разговора. Шаг к более персонализированным рабочим процессам с ИИ Объединяя память чата Claude и Cowork, Anthropic делает ставку на то, что пользователи оценят более персонализированный и непрерывный опыт взаимодействия с ИИ, особенно в сложных, длительных проектах. Обновление снижает нагрузку на людей, совмещающих несколько задач, и дает предприятиям более четкий путь к созданию рабочих процессов с поддержкой ИИ, которые сохраняются с течением времени. В то же время компания пытается сбалансировать удобство с конфиденциальностью и безопасностью, предоставляя пользователям детальные элементы управления и ограничивая сохранение конфиденциальных данных по умолчанию.

Nic Reeve·
Утечка Claude 3.5 и появление Gemini 3.5 в чат-боте Arena изменили расстановку сил в гонке ИИ-моделей
AI & Tech

Утечка Claude 3.5 и появление Gemini 3.5 в чат-боте Arena изменили расстановку сил в гонке ИИ-моделей

Крупная утечка, связанная с еще не выпущенной моделью Anthropic Claude Sonnet 4.8 , свежие спекуляции вокруг нового семейства моделей Claude «Cardinal» и тихое появление вариантов Gemini 3.5 от Google в популярном бенчмарке LMSYS Arena превратили эту неделю в поворотный момент для наблюдателей за рынком ИИ, аналитиков и создателей контента, отслеживающих такие каналы, как новостная серия об ИИ от Джейлина Уильямса (Jaylin Williams). Claude Sonnet 4.8: что на самом деле раскрывает утечка История с Claude Sonnet 4.8 началась с ошибки при упаковке npm-библиотеки Anthropic @anthropic-ai/claude-code . Разработчики обнаружили, что файл source-map объемом 59,8 МБ был случайно опубликован как часть обновления от 31 марта 2026 года. Это открыло доступ примерно к 512 000 строк внутреннего кода на TypeScript и более чем 1900 исходным файлам, связанным с продуктом Claude Code. Хотя данные клиентов, учетные данные или работающие системы не пострадали, отладочный пакет содержал внутренние ссылки, которые никогда не должны были стать публичными. Среди этих ссылок оказалась строка «sonnet-4-8» , указанная во внутреннем списке «запрещенных строк» или фильтре Undercover Mode , предназначенном для того, чтобы инженеры случайно не упоминали невыпущенные версии моделей в логах, текстах интерфейса или сообщениях коммитов. Согласно сообщениям, в том же списке значились «opus-4-7» и кодовые имена, такие как «mythos» , что намекает на более широкую «дорожную карту» флагманского семейства Claude от Anthropic. Важно отметить, что утечка содержала инфраструктурный код и конфигурации , а не чекпоинт модели или веса. Не было ни публичной карточки модели, ни документации API для эндпоинта Sonnet 4.8, ни таблиц с результатами тестирования. Это означает, что единственный подтвержденный факт, вытекающий из утечки, — это то, что Anthropic использует строку версии Sonnet 4.8 внутри своих инструментов, а компания как минимум планирует или тестирует новое поколение линейки среднего уровня Sonnet. Тем не менее, этот инцидент вызвал бурные спекуляции. В ИИ-сообществе начали циркулировать утверждения о таких улучшениях, как двузначный прирост производительности в задачах программирования, значительный скачок в точности распознавания визуальных данных и новые фоновые «агентные» возможности для выполнения длительных задач. Хотя эти заявления, по-видимому, основаны на упоминаниях в отладочном коде и экстраполяции данных из недавних релизов Claude 4.x, ни одно из них не было подтверждено Anthropic. По состоянию на середину августа 2026 года официального релиза Claude Sonnet 4.8 через API Anthropic, Amazon Bedrock или Google Cloud Vertex AI все еще нет. Anthropic охарактеризовала событие как человеческую ошибку при упаковке , потребовала удалить тысячи зеркальных копий пакета из публичных репозиториев и не давала публичных обещаний выпустить модель под брендом Sonnet 4.8. Кодовые имена моделей Anthropic: Cardinal, Capybara и другие Дискуссия вокруг Sonnet 4.8 привлекла внимание к растущей сети внутренних кодовых имен моделей Claude от Anthropic. Более ранний анализ утекшего исходного кода Claude Code выявил такие названия, как Fennec (связанное с моделью класса Opus 4.6), Capybara (связанное с экспериментальным уровнем, который, как сообщается, по своим возможностям превосходит Opus) и Numbat для моделей, находящихся на стадии тестирования. В этом контексте разговоры в сообществе о линейке, предварительно названной Claude «Cardinal» , усилились. Хотя подробностей по-прежнему мало, комментаторы описывают Cardinal как потенциальное новое семейство или подкатегорию , которая может занять нишу между существующими предложениями Sonnet и Opus, либо как внутреннее направление, ориентированное на инструменты, программирование и постоянных агентов. На данном этапе Cardinal выглядит скорее как предполагаемое кодовое имя и намек на планы развития, чем как готовый продукт с публичной карточкой модели. Намеренное молчание Anthropic подтверждает закономерность, которой компания следовала в предыдущих циклах: внутренние строки версий и кодовые имена часто появляются в инструментах и утечках за месяцы до любого официального анонса. Присутствие названий вроде Sonnet 4.8 или Cardinal в коде не гарантирует, что эти модели будут запущены под именно такими именами или что все они вообще дойдут до публичного релиза. Gemini 3.5 выходит на арену Пока Anthropic разбирается с последствиями утечки исходного кода, новейшие модели Google производят фурор совсем иным способом: появляясь в Chatbot Arena от LMSYS — краудсорсинговом бенчмарке, где большие языковые модели соревнуются друг с другом в слепых сравнениях. В последние недели в таблице лидеров Arena появились новые варианты, помеченные как Gemini 3.5 . Хотя Arena обычно использует анонимные идентификаторы для моделей, проходящих слепое тестирование, накопилось достаточно метаданных и тенденций производительности, чтобы наблюдатели могли связать несколько высокорезультативных участников с новым поколением Gemini от Google. Первые впечатления сообщества говорят о том, что Gemini 3.5 сохраняет или улучшает сильные стороны Gemini 1.5 в работе с длинным контекстом и мультимодальностью, при этом делая упор на более строгое следование инструкциям и улучшенную производительность при написании кода. Во многих «слепых» матчах Arena пользователи отмечают, что модели класса 3.5 более отзывчивы в повседневных чатах и задачах на рассуждение, демонстрируя конкурентные результаты по сравнению с топовыми системами от Anthropic и OpenAI. Поскольку Chatbot Arena опирается на добровольные краудсорсинговые оценки, ее рейтинги не имеют такого веса, как формальные академические бенчмарки. Тем не менее, таблица лидеров стала важным реальным индикатором того, как модели ведут себя «в дикой природе», фиксируя качественные факторы, такие как стиль, ясность и надежность, которые сложно свести к единому числовому показателю. Как создатели контента освещают эти изменения Череда быстрых событий — утечки, кодовые имена и новые записи в бенчмарках — дала много материала создателям контента в сфере ИИ. Среди них Джейлин Уильямс , чей новостной контент (включая эпизод, упомянутый в списке Mshale) объединяет такие истории, как утечка Claude Sonnet 4.8 , слухи о линейке Claude Cardinal и появление Gemini 3.5 в Arena, в доступные сводки для разработчиков и энтузиастов. В этих обзорах создатели обычно выделяют три темы: Усиление конкуренции между пограничными моделями, поскольку Anthropic, Google и OpenAI развиваются быстрыми темпами, используя как официальные запуски, так и тихую оценку в публичных бенчмарках для проверки своих возможностей. Непрозрачность и утечки как повторяющиеся проблемы, когда внутренние инструменты и отладочные артефакты становятся неожиданным окном в «дорожные карты» компаний задолго до официальных заявлений. Практическое влияние на пользователей : от разработчиков, задающихся вопросом, когда они смогут получить доступ к производительности уровня Sonnet 4.8, до бизнеса, оценивающего, стоит ли строить свои решения на базе Claude, Gemini или их комбинации. На что обратить внимание дальше Заглядывая вперед, можно выделить основные вопросы для пользователей и наблюдателей. Анонсирует ли Anthropic официально модель Sonnet 4.8 или Cardinal в ближайшие месяцы, и если да, то как она будет позиционироваться по отношению к Opus и конкурирующим системам от Google и OpenAI? Трансформируются ли возможности, намеки на которые содержатся во внутреннем коде — от более мощного программирования и анализа изображений до более устойчивых агентов — в доступные, готовые к промышленному использованию функции? Что касается Google, все внимание приковано к тому, как быстро линейка Gemini 3.5 перейдет от экспериментов в Arena и ограниченного внедрения к широкой доступности в Google Cloud и потребительских продуктах. Любое изменение цен, длины контекста или возможностей дообучения может перекроить рынок выбора провайдеров стартапами и предприятиями. На данный момент ландшафт характеризуется контрастом: непреднамеренная утечка от Anthropic дает представление о том, куда может двигаться Claude, в то время как Gemini 3.5 от Google ищет подтверждения в открытой конкуренции. Вместе они сигнализируют о создании ИИ-экосистемы, где «дорожные карты» продуктов становятся все более заметными — не только через пресс-релизы, но и через код, кодовые имена и коллективное суждение пользователей, испытывающих эти системы на прочность.

Nic Reeve·