allnewscastallnewscast
Срочные новости
AI & Tech

Утечка Claude 3.5 и появление Gemini 3.5 в чат-боте Arena изменили расстановку сил в гонке ИИ-моделей

Nic Reeve6 мин чтения
Утечка Claude 3.5 и появление Gemini 3.5 в чат-боте Arena изменили расстановку сил в гонке ИИ-моделей

Крупная утечка, связанная с еще не выпущенной моделью Anthropic Claude Sonnet 4.8, свежие спекуляции вокруг нового семейства моделей Claude «Cardinal» и тихое появление вариантов Gemini 3.5 от Google в популярном бенчмарке LMSYS Arena превратили эту неделю в поворотный момент для наблюдателей за рынком ИИ, аналитиков и создателей контента, отслеживающих такие каналы, как новостная серия об ИИ от Джейлина Уильямса (Jaylin Williams).

Claude Sonnet 4.8: что на самом деле раскрывает утечка

История с Claude Sonnet 4.8 началась с ошибки при упаковке npm-библиотеки Anthropic @anthropic-ai/claude-code. Разработчики обнаружили, что файл source-map объемом 59,8 МБ был случайно опубликован как часть обновления от 31 марта 2026 года. Это открыло доступ примерно к 512 000 строк внутреннего кода на TypeScript и более чем 1900 исходным файлам, связанным с продуктом Claude Code. Хотя данные клиентов, учетные данные или работающие системы не пострадали, отладочный пакет содержал внутренние ссылки, которые никогда не должны были стать публичными.

Среди этих ссылок оказалась строка «sonnet-4-8», указанная во внутреннем списке «запрещенных строк» или фильтре Undercover Mode, предназначенном для того, чтобы инженеры случайно не упоминали невыпущенные версии моделей в логах, текстах интерфейса или сообщениях коммитов. Согласно сообщениям, в том же списке значились «opus-4-7» и кодовые имена, такие как «mythos», что намекает на более широкую «дорожную карту» флагманского семейства Claude от Anthropic.

Важно отметить, что утечка содержала инфраструктурный код и конфигурации, а не чекпоинт модели или веса. Не было ни публичной карточки модели, ни документации API для эндпоинта Sonnet 4.8, ни таблиц с результатами тестирования. Это означает, что единственный подтвержденный факт, вытекающий из утечки, — это то, что Anthropic использует строку версии Sonnet 4.8 внутри своих инструментов, а компания как минимум планирует или тестирует новое поколение линейки среднего уровня Sonnet.

Тем не менее, этот инцидент вызвал бурные спекуляции. В ИИ-сообществе начали циркулировать утверждения о таких улучшениях, как двузначный прирост производительности в задачах программирования, значительный скачок в точности распознавания визуальных данных и новые фоновые «агентные» возможности для выполнения длительных задач. Хотя эти заявления, по-видимому, основаны на упоминаниях в отладочном коде и экстраполяции данных из недавних релизов Claude 4.x, ни одно из них не было подтверждено Anthropic.

По состоянию на середину августа 2026 года официального релиза Claude Sonnet 4.8 через API Anthropic, Amazon Bedrock или Google Cloud Vertex AI все еще нет. Anthropic охарактеризовала событие как человеческую ошибку при упаковке, потребовала удалить тысячи зеркальных копий пакета из публичных репозиториев и не давала публичных обещаний выпустить модель под брендом Sonnet 4.8.

Кодовые имена моделей Anthropic: Cardinal, Capybara и другие

Дискуссия вокруг Sonnet 4.8 привлекла внимание к растущей сети внутренних кодовых имен моделей Claude от Anthropic. Более ранний анализ утекшего исходного кода Claude Code выявил такие названия, как Fennec (связанное с моделью класса Opus 4.6), Capybara (связанное с экспериментальным уровнем, который, как сообщается, по своим возможностям превосходит Opus) и Numbat для моделей, находящихся на стадии тестирования.

В этом контексте разговоры в сообществе о линейке, предварительно названной Claude «Cardinal», усилились. Хотя подробностей по-прежнему мало, комментаторы описывают Cardinal как потенциальное новое семейство или подкатегорию, которая может занять нишу между существующими предложениями Sonnet и Opus, либо как внутреннее направление, ориентированное на инструменты, программирование и постоянных агентов. На данном этапе Cardinal выглядит скорее как предполагаемое кодовое имя и намек на планы развития, чем как готовый продукт с публичной карточкой модели.

Намеренное молчание Anthropic подтверждает закономерность, которой компания следовала в предыдущих циклах: внутренние строки версий и кодовые имена часто появляются в инструментах и утечках за месяцы до любого официального анонса. Присутствие названий вроде Sonnet 4.8 или Cardinal в коде не гарантирует, что эти модели будут запущены под именно такими именами или что все они вообще дойдут до публичного релиза.

Gemini 3.5 выходит на арену

Пока Anthropic разбирается с последствиями утечки исходного кода, новейшие модели Google производят фурор совсем иным способом: появляясь в Chatbot Arena от LMSYS — краудсорсинговом бенчмарке, где большие языковые модели соревнуются друг с другом в слепых сравнениях.

В последние недели в таблице лидеров Arena появились новые варианты, помеченные как Gemini 3.5. Хотя Arena обычно использует анонимные идентификаторы для моделей, проходящих слепое тестирование, накопилось достаточно метаданных и тенденций производительности, чтобы наблюдатели могли связать несколько высокорезультативных участников с новым поколением Gemini от Google.

Первые впечатления сообщества говорят о том, что Gemini 3.5 сохраняет или улучшает сильные стороны Gemini 1.5 в работе с длинным контекстом и мультимодальностью, при этом делая упор на более строгое следование инструкциям и улучшенную производительность при написании кода. Во многих «слепых» матчах Arena пользователи отмечают, что модели класса 3.5 более отзывчивы в повседневных чатах и задачах на рассуждение, демонстрируя конкурентные результаты по сравнению с топовыми системами от Anthropic и OpenAI.

Поскольку Chatbot Arena опирается на добровольные краудсорсинговые оценки, ее рейтинги не имеют такого веса, как формальные академические бенчмарки. Тем не менее, таблица лидеров стала важным реальным индикатором того, как модели ведут себя «в дикой природе», фиксируя качественные факторы, такие как стиль, ясность и надежность, которые сложно свести к единому числовому показателю.

Как создатели контента освещают эти изменения

Череда быстрых событий — утечки, кодовые имена и новые записи в бенчмарках — дала много материала создателям контента в сфере ИИ. Среди них Джейлин Уильямс, чей новостной контент (включая эпизод, упомянутый в списке Mshale) объединяет такие истории, как утечка Claude Sonnet 4.8, слухи о линейке Claude Cardinal и появление Gemini 3.5 в Arena, в доступные сводки для разработчиков и энтузиастов.

В этих обзорах создатели обычно выделяют три темы:

  • Усиление конкуренции между пограничными моделями, поскольку Anthropic, Google и OpenAI развиваются быстрыми темпами, используя как официальные запуски, так и тихую оценку в публичных бенчмарках для проверки своих возможностей.
  • Непрозрачность и утечки как повторяющиеся проблемы, когда внутренние инструменты и отладочные артефакты становятся неожиданным окном в «дорожные карты» компаний задолго до официальных заявлений.
  • Практическое влияние на пользователей: от разработчиков, задающихся вопросом, когда они смогут получить доступ к производительности уровня Sonnet 4.8, до бизнеса, оценивающего, стоит ли строить свои решения на базе Claude, Gemini или их комбинации.

На что обратить внимание дальше

Заглядывая вперед, можно выделить основные вопросы для пользователей и наблюдателей. Анонсирует ли Anthropic официально модель Sonnet 4.8 или Cardinal в ближайшие месяцы, и если да, то как она будет позиционироваться по отношению к Opus и конкурирующим системам от Google и OpenAI? Трансформируются ли возможности, намеки на которые содержатся во внутреннем коде — от более мощного программирования и анализа изображений до более устойчивых агентов — в доступные, готовые к промышленному использованию функции?

Что касается Google, все внимание приковано к тому, как быстро линейка Gemini 3.5 перейдет от экспериментов в Arena и ограниченного внедрения к широкой доступности в Google Cloud и потребительских продуктах. Любое изменение цен, длины контекста или возможностей дообучения может перекроить рынок выбора провайдеров стартапами и предприятиями.

На данный момент ландшафт характеризуется контрастом: непреднамеренная утечка от Anthropic дает представление о том, куда может двигаться Claude, в то время как Gemini 3.5 от Google ищет подтверждения в открытой конкуренции. Вместе они сигнализируют о создании ИИ-экосистемы, где «дорожные карты» продуктов становятся все более заметными — не только через пресс-релизы, но и через код, кодовые имена и коллективное суждение пользователей, испытывающих эти системы на прочность.

Читать далее

Похожие материалы

AInews: Прогнозы цены TAO резко выросли на фоне запуска новых платформ ИИ-агентов
AI & Tech

AInews: Прогнозы цены TAO резко выросли на фоне запуска новых платформ ИИ-агентов

AInews: Прогнозы цены TAO резко выросли на фоне запуска новых платформ ИИ-агентов В период с 13 по 20 сентября 2026 года аналитики резко повысили прогнозы цен на токен TAO сети Bittensor, в то время как на рынке появились новые инструменты автономных ИИ-агентов. Это превратило AInews в окно, позволяющее наблюдать как за спекулятивными ставками на криптовалюту, так и за практическими программными решениями, меняющими подход разработчиков к созданию автоматизированных цифровых работников. Что происходит с ценой TAO прямо сейчас? TAO торгуется в диапазоне чуть выше 250 долларов, демонстрируя колебания в 8–9% за последние дни, что является реакцией трейдеров на обновления протокола и общий ралли токенов в секторе ИИ. Прогнозы на сентябрь 2026 года сосредоточены в «бычьем» диапазоне примерно от 220 до 541 доллара, в зависимости от используемых моделей и допущений относительно рисков. Последние рыночные данные показывают: Согласно данным CoinMarketCap по TAO на 18–20 сентября 2026 года, цена TAO колебалась примерно между 233 и 260 долларами во время нескольких краткосрочных ралли и откатов, при этом ежедневные движения на 3–9% были обычным явлением в течение последней недели. Краткосрочный прогноз CoinLore от 20 сентября 2026 года оценивает текущую цену TAO примерно в 262,32 доллара и прогнозирует 250,14 доллара на 21 сентября 2026 года, ожидая 24-часовой торговый диапазон между 245,27 и 277,89 долларами. Анализ CoinMarketCap резкого скачка на 8–9% за 25 часов до 18 сентября 2026 года связывает это движение с изменениями токеномики протокола, ротацией капитала в ИИ-сектор и техническим паттерном прорыва на графике. Эти колебания происходят на фоне сохраняющейся волатильности. В июне 2026 года TAO упал примерно на 4% всего за одну ночь, когда одновременно сработали изменения в эмиссии и ослабление рынка, согласно обзору цен CoinMarketCap за июнь. Этот контекст заставляет краткосрочных трейдеров проявлять осторожность, даже несмотря на рост ценовых прогнозов. Насколько высоки текущие прогнозы цены TAO на сентябрь 2026 года? Сайты с прогнозами, ориентированные на розничных инвесторов, сейчас показывают, что возможный диапазон TAO в сентябре 2026 года варьируется от низких 170-х долларов в «медвежьих» сценариях до более чем 1100 долларов в агрессивных «бычьих» моделях. Большинство прогнозов сосредоточено в более узком диапазоне: около 220–370 долларов для трейдеров и 364–541 доллар в аналитических долгосрочных моделях. Различные сервисы публикуют заметно отличающиеся цифры: Отчет Cryptopolitan от 13 сентября 2026 года по Bittensor ожидает, что средняя цена TAO в сентябре составит около 210 долларов, с целью бычьего прорыва на уровне 275 долларов и худшим сценарием (минимумом) около 176 долларов, исходя из уровней технического сопротивления и поддержки. Заметка OpenPR от 13 сентября 2026 года под заголовком «TAO стремится к 300 долларам после обновлений ИИ» утверждает, что 300 долларов является ключевым уровнем восстановления, при этом на тот момент TAO торговался в районе 234 долларов и сталкивался с сопротивлением в районе 260 долларов. Долгосрочный прогноз Changelly по Bittensor, обновленный 20 сентября 2026 года, помещает сценарии цены на сентябрь 2026 года в диапазон от минимума 363,90 до максимума 541,27 доллара, со средним значением 452,59 доллара, основываясь на исторической волатильности и ожидаемом спросе в секторе ИИ. Краткосрочная модель CoinLore, обновленная 20 сентября 2026 года, предполагает, что в неделю с 21 по 28 сентября цена может снизиться с примерно 250,14 до уровня чуть выше 240 долларов перед небольшим отскоком, что рисует более осторожный краткосрочный путь. Прогностическая модель CoinCodex, обновленная в конце августа 2026 года, прогнозировала кратковременное падение примерно до 176,10 долларов к началу сентября, демонстрируя, как устаревшие данные могут недооценивать последующее ралли, вызванное нарративами вокруг ИИ-токенов. Эти прогнозы используют разные вводные данные. Некоторые полагаются в основном на графические паттерны и импульс, в то время как другие учитывают предположения о растущем спросе на децентрализованный ИИ и устойчивом внимании к роли Bittensor как специализированной сети для задач машинного обучения. Почему прогнозы по TAO растут, несмотря на недавнюю волатильность? Прогнозы растут, потому что TAO находится на пересечении двух трендов: эволюционирующей модели токеномики, которая снижает эмиссию неиспользуемых подсетей (subnets), и глобальной волны интереса к децентрализованной ИИ-инфраструктуре. Обновления, смена нарративов и внешние достижения в области ИИ — все это подпитывает ожидания трейдеров. Аналитики указывают на несколько конкретных факторов: Материал CoinMarketCap от 18 сентября 2026 года, посвященный скачку TAO на 8–9%, подчеркивает «обновления токеномики протокола», которые изменяют вознаграждения за стейкинг и эмиссию, делая актив более дефляционным и, следовательно, более привлекательным для инвесторов, делающих ставку на дефицит. Другой анализ CoinMarketCap в середине сентября отмечает, что основная команда Bittensor отключила эмиссию для 57 «мертвых» подсетей — тех, у которых нет активного механизма майнинга или полезного кода, — с планами на еженедельную «чистку», что позволяет сосредоточиться на продуктивных частях сети. Отчет CryptoRank от 11 апреля 2026 года о падении TAO на 25% во время выхода Covenant AI из сети (обновленный в сентябре) напоминает трейдерам о рисках управления, но также показывает способность рынка поглощать шоки: TAO отскочил от минимумов около 250 долларов к уровню 260 долларов. Cryptonews и другие издания акцентируют внимание на максимальном ограничении предложения в 21 миллион TAO, поддерживаемом протоколом Bittensor, проводя параллель с моделью фиксированной эмиссии биткоина, но связывая ее с обучением и использованием моделей ИИ, а не просто с функцией средства сбережения. В сочетании с более громкими событиями в сфере ИИ, такими как анонс «Astra» от GPT-6 компании OpenAI и позиционирование Anthropic перед IPO (о чем сообщил CoinMarketCap 18 сентября 2026 года), статус TAO как «чистого игрока в децентрализованный ИИ» побуждает некоторых трейдеров рассматривать токен как инструмент с кредитным плечом на спрос к ИИ, а не просто как очередной альткоин. Как новые инструменты ИИ-агентов связаны с этим крипто-ралли? Всплеск появления новых фреймворков и сервисов для ИИ-агентов в начале сентября 2026 года напрямую связан с историей ИИ-токенов, так как оба тренда отражают спрос на автономное программное обеспечение, способное планировать задачи, выполнять рабочие процессы и работать в нескольких приложениях без пошагового участия человека. Недавние отчеты по программной части выделяют несколько разработок: Статья DutchStartup.ai от 7 сентября 2026 года описывает «волну новых инструментов ИИ-агентов», появившуюся около 4 сентября. Команды выпустили новые фреймворки, позволяющие разработчикам определять долгосрочные цели, при этом агенты сами планируют, выполняют и корректируют задачи на основе обратной связи. В том же отчете отмечается, что существующие платформы обновили свои уровни оркестрации, чтобы агенты могли вызывать API, запускать облачные функции и координировать действия с другими агентами, что делает их способными справляться со сложными многоэтапными процессами, такими как подача заявок на гранты или продажи. Несколько проектов с открытым исходным кодом выделены как «платформы агентов», которые работают в обычных облаках, но, в принципе, могут подключаться к таким сетям, как Bittensor, для аутсорсинга тяжелых задач по инференсу (выводу), что усиливает потенциальную связь между вычислениями, оплачиваемыми в TAO, и развертыванием агентов. Эти инструменты появляются в то время, когда ИИ-компании исследуют пределы автоматизации. Трейдеры, наблюдающие за динамикой цены TAO, рассматривают расширение экосистем агентов как косвенное подтверждение того, что спрос на децентрализованные вычислительные услуги по рыночным ценам может расти, что подпитывает «бычьи» прогнозы по токену. Кто больше всего подвержен влиянию колебаний TAO и новой экосистемы агентов? Волатильность TAO и появление новых инструментов агентов затрагивают разные группы. Краткосрочные криптотрейдеры сталкиваются с резкими скачками. Долгосрочные стейкеры Bittensor и разработчики подсетей следят за изменениями в управлении и эмиссии. Тем временем создатели ИИ и стартапы оценивают, смогут ли новые агенты снизить операционные расходы или открыть новые источники дохода. Что касается TAO, риски распределяются следующим образом: Дей-трейдеры и пользователи деривативов, спекулирующие на ежедневных движениях в 3–9%, зафиксированных на графиках CoinMarketCap в середине сентября 2026 года, часто используя кредитное плечо, которое увеличивает как прибыль, так и убытки. Стейкеры, которые блокируют TAO для поддержки подсетей и получения эмиссии. Решение руководства Bittensor сократить вознаграждения неактивным подсетям меняет их ожидания по доходности и влияет на то, как они распределяют капитал в сети. Разработчики, создающие модели ИИ, которые полагаются на стимулы, номинированные в TAO. Их потоки доходов зависят от правил протокола и того, будут ли рыночные цены достаточно высокими, чтобы покрывать расходы на инфраструктуру и исследования. Для инструментов ИИ-агентов риски и возможности выглядят иначе: Стартапы, внедряющие фреймворки агентов (о чем сообщал DutchStartup.ai в начале сентября 2026 года), надеются автоматизировать такие задачи, как бронирование встреч, первичная клиентская поддержка или управление конвейерами данных с минимальным контролем. Корпоративные ИТ-команды тестируют новые функции оркестрации, связывающие агентов с внутренними системами, что поднимает вопросы безопасности, аудита и комплаенса, поскольку все больше процессов выполняется без прямых команд человека. Отдельные специалисты экспериментируют с готовыми агентами, которые обещают управлять электронной почтой, исследованиями или планированием, что переносит часть нагрузки «белых воротничков» на программное обеспечение, но все еще требует тщательного надзора. Что может произойти с TAO и платформами ИИ-агентов дальше? Ближайшие месяцы, вероятно, будут зависеть от того, успокоят ли инвесторов изменения в токеномике и дебаты по управлению Bittensor, и перейдут ли инструменты ИИ-агентов из стадии пилотных проектов в стадию промышленного внедрения. Прогнозы остаются широкими, что сигнализирует о неопределенности, но также и о сильных ожиданиях продолжения активности в сфере ИИ. Что касается дальнейшего пути TAO, доступные анализы выделяют следующее: Прогноз OpenPR на середину сентября 2026 года с целью восстановления на уровне 300 долларов предполагает плавную интеграцию недавних обновлений протокола и устойчивый интерес к сектору ИИ. Если споры по вопросам управления возобновятся, этот путь может затормозиться. Более широкий прогноз Cryptopolitan на 2026–2032 годы предполагает возможный максимум около 371 доллара в 2026 году при среднем значении около 210 долларов, подчеркивая, что даже оптимистичные сценарии предусматривают длительные периоды консолидации и коррекции. Долгосрочная оценка Changelly, предполагающая среднюю цену TAO около 1000 долларов в 2026 году (как теоретический уровень к концу года), зависит от агрессивного внедрения децентрализованного ИИ и сохранения дефицита благодаря ограничению эмиссии в 21 миллион токенов, о котором сообщают крипто-сервисы. Для инструментов ИИ-агентов опрос DutchStartup.ai в начале сентября 2026 года предполагает, что в ближайшие кварталы конкуренция усилится: появятся новые фреймворки, более тесная интеграция в пакеты офисных программ и облачные сервисы, а также эксперименты по объединению финансовых стимулов с метриками эффективности агентов. По мере масштабирования этих систем они могут вызвать рост спроса на гибкие сети ИИ-вычислений, в том числе тех, где оплата производится токенами, такими как TAO.

Nic Reeve·
Запуск ИИ-функций Siri от Apple получил неоднозначные отзывы из-за задержек и ограничений
AI & Tech

Запуск ИИ-функций Siri от Apple получил неоднозначные отзывы из-за задержек и ограничений

8 июня 2026 года компания Apple использовала свою Всемирную конференцию разработчиков (WWDC), чтобы представить Siri AI и более широкую стратегию Apple Intelligence. Однако спустя несколько недель после презентации новость об ИИ вызвала неоднозначную реакцию: разработчики и пользователи обеспокоены задержками релизов, региональными ограничениями и тем, будет ли обновленный помощник достаточно надежным в повседневном использовании. Что именно Apple пообещала в отношении Siri AI и Apple Intelligence? Apple пообещала создать обновленную версию Siri под брендом Siri AI, глубоко интегрированную в iPhone, iPad, Mac, Apple Watch и Vision Pro. Она будет работать на базе Apple Intelligence и специальной версии модели Google Gemini. Бета-доступ ожидается в 2026 году, а более широкий запуск для потребителей — осенью вместе с выходом iOS 27 и других обновлений ПО. Ключевая презентация Apple на WWDC 2026, состоявшаяся 8 июня, задала амбициозное видение будущего помощника. Согласно сводке новостей Apple от 8 июня 2026 года, Siri AI — это «полностью новая версия Siri», встроенная во все основные платформы, включая iOS 27, iPadOS 27, macOS 27, watchOS 27 и visionOS 27. TechCrunch сообщил, что новый помощник работает на базе Google Gemini, что делает Siri более разговорчивой и способной к визуальному восприятию; кроме того, помимо системной интеграции, появится отдельное приложение Siri. The Next Web охарактеризовал Siri AI как «перезагрузку ИИ» от Apple, построенную на кастомной модели Gemini с объемом около 1,2 триллиона параметров, лицензированной в рамках сделки стоимостью примерно 1 миллиард долларов в год. Digital Trends подвел итог плана выпуска: бета-версия для разработчиков с 8 июня 2026 года и стабильный релиз, ожидаемый в середине сентября 2026 года вместе с iOS 27. В демонстрационных версиях Apple Siri AI справлялась с такими задачами, как покупка билетов на концерты, написание сообщений с учетом личного контекста, организация мероприятий и распознавание объектов на фотографиях для выполнения последующих действий. Почему реакция на анонс ИИ от Apple описывается как сдержанная? Реакция общественности и разработчиков оказалась более прохладной, чем, вероятно, ожидала Apple, поскольку презентация компании во многом опиралась на тщательно срежиссированные демо-версии. Отсутствие точных дат доступности для конечных пользователей, ограниченная языковая и аппаратная поддержка, а также тот факт, что многие регионы остались без доступа на запуске, заставили комментаторов усомниться в том, насколько революционным на самом деле будет это обновление. Сдержанный отклик аналитиков и технологической прессы можно объяснить несколькими причинами. Business Insider отметил, что Siri AI выйдет в бета-версию только позднее в 2026 году, а не как полностью готовый продукт, что контрастирует с широкими публичными релизами конкурентов, таких как ChatGPT от OpenAI или Gemini от Google. В материале Mashable подчеркивается, что помощник в настоящее время ориентирован только на английский язык и ограниченный набор оборудования, что сужает первоначальное влияние на глобальную базу пользователей iPhone. TechRadar указал, что, хотя Siri AI выглядит более детализированной и разговорчивой, она по-прежнему зависит от стороннего ИИ-движка, что вызывает вопросы о том, какая доля инноваций действительно принадлежит Apple. The Next Web представил анонс как попытку Apple «догнать» конкурентов, а не вырваться вперед, позиционируя Siri AI как давно назревший ответ на многолетнюю критику надежности и интеллектуальных возможностей Siri. В освещении Associated Press подчеркивается, что Apple делает упор на конфиденциальность и повседневную пользу, но описанные функции звучат как постепенное развитие по сравнению с ожиданиями от генеративного ИИ на смартфонах. Некоторые комментаторы положительно отреагировали на более осторожный, ориентированный на конфиденциальность подход Apple, но уровень восторга в первых обзорах оказался далек от оценки «прорывного продукта». Как Apple меняет возможности Siri на практике? Apple позиционирует Siri AI как контекстно-зависимого помощника, который запоминает предыдущие разговоры, действует внутри приложений от имени пользователя и использует локальные и облачные модели для понимания личных данных. В помощнике предусмотрен отдельный чат-интерфейс и более глубокие системные связки для выполнения многошаговых задач, с которыми старая Siri часто не справлялась. Обновленный помощник вводит структурные изменения, а не просто новые «трюки». Согласно анонсу Apple от 8 июня 2026 года, Siri AI привязана к «Apple Intelligence» — набору базовых моделей, которые работают на устройстве, когда это возможно, и перенаправляют более сложные запросы на серверы Apple. The Next Web описал трехуровневую модель конфиденциальности: небольшие модели на устройстве, более крупные модели в среде «Private Cloud Compute» и кастомная модель Gemini для самых требовательных задач. Business Insider сообщил, что Siri AI существует как отдельное приложение, где пользователи могут просматривать чаты, задавать уточняющие вопросы и взаимодействовать с помощником аналогично популярным ИИ-чат-ботам. MacRumors выделил интерфейсные изменения: обновленный визуальный стиль, более точные подсказки и возможность управлять большим количеством системных настроек и приложений с помощью естественного языка. TechCrunch отметил, что Siri теперь может интерпретировать изображения, например, просматривать фотографию и помогать пользователю идентифицировать объекты или выполнять действия на основе увиденного. Engadget написал, что помощник появится не только в iOS и macOS, но и в watchOS, CarPlay, AirPods и Vision Pro, обеспечивая Apple единый уровень ИИ во всей экосистеме оборудования. Руководители Apple подчеркнули, что помощник должен ощущаться как «гораздо более способный ассистент», сосредоточенный на выполнении реальной работы на всех устройствах, а не просто на ответах на справочные вопросы. Почему планы по выпуску Siri AI вызывают обеспокоенность? Поэтапный запуск Siri AI, ограниченная поддержка устройств и полное отсутствие функции в Европейском Союзе и Китае на момент запуска вызвали опасения, что Apple создает фрагментированный опыт использования ИИ для своих клиентов, где лишь малая часть пользователей получит все преимущества в 2026 году. График выпуска и региональные пробелы вызывают вопросы. Digital Trends представил график, согласно которому бета-версия для разработчиков началась 8 июня 2026 года, а стабильный публичный релиз ожидается осенью 2026 года вместе с iOS 27. AI Empire Media сообщила, что публичный релиз Siri AI и Apple Intelligence запланирован на сентябрь 2026 года, привязывая его к более широкому обновлению ОС. Engadget и собственная документация Apple перечислили поддерживаемое оборудование: iPhone 16 и новее, модели iPhone 15 Pro, iPad и Mac с чипами M1 или новее, Apple Watch Series 10 и Ultra 2, а также Apple Vision Pro, исключая многие старые, но все еще широко используемые устройства. Associated Press, Business Insider и обзор WWDC от Yahoo сообщили, что Apple не планирует запускать Siri AI в Европейском Союзе при выходе iOS 27, ссылаясь на необходимость соблюдения Закона о цифровых рынках (DMA). В этих же отчетах указано, что Китай не получит Siri AI на первом этапе, пока Apple работает над выполнением местных нормативных требований. Крейг Федериги, глава отдела разработки ПО Apple, заявил журналистам: «Мы разочарованы тем, что пользователи в ЕС не получат ИИ на iPhone или iPad, когда мы представим наши новые программные релизы позднее в этом году», сделав задержку официальной. Что беспокоит пользователей и разработчиков в отношении надежности и конфиденциальности Siri AI? Пользователи и разработчики пытаются найти ответы на два главных вопроса: станет ли Siri AI наконец надежной после многих лет разочарований из-за ограничений Siri, и как использование Apple моделей Google Gemini и облачных вычислений может сочетаться с давними обещаниями компании в области конфиденциальности. Apple попыталась ответить на эти опасения напрямую. Анонсы Apple подчеркивают, что большинство запросов будут обрабатываться на устройстве, а сложные запросы, обрабатываемые в облаке, будут выполняться внутри среды «Private Cloud Compute», разработанной для минимизации хранения данных. Associated Press сообщило, что Apple неоднократно выстраивала свою работу с ИИ вокруг конфиденциальности и повседневной практичности, а не экспериментальных функций, утверждая, что такой подход отличает ее продукты от конкурентов. The Next Web отметил, что, хотя Apple избегает упоминания Google в своих пресс-материалах, несколько изданий подтвердили, что кастомная модель Gemini лежит в основе Siri AI, что может вызвать вопросы у пользователей, скептически относящихся к передаче данных сторонним провайдерам. Анализ TechRadar указывает, что Apple заявляет, что Siri AI больше не будет «передавать» задачи сторонним чат-ботам, но все еще ведутся споры о том, предотвратит ли этот новый слой путаницу и неверную интерпретацию, которыми страдала старая версия помощника. Mashable сообщил, что Apple ограничивает первоначальный запуск английским языком и конкретными устройствами, что вызывает беспокойство у разработчиков международных приложений, которым требуется предсказуемое поведение ИИ на разных рынках. Аналитики отмечают, что настоящим испытанием станет момент, когда обычные пользователи начнут нагружать помощника сложными многошаговыми запросами, а не просто повторять отполированные примеры, увиденные на сцене. Как стратегия Apple в области ИИ соотносится с конкурентами, такими как Google и OpenAI? Подход Apple заключается во внедрении ИИ в существующее программное обеспечение и оборудование с использованием сочетания собственных и лицензированных моделей, вместо запуска одного флагманского чат-бота. Это контрастирует с фокусом Google на Gemini как бренде и стремлением OpenAI развивать ChatGPT, что делает Apple более осторожной, но при этом более глубоко интегрированной. Конкурирующие компании выбрали заметно разные пути. Согласно The Next Web, кастомная модель Gemini от Apple работает «за кулисами», в то время как Apple Intelligence позиционируется как пользовательский бренд, тогда как Google выводит Gemini на передний план в своих продуктах. В материалах TechRadar и Mashable модель Siri AI противопоставляется чат-ботам в стиле ChatGPT, отмечая, что Apple меньше заинтересована в генерации произвольного текста и больше — в выполнении задач внутри своей экосистемы. Associated Press отметило, что Apple пытается «догнать» конкурентов в сфере ИИ после того, как они быстрее развернули генеративные системы, и что компания делает ставку на плотную интеграцию оборудования и ПО, а также на сообщения о конфиденциальности, чтобы выделиться. Business Insider указал, что долгосрочная зависимость Apple от внешней базовой модели может создать стратегические проблемы, если Google изменит условия лицензирования или продолжит более глубокую интеграцию Gemini непосредственно в устройства Android. На данный момент Apple позиционирует свой прорыв в области ИИ как способ сделать iPhone и другие устройства умнее, не превращая их в терминалы для работы с обычными чат-ботами. Кто первым столкнется с новым ИИ от Apple и что будет дальше? Первыми это ощутят разработчики и ранние последователи на новейших iPhone, iPad, Mac и часах в поддерживаемых регионах, которые получат бета-доступ в середине 2026 года. Большинство обычных пользователей столкнутся с Siri AI только после выхода iOS 27 и соответствующих обновлений осенью, а также по мере того, как Apple будет решать регуляторные препятствия в Европе и Китае. Влияние сильно варьируется в зависимости от устройства и географии. Разработчики с совместимым оборудованием и учетными записями Apple получили бета-доступ с 8 июня 2026 года, что позволяет им тестировать функции Siri AI в своих приложениях за несколько месяцев до публичного релиза. Потребители с iPhone 16 или iPhone 15 Pro, Mac и iPad на базе M1 и новейшими Apple Watch смогут получить полный опыт работы после выпуска стабильного ПО в сентябре 2026 года. Владельцы старых устройств, таких как iPhone без чипов класса A17 или Mac до M1, скорее всего, пропустят самые богатые возможности ИИ или вовсе не получат Siri AI. Пользователи в Европейском Союзе и Китае получат новые операционные системы с пробелами там, где должна быть Siri AI, в ожидании одобрения регуляторов и технических корректировок для этих рынков. Apple не назвала точную дату появления Siri AI в ЕС и Китае, оставив миллионы клиентов в неведении относительно того, когда они смогут воспользоваться новыми функциями. Во всех этих аспектах новый помощник Apple представляет собой серьезный архитектурный сдвиг для Siri и того, как ИИ работает на iPhone. Сдержанный энтузиазм и продолжающиеся опасения по поводу сроков выпуска, региональных исключений и доверия показывают, что эра ИИ для Apple начинается под пристальным наблюдением, а не под аккомпанемент безоговорочного восторга.

Nic Reeve·
AI-новости: xAI представила Grok 4.7 с расширенными возможностями логического вывода для разработчиков
AI & Tech

AI-новости: xAI представила Grok 4.7 с расширенными возможностями логического вывода для разработчиков

AInews: 21 сентября 2026 года компания xAI представила Grok 4.7, позиционируя модель как свою самую мощную систему на данный момент для разработки программного обеспечения, агентских задач и профессиональной интеллектуальной деятельности. Согласно анонсу xAI, модель доступна через Cursor, Grok Build, Grok API, сторонние инструменты для кодинга, маршрутизаторы моделей и облачные платформы. Что именно xAI выпустила 21 сентября? xAI выпустила Grok 4.7 в качестве новой флагманской модели для задач, требующих глубоких рассуждений, генерации кода и проведения исследований. Компания заявляет, что система построена на базе более крупной модели, чем Grok 4.6, и прошла дополнительное обучение с подкреплением (reinforcement learning) для решения сложных и длительных задач. Дата запуска: 21 сентября 2026 года, согласно данным xAI. Основное назначение: программирование, агентские рабочие процессы и интеллектуальная деятельность, согласно xAI. Идентификатор модели: grok-4.7 в xAI API, согласно информации о релизе xAI. Входные и выходные данные: на вход подаются текст и изображения, на выходе — текст, согласно опубликованным деталям модели от xAI. Запуск последовал за несколькими днями спекуляций о новой версии Grok. Отчеты, опубликованные до анонса, указывали на возможное появление модели в квотах облачных сервисов, однако те сообщения не подтверждали публичный релиз. Анонс xAI от 21 сентября стал первым прямым подтверждением. Какие возможности заявляются у Grok 4.7? Grok 4.7 спроектирована так, чтобы дольше удерживать внимание на сложных задачах, проверять собственную работу и обрабатывать огромные объемы контекста. Эти утверждения исходят от xAI и описывают целевое использование модели компанией, а не являются независимым вердиктом о производительности. Контекстное окно: 500 000 токенов, согласно информации о модели от xAI. Уровни рассуждений (reasoning): настройки low, medium, high и xhigh, согласно документации к релизу xAI. Уровень рассуждений по умолчанию: high, согласно деталям релиза, обобщенным независимыми отраслевыми ИИ-изданиями. Инструменты: вызов функций (function calling), веб-поиск, поиск в X и выполнение кода, согласно документации xAI API. Фокус модели смещен с простого чата на практическое применение. Агент для кодинга может использовать вызовы инструментов, проверять файлы, пересматривать код и запускать тесты. Исследовательский процесс позволяет удерживать больше материалов в рамках одной сессии. Контекстное окно в 500 000 токенов также дает разработчикам возможность передавать большие репозитории, техническую документацию или истории многоэтапных задач без необходимости разбивать каждый запрос. Как новая модель показала себя в опубликованных тестах? Первые показатели бенчмарков взяты в основном из собственных материалов xAI по запуску и должны рассматриваться как результаты, представленные компанией. Независимые издания повторяли эти цифры, однако имеющиеся отчеты не подтверждают, что во всех тестах использовались идентичные промпты, инструменты или правила оценки для конкурирующих систем. CursorBench 4.0: 46,3%, согласно представленным xAI результатам бенчмарков. DeepSWE v1.1: 71,0%, согласно представленным xAI результатам бенчмарков. EEBench: 64,0%, согласно представленным xAI результатам бенчмарков. HealthBench Professional: 56,7%, согласно представленным xAI результатам бенчмарков. Harvey Legal Agent Benchmark: 19,6%, согласно представленным xAI результатам бенчмарков. Эти тесты охватывают разные способности. Бенчмарки по кодингу измеряют эффективность программной инженерии, в то время как медицинские и юридические оценки проверяют умение отвечать на профессиональные вопросы или поведение агента. Один процент не может описать производительность модели во всех сценариях использования. Пользователям также необходимо отличать баллы бенчмарков от надежности в реальной эксплуатации. Система может показать отличный результат в контролируемом тесте, но все равно требовать проверки человеком при внесении изменений в живую кодовую базу, работе с конфиденциальными записями или принятии решений в регулируемых областях. Где клиенты могут использовать Grok 4.7? Grok 4.7 была запущена скорее как набор инструментов для разработчиков, нежели как единое обновление для потребителей. xAI сообщает, что клиенты могут получить к ней доступ через Cursor и Grok Build, а пользователи API могут подключать её к приложениям и агентским системам для кодинга. Cursor: доступен на момент запуска, согласно xAI и независимым отчетам о релизе. Grok Build: доступен на момент запуска, согласно xAI. xAI API: доступен под именем grok-4.7 , согласно xAI. Другие пути: сторонние среды для разработки, маршрутизаторы моделей и облачные платформы, согласно xAI. GitHub Copilot: согласно независимым отчетам о релизе, модель была добавлена для планов Pro, Pro+, Max, Business и Enterprise в день запуска. Доступность может варьироваться в зависимости от продукта, тарифного плана и региона. Доступ через API также зависит от одобрения аккаунта, поддержки эндпоинтов и выбранной разработчиком интеграции. Появление модели в сервисе маршрутизации не обязательно означает, что все клиенты получат одинаковые лимиты, задержки или доступ к инструментам. Сколько стоит Grok 4.7? Согласно опубликованным тарифам компании, xAI установила цену для стандартной API-модели на уровне $2 за миллион входных токенов и $6 за миллион выходных токенов для промптов объемом менее 200 000 токенов. Для более длинных промптов применяется более высокий ценовой уровень. Вход (Input): $2 за миллион токенов при объеме промпта ниже порога в 200 000 токенов, согласно xAI. Кэшированный вход (Cached input): $0,50 за миллион токенов ниже этого порога, согласно документации к релизу. Выход (Output): $6 за миллион токенов ниже порога, согласно xAI. Длинные промпты: $4 за вход, $1 за кэшированный вход и $12 за выход за миллион токенов при объеме свыше 200 000 токенов, согласно прайс-листу xAI. Оплата за токены — это лишь часть расходов. Приложения, выполняющие повторяющиеся вызовы инструментов, веб-поиск или выполнение кода, могут потреблять больше токенов и генерировать дополнительные сервисные затраты. Разработчикам также необходимо учитывать расходы на хранение данных, мониторинг и стоимость проверки человеком. Что изменилось по сравнению с Grok 4.6? Согласно отчетам о релизе, Grok 4.7 сохраняет контекстное окно в 500 000 токенов и стандартные тарифы ($2 за вход и $6 за выход) для коротких промптов, характерные для Grok 4.6. Вместо этого xAI представляет обновление как качественное улучшение, направленное на более сложные задачи, усиленную верификацию и длительную работу. Масштаб модели: xAI утверждает, что в Grok 4.7 используется более крупная базовая модель, чем в Grok 4.6. Обучение: xAI заявляет, что новая система прошла расширенное обучение с подкреплением на более трудных и длительных задачах. Самопроверка: xAI утверждает, что Grok 4.7 проверяет свои результаты более надежно. Ценообразование: стандартные тарифы API для коротких промптов остаются прежними — $2 за миллион входных токенов и $6 за миллион выходных токенов, согласно xAI. Компания также упоминает более быструю версию под названием Grok 4.7 Fast. Независимые источники сообщают, что быстрая версия доступна через Cursor и Grok Build по двойному тарифу за токены, при этом на момент запуска она не была указана как публичная модель в xAI API. На что разработчикам обратить внимание в дальнейшем? Следующим испытанием станет реальное развертывание. Разработчики оценят, сокращает ли увеличенный контекст и самопроверка время на отладку, оправдывают ли высокие настройки рассуждений задержку (latency) и ведет ли себя система стабильно в различных инструментах кодинга и облачных сервисах. Независимое воспроизведение бенчмарков может прояснить, как Grok 4.7 соотносится с конкурирующими системами. Документация API и детали регионального развертывания определят, кто сможет получить доступ к каждой функции. Корпоративные пользователи изучат вопросы конфиденциальности, логирования, хранения данных и контроля разрешений перед широким внедрением. Разработчики сравнят стандартную и Fast-версии по стоимости, скорости и точности выполнения задач. Grok 4.7 выходит на рынок в момент, когда ИИ-компании ведут борьбу за рабочие нагрузки разработчиков, которые выходят далеко за рамки простой генерации текста. Успех продукта будет зависеть от измеримых результатов в разработке ПО, предсказуемых операционных расходов и способности сохранять контроль человека в процессе, когда автоматизированный агент меняет код или выполняет деликатную профессиональную работу.

Nic Reeve·