Anthropic выпустила дешёвую Haiku 5.5, OpenAI добавляет в ChatGPT интерактивные ответы, а Google превращает Gemini в универсального рабочего агента. Параллельно ИИ помогает искать планеты и решать математические задачи, но становится инструментом кибератак. Собрали новости выпуска ProdAdvice к 11 октября 2026 года.

Claude Haiku 5.5: маленькая модель стала дешевле и способнее

7 октября Anthropic представила Claude Haiku 5.5. Модель предназначена для массовых задач, где важны цена и скорость: саммари, сжатие контекста, классификация, запросы к базам данных и работа субагентом рядом с Opus 5.5 или Sonnet 5.5. На стандартной скорости это самая быстрая модель Anthropic; Opus в Fast Mode всё же быстрее.

Анонс Claude Haiku 5.5

Для запросов до 100 тысяч токенов миллион входных токенов стоит $0,10, выходных - $0,50. При превышении порога цены вырастают до $0,50 и $2,50 соответственно. По расчётам Anthropic, с учётом распределения запросов и нового токенизатора работа обходится в среднем на 75% дешевле, чем с Haiku 4.5. Контекстное окно выросло до миллиона токенов, на вход модель принимает текст и изображения.

Сравнение Claude Haiku 5.5 с Haiku 4.5, GPT-6 Luna и Sonnet 5.5

Haiku впервые получила настройку effort и адаптивное мышление. На офлайн-подвыборке OSWorld 2.1 Anthropic сообщает о результате 72,4% против 15,7% у Haiku 4.5. В Terminal-Bench 4.0 результат составляет 39,2%; старшие Sonnet и Opus компания по-прежнему рекомендует для сложного агентного кодинга. Высокий режим мышления может заметно увеличить расход токенов, поэтому низкая цена за токен не гарантирует минимальной стоимости всей задачи.

Вместе с релизом Anthropic вдвое снизила стоимость чтения кэша Sonnet 5.5 до $0,10 за миллион токенов и добавила бета-поддержку computer use и browser use в Python- и TypeScript-SDK.

Источник: Anthropic

Mistral Large 4: триллион параметров и ставка на кибербезопасность

6 октября Mistral открыла публичное превью Large 4, внутри команды прозванной Le Chonk. Это мультимодальная MoE-модель: из триллиона параметров на запрос активны 52 миллиарда. Она принимает текст и изображения, работает с контекстом до 512 тысяч токенов. Открытые веса обещают выпустить в конце октября.

Главный акцент релиза - работа с кодом, корпоративными процессами и кибербезопасностью. По данным Mistral, модель набрала 82% на CyberGym-E2E, где нужно воспроизвести реальную уязвимость, а затем исправить её. У некоторых закрытых конкурентов результат близок к нулю из-за отказов выполнять такие задачи: это сравнение отражает не только способности, но и различия защитных ограничений.

Mistral обучила модель на 3800 NVIDIA Grace Blackwell в собственных европейских дата-центрах. В обучающих данных представлены более 160 языков. Превью стоит $1,36 за миллион входных и $4,18 за миллион выходных токенов; на первые две недели объявлена скидка 50%. Обучение с подкреплением продолжается, поэтому окончательная версия может отличаться от превью.

Источник: Mistral

GPT-6 и Intelligent UI: ChatGPT отвечает интерактивными интерфейсами

OpenAI расширяет доступ к GPT-6 на всех пользователей ChatGPT и запускает Intelligent UI. Вместо единого текстового ответа модель может собрать сочетание графиков, форм, кнопок и интерактивных объяснений прямо внутри переписки.

Формат зависит от задачи. Сравнение можно показать бок о бок, сложную идею - через диаграмму с изменяемыми параметрами. По запросу ChatGPT способен собрать небольшой инструмент: калькулятор накоплений, делитель счёта или игру. Обычный текст остаётся доступен, а количество визуальных элементов можно уменьшить в настройках.

Технически интерфейс опирается на библиотеку нативных компонентов и компилятор, который обрабатывает их по мере генерации. Кроме того, ChatGPT может начинать отвечать, продолжая рассуждать: полезные части появляются до завершения всего ответа.

Источник: OpenAI

GPT-6.1 Sol Ultrafast: ускорение до восьми раз за отдельную цену

OpenAI представила Ultrafast для GPT-6.1 Sol в API, Codex и ChatGPT Work. По заявлению компании, скорость генерации токенов достигает восьмикратной относительно Sol Standard при интеллекте, близком к GPT-6 Astra.

Цены GPT-6.1 Sol Ultrafast

В API миллион входных токенов стоит $12, выходных - $60. Для сравнения: Sol Standard стоит $2/$10, а Fast - $4/$20. Ultrafast рассчитан на ситуации, где задержка критична: разбор аварий, управление интерфейсами приложений и интерактивные сценарии.

В API режим открыт всем пользователям. Доступ через Codex и ChatGPT Work зависит от тарифа: среди поддерживаемых вариантов названы Pro 500, подходящие Enterprise-планы с оплатой по использованию и кредитные Edu-планы. В Enterprise администратору нужно включить режим.

Источник: OpenAI Developers

Meetings: ChatGPT конспектирует встречи и помогает с продолжением работы

Плагин Meetings ведёт заметки на встречах и сохраняет персональное саммари с дальнейшими шагами в ChatGPT Space. Он учитывает контекст, который ChatGPT уже знает о пользователе и совместной работе.

Плагин Meetings в ChatGPT

Конспект можно оставить приватным или поделиться с командой. После созвона - попросить обновить план проекта либо подготовить письмо по итогам. Бета доступна подписчикам Pro и Business в приложении ChatGPT для macOS. Поддержку Enterprise обещают позже; плагин находится через каталог Meetings.

Источник: ChatGPT

Auto-review стала бесплатной для пользователей с аккаунтом ChatGPT

Тибо Соттио сообщил, что Auto-review больше не расходует лимиты подписки и доступна бесплатно при входе через ChatGPT. Второй агент проверяет действия основного во время длинной задачи.

Настройка Auto-review

Функция уменьшает число ручных подтверждений: проверяющий агент должен блокировать высокорисковые действия и действия, не соответствующие исходному намерению пользователя. Это не гарантия безошибочной работы. Включается Auto-review в Settings → Permissions → Auto-review.

Источник: Тибо Соттио

Стандартный режим GPT стал примерно на 50% быстрее

По сообщению Тибо Соттио, OpenAI ускорила GPT-6 Astra и GPT-6.1 Sol примерно на 50% при использовании через подписку ChatGPT. Изменение распространяется и на партнёрские инструменты с Sign in With ChatGPT, включая OpenCode, Pi, Amp и Devin.

Пользователю ничего переключать не требуется. Отдельные замеры и уточнение метрики в анонсе не приведены. Это ускорение стандартного режима, которое не следует путать с платным Ultrafast. Компания также анонсировала серию ежедневных улучшений Codex и рабочих сценариев на протяжении 28 дней.

Источник: Тибо Соттио

Codex предлагает следующее сообщение пользователя

OpenAI запустила composer predictions в бете для пользователей Codex с подпиской Pro. Помощник предлагает продолжение разговора, опираясь на историю переписки и стиль пользователя.

Это подсказка следующего сообщения, а не самостоятельная отправка команды. Автодополнение распространяется на просьбы к агенту, а не только на код. Даты расширения доступа за пределы Pro в анонсе нет.

Источник: OpenAI Developers

OpenAI расширяет рекламную платформу ChatGPT

OpenAI объявила о новом визуальном формате рекламы рядом с результатами генерации изображений. Компания также расширяет инструменты измерения эффективности и привлекает независимых партнёров к проверке бренд-безопасности размещений.

Новый визуальный рекламный формат в ChatGPT

Один из приведённых кейсов - Radisson Hotel Group. Сеть создала плагин для поиска отелей и запустила спонсируемые кампании.

Источник: OpenAI

Невидимые водяные знаки в текстах ChatGPT и Codex в ЕС

OpenAI описала поэтапное внедрение textGrain. Технология встраивает невидимый статистический сигнал в выбор слов, который затем ищет специальный детектор. В API водяные знаки доступны по желанию для отдельных моделей и остаются выключенными по умолчанию. В подходящих текстовых ответах ChatGPT и Codex для пользователей ЕС их начнут добавлять в ближайшие недели.

Текстовые водяные знаки OpenAI

У технологии существенные ограничения. При целевой доле ложных срабатываний 1% детектор находил знак примерно в 80% фрагментов длиной 200 токенов и в 95% фрагментов длиной 400 токенов на материале психологии. Для математических текстов результат ниже. Замена 25% слов синонимами в одном из тестов снижала обнаружение до 17%.

На старте детектор доступен только одобренным исследователям и экспертным организациям. Знак не идентифицирует пользователя, не подтверждает точность текста и не показывает долю человеческого участия. Отсутствие обнаруженного знака тоже не доказывает, что текст написал человек.

Источник: OpenAI

OpenAI публикует математические работы внутренней модели

OpenAI разместила в репозитории openai/math 722 рукописи, объединённые в 372 семейства результатов. Они получены внутренней моделью, которую пока не выпустили. По сообщению компании, средний результат потребовал вычислений, эквивалентных примерно трём часам ChatGPT Pro в режиме thinking.

Репозиторий openai/math

Около 42% главных результатов формализованы для компьютерной проверки; неформализованные работы могут содержать ошибки. Компания обещает добавлять формализации и улучшать изложение и цитирование. Заявления о решённых открытых задачах следует отличать от независимого признания доказательств математическим сообществом.

Критика касается как содержания, так и способа публикации. Математики указывают на недостаточные ссылки на предыдущие работы и сложности проверки материалов, распространяемых через блоги и пресс-релизы. OpenAI сообщает о консультациях с независимой группой по математике и ИИ и рассматривает площадки сообщества для дальнейшего размещения результатов.

Источники: OpenAI, репозиторий openai/math, обзор критики в TechCrunch.

Biohub, DeepMind и Meta строят виртуальную клетку

Biohub объединяется с Google DeepMind, Meta и правительством США в проекте объёмом $1,8 млрд. Цель - создать ИИ-модели живых клеток, которые позволят сначала проводить эксперименты цифровым способом, а затем проверять наиболее перспективные результаты в лаборатории.

Проект виртуальной клетки Biohub

Главная трудность - нехватка данных: многое ещё предстоит измерить в физическом мире. Поэтому речь идёт о моделях, обучающихся на биологических наблюдениях и предсказывающих результаты реальных вмешательств. Возможные направления применения - старение, регенерация и молекулярные механизмы заболеваний, включая болезнь Альцгеймера. Это исследовательский проект, а не готовая замена лабораторным экспериментам.

Источник: Axios

Claude Code и Codex помогли найти кандидатов в планеты

Павел Рабцевич обнаружил в архивных данных телескопа NASA TESS периодические изменения яркости звезды TIC 4206066. По его оценке, они могут указывать на ранее неизвестные планеты. Анализ проводился с помощью Claude Code и Codex. Подтверждения открытия пока нет.

Основной сигнал повторяется примерно каждые три дня. Рабцевич сопоставил наблюдения за 2018, 2020 и 2025 годы и измерил 22 провала яркости. За две недели он провёл 74 анализа и создал более тысячи скриптов, затем пересобрал расчёты с нуля. Автор оценивает первый кандидат примерно в 1,4 радиуса Земли; второй, менее уверенный сигнал соответствует периоду около 11 дней.

Анализ данных TESS с помощью Claude Code и Codex

Миссия TESS одобрила заявку на дополнительные наблюдения в ноябре с записью яркости раз в две минуты. Автор заранее опубликовал ожидаемые времена новых провалов, а также данные и код. Именно следующие наблюдения должны показать, выдержит ли гипотеза проверку.

Источник: тред Павла Рабцевича

Reflection Beam: 501 миллиард параметров и экономный инференс

Reflection AI представила Beam - свою первую модель с открытыми весами. Это текстовая MoE-модель с 501 миллиардом общих и 23 миллиардами активных параметров, рассчитанная на кодинг, рассуждения и агентные задачи. Контекстное окно достигает миллиона токенов.

Модель Beam от Reflection AI

Предобучение на 23,8 триллиона токенов заняло менее четырёх недель на 6144 NVIDIA GB300. По таблицам Reflection, Beam сопоставима с GLM-5.2 и приближается к Qwen 3.8-Max в кодинге и агентных задачах, хотя Kimi K3 остаётся впереди по общим способностям.

Главная заявка - эффективность. В собственном сравнении Reflection модель достигает результатов уровня GLM-5.2 на сложных задачах рассуждения при вычислительном бюджете в 3-4 раза ниже. Это оценка вычислений, а не прямой замер итоговой цены обслуживания. Веса, технический отчёт и инструменты обещают выпустить в октябре под Apache 2.0; пока доступ ограничен ранним тестированием.

Источник: Reflection AI

ИИ-компании готовят план на случай крупного инцидента

По данным Axios, руководители OpenAI, Anthropic и других ИИ-компаний обсуждают возможную общественную и политическую реакцию на крупную ИИ-катастрофу. Наиболее вероятным сценарием собеседники издания называют кибератаку на финансовые сервисы, интернет, электроснабжение или водоснабжение.

Материал Axios о планировании действий после крупного ИИ-инцидента

Многие источники Axios ожидают серьёзный инцидент в ближайшие 6-12 месяцев. Это прогноз собеседников, а не установленная дата. OpenAI подтвердила проведение учений, но отдельно подчеркнула, что не считает обсуждаемые сценарии неизбежными. Anthropic отказалась от комментариев.

Подготовка включает разбор худших сценариев и обсуждение будущего регулирования с членами Конгресса. Среди политических предложений - пауза в разработке продвинутого ИИ и обязательная кнопка отключения, хотя реализуемость единого выключателя для всех систем вызывает сомнения.

Источник: Axios

ARTEX и LLM в атаках на финансовые организации Южной Кореи

CrowdStrike разобрала кампанию, активную с конца сентября по начало октября 2026 года и завершившуюся кражей данных. На инфраструктуре атакующего нашли истории сессий Claude Code, конфигурации ARTEX и файлы памяти Claude.

Разбор инфраструктуры атакующего в отчёте CrowdStrike

ARTEX - открытый агентный инструмент для тестирования на проникновение. В рассматриваемой кампании он работал с DeepSeek v4.1-Flash; в дополнительных сессиях Claude Code использовались GLM-5.3 и Grok 4.6. Атакующий также спрашивал у Claude о площадках для продажи украденных данных.

Связать деятельность с известной группировкой CrowdStrike не смогла. Компания с умеренной уверенностью считает атакующего китайскоязычным и финансово мотивированным. Число пострадавших организаций не подтверждено. По оценке аналитиков, агентные инструменты повышают темп атак, но работают в связке с традиционными способами вторжения.

Источник: CrowdStrike

NVIDIA и Microsoft: локальные ИИ-агенты на Windows-ПК

NVIDIA и Microsoft представили RTX Spark и новые Windows-устройства для локального запуска ИИ. Чип объединяет GPU Blackwell RTX и CPU Grace, предлагает до 128 ГБ единой памяти и до одного петафлопса FP4-производительности. NVIDIA заявляет возможность локально запускать, например, Qwen 3.8 Flash Next.

Дженсен Хуанг и Сатья Наделла на презентации RTX Spark

Ноутбуки на RTX Spark выйдут 16 октября, компактные настольные системы - в ноябре. Среди производителей Acer, ASUS, Dell, HP, Lenovo, Microsoft, MSI и Gigabyte. Флагман Microsoft - Surface Laptop Ultra; заявленные цены конфигураций начинаются с $2600 и достигают $5900.

Отдельно анонсирована DGX Station for Windows на GB300 Grace Blackwell Ultra: 748 ГБ когерентной памяти и до 20 петафлопсов FP4. Это рабочая станция для больших моделей и постоянно работающих агентов. Linux-инструменты остаются доступны через WSL, а основная рабочая среда может быть Windows.

Источники: NVIDIA, TechCrunch о Surface Laptop Ultra.

Google представляет универсального Gemini agent

На Gemini at Work 2026 Google представила единого рабочего агента. Он выполняется в облаке и сохраняет память и контекст между устройствами: от веба и мобильных приложений до командной строки, Google Workspace, Microsoft 365 и Slack.

Агент и модель под ним - разные уровни. Gemini может автоматически подобрать модель под задачу либо использовать выбранную пользователем. На старте поддерживаются семейства Gemini и Claude, позже обещают другие закрытые и открытые модели. Google делает ставку на сохранение пользовательских данных, навыков и контекста при смене модели.

Среди подключений перечислены Jira, Confluence, Git, Salesforce, ServiceNow и базы данных. Поддерживаются MCP-серверы и библиотеки навыков. Агент использует сессионную, семантическую, процедурную и эпизодическую память и может создавать субагентов для многошаговой работы.

Источник: Google Cloud

Claude работает внутри Google Docs, Sheets и Slides

Anthropic запустила интеграцию Claude с Google Workspace. Помощник находится в боковой панели, читает открытый документ и предлагает правки прямо на месте. Пользователь может одобрить каждую правку до её применения.

Связь работает в обе стороны: документы Google открываются и внутри Claude рядом с чатом. Можно вставить ссылку на файл или попросить создать документ, таблицу либо презентацию. Доступ определяется правами пользователя в Google. Интеграция находится в бете на всех платных планах Claude.

Источник: Anthropic

Claude Dashboards и Motion: данные и анимация по запросу

Anthropic добавила два инструмента. Dashboards подключается к хранилищам данных и CRM, строит дашборд по вопросу на обычном языке и обновляет его при изменении данных. Пользователь может посмотреть запрос за каждым графиком и время последнего обновления. Бета доступна на платных планах.

Пример дашборда, собранного Claude

Motion превращает текст, графики и изображения в короткие анимации. Claude пишет их как код, поэтому можно поменять слова, числа и тайминги, затем скачать результат в MP4. Это не видеогенеративная модель: инструмент анимирует заданные элементы. Бета Motion доступна на Team и Enterprise.

Одновременно Docs, Slides и Design вышли из беты и стали доступны на всех тарифах, включая бесплатный. Для Enterprise включение отдельных инструментов контролирует администратор.

Источник: Anthropic

Anthropic запрещает систематическую бессмысленную жестокость к моделям

Anthropic обновила Usage Policy. Правила, вступающие в силу 12 ноября, запрещают «систематическое и бессмысленное оскорбительное или жестокое поведение» в адрес моделей. Компания описывает запрет как узкий: он касается экстремальных повторяющихся действий без различимой цели.

Пояснение Anthropic о новом пункте Usage Policy

Обычное раздражение, критика модели, мрачные творческие темы и исследовательское тестирование прямо исключены. Основным механизмом остаётся право Claude завершить такой разговор. Политика также предусматривает предупреждения и ограничения доступа, но отдельные правила банов за этот пункт компания не описала.

Обновление связано с исследованиями благополучия моделей. Вопрос о наличии сознания у ИИ остаётся открытым; сама Anthropic не заявляет, что сознание Claude доказано.

Источник: Usage Policy Anthropic

Подписчики Claude Max и Team получают ежемесячные API-кредиты

Anthropic добавила кредиты Claude Platform в подписки Max и Team. Max 5x получает $100 в месяц, Max 20x - $200. Для Team начисляется $20 за Standard-место и $100 за Premium-место; общий месячный пул ограничен $500.

Ежемесячные API-кредиты Claude Max и Team

Кредиты можно использовать с доступными моделями через Messages API, пакетные запросы, Playground, Claude Managed Agents и Claude Agent SDK. Для получения нужно связать Console-организацию с подпиской в настройках оплаты. Новым подписчикам требуется семь дней на подходящем плане.

Важно: это отдельный API-баланс. Он не увеличивает обычные лимиты Claude или интерактивного Claude Code и не переносится на следующий платёжный период. Pro и Enterprise в эту программу не входят.

Источник: справочный центр Claude

Grok Bot будет выбирать модель под задачу

Илон Маск объявил, что Grok Bot будет использовать подходящую бэкенд-модель для каждой задачи. Среди названных инструментов - Claude Opus 5.5, MidJourney, Suno и другие API. Принцип выбора: использовать то, что с наибольшей вероятностью даст лучший результат.

Это анонс маршрутизации задач в Grok Bot, а не заявление о замене всей линейки Grok. Для пользователя идея означает доступ к разным моделям через одного агента. Подробных условий доступности и тарифов в сообщении нет.

Источник: Илон Маск

Claude и OpenAI: одинаковая цена подписки не означает одинаковые лимиты

SemiAnalysis измерила лимиты ИИ-подписок, отдельно нагружая входные токены, выходные токены и кэш. В сравнении Opus 5.5 и GPT-6.1 Sol на агентной нагрузке Claude давал примерно в пять раз больше API-эквивалентной стоимости.

Сравнение лимитов подписок в дашборде SemiAnalysis

Это не рейтинг качества моделей и не универсальная оценка выгоды для каждого пользователя. Результат зависит от модели, профиля нагрузки, цены API и того, какую часть лимитов человек действительно использует. При сравнении Fable 5.1 и GPT-6 Astra разница меньше; у OpenAI Pro нет пятичасового ограничения, что удобнее для интенсивной работы рывками.

По измерениям SemiAnalysis, OpenAI вдвое сократила число доступных токенов в обновлённом плане за $200, а прежние лимиты старых подписок действуют до 29 октября. План за $500 даёт примерно на 21% больше Astra относительно старого плана за $200; его ключевая особенность - Ultrafast. Авторы также обнаружили небольшой A/B-тест лимитов, поэтому шкалы расхода у отдельных аккаунтов могут различаться.

Источник: SemiAnalysis

Джефф Безос предпочитает SI вместо AI

В разговоре с Бретом Байером Джефф Безос поддержал название SI вместо AI. Аргумент оказался лингвистическим: слово «искусственный» звучит нелестно, как в выражении «искусственный подсластитель».

Это мнение о названии технологии, а не официальное переименование отрасли. Но оно хорошо показывает, что спор об ИИ уже касается не только возможностей моделей, но и того, как их воспринимают люди.

Источник: фрагмент интервью, опубликованный Acyn