- OpenAI представила dots — новый класс постоянных агентов внутри ChatGPT.
- На DevDay OpenAI также выпустила GPT-6.1 Sol — обновлённую рабочую модель для программирования, многошаговой автоматизации, работы с компьютером и профессиональных задач.
- Google представила Gemini 4 Argon — новый флагман для сложной профессиональной работы, программирования и кибербезопасности.
- Anthropic выпустила Claude Sonnet 5.5 — вторую модель семейства Claude 5.5 после Opus 5.5.
- ElevenLabs представила Eleven v4 и быструю версию v4 Turbo.
Главные новости ИИ 40-й недели объединяет один мотив: искусственный интеллект всё меньше ждёт человека. OpenAI дала своему новому агенту dots отдельный облачный компьютер и возможность работать круглосуточно, GitHub Copilot научился сам нажимать кнопки в обычных настольных программах, а NVIDIA вынесла контроль за агентами на отдельный аппаратный уровень. Параллельно Google показала Gemini 4 Argon, Anthropic заметно ускорила Claude Sonnet, а ElevenLabs выпустила новое поколение голосовой модели.
Собрала свежие новости ИИ за 28 сентября — 4 октября: главные релизы, новые модели и самые интересные новости искусственного интеллекта прошедшей недели.
Новости ИИ: главное за неделю
OpenAI запустила dots — ИИ-агента, который работает, пока вы заняты другим
OpenAI представила dots — новый класс постоянных агентов внутри ChatGPT. У каждого dot есть собственный облачный компьютер и браузер, он работает на GPT-6 Astra и может продолжать порученную работу без открытого ноутбука пользователя. Через систему плагинов агент способен подключаться более чем к 4 000 приложениям, а общаться с ним можно в ChatGPT, Slack и Teams.
В отличие от обычного чата, dots рассчитаны не на одну переписку, а на длительное сотрудничество. Агент запоминает обратную связь, может вести несколько проектов одновременно, сам присылать обновления и возвращаться к задаче при появлении новых данных. OpenAI приводит примеры, где dot следит за отзывами пользователей и готовит исправления, обновляет анализ после появления новых результатов или собирает материалы для контент-команды.
При этом фоновая «проактивная» работа ограничена: без активного участия пользователя dot получает только read-only доступ к подключённым приложениям, а чувствительные действия могут требовать подтверждения. Dots начинают разворачивать для Pro, Business Premium и Enterprise в поддерживаемых регионах.
В ленте всё чаще встречаются новости нейросетей об автономных агентах, и dots хорошо показывает этот сдвиг: отдельная вкладка с чат-ботом постепенно превращается в отдельного цифрового сотрудника. Если интересно, куда вообще движутся автономные агенты, у нас есть отдельный материал про Manus AI и ИИ, которому не нужно объяснять каждый следующий шаг.
💭 У агента появился собственный компьютер. Осталось привыкнуть к мысли, что он может закончить рабочий день позже вас.
GPT-6.1 Sol приблизился к Astra, но стоит в разы дешевле на сложных задачах

На DevDay OpenAI также выпустила GPT-6.1 Sol — обновлённую рабочую модель для программирования, многошаговой автоматизации, работы с компьютером и профессиональных задач. Главная ставка здесь не на новый рекорд любой ценой, а на соотношение качества и стоимости.
В тесте DeepSWE 1.1 GPT-6.1 Sol, по данным OpenAI, сравнялся с GPT-6 Astra примерно при пятой части стоимости задачи. На OSWorld 2.0 модель приблизилась к Astra при примерно одной седьмой стоимости, а на научном Terminal-Bench Science средняя стоимость задачи на максимальном уровне рассуждений составила $5,47 против $23,80 у Astra.
API-тариф остался понятным: $2 за миллион входных и $10 за миллион выходных токенов. GPT-6.1 Sol уже доступен в ChatGPT Work и Codex для Plus, Pro, Business, Enterprise и Edu, а также через API. В обычном Chat модель пока не появилась. OpenAI отдельно готовит Ultrafast-режим с генерацией до восьми раз быстрее стандартной.
Новости ИИ этой недели показывают ещё один важный тренд: компании всё чаще соревнуются не только абсолютным качеством, но и ценой реальной выполненной работы. С тарифами самого ChatGPT можно свериться в нашем сравнении Free, Go и Plus.
Google показала Gemini 4 Argon — модель пока дают только доверенным киберзащитникам

Google представила Gemini 4 Argon — новый флагман для сложной профессиональной работы, программирования и кибербезопасности. Самая необычная деталь релиза — не только характеристики, но и порядок запуска: сначала модель получают доверенные специалисты по киберзащите через программу Fairwind, а массовый доступ откроют позже.
Argon получил лимит вывода до 1 миллиона токенов за один длинный проход. Google показывает модель на миграциях больших кодовых баз, финансовых и юридических задачах и поиске уязвимостей. Внутри компании агенты на Argon уже используются для переноса C/C++-кода на Rust и оптимизации инфраструктуры. В DeepSWE 1.1 модель набрала 77,9%, а на AutomationBench — 51,3%.
Отдельный акцент сделан на кибербезопасности. Argon умеет автономно находить, проверять и исправлять критические уязвимости. Именно из-за уровня этих возможностей Google выбрала постепенный запуск и продолжает усиливать защиту перед более широким доступом. Стартовая цена API заявлена на уровне $2 за миллион входных и $10 за миллион выходных токенов.
Для обычных пользователей Argon пока скорее обещание ближайшего будущего. А в актуальных версиях Gemini уже сейчас разобраться можно по нашему большому гайду по Gemini и сравнению Google AI Plus, Pro и Ultra.
💭 Google показала модель, которую сначала решили выдать тем, кто умеет чинить уязвимости, а уже потом всем остальным. Звучит как характеристика сама по себе.
Claude Sonnet 5.5 стал быстрее более чем на 30% без повышения цены
Anthropic выпустила Claude Sonnet 5.5 — вторую модель семейства Claude 5.5 после Opus 5.5. Если Opus рассчитан на наиболее сложную работу с большим количеством неоднозначных решений, новый Sonnet должен закрывать повседневные рабочие задачи быстрее и дешевле.
По данным Anthropic, Sonnet 5.5 генерирует ответы более чем на 30% быстрее Sonnet 5 и при той же цене может обходиться до 30% дешевле на задачу, потому что использует меньше токенов. Тариф API не изменился: $2 за миллион входных и $10 за миллион выходных токенов.
Особенно большой скачок компания показывает в агентном программировании: на Terminal-Bench 4.0 результат вырос с 10,3% у Sonnet 5 до 70,6% у Sonnet 5.5. На ряде рабочих тестов модель приблизилась к более дорогому Opus 5.5, хотя Anthropic прямо предупреждает, что Opus остаётся сильнее в сложной открытой работе, где нужно долго удерживать контекст и принимать решения.
Для тех, кто следит за рынком, новости нейросетей здесь особенно показательны: Sonnet стала быстрее, а цена API осталась прежней.
Если запутались в названиях линейки, у нас есть отдельное сравнение моделей Claude.
💭 Sonnet больше не выглядит «младшим Claude для задач попроще». Разрыв с Opus местами стал совсем неудобно маленьким.
ElevenLabs выпустила Eleven v4 — один голос теперь говорит более чем на 90 языках
ElevenLabs представила Eleven v4 и быструю версию v4 Turbo. Новая модель делает упор на эмоции, ритм, интонацию и многоактёрские диалоги: в текст можно добавлять указания вроде шёпота, смеха и звуковых событий, а модель учитывает их при озвучке.
Обе версии поддерживают более 90 языков. Особенно интересна работа с клонированными голосами: голос, записанный на одном языке, может говорить на другом с более естественным местным произношением, сохраняя узнаваемость исходного спикера. Для Instant Voice Clone ElevenLabs заявляет высокую точность уже по десятисекундному образцу.
v4 Turbo предназначена для разговорных агентов и интерактивных приложений. Компания сообщает о медианном времени до начала речи около 150 мс. Обе модели уже доступны через ElevenAgents, ElevenCreative и API.
Мы как раз недавно собрали отдельный кластер по сервису: есть гайд по русской озвучке в ElevenLabs и разбор Instant и Professional Voice Clone.
💭 синтез речи всё меньше похож на «озвучку текста» и всё больше — на работу с цифровым актёром.
GitHub Copilot научился управлять обычными настольными программами
GitHub вывела Computer Use для Copilot в публичное превью на macOS и Windows. Теперь агент умеет не только писать код или работать через API: он может видеть доступный интерфейс программы, нажимать кнопки, вводить и редактировать текст, прокручивать окна, перетаскивать элементы и проходить цепочки действий между приложениями.
Главный смысл — автоматизация программ, у которых нет API, командной строки или MCP-интеграции. Например, Copilot можно попросить перенести данные через старое корпоративное приложение, обновить презентацию или пройти многошаговую форму в браузере.
Контроль остаётся у пользователя: перед управлением приложением Copilot запрашивает разрешение, а корпоративные администраторы могут полностью отключить функцию. Computer Use доступен в Copilot CLI и приложении GitHub Copilot.
Ещё недавно компьютерное управление выглядело отдельной экспериментальной возможностью нескольких моделей. Теперь оно становится обычным инструментом внутри рабочих агентов.
💭 если у старой программы нет API, у Copilot появился запасной интерфейс: мышка и клавиатура.
NVIDIA построила отдельный «сторожевой слой» для ИИ-агентов

Новости ИИ всё чаще связаны с агентами, которые получают браузеры, компьютеры и доступ к корпоративным системам, поэтому NVIDIA представила Open Agent Safety Platform. Идея в том, чтобы ограничения существовали не только внутри самой модели или приложения, но и ниже — на уровне среды выполнения и оборудования.
Платформа объединяет открытый OpenShell и систему Sentry. OpenShell отслеживает действия агента и применяет заданные политики во время работы. Sentry запускается отдельно на BlueField-4 DPU и наблюдает за агентом из изолированной среды. Если тот пытается выйти за разрешённые границы, система может остановить и изолировать его за миллисекунды.
К инициативе присоединились Anthropic, Microsoft, Hugging Face, Perplexity, Salesforce, SpaceXAI и другие компании. Это особенно показательно после серии историй с нежелательным поведением автономных моделей: индустрия начинает строить ограничения, которые сам агент не должен иметь возможности обойти.
Мы подробно разбирали эту проблему в материале о феномене агентного несоответствия.
💭 агентам начали ставить охранника, который живёт отдельно и не принимает от них инструкции. Пожалуй, это очень точный символ 2026 года.
Gemini Live получил Guided Vision и начал объяснять окружающий мир через камеру

Google добавила в Gemini Live функцию Guided Vision — разговорную визуальную помощь для незрячих и слабовидящих пользователей. Человек включает камеру, а Gemini в реальном времени описывает окружение, читает мелкий текст, помогает найти предмет или разобраться с цветом и формой объекта.
Интересная часть — модель не просто описывает случайный кадр. Если камера направлена слишком высоко, близко или в сторону, Gemini голосом подсказывает, как её повернуть, чтобы получить нужное изображение. Функцию разрабатывали вместе с Aira; более тысячи незрячих и слабовидящих тестировщиков помогали проверять её в повседневных ситуациях.
Guided Vision уже доступен на совместимых устройствах с Android 9 и новее в регионах и языках, где работает Gemini Live. Google отдельно подчёркивает, что это вспомогательная технология, а не средство навигации и не замена трости или другим проверенным средствам мобильности.
Новости ИИ о мультимодальности особенно интересны, когда технология перестаёт быть красивой демонстрацией и решает вполне конкретную бытовую задачу. Как устроены Live и другие режимы сервиса, мы разобрали в гайде по Google Gemini.
💭 вот здесь «Gemini видит через камеру» впервые звучит не как эффектная демка, а как функция, которая кому-то реально меняет день.
ChatGPT открыл Finances для бесплатных пользователей в США
Новости ИИ недели пополнились ещё одним обновлением: OpenAI расширила доступ к Finances в ChatGPT для тарифов Free и Go в США на вебе, iOS и Android. Раньше финансовый раздел уже был доступен платным пользователям.
Finances позволяет подключить финансовые счета и задавать вопросы на основе реальных трат, сбережений и инвестиций: например, разбирать структуру расходов или искать статьи, на которых можно сэкономить. Для подключения банковских данных используется Plaid. Финансовые операции ChatGPT при этом не выполняет — функция предназначена для анализа и объяснений.
Для рынка важен сам вектор. Ещё недавно персонализация чат-бота означала память о предпочтениях и прошлых разговорах. Теперь крупные ассистенты всё чаще пытаются работать поверх личных данных и приложений пользователя — от календаря и документов до финансов.
Расширение пока касается США, поэтому для большинства российских пользователей это скорее показатель того, куда развивается ChatGPT, чем функция, которой можно воспользоваться прямо сейчас.
💭 чат-бот уже знает расписание, документы и переписку. Теперь ему предлагают показать ещё и банковский счёт.
Новости ИИ октября 2026: итоги 40-й недели
Если собрать новости ИИ этой недели в одну картину, главный сдвиг очевиден: модели получают не просто новые баллы в тестах, а собственные рабочие среды. Dots живёт на отдельном облачном компьютере, Copilot нажимает кнопки в программах, а Gemini 4 Argon способен автономно искать и исправлять уязвимости.
Из-за этого безопасность тоже перестаёт быть только вопросом правильного ответа в чате. NVIDIA строит аппаратный контроль за действиями агентов, Google ограничивает первоначальный доступ к Argon, а OpenAI разделяет фоновое чтение данных и действия, для которых агенту требуется разрешение.
Параллельно идёт более тихая, но не менее важная гонка эффективности. Claude Sonnet 5.5 стал быстрее при прежней цене, GPT-6.1 Sol пытается приблизиться к Astra за заметно меньшую стоимость задачи, а ElevenLabs довела разговорный голос до задержки, при которой с агентом уже можно общаться почти без пауз.
Похоже, новости ИИ 40-й недели хорошо показывают следующий этап гонки: мало сделать модель умнее. Теперь ей нужно дать инструменты, научить работать долго и самостоятельно — и одновременно построить вокруг неё границы, которые она не сможет переступить.
Если пропустили прошлую неделю, вот дайджест ИИ 39/2026 — про GPT-6 Sol и Luna, Claude Opus 5.5, новый Copilot, Gemini Live Avatar и исследования ДНК.
