ROBOTON / ДАЙДЖЕСТ · 1–7 СЕНТЯБРЯ 2026

Мозг стал сильнее, тело вышло на улицы: неделя Astra, гуманоидов и роботакси

За семь дней ИИ почти закрыл тест на адаптацию к незнакомому миру, научился дешевле разбирать многочасовое видео, а роботакси одновременно расширились, добрались до Лондона и столкнулись с законом. Отделяем уже случившееся от обещанного.

У этой недели два разных темпа. В цифровом мире новые модели осваивают незнакомые среды, часами пишут код и сами выбирают, какой фрагмент видео рассмотреть внимательнее. В физическом мире всё осторожнее: один сервис запускается сразу без водителя, второй оставляет человека за рулём, а третий встречает федерального регулятора через сутки после старта.

Именно это расхождение сейчас важнее любого отдельного рекорда. «Мозг» машин ускоряется почти ежемесячно; тело, инфраструктура, безопасность и право вынуждены жить в мире трения, бордюров и действующих стандартов. К счастью, реальность всё ещё не обновляется одной кнопкой.

1. GPT-6 Astra: рекорд не равен AGI, но старое возражение стало слабее

Статус: произошло. 3 сентября OpenAI выпустила GPT-6 Astra. Самый заметный результат — ARC-AGI-3, где агенту не объясняют правила нового интерактивного мира. Он должен экспериментировать, замечать последствия действий, строить внутреннюю модель среды и менять стратегию.

Лучший зафиксированный результат Astra составил 99,9%. Однако важная мелочь размером почти со весь заголовок: использовался Provider Adapter, сохраняющий скрытое состояние рассуждений между запросами, а прогон стоил около $18 817. Со стандартной обвязкой модель получила 62,7% при стоимости примерно $26 098. Оба результата рекордные, но массового дешёвого «универсального разума в телефоне» из них пока не получается.

Почему это всё равно важно? Ещё весной незнакомые интерактивные среды были наглядной слабостью frontier-моделей. Astra показала, что машина уже способна превращать неизвестный мир в набор правил и действовать в нём экономнее медианного человека на 96% уровней теста. Это не доказательство AGI, но сильный экспериментальный удар по тезису «модель умеет только воспроизводить знакомые шаблоны».

RobotON подробно разобрал стоимость, ограничения и другие тесты Astra в отдельном материале «GPT-6 Astra прошла тест на незнакомый мир. Это уже AGI?». После релиза предварительный RobotON AGI Index изменился с 52,5 до 53,9: заметно для одного события, но без попытки выдать один дорогой прогон за конец истории.

Сильнее — и одновременно опаснее

Astra стала первой широко развёрнутой моделью OpenAI, которой компания присвоила уровень Critical по кибервозможностям. В испытаниях она находила неизвестные уязвимости и собирала цепочки эксплуатации. Это полезнейший инструмент для защиты систем — и ровно та же способность в чужих руках становится проблемой.

6 сентября главный научный сотрудник OpenAI Якуб Пахоцкий опубликовал эссе An Alien Mind. Он не объявил остановку разработки. Формулировка точнее и серьёзнее: масштабирование будущих систем должно ограничиваться уверенностью в безопасности, а обязательные пороги могут контролировать независимые аудиторы, государства или международные органы. В качестве одного из вариантов он прямо назвал координированное замедление, если надёжность контроля будет отставать от способностей.

Значение: безопасность впервые выглядит не внешним приложением к новому продукту, а возможным ограничителем темпа разработки. Это уже не спор о том, поставит ли чат-бот неправильную запятую.

2. Claude Fable 5.1: длинная работа становится экономически нормальной

Статус: произошло. 1 сентября Anthropic выпустила Claude Fable 5.1 в общий доступ и Claude Mythos 5.1 — для проверенных программ доступа в кибербезопасности и биологии. Это одна базовая модель с разными уровнями защитных ограничений.

Главный сдвиг здесь не только в баллах, но и в цене длинной работы. Anthropic оставила базовые тарифы, но в четыре раза снизила цену чтения кэша. По расчётам компании, типичный сценарий станет примерно на 25% дешевле, а особенно длинная агентная работа — до 45% дешевле. Для агента, который часами перечитывает кодовую базу, документы и собственные заметки, кэш — не бухгалтерская мелочь, а значительная часть счёта.

На Terminal-Bench-Science 0.1 Fable 5.1 получила 52,6% против 24,7% у Fable 5; на Terminal-Bench 4.0 — 55,8% против 42,0%. Это цифры Anthropic, а не независимая контрольная работа, поэтому относиться к ним следует как к сильному, но пока фирменному свидетельству.

Значение: следующая граница — не ещё один красивый ответ, а проект, который можно отдать модели вечером и получить утром с тестами, журналом действий и проверяемым результатом. На форуме людей и машин RobotON уже открыт ровно такой разговор: какие повторяемые задачи пора передавать агентам и где человек обязан оставаться в контуре.

3. Gemini перестал смотреть длинное видео кадр за кадром

Статус: произошло. 1 сентября Google запустила агентное понимание видео для Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite через API и корпоративную агентную платформу.

Обычная система берёт кадры с фиксированной частотой — например, один кадр в секунду — и либо тратит токены на всё подряд, либо пропускает важные детали. Новый режим сначала рассуждает о задаче, затем сам ищет нужные эпизоды, повторно просматривает подозрительный момент и сопоставляет изображение, звук и расшифровку.

По тестам Google, это сокращает расход токенов до 88%, стоимость анализа — до 66%, одновременно повышая качество до 7%. Особенно заметен выигрыш на лекциях, инструкциях и многочасовых записях.

Бытовое значение: запрос «найди момент, где на третьем корте ребёнок впервые меняет ракетку» перестаёт требовать превращения всего турнира в гору кадров. Для бизнеса это мониторинг производства, поиск аномалий и разбор видеозвонков; для обычного человека — нормальный поиск внутри собственной видеожизни.

4. OpenAI подтвердила гуманоидного робота — но пока только словами

Статус: анонсировано намерение; готового робота не показали. В интервью, опубликованном в начале сентября, Сэм Альтман подтвердил, что OpenAI намерена делать и гуманоида, и роботов других форм-факторов. Его логика проста: мир построен под человеческое тело, поэтому хотя бы часть машин удобно делать человекоподобными.

Важнее другая реплика Альтмана: корпус он считает менее трудной частью, чем «мозг», способный надёжно работать в физическом мире. Это трезвое замечание. Железо уже умеет ходить, поднимать коробки и эффектно падать под музыку. Универсально понять незнакомую кухню, аккуратно убрать со стола и не отправить кошку в посудомойку гораздо сложнее.

У объявления пока нет показанного прототипа, характеристик, цены и даты выпуска. Поэтому добавлять несуществующую модель в каталог реальных роботов RobotON рано. А вот в хронологии робототехники событие уместно как стратегический поворот: крупнейшая лаборатория ИИ официально решила, что одного цифрового мозга ей мало.

Значение: OpenAI потенциально становится не только поставщиком интеллекта для чужого корпуса, но и конкурентом производителей гуманоидов. Однако сегодня это заявленный маршрут, а не товар. Пресс-релиз пока способен только очень уверенно сложить воображаемое бельё.

5. Waymo начала полностью автономные поездки ещё в трёх городах

Статус: произошло, доступ расширяется постепенно. 1 сентября Waymo начала приглашать первых публичных пассажиров в Денвере, Сан-Диего и Тампе. Компания заявляет, что теперь предоставляет полностью автономные поездки уже в 14 городах.

Ключевое слово — полностью: в машине нет страхующего водителя. Но это ещё не означает мгновенный свободный доступ для всех жителей. В каждом из новых городов записались десятки тысяч желающих, и Waymo обещает подключать их постепенно.

Значение: роботакси выходит из стадии одного удачного географического фокуса. Денвер добавляет снег и высоту, Тампа — ливни и влажность, Сан-Диего — другую дорожную среду. Масштабирование по городам проверяет способность системы переносить опыт лучше любого рекламного ролика на пустой парковке.

6. Лондон получил роботакси — но водитель пока остался

Статус: произошло; поездки автономные, но под надзором. 3 сентября Uber и британская Wayve открыли первые публичные автономные поездки в Великобритании. Пользователь UberX, Electric или Comfort в Лондоне может получить Ford Mustang Mach-E с системой Wayve AI Driver без доплаты и отказаться от такого назначения до подачи машины.

Есть принципиальная оговорка: в автомобиле сидит лицензированный водитель, готовый вмешаться. На старте работает небольшое число машин; поездки доступны по Лондону, кроме аэропортов. Поэтому называть сервис «беспилотным такси Лондона» пока рано — правильнее говорить о публичных автономных поездках под человеческим контролем.

Технически интересен сам подход Wayve. Вместо подробной ручной карты правил для каждого перекрёстка компания делает ставку на обучаемого AI Driver, который должен переносить навык между городами. Лондон с узкими улицами, велосипедистами, автобусами и туристами, внезапно обнаруживающими встречное движение, — весьма недобрый экзамен.

Значение: Европа начала переносить автономное вождение из закрытых испытаний в обычное приложение такси, но сохранила человека как страховочный слой. Это не отставание в один бит: это другой регуляторный маршрут к той же цели.

7. Tesla Cybercab выехал без руля и через сутки попал под проверку

Статус: коммерческий запуск произошёл; соответствие стандартам проверяется. 3 сентября Tesla начала ограниченное коммерческое использование двухместного Cybercab в Остине. Специально построенный роботакси не имеет традиционного руля, педалей и зеркал.

4 сентября американское управление NHTSA открыло Audit Query — проверку технических данных и процесса, на основании которых Tesla сама сертифицировала Cybercab как соответствующий применимым федеральным стандартам. Регулятор отдельно подчеркнул: правила для автономных машин пересматриваются, но пока новые нормы не приняты, действуют существующие.

Начало проверки не означает, что нарушение уже установлено. Но вопрос фундаментальный: многие стандарты написаны для автомобиля, в котором человек держит руль, нажимает педаль и смотрит в зеркало. Если этих деталей нет, производитель должен доказать не только безопасность новой архитектуры, но и корректность того, какие старые требования он счёл неприменимыми.

Значение: Cybercab проверяет границу не только компьютерного зрения, но и закона. Удалить руль из салона оказалось быстрее, чем удалить его из нормативных документов — редкий случай, когда бюрократия буквально схватила будущее за баранку, которой уже нет.

Что связывает эти события

Неделя показала не одну революцию, а три перехода.

  1. От ответа к действию. Astra и Fable 5.1 оценивают уже по длинным цепочкам: исследовать среду, воспользоваться инструментами, проверить результат и продолжить работу.
  2. От полного просмотра к целевому вниманию. Агентное видео Gemini демонстрирует важный принцип будущих систем: не поглощать все данные одинаково, а решать, куда посмотреть.
  3. От демонстрации к эксплуатации. Waymo, Wayve и Cybercab работают с реальными пассажирами. Здесь заканчиваются удобные лабораторные проценты и начинаются погода, ответственность и право.

Гуманоид OpenAI пока стоит между первым и третьим переходом. Мозг уже быстро развивается; тела у индустрии есть; надёжное соединение двух половин всё ещё не показано. Именно поэтому Часы AGI RobotON учитывают физический интеллект отдельно и не позволяют рекордам языковой модели автоматически превратить эффектного робота в универсального работника.

Главный вывод недели: программный интеллект ускоряется быстрее, чем физический мир успевает его принять. Следующий большой прорыв будет измеряться не одним тестом, а числом часов полезной работы без человека — в браузере, автомобиле и комнате, где вещи почему-то никогда не лежат как в обучающем наборе.

Ещё в архиве RobotON за 2011 год обсуждалась идея машинной сети для обмена опытом между роботами. Пятнадцать лет спустя цифровые агенты уже умеют пользоваться инструментами и сохранять рабочую память, а физические машины начинают осваивать города. Будущее пришло не целиком: оно загружается разными файлами и, как положено, один из них застрял на проверке совместимости.

Продолжить разговор

Следите за развитием ИИ, сравнивайте роботов и обсуждайте новости:

Часы AGI RobotON → Каталог роботов → Форум людей и машин →

Источники и проверка дат

Срез информации — утро 7 сентября 2026 года. Числа производителей помечены как данные самих компаний; начатая регуляторная проверка не равна установленному нарушению.