Отставка в Anthropic и оценка риска выше 10% — AI-дайджест

Исследователь Anthropic ушёл публично, заявив, что лаборатории слишком быстро движутся к сверхинтеллекту; оценка риска для человечества — выше 10%. GPT-6 Astra собрала игру на macOS со 120 кадрами в секунду, а открытая модель на 2 миллиарда параметров возглавила рейтинг до 4B.
Главное сегодня
Отставка исследователя Anthropic стала самым громким выступлением о рисках ИИ
Джейкоб Коксон, сотрудник Anthropic и бывший сотрудник OpenAI, ушёл из компании публично — заявлением в соцсети о том, что ведущие лаборатории слишком быстро движутся к самоулучшающемуся сверхинтеллекту и к агентам, способным работать в кибератаках. По оценке Ben's Bites, его пост стал, вероятно, самым просматриваемым высказыванием о безопасности ИИ за всё время. Реакция разделилась не по линии «согласен — не согласен», а по линии «что с этим делать»: Йошуа Бенжио написал, что к предупреждениям исследователей передовых лабораторий нужно относиться серьёзно, Дэвид Шор потребовал обязательного государственного надзора, а несколько исследователей публично поручились за компетентность Коксона. Отдельно в тот же день исследователь Anthropic оценил вероятность гибели человечества от ИИ в ближайшее десятилетие выше 10%. Разбор недели от Ben's Bites, позиция Бенжио, требование надзора, оценка вероятности и разбор спора.
GPT-6 Astra собрала и запустила игру на macOS: 120 кадров в секунду за шесть часов
Разработчик Тео сообщил, что GPT-6 Astra самостоятельно собрала и запустила Super Smash Bros. Melee на macOS со скоростью 120 кадров в секунду, проработав около шести часов в одном цикле. Параллельно компания Vals сообщила, что Astra почти исчерпала их ещё не выпущенный тест на управление компьютером, построив портал в Нижний мир в Minecraft менее чем за три часа и без специальной обвязки под задачу. Это второй за неделю сигнал одного рода: модель работает не с текстом о программе, а с самой программой — мышью, окнами, компилятором. Практический смысл для работы: задачи, которые раньше требовали писать скрипт под каждый интерфейс, теперь решаются обычным описанием цели, но ценой часов машинного времени. Демонстрация с Melee, замер Vals.
Модель на 2 миллиарда параметров возглавила рейтинг среди открытых моделей до 4B
OpenBMB выложила в открытый доступ MiniCPM5-2B и заявила 15 баллов в Artificial Analysis Intelligence Index v4.2 — лучший результат среди открытых моделей размером до 4 миллиардов параметров. Веса опубликованы на Hugging Face, код — на GitHub. Практический интерес обсуждающих сместился с бенчмарков на конвейеры: модель такого размера помещается в связку «распознавание речи → модель → синтез речи» на слабом железе, где раньше требовался сервер. Рядом вышел другой результат того же направления: автор метода квантования TAK сообщил, что его версия Qwen3.8-27B набирает 82,81% против 83,59% у исходной модели в полной точности, занимая при этом 15% её размера. Квантование — это сжатие модели за счёт огрубления чисел внутри неё: модель становится в разы меньше и быстрее, но обычно теряет в качестве. Релиз MiniCPM5-2B, разбор метода квантования.
Apple A20 Pro: 115 ГБ/с памяти в телефоне — уровень ноутбучного M4
Чип Apple A20 Pro получил 7-ядерный графический процессор, удвоенный 32-ядерный нейронный движок и около 115 ГБ/с пропускной способности памяти — примерно на 50% больше, чем у A19 Pro, и почти столько же, сколько у ноутбучного M4 со 120 ГБ/с. Пропускная способность памяти — это скорость, с которой процессор читает веса модели; для локального ИИ она важнее частоты, потому что модель читается целиком на каждый ответ. По разбору Notebookcheck, чип переходит на 2-нанометровый техпроцесс TSMC и получает 96-битную шину LPDDR5X. Ограничение осталось прежним и оно не в скорости: в телефоне по-прежнему ожидается 12 ГБ оперативной памяти, а размер локальной модели упирается именно в объём. Разбор характеристик.
LangChain выпустила управление секретами для агентов
В LangChain Managed Deep Agents 0.7 появились Connections — механизм, который отделяет доступы агента от доступов пользователя: часть подключений принадлежит самому агенту, часть проходит через OAuth-вход человека. Это ответ на конкретную проблему: агент, которому выдали ключ от почты или таблиц, хранит его в своём окружении, и отозвать доступ отдельно от агента нельзя. Рядом вышло обновление VS Code с автоматизацией повторяющихся задач и работой с GitHub прямо в окне агентов. Тема недели у обеих команд одна — не «умнее модель», а «предсказуемее права». Для тех, кто уже выдал агенту доступ к рабочей почте, это ближайшая практическая правка: ключи стоит переносить на сторону подключения, а не хранить в настройках самого агента. Анонс Connections, обновление VS Code.
Цифры и факты
- 120 кадров в секунду за ~6 часов работы — Astra собрала и запустила Super Smash Bros. Melee на macOS (демонстрация).
- Менее 3 часов — постройка портала в Нижний мир в Minecraft на тесте управления компьютером, без специальной обвязки (Vals).
- 15 баллов в Artificial Analysis Intelligence Index v4.2 — MiniCPM5-2B, лучший результат среди открытых моделей до 4B (релиз).
- 82,81% против 83,59% при 15% размера — TAK-квантование Qwen3.8-27B против исходной модели в полной точности (разбор).
- ~115 ГБ/с против 120 ГБ/с у M4 — пропускная способность памяти Apple A20 Pro и ноутбучного чипа (разбор).
- $468 млн и до 10x ёмкости HBM — Kepler Compute вышла из семилетнего режима тишины с собственной фабрикой и памятью без зависимости от EUV (заявление).
- 364 из 10 416 скиллов каталога AI SKILLS для Claude Code на 11 сентября 2026 года описывают управление компьютером или браузером; агенты упоминаются в описаниях 2 991 скилла.
- Больше 10% — оценка вероятности гибели человечества от ИИ в ближайшее десятилетие, данная исследователем Anthropic (разбор спора).
Разные точки зрения: предупреждения изнутри лабораторий — сигнал или кампания?
Спор идёт не о фактах, а о том, как читать публичную отставку исследователя. Сам факт никто не оспаривает: сотрудник Anthropic и бывший сотрудник OpenAI ушёл публично, заявив, что лаборатории слишком быстро движутся к самоулучшающемуся сверхинтеллекту.
За то, что это сигнал. Йошуа Бенжио прямо написал, что к предупреждениям исследователей передовых лабораторий стоит относиться серьёзно (Бенжио). Несколько исследователей публично поручились за компетентность Коксона — среди них Итан Перес и Уилл Депью (Перес, Депью).
Нейтрально. Дэвид Шор переводит разговор из плоскости доверия в плоскость устройства: нужен обязательный государственный независимый надзор, а не вера в добросовестность компаний (Шор). При такой постановке вопрос о мотивах конкретного человека перестаёт быть решающим.
Против. Паркер Тайер описал эпизод как политизированную кампанию, близкую к «психологической операции» (Тайер); Ben's Bites фиксирует, что часть аудитории прямо спрашивает, не сговор ли это (разбор).
Инструменты и приёмы
- Разделите доступы агента и свои. Connections в LangChain Managed Deep Agents 0.7 позволяют держать часть подключений на стороне агента, а часть — через OAuth-вход пользователя, чтобы отзыв доступа не требовал разбирать агента (анонс).
- Photon 2.2 расширил локальный инференс на почти весь парк NVIDIA — A10/A10G, A100, 3090, L4, H100, B200 и RTX PRO 6000 Blackwell, плюс обновление компилятора мегаядер: единое ядро ровнее кормит видеокарту, когда процессор занят (релиз). Подборка открытых инструментов для локального запуска — в разделе Open Source AI SKILLS.
- Открытый формат схем для ИИ. Ben's Bites отмечает Eraser Diagrams — открытый формат, в котором модель рисует и раскладывает диаграммы, вместо того чтобы отдавать картинку (выпуск). Готовые сценарии для агентов — в каталоге шаблонов автоматизаций AI SKILLS.
Коротко
- OpenAI откатила сбой со списанием лимитов в ChatGPT Work и Codex: пострадавшим обещаны повторные сбросы и письма с извинениями (сообщение).
- Отказ от обучения на своих данных в OpenAI не суммируется: настройка в приложении и портал приватности — два пути к одному и тому же переключателю, а не два разных (разъяснение).
- Arena представила GameDevBench — тест на детерминированных задачах игровой разработки, собранных из реальных обучающих материалов (Arena).
- StereoPolicy обещает 3D-восприятие для манипуляторов прямо из пары стереокамер, без карт глубины и лидара, с результатом выше RGB, RGB-D и PointNet на настольных задачах (Lambda).
- Anthropic собрала интерактивную модель экономики 2030 года, а в Codex появился плагин для Unity и набор плагинов для малого бизнеса (обзор).
- Фильм «Artificial» об увольнении и возвращении Сэма Альтмана выйдет к Рождеству, роль Альтмана играет Эндрю Гарфилд (обзор).
- В iOS 28 ожидается функция подтверждения подлинности снимка (обзор).
- Биолог с докторской степенью по вычислительной биологии заявил, что синтезировал в гараже соединение PAC-3310, придуманное ChatGPT; независимых проверок работа не проходила (обсуждение).