Отставка в Anthropic и оценка риска выше 10% — AI-дайджест

Отставка в Anthropic и оценка риска выше 10% — AI-дайджест

Исследователь Anthropic ушёл публично, заявив, что лаборатории слишком быстро движутся к сверхинтеллекту; оценка риска для человечества — выше 10%. GPT-6 Astra собрала игру на macOS со 120 кадрами в секунду, а открытая модель на 2 миллиарда параметров возглавила рейтинг до 4B.

Главное сегодня

Отставка исследователя Anthropic стала самым громким выступлением о рисках ИИ

Джейкоб Коксон, сотрудник Anthropic и бывший сотрудник OpenAI, ушёл из компании публично — заявлением в соцсети о том, что ведущие лаборатории слишком быстро движутся к самоулучшающемуся сверхинтеллекту и к агентам, способным работать в кибератаках. По оценке Ben's Bites, его пост стал, вероятно, самым просматриваемым высказыванием о безопасности ИИ за всё время. Реакция разделилась не по линии «согласен — не согласен», а по линии «что с этим делать»: Йошуа Бенжио написал, что к предупреждениям исследователей передовых лабораторий нужно относиться серьёзно, Дэвид Шор потребовал обязательного государственного надзора, а несколько исследователей публично поручились за компетентность Коксона. Отдельно в тот же день исследователь Anthropic оценил вероятность гибели человечества от ИИ в ближайшее десятилетие выше 10%. Разбор недели от Ben's Bites, позиция Бенжио, требование надзора, оценка вероятности и разбор спора.

GPT-6 Astra собрала и запустила игру на macOS: 120 кадров в секунду за шесть часов

Разработчик Тео сообщил, что GPT-6 Astra самостоятельно собрала и запустила Super Smash Bros. Melee на macOS со скоростью 120 кадров в секунду, проработав около шести часов в одном цикле. Параллельно компания Vals сообщила, что Astra почти исчерпала их ещё не выпущенный тест на управление компьютером, построив портал в Нижний мир в Minecraft менее чем за три часа и без специальной обвязки под задачу. Это второй за неделю сигнал одного рода: модель работает не с текстом о программе, а с самой программой — мышью, окнами, компилятором. Практический смысл для работы: задачи, которые раньше требовали писать скрипт под каждый интерфейс, теперь решаются обычным описанием цели, но ценой часов машинного времени. Демонстрация с Melee, замер Vals.

Модель на 2 миллиарда параметров возглавила рейтинг среди открытых моделей до 4B

OpenBMB выложила в открытый доступ MiniCPM5-2B и заявила 15 баллов в Artificial Analysis Intelligence Index v4.2 — лучший результат среди открытых моделей размером до 4 миллиардов параметров. Веса опубликованы на Hugging Face, код — на GitHub. Практический интерес обсуждающих сместился с бенчмарков на конвейеры: модель такого размера помещается в связку «распознавание речи → модель → синтез речи» на слабом железе, где раньше требовался сервер. Рядом вышел другой результат того же направления: автор метода квантования TAK сообщил, что его версия Qwen3.8-27B набирает 82,81% против 83,59% у исходной модели в полной точности, занимая при этом 15% её размера. Квантование — это сжатие модели за счёт огрубления чисел внутри неё: модель становится в разы меньше и быстрее, но обычно теряет в качестве. Релиз MiniCPM5-2B, разбор метода квантования.

Apple A20 Pro: 115 ГБ/с памяти в телефоне — уровень ноутбучного M4

Чип Apple A20 Pro получил 7-ядерный графический процессор, удвоенный 32-ядерный нейронный движок и около 115 ГБ/с пропускной способности памяти — примерно на 50% больше, чем у A19 Pro, и почти столько же, сколько у ноутбучного M4 со 120 ГБ/с. Пропускная способность памяти — это скорость, с которой процессор читает веса модели; для локального ИИ она важнее частоты, потому что модель читается целиком на каждый ответ. По разбору Notebookcheck, чип переходит на 2-нанометровый техпроцесс TSMC и получает 96-битную шину LPDDR5X. Ограничение осталось прежним и оно не в скорости: в телефоне по-прежнему ожидается 12 ГБ оперативной памяти, а размер локальной модели упирается именно в объём. Разбор характеристик.

LangChain выпустила управление секретами для агентов

В LangChain Managed Deep Agents 0.7 появились Connections — механизм, который отделяет доступы агента от доступов пользователя: часть подключений принадлежит самому агенту, часть проходит через OAuth-вход человека. Это ответ на конкретную проблему: агент, которому выдали ключ от почты или таблиц, хранит его в своём окружении, и отозвать доступ отдельно от агента нельзя. Рядом вышло обновление VS Code с автоматизацией повторяющихся задач и работой с GitHub прямо в окне агентов. Тема недели у обеих команд одна — не «умнее модель», а «предсказуемее права». Для тех, кто уже выдал агенту доступ к рабочей почте, это ближайшая практическая правка: ключи стоит переносить на сторону подключения, а не хранить в настройках самого агента. Анонс Connections, обновление VS Code.

Цифры и факты

Разные точки зрения: предупреждения изнутри лабораторий — сигнал или кампания?

Спор идёт не о фактах, а о том, как читать публичную отставку исследователя. Сам факт никто не оспаривает: сотрудник Anthropic и бывший сотрудник OpenAI ушёл публично, заявив, что лаборатории слишком быстро движутся к самоулучшающемуся сверхинтеллекту.

За то, что это сигнал. Йошуа Бенжио прямо написал, что к предупреждениям исследователей передовых лабораторий стоит относиться серьёзно (Бенжио). Несколько исследователей публично поручились за компетентность Коксона — среди них Итан Перес и Уилл Депью (Перес, Депью).

Нейтрально. Дэвид Шор переводит разговор из плоскости доверия в плоскость устройства: нужен обязательный государственный независимый надзор, а не вера в добросовестность компаний (Шор). При такой постановке вопрос о мотивах конкретного человека перестаёт быть решающим.

Против. Паркер Тайер описал эпизод как политизированную кампанию, близкую к «психологической операции» (Тайер); Ben's Bites фиксирует, что часть аудитории прямо спрашивает, не сговор ли это (разбор).

Инструменты и приёмы

Коротко