AT&T перевела 40% ИИ на открытые модели — AI-дайджест

AT&T перевела 40% ИИ на открытые модели — AI-дайджест

AT&T отправляет 40% ИИ-нагрузки сотрудников на открытые модели и режет стоимость кодинга на 56%. Anthropic вывела computer use, Skills API и Files API в общий доступ, а Gemini 3.7 Flash взяла 84,6% на ARC-AGI-2 за $0,25 за задачу.

Главное сегодня

AT&T: 40% корпоративной ИИ-нагрузки уже уходит на открытые модели

AT&T направляет 40% всего использования ИИ сотрудниками на открытые модели и планирует довести долю до 60–70%. Открытые веса — это модели, чьи параметры выложены в публичный доступ, так что компания запускает их на своей инфраструктуре и не платит за каждый вызов API. По разбору внедрения, опубликованному 20 августа 2026 года, оператор обрабатывает 45 млрд токенов в сутки, а после перевода части нагрузки на открытые веса стоимость кодинг-сценариев упала на 56% при падении качества всего на 2% (сводка внедрения AT&T). В обсуждении эти цифры назвали тревожным сигналом для корпоративного рва OpenAI и Anthropic (реплика), а команда Ollama публично поприветствовала переход AT&T на открытые модели (пост). Готовые к развёртыванию открытые проекты мы собираем в каталоге open-source инструментов AI SKILLS, а что из открытых LLM запускать локально — разобрано в обзоре открытых моделей.

Anthropic вывела computer use, browser tool, Skills API и Files API в общий доступ

Anthropic 20 августа 2026 года перевела в общий доступ четыре компонента Claude Platform: computer use, browser tool, Skills API и Files API (анонс Anthropic). Skills API добавляет версионируемые многоразовые процедуры, которые агент подгружает по мере надобности (детали Skills API). Files API получил управление сроком жизни файлов, лимиты выше в 5 раз — до 500 запросов в минуту — и 1 ТБ хранилища на организацию (детали Files API). Отдельно Anthropic опубликовала адаптер AG-UI для Claude Managed Agents: он отображает чат-треды в управляемые сессии и стримит в собственный интерфейс текст, вызовы инструментов и рассуждения модели (адаптер AG-UI). Готовые процедуры под этот формат — в каталоге Skills для Claude Code; как устроен сам SKILL.md, разобрано в руководстве по скиллам Claude Code.

Gemini 3.7 Flash: 84,6% на ARC-AGI-2 при $0,25 за задачу

Gemini 3.7 Flash показала 84,6% на бенчмарке ARC-AGI-2 при стоимости $0,25 за задачу и 95,5% на ARC-AGI-1 за $0,12 за задачу. Замер опубликовал фонд ARC Prize 20 августа 2026 года (результаты ARC Prize). Показатель важен не абсолютной величиной, а ценой: ARC-AGI-2 составлен из задач на абстрактное рассуждение, и до сих пор высокие проценты на нём набирали дорогие фронтир-модели. Отдельно Gemini 3.7 Flash хвалят за агентские задачи со зрением — работу с интерфейсами и скриншотами (оценка практика). Для платформ вроде нашей это прямое следствие: маршрутизация на дешёвую модель перестаёт означать заметную потерю качества.

Moderna и Merck: первая положительная III фаза персонализированной противораковой вакцины

Moderna и Merck сообщили о первых в истории положительных результатах III фазы персонализированной противораковой вакцины — на меланоме, с сокращением числа рецидивов; акции Moderna выросли более чем на 110% (обсуждение результатов). Подход индивидуальный: вакцина собирается под неоантигены конкретной опухоли и применяется вместе с иммунотерапией. Главное возражение — экономика: индивидуальное производство оценивают примерно в $150 тыс. на пациента, и без резкого удешевления массовым такое лечение не станет. Второе возражение — атрибуция: часть комментаторов указывает, что технология разрабатывалась примерно с 2017 года и приписывать успех нынешней волне генеративного ИИ некорректно. Новость попала и в подкаст The AI Daily Brief как одна из главных недели (выпуск от 20 августа 2026 года).

Обвязка агента учится отдельно от модели: заявленный прирост более 10%

Работа о непрерывном обучении обвязки показала прирост более 10% на текстовых, мультимодальных и открытых задачах — при полностью неизменных весах модели. Харнес (обвязка) — это слой вокруг модели: промпты, память, набор навыков и правила маршрутизации, которые можно менять без дообучения. Основной сбой такого подхода авторы называют забыванием на уровне обвязки: улучшение одного компонента незаметно ломает поведение, которое до этого работало стабильно. Предложенное решение — «охраняемая эволюция», в которой предложение обновления и его фиксация разведены как отдельные шаги (разбор работы). Рядом стоят два негативных результата: агенты с самоулучшающейся памятью выглядят заметно хуже, если контролировать порядок задач и разброс оценки (разбор), а дообученные агенты склонны закрепляться на первой выбранной стратегии и тратить остаток бюджета на локальные доработки вместо пересмотра плана (разбор).

Цифры и факты

Разные точки зрения: съедают ли открытые модели корпоративный рынок?

Спор идёт вокруг одной цифры: AT&T снизила стоимость кодинг-сценариев на 56%, потеряв 2% качества, и уже отправляет 40% ИИ-нагрузки на открытые модели (сводка внедрения). Вопрос в том, частный ли это случай крупного оператора или общий сдвиг корпоративного спроса.

За. Открытые веса берут широкую середину задач, где «достаточно хорошо» дешевле, чем «лучше всех»: цена падает в разы, а качество — на проценты. Косвенное подтверждение — распространение: Kimi K3 раскатан более чем на половину подписчиков Ollama с хостингом в США и ЕС (анонс), Gemma перешла отметку в 1 млрд загрузок (анонс).

Нейтрально. Сама AT&T описывает гибридную маршрутизацию, а не замену: фронтир-модели остаются на самых сложных задачах, открытые забирают массовые. Это архитектурное решение, а не выбор лагеря, и его выигрыш зависит от того, насколько точно компания умеет разделять задачи по сложности.

Против. Закрытые провайдеры отвечают ценой и лимитами, а не капитуляцией: GPT-5.6 Sol ушёл в скидку 50% через Router (анонс). При этом жалобы пользователей смещаются с качества на потолки потребления — тариф OpenAI Pro за $200 в месяц можно исчерпать за один тяжёлый день работы с агентом (жалоба пользователя). Проще говоря, дефицит закрытых мощностей проявляется как квоты, и это не то же самое, что проигрыш открытым моделям.

Инструменты и приёмы

Коротко