AT&T перевела 40% ИИ на открытые модели — AI-дайджест

AT&T отправляет 40% ИИ-нагрузки сотрудников на открытые модели и режет стоимость кодинга на 56%. Anthropic вывела computer use, Skills API и Files API в общий доступ, а Gemini 3.7 Flash взяла 84,6% на ARC-AGI-2 за $0,25 за задачу.
Главное сегодня
AT&T: 40% корпоративной ИИ-нагрузки уже уходит на открытые модели
AT&T направляет 40% всего использования ИИ сотрудниками на открытые модели и планирует довести долю до 60–70%. Открытые веса — это модели, чьи параметры выложены в публичный доступ, так что компания запускает их на своей инфраструктуре и не платит за каждый вызов API. По разбору внедрения, опубликованному 20 августа 2026 года, оператор обрабатывает 45 млрд токенов в сутки, а после перевода части нагрузки на открытые веса стоимость кодинг-сценариев упала на 56% при падении качества всего на 2% (сводка внедрения AT&T). В обсуждении эти цифры назвали тревожным сигналом для корпоративного рва OpenAI и Anthropic (реплика), а команда Ollama публично поприветствовала переход AT&T на открытые модели (пост). Готовые к развёртыванию открытые проекты мы собираем в каталоге open-source инструментов AI SKILLS, а что из открытых LLM запускать локально — разобрано в обзоре открытых моделей.
Anthropic вывела computer use, browser tool, Skills API и Files API в общий доступ
Anthropic 20 августа 2026 года перевела в общий доступ четыре компонента Claude Platform: computer use, browser tool, Skills API и Files API (анонс Anthropic). Skills API добавляет версионируемые многоразовые процедуры, которые агент подгружает по мере надобности (детали Skills API). Files API получил управление сроком жизни файлов, лимиты выше в 5 раз — до 500 запросов в минуту — и 1 ТБ хранилища на организацию (детали Files API). Отдельно Anthropic опубликовала адаптер AG-UI для Claude Managed Agents: он отображает чат-треды в управляемые сессии и стримит в собственный интерфейс текст, вызовы инструментов и рассуждения модели (адаптер AG-UI). Готовые процедуры под этот формат — в каталоге Skills для Claude Code; как устроен сам SKILL.md, разобрано в руководстве по скиллам Claude Code.
Gemini 3.7 Flash: 84,6% на ARC-AGI-2 при $0,25 за задачу
Gemini 3.7 Flash показала 84,6% на бенчмарке ARC-AGI-2 при стоимости $0,25 за задачу и 95,5% на ARC-AGI-1 за $0,12 за задачу. Замер опубликовал фонд ARC Prize 20 августа 2026 года (результаты ARC Prize). Показатель важен не абсолютной величиной, а ценой: ARC-AGI-2 составлен из задач на абстрактное рассуждение, и до сих пор высокие проценты на нём набирали дорогие фронтир-модели. Отдельно Gemini 3.7 Flash хвалят за агентские задачи со зрением — работу с интерфейсами и скриншотами (оценка практика). Для платформ вроде нашей это прямое следствие: маршрутизация на дешёвую модель перестаёт означать заметную потерю качества.
Moderna и Merck: первая положительная III фаза персонализированной противораковой вакцины
Moderna и Merck сообщили о первых в истории положительных результатах III фазы персонализированной противораковой вакцины — на меланоме, с сокращением числа рецидивов; акции Moderna выросли более чем на 110% (обсуждение результатов). Подход индивидуальный: вакцина собирается под неоантигены конкретной опухоли и применяется вместе с иммунотерапией. Главное возражение — экономика: индивидуальное производство оценивают примерно в $150 тыс. на пациента, и без резкого удешевления массовым такое лечение не станет. Второе возражение — атрибуция: часть комментаторов указывает, что технология разрабатывалась примерно с 2017 года и приписывать успех нынешней волне генеративного ИИ некорректно. Новость попала и в подкаст The AI Daily Brief как одна из главных недели (выпуск от 20 августа 2026 года).
Обвязка агента учится отдельно от модели: заявленный прирост более 10%
Работа о непрерывном обучении обвязки показала прирост более 10% на текстовых, мультимодальных и открытых задачах — при полностью неизменных весах модели. Харнес (обвязка) — это слой вокруг модели: промпты, память, набор навыков и правила маршрутизации, которые можно менять без дообучения. Основной сбой такого подхода авторы называют забыванием на уровне обвязки: улучшение одного компонента незаметно ломает поведение, которое до этого работало стабильно. Предложенное решение — «охраняемая эволюция», в которой предложение обновления и его фиксация разведены как отдельные шаги (разбор работы). Рядом стоят два негативных результата: агенты с самоулучшающейся памятью выглядят заметно хуже, если контролировать порядок задач и разброс оценки (разбор), а дообученные агенты склонны закрепляться на первой выбранной стратегии и тратить остаток бюджета на локальные доработки вместо пересмотра плана (разбор).
Цифры и факты
- Cerebras CS-4: 250 PFLOPs на ускоритель WSE-3 Turbo, 43,2 ПБ/с пропускной способности памяти, стойка из трёх пластин — 750 PFLOPs; заявлено 4400+ токенов в секунду на пользователя на GPT-OSS-120B при том же 5-нм техпроцессе, 4 трлн транзисторов и 900 тыс. ядер (сводка запуска).
- GLM-5.3 Max: проекция на 2-е место среди открытых моделей и 8-е в общем зачёте Code Arena: WebDev при 1597 баллах и цене $3,65 за миллион токенов (замер Arena).
- Muse Spark 1.2: +2,1% чистого прироста в Agent Arena против 0,9% у версии 1.1, отдельно Bash Recovery +11,4% (замер Arena); 1-е место в Video-to-Website, 2-е в Image-to-HTML, 3-е в Image-to-Frontend (замер DesignArena).
- Gemma преодолела 1 млрд загрузок (анонс Google).
- Kimi K3 раскатан более чем на половину подписчиков Ollama, с хостингом в США и ЕС и нулевым хранением данных (анонс Ollama).
- GPT-5.6 Sol — скидка 50% через Router (анонс), подхваченная GitHub Copilot (пост GitHub) и VS Code (пост VS Code).
- Наш каталог на 22 августа 2026 года: 10 101 активных скиллов для Claude Code, 590 open-source инструментов, 3268 шаблонов автоматизаций и 338 моделей генерации — цифры платформы AI SKILLS, а не внешних источников.
Разные точки зрения: съедают ли открытые модели корпоративный рынок?
Спор идёт вокруг одной цифры: AT&T снизила стоимость кодинг-сценариев на 56%, потеряв 2% качества, и уже отправляет 40% ИИ-нагрузки на открытые модели (сводка внедрения). Вопрос в том, частный ли это случай крупного оператора или общий сдвиг корпоративного спроса.
За. Открытые веса берут широкую середину задач, где «достаточно хорошо» дешевле, чем «лучше всех»: цена падает в разы, а качество — на проценты. Косвенное подтверждение — распространение: Kimi K3 раскатан более чем на половину подписчиков Ollama с хостингом в США и ЕС (анонс), Gemma перешла отметку в 1 млрд загрузок (анонс).
Нейтрально. Сама AT&T описывает гибридную маршрутизацию, а не замену: фронтир-модели остаются на самых сложных задачах, открытые забирают массовые. Это архитектурное решение, а не выбор лагеря, и его выигрыш зависит от того, насколько точно компания умеет разделять задачи по сложности.
Против. Закрытые провайдеры отвечают ценой и лимитами, а не капитуляцией: GPT-5.6 Sol ушёл в скидку 50% через Router (анонс). При этом жалобы пользователей смещаются с качества на потолки потребления — тариф OpenAI Pro за $200 в месяц можно исчерпать за один тяжёлый день работы с агентом (жалоба пользователя). Проще говоря, дефицит закрытых мощностей проявляется как квоты, и это не то же самое, что проигрыш открытым моделям.
Инструменты и приёмы
- Семантический кэш перед LLM. Семантический кэш — это слой, который отдаёт готовый ответ на запрос, похожий по смыслу на уже виденный, вместо повторного обращения к модели. Практический разбор от команды Qdrant показывает 57,1% попаданий, 55,7% экономии токенов и задержку около 15 мс на попадании (разбор).
- Gisting — сжатие контекста в короткие «конспекты». Заявлено снижение сквозной задержки примерно на 40% и рост пропускной способности примерно на 15% при лучшем качестве ответов (тезис, инженерный разбор Shopify).
- Прозрачный фон в GPT-Image-2 вышел в превью — под многоразовые дизайн-ассеты без ручного вырезания (анонс OpenAI). Промпт под конкретную картинку удобно собирать в генераторе промптов AI SKILLS.
- Awesome Gemma — свежий сборник вариантов модели, гайдов по развёртыванию и рецептов дообучения (анонс репозитория).
Коротко
- OpenAI установила первые стойки NVIDIA Vera Rubin и запустила на них тренировочный стек для предобучения следующего поколения моделей (пост инженера, комментарий Грега Брокмана).
- OpenAI приостановила обучение новых моделей на две недели на время проверки мер безопасности (Hard Fork, NYT).
- ChatGPT получил плагин Apple Messages на Mac: поиск по переписке, сводка пропущенного, черновики и отправка прямо из десктопного приложения (анонс).
- Computer History и Record & Replay стали доступны пользователям Mac с тарифами Pro, Business и Enterprise в ЕЭЗ, Великобритании и Швейцарии (анонс, Record & Replay).
- Anthropic открыла Claude Academy — 355 обучающих материалов (Superhuman AI).
- Anthropic работает над водяным знаком для текста Claude, который должен переживать копирование и правку; механика пока не раскрыта (Мэтт Вулф).
- Chroma представила Foundation — исследовательское превью памяти агента, собираемой из его прошлых сессий (анонс).
- Generalist AI показала GEN-1.5 — робота, который воспроизводит задачу после одной демонстрации (демонстрация и обсуждение).
- Autonomous Intern 2 — пирамидальный мини-компьютер под запуск агентов с локальным хранением памяти, файлов и ключей (Мэтт Вулф).
- Противодействие ИИ-дата-центрам стало одной из самых быстрорастущих двухпартийных тем в США — из-за электричества, воды, шума и цен на недвижимость (The AI Daily Brief).
- Разработчики отмечают, что Linux заметно обгоняет macOS на агентских нагрузках с интенсивной работой с файловой системой (наблюдение).