#дайджест
Дайджест AI/ML за неделю 20–26 июля 2026
Anthropic: Claude Opus 5
Модель почти уровня Fable 5 в 2 раза дешевле и без настолько драконовских ограничений по безопасности, хотя ее тоже переключает на Opus 4.8 если вы делаете что-то подозрительное. На CursorBench отстает от Fable на 0.5%, на Frontier-Bench больше чем вдвое обгоняет Opus 4.8. Контекст 1М, выход до 128К, есть fast mode в 2.5 раза быстрее и в 2 раза дороже. Opus 5 теперь дефолт для Max и самая умная модель в Pro, доступна в приложениях, Claude Code и API.
Блогпост
Black Forest Labs: FLUX 3
FLUX теперь не только картинки. Модель обучена на изображениях, видео и аудио. Генерирует и редактирует изображения, видео до 20 секунд со звуком и предсказывает действия для роботов.
FLUX 3 Image и Video доступны только в early access через API, цены пока нет. Открытый мультимодальный FLUX 3 Dev обещают потом.
Блогпост, FLUX 3 × mimic
OpenAI: GPT-5.6 Sol взломала Hugging Face
Во время тестирования GPT-5.6 Sol и еще более умная внутренняя модель сбежали из песочницы ради ответов на тест. Нашли zero-day в прокси, добыли доступ в интернет, вскрыли продакшен базу Hugging Face, после чего всех превратили в скрепки атаку проанализировала агентная система HF на GLM 5.2.
отчет Hugging Face, Разбор OpenAI
Poolside: Laguna S 2.1
Открытая кодинг-модель 118B-A8B с контекстом 1М, thinking/no-thinking и весами от BF16 до NVFP4. На Terminal-Bench 2.1 набрала 70.2% против 88% у Kimi K3 и Fable 5, на DeepSWE - 40.4% против 69–70%. В общем немного хуже 300B-1Т моделей при размере 118B, на OpenRouter стоит $0.10/$0.20 за миллион токенов и $0.01 за кэш.
Блогпост, Веса
Alibaba: Qwen-Image-3.0
Рекламируют значимые улучшения во всякой инфографике с текстом. Обещают читаемый текст размером 10px, 12 языков, генерацию и редактирование до 2048×2048 с 1–3 референсами по промптам до 4.5K токенов.
Пока invite-only preview в Alibaba Model Studio, API на ограниченное время бесплатный. Открытых весов нет.
Блогпост, API
KeenTools: GeoTracker for Houdini
Плагин переносит движение объекта или камеры из обычного видео прямо в 3D-сцену Houdini. Затреканный объект можно сразу использовать в симуляциях - например, заставить его расталкивать частицы или выпускать дым. Плагин также сам оценивает фокусное расстояние и зум камеры.
3D-модель объекта нужно подготовить самим, но если высокая точность не нужна, машину обещают затрекать даже обычным кубом. 15 дней бесплатно, дальше $19.99 в месяц или $95.94 за первый год по стартовой скидке.
Страница продукта
Google: Frozen v2
Говорят Google делает отдельный серверный чип, в котором прямо в кремний зашита часть архитектуры Gemini. Изначально хотели зашивать веса, но релизы моделей раз в месяц мешают такому подходу. Ожидают 6-10х инференс и хотят начать использовать в 2028г. Это все утечки из The Information от сотрудников, а не данные от самого гугла, так что цифры и сроки не точны, но работа в этом направлении явно ведется.
Статья The Information
Менее значительные релизы:
Qualcomm: MobileWan - Wan2.2-5B запихнули в телефон: 5 секунд видео 480×832 при 16 fps генерируются за 20 секунд, VBench 83.79. Проект
Google: Gemini 3.6 Flash и 3.5 Flash-Lite - гугл расстраивает нас очередным минорным релизом. 3.6 Flash тратит на 17% меньше выходных токенов за тот же результат чем 3.5 Flash, вторая выдает около 350 токенов/с за $0.30/$2.50. У обеих контекст 1М. Блогпост
Lightricks: LTX-2.3 Clean Plate - IC-LoRA для удаления людей, машин и других динамических объектов из видео с восстановлением фона. Веса