Модель, которая сама доводит задачу до конца. Instagram, который путает AI-метки. И видеопоток, которым управляют зрители.
Свежие события из мира искусственного интеллекта — с нашим разбором, почему это важно и что делать.
Пользователь cozyblaze заставил новую модель OpenAI пройти культовую головоломку Valve Portal целиком менее чем за сутки, потратив меньше $600 на инференс. Это первый публичный кейс, где frontier-модель самостоятельно решает полноценную игру от начала до конца — раньше такое считалось недостижимым для LLM.
Контекст. Ещё вчера Astra запускали с «грязным» релизом и извинениями Альтмана, а сегодня она уже проходит Portal за $571. Скорость, с которой модель перешла от «недоступна подписчикам» к «решает игру целиком», — главный сигнал дня.
Последствия. Игры становятся дешёвым и наглядным бенчмарком агентности. Если модель проходит Portal, она умеет планировать, удерживать контекст и действовать в среде — ровно то, что нужно для реальных бизнес-задач.
Связи. 4 сентября мы писали про запуск Astra как «вступившей в эпоху AGI». Сегодня — первое практическое подтверждение.
Что делать. Следите за стоимостью инференса: $571 за игру — это уже измеримая юнит-экономика. Кто научится считать такие цифры для своих задач, тот поймёт, где агенты окупаются.
Meta снова вешает ярлык «AI Content» на оригинальные фотографии, которые пользователи не создавали и не редактировали нейросетями, — и одновременно пропускает настоящий AI-контент. Система детекции сгенерированных изображений дала сбой, и доверие к меткам на платформе снова подорвано.
Контекст. Маркировка AI-контента — обязательное требование регуляторов, но технически она всё ещё сырая. Ложные срабатывания на реальных фото бьют по обычным пользователям и креаторам.
Последствия. Пока детекция ненадёжна, «AI-метка» теряет смысл: если её ставят на всё подряд, люди перестают ей верить. Это проблема доверия, а не только технологий.
Связи. 1 сентября мы писали про комплаенс и маркировку ИИ-контента как услугу — вот живой пример, почему этот рынок будет расти.
Что делать. Для бизнеса это сигнал: не полагайтесь на чужие детекторы. Стройте собственные пайплайны проверки контента, если маркировка критична для вашей ниши.
Namespace интегрировала облачные Devboxes с Cursor Cloud Agents: теперь агент может работать на реальном Mac с Apple Silicon M5 — собирать и тестировать приложения для iOS и macOS, что невозможно в обычном Linux-окружении. Агентный цикл остаётся за Cursor, а выполнение переносится в изолированные среды.
Контекст. До сих пор AI-кодинг упирался в Linux-окружения: собрать нативное iOS-приложение агент не мог. Теперь барьер снят.
Последствия. Мобильная разработка — последний оплот «ручного» кодинга — открывается для агентов. Это ускорит прототипирование приложений в разы.
Связи. 31 августа мы писали про разрыв OpenAI с Cursor после сделки SpaceX — а Cursor тем временем продолжает наращивать агентные возможности.
Что делать. Если вы делаете мобильные приложения, протестируйте cloud-агентов на сборке — это может срезать недели ручной работы на конфигурацию окружений.
Новая версия H3 Max выдаёт не отдельные клипы, а единый непрерывный видеопоток: модель удерживает контекст сцены и персонажей, а промпт можно менять прямо во время генерации. На fal.live запущены «бесконечные» AI-эфиры, где зрители сами предлагают развитие сюжета. Промо-цена — $0,02 за секунду до 14 сентября.
Контекст. Видеогенерация двигалась от коротких клипов к длинным. Непрерывный поток с управлением на лету — качественный скачок к интерактивному AI-телевидению.
Последствия. Появляется новый формат: зритель не смотрит, а со-режиссирует. Это меняет и контент, и монетизацию — от стримов до рекламы.
Связи. 5 сентября мы писали про Roland Melody Flip в генеративной музыке — теперь то же самое приходит в видео.
Что делать. Пока цена $0,02/сек — экспериментируйте с интерактивными форматами. После 14 сентября тариф вырастет вчетверо, окно дешёвого теста закрывается.
Новая флагманская модель Z.ai GLM-5.3 появилась в MWS GPT Model Hub. По данным разработчика, на Code Bench результат в задачах программирования вырос на 50% к GLM-5.2, а на Terminal-Bench 3.0 показатель подскочил с 4,6 до 28,3 — модель заточена под агентные сценарии и многошаговые запросы.
Контекст. Китайские open-weight модели продолжают догонять западные флагманы в агентных задачах. Рост Terminal-Bench в 6 раз — серьёзная заявка.
Последствия. Чем сильнее open-weight модели в терминале, тем дешевле становится автономный кодинг. Давление на цены подписок западных провайдеров растёт.
Связи. 3 сентября мы писали про DeepSeek V4-Flash-Vision — тренд на открытые веса только усиливается.
Что делать. Если вы строите агентов на API, добавьте GLM-5.3 в тестовый пул — на терминальных задачах он может оказаться дешевле и не хуже флагманов.
OpenAI добавил в десктопный браузер ChatGPT поддержку стандарта WebMCP — пока на моделях GPT-5.6 Sol и Terra. Техническая новость скрывает важный сдвиг: веб негласно делится на сайты, которые умеют «разговаривать» с агентами, и сайты, мимо которых агент просто проходит.
Контекст. WebMCP — черновик W3C, но его поддержка в ChatGPT превращает стандарт из эксперимента в сигнал рынку.
Последствия. Появляется новый слой SEO: оптимизация сайта под агентов, а не только под поисковики. Сайты без WebMCP рискуют стать невидимыми для ИИ-ассистентов.
Связи. 2 сентября мы писали про продажу API ИИ-агентам (agentic commerce) — WebMCP это техническая основа того же тренда.
Что делать. Владельцам сайтов пора задуматься о machine-readable интерфейсах. Ранние внедрители WebMCP получат фору в выдаче агентов.
Опубликованы итоги открытого сравнения семи нейросетей от семи команд на восьми практических заданиях. Первое место по сумме баллов — Fable 5.1 (145), второе — Kimi K3 (133), третье — GPT-5.6 Sol (118). Участники судили друг друга вслепую: работы обезличены, за себя голосовать нельзя.
Контекст. Синтетические бенчмарки вендоров давно не вызывают доверия. Слепое взаимное судейство — честная альтернатива, где модели оценивают друг друга без брендов.
Последствия. Fable 5.1 обходит GPT-5.6 Sol на практических задачах — это сигнал, что «самая разрекламированная» не значит «самая полезная».
Связи. 2 сентября мы писали про Claude Fable 5.1 и её удешевление на 45% — теперь модель ещё и выигрывает слепые тесты.
Что делать. Не выбирайте модель по маркетингу. Прогоняйте свои реальные задачи через 2-3 кандидата вслепую — это дешевле, чем привязка к одному вендору.
Топ видео об AI-агентах, автоматизации и заработке на нейросетях — с нашим кратким пересказом, чтобы не тратить время на просмотр.
10:36
11:04
11:34
39:29
30:04
13:43
2:24:11
12:03
13:44
18:28
Реальные примеры с конкретными цифрами — как компании применяют ИИ и что из этого выходит.
Пользователь cozyblaze заставил Astra пройти Portal целиком менее чем за сутки, потратив меньше $600. Это первый публичный кейс, где frontier-модель самостоятельно решает полноценную игру — доказательство агентности, а не просто генерации текста.
Интеграция Devboxes с Cursor Cloud Agents позволила агентам работать на реальном Mac: собирать и тестировать приложения для iOS и macOS. Раньше это было невозможно в Linux-окружениях — теперь мобильная разработка открыта для автономного кодинга.
На fal.live запущены «бесконечные» AI-эфиры, где зрители сами предлагают развитие сюжета в реальном времени. Промо-цена $0,02/сек (скидка 75%) до 14 сентября, затем $0,08/сек — модель монетизации интерактивного AI-телевидения.
Новая модель Z.ai показала рост в 6 раз на Terminal-Bench 3.0 и +50% на Code Bench. Заточка под агентные сценарии и многошаговые запросы делает её серьёзным конкурентом западным флагманам в автономном кодинге.
Система детекции AI-контента дала сбой: Meta вешает ярлык «AI Content» на реальные фото и пропускает настоящий AI-контент. Кейс о том, как ненадёжная маркировка подрывает доверие к платформе — и почему рынок комплаенса будет расти.
Практические способы заработать на ИИ — от агентов-геймеров до SEO для машин.
Прохождение Portal за $571 — это не просто трюк, а измеримый тест агентности. Продавать можно как услугу оценки моделей, так и как демонстрацию возможностей для клиентов, которым нужны агенты, действующие в сложных средах.
H3 Max Director генерирует непрерывный видеопоток, где зрители со-режиссируют сюжет. Монетизация — подписка на «бесконечные» эфиры, плата за секунду генерации и реклама внутри управляемого потока.
Cursor Cloud Agents на Apple Silicon M5 открывают сборку iOS/macOS-приложений для агентов. Продавать можно изолированные среды разработки по подписке — разработчикам, которые хотят делегировать сборку и тестирование.
Слепое сравнение 7 нейросетей (Fable 5.1 победила) показывает спрос на честную оценку моделей. Продавать можно подписку на регулярные слепые тесты, отчёты для компаний, выбирающих модель, и консалтинг по выбору стека.
Поддержка WebMCP в ChatGPT делит веб на сайты, которые «разговаривают» с агентами, и невидимые для них. Появляется новый рынок: настройка machine-readable интерфейсов, чтобы сайт попадал в выдачу ИИ-ассистентов.
7 сентября 2026 — день, когда ИИ окончательно перестал быть «генератором ответов» и стал «исполнителем задач». GPT-6 Astra проходит Portal за $571 — модель не отвечает на вопрос, а действует в среде, планирует и доводит до конца. Cursor Cloud Agents собирают iOS-приложения на реальном Mac. H3 Max генерирует видеопоток, которым зрители управляют на лету. Общий вектор: ценность уходит от «у кого самая умная модель» к «кто умеет встроить агента в реальный процесс и посчитать юнит-экономику каждого действия». Побеждает не тот, кто генерирует больше, а тот, кто понимает, на каком слое стоит — инференс, среда исполнения, канал дистрибуции или данные — и какую ренту с него собирает. Хайп про модели умер давно. Теперь умирает и хайп про «агента в чате». Начинается эпоха, где главный навык — не писать промты, а считать стоимость инференса, настраивать среду исполнения и понимать, где заканчивается автономия и начинается ответственность.
Подпишитесь на ежедневный дайджест и получайте проверенные кейсы, модели монетизации и разборы видео каждое утро.
Агентство автоматизации