ИИ-агенты наступают: автономные помощники, ускоренные модели и битва за безопасность
Что произошло в мире ИИ за неделю: 23 материалов PLai одним обзором.
Эта неделя прошла под знаком автономных ИИ-агентов — от Grok Bot Илона Маска до корпоративных решений OpenAI и Claude. Параллельно разработчики получили мощные модели с рекордными скоростями и контекстами, а индустрия столкнулась с новыми вызовами: от утечек рассуждений до ложных срабатываний ИИ-детекторов. При этом компании активно ищут способы контролировать расходы на токены и защищаться от ИИ-угроз.
Модели: скорость, мультимодальность и открытые веса
Неделя принесла сразу несколько заметных релизов. Qwen порадовала мультимодальной моделью Qwen3.8-27B-FP8, которая влезает на одну видеокарту благодаря квантованию, поддерживает видео и контекст в 1 млн токенов, сохраняя при этом флагманские бенчмарки Qwen3.8-27B-FP8: мультимодальный монстр с FP8, который влезает на одну видеокарту. Google не отстаёт и выпустила Gemini 3.7 Flash — модель, которая пишет код точнее предшественников, вдвое дешевле и уже интегрирована в Spark Gemini 3.7 Flash: Google выпустил модель, которая пишет код лучше и стоит в два раза дешевле.
DeepSeek представила V4-Pro-0813 с DSpark-декодированием, MIT-лицензией и поддержкой контекста в 1 млн токенов — подробности о запуске на vLLM и SGLang DeepSeek-V4-Pro-0813: официальный релиз флагмана с DSpark-декодированием, а также пошаговый гайд по подключению через API пошаговый гайд по DeepSeek V4 Pro 0813. OpenAI ускорила GPT-5.6 Sol в 14 раз с новым режимом Ultrafast (до 750 токенов/сек) GPT-5.6 Sol теперь отвечает мгновенно: как OpenAI ускорила модель в 14 раз, а Meta вернулась к open weights с Muse Glimmer — 30-миллиардной моделью под Apache 2.0 для локальных агентов Meta вернулась в open weights с Muse Glimmer: ставим локального агента на 30B параметрах.
Инструменты и практика: от терминала до финансовых презентаций
Разработчики получили новые возможности для работы с ИИ. Gemini 3.7 Flash теперь доступен прямо в терминале через плагин llm-gemini 0.33 — с трассировкой рассуждений и серверными инструментами Gemini 3.7 Flash в терминале: запускаем ИИ-модели Google без браузера. GPT-5.6 Sol протестировали на финансовых задачах, где модель научилась не только анализировать данные, но и генерировать готовые презентации с прослеживаемостью GPT-5.6 Sol взялась за финансовую рутину: Model ML довела ИИ до готовых презентаций.
Anthropic сделала auto mode стандартным для Claude Code, доверив ИИ ловить 89% опасных действий против 13,6% у людей 89% против 13,6%: почему Anthropic доверяет автопилоту Claude Code больше, чем людям. А один разработчик с помощью Codex собрал open-source лабораторию Runtime Lab по Node.js, превратив один промпт в учебный стенд на 24 главы Codex вместо документации: как я собрал лабораторию по Node.js, пока учил Event Loop.
Автономные агенты: от корпоративных помощников до Grok Bot
Главный тренд недели — автономные ИИ-агенты. OpenAI опубликовала отчёт о том, как компании переходят от простых запросов к полной автоматизации задач От «помоги написать» к «сделай за меня»: OpenAI показала, как лидеры рынка переходят на автономных AI-агентов. Илон Маск пошёл дальше и дал Grok Bot отдельный ПК с доступом к рабочим сервисам — теперь агенты SpaceXAI работают круглосуточно как цифровые коллеги Илон Маск дал Grok отдельный ПК и пароли от рабочих сервисов: разбираем автономных ИИ-агентов Grok Bot.
Cloudflare представила Kitesurf — браузер без вкладок и тем, созданный специально для ИИ-агентов Cloudflare сделала браузер, в котором нет ни вкладок, ни тем — потому что его пользователь не человек. А эксперимент с двумя агентами на одном промпте показал, как GPT-5.6 Sol Ultra и Claude Code генерируют принципиально разные решения одной задачи Один и тот же промпт скормили двум ИИ-агентам — вот что получилось у GPT-5.6 Sol Ultra.
Индустрия: конфликты, этика и контроль расходов
ИИ продолжает менять рынок труда и творчества. Сценаристка обвинила Saber в замене её на ChatGPT, хотя компания отрицает это, признавая использование ИИ Сценаристка заявила, что Saber заменила её на ChatGPT. CEO отрицает, но признаёт: ИИ в игре есть. Spotify с сентября начнёт помечать фейковых артистов бейджем «AI Persona» и перестанет продвигать их музыку Spotify начинает разоблачать фейковых артистов — но не их музыку.
Проблемы с безопасностью и доверием остаются острыми. Исследователи взломали reasoning traces в API OpenAI, Anthropic и Google, раскрыв уязвимости в шифровании Как мы украли цепочки рассуждений у GPT-5 и Claude — и что нашли внутри. ИИ-детекторы вроде Turnitin и GPTZero, обещающие точность выше 99%, уже стоили людям дипломов и контрактов на миллионы ИИ-детекторы ошибаются, но уже стоили людям дипломов и контрактов на миллионы.
Компании ищут способы оптимизировать расходы на ИИ. Rippling построила AI Spend Console, чтобы остановить инженеров, тратящих по $50 000 в месяц на токены Инженер тратил $50 000 в месяц на AI-токены. Как Rippling построила систему, которая это остановила. А OpenAI приостановила разработку модели Astra, которая слишком хорошо находила zero-day уязвимости OpenAI остановила разработку модели, которая слишком хорошо умеет взламывать сети, но выпустила GPT-5.6-Cyber для защиты от автономных атак OpenAI выпустила модель, которая должна ловить ИИ-хакеров раньше, чем те что-то взломают.
Что попробовать и за чем следить
Если вы разработчик — поставьте Gemini 3.7 Flash в терминал или протестируйте GPT-5.6 Sol Ultra на агентных задачах. Финансистам стоит присмотреться к кейсам Model ML с готовыми презентациями. Для локальных экспериментов подойдёт Muse Glimmer от Meta, а DeepSeek V4 Pro порадует длинным контекстом и низкими ценами.
За автономными агентами будущее — следите за Grok Bot и Cloudflare Kitesurf. Но не забывайте о рисках: проверяйте, как защищены ваши рассуждения в API, и будьте осторожны с ИИ-детекторами. А если тратите много на токены — изучите опыт Rippling с AI Spend Console.
Читайте также
Комментарии · 1
- Ленар14.08.2026
Сильно однако.

