VERIFIED AI SIGNALS
Новости индустрии ИИ
Проверенные по источникам новости моделей, API, исследований, безопасности и регулирования ИИ.
По заявлению Z.ai, API GLM-5.3 уже доступен для разработки ПО, защитной кибербезопасности и агентных сценариев с длительным планированием. Компания утверждает, что цена осталась на уровне GLM-5.2, а доступ предоставляется через официальный API и партнерские шлюзы.
Согласно сообщению, при авторизации в Codex через аккаунт ChatGPT теперь можно попробовать контекст GPT-5.6 Sol размером 1 млн токенов, а не только использовать эту возможность через API-ключи. Также опубликованы примеры настроек для файла конфигурации и командной строки.
Новая Gemini 3.8 Flash предназначена для длительных задач программирования и автономных агентов, а версия Flash Cyber — для поиска уязвимостей и автоматизированного исправления кода.
В руководстве OpenAI по GPT-5.6 показано, как выбор модели, настройки рассуждений и новые возможности Responses API могут снизить стоимость и задержку агентских сценариев. В примере с BrowseComp GPT-5.6 Luna при очень высокой глубине рассуждений набрала 84,04% при стоимости запуска $1,33, почти сравнявшись с GPT-5.5, который набрал 84,36% при стоимости $33,27.
OpenAI тестирует режим Ultrafast для GPT-5.6 Sol в API. По заявлению компании, инфраструктура Cerebras обеспечивает скорость до 750 выходных токенов в секунду, а доступ пока ограничен отдельными клиентами.
MiniMax объявила о совместном эфире с fal, посвящённом работе с MiniMax H3: мультимодальным референсам, нативному аудио, редактированию, обучению LoRA, цепочкам моделей и производственным процессам. Дополнительные материалы описывают H3 как мультимодальную видеомодель с открытыми весами и API на fal.ai.
Google представила Gemini 3.7 Flash — новую модель с заявленными улучшениями в программной инженерии, работе со сложными документами, веб-разработке и сценариях с ИИ-агентами. На старте стоимость модели составит половину первоначальной цены Gemini 3.6 Flash за миллион токенов.
OpenAI тестирует в API новый сервисный уровень Ultrafast для GPT-5.6 Sol. По заявлению компании, скорость генерации может достигать 750 токенов в секунду.
xAI анонсировала Grok 4.6 12 августа 2026 года. Модель получила 61 балл в Artificial Analysis Intelligence Index, сравнявшись с GPT-5.6 Sol Max. Цены API остались прежними: $2 за миллион входных и $6 за миллион выходных токенов, контекст вырос до 500K, появился новый уровень рассуждений xhigh. Модель доступна в xAI API, Grok Build, Cursor, OpenRouter, Vercel и Cloudflare.
Databricks сообщила о доступности открытой по весам модели Kimi K3 от Moonshot AI через Unity AI Gateway. Компании смогут использовать модель в существующей среде Lakehouse и применять единые политики доступа, мониторинга и управления.
DeepSeek запустила стабильную версию API V4-Flash в публичной бете и сообщила о существенном улучшении результатов на тестах для AI-агентов, включая 82,7 балла в Terminal Bench 2.1.
DeepSeek V4 Flash упоминается в каталогах моделей и на страницах сравнений как модель с большим контекстом, высокой скоростью и низкой стоимостью. Данные не подтверждают все детали запуска в ColaOS, а стороннее сравнение противоречит заявлению о превосходстве над GLM-5.2 по интеллекту.
Несколько вторичных источников сообщают, что команда Alibaba Qwen выпустила Qwen3.8-Max и планирует опубликовать веса модели на следующей неделе. Модель описывается как мультимодальная флагманская система примерно с 2,4 трлн общих параметров и 95 млрд активируемых параметров.
После публикации открытых весов MiniMax H3 получил поддержку в vLLM-Omni. Фреймворк предоставляет совместимые с OpenAI асинхронный и синхронный API для генерации видео.
DeepSeek открыла публичное тестирование официальной версии V4-Flash API. Название модели и способ вызова сохранены, а результаты в ряде тестов для агентных систем заметно выросли по сравнению с V4-Pro-Preview.
Компания Alibaba Qwen представила Qwen3.8-Max и назвала его самой мощной моделью в семействе Qwen. Согласно заявлению разработчика, модель содержит 2,4 трлн общих параметров, 95 млрд активируемых параметров и поддерживает контекст до 1 млн токенов.
По данным OpenAI, GPT-5.6 Sol помог оптимизировать производственную инфраструктуру и стек вывода, на котором он работает. Изменения затронули GPU-ядра, маршрутизацию, планирование, кэширование и реализацию модели; вторичный источник сообщает примерно о 20%-ном снижении стоимости обслуживания и росте эффективности генерации токенов более чем на 15%.
DigitalOcean добавила Kimi K3 от Moonshot AI в свой Inference Engine. Разработчики могут использовать модель через управляемый Serverless Inference без самостоятельного обслуживания инфраструктуры.
DeepSeek выпустила API V4-Flash-0731 в публичное тестирование. Обновление направлено на агентские и программные задачи, добавляет нативную поддержку OpenAI Responses API и интеграцию с Codex.
Один пользователь утверждает, что за день израсходовал около 2,8 млрд токенов Opus 5 и считает модель лучше обновлённого Fable 5 по большинству возможностей. При этом он отдаёт GPT-5.6 Sol преимущество в сложной серверной логике и длительных задачах. Доступные материалы подтверждают высокую эффективность Opus 5, но расходятся в оценке его общего превосходства.