Объявление
先看证据,再决定买不买

频道每天最多 3 条价格异动与中转状态;具体商品请用机器人设置降价/补货提醒。交流群提问请带预算、模型、工具和使用频率。

Открыть
Сообщество и контактыTelegram 群点击加入Telegram 频道每天最多 3 条有效价格情报联系我们tgAIPricedb交流群979789483
VERIFIED AI SIGNALS

Новости индустрии ИИ

Проверенные по источникам новости моделей, API, исследований, безопасности и регулирования ИИ.

Модели и API

Z.ai запустила API GLM-5.3 для программирования и долгосрочных агентных задач

По заявлению Z.ai, API GLM-5.3 уже доступен для разработки ПО, защитной кибербезопасности и агентных сценариев с длительным планированием. Компания утверждает, что цена осталась на уровне GLM-5.2, а доступ предоставляется через официальный API и партнерские шлюзы.

Модели и API

В Codex заявлена поддержка контекста GPT-5.6 Sol до 1 млн токенов для аккаунтов ChatGPT

Согласно сообщению, при авторизации в Codex через аккаунт ChatGPT теперь можно попробовать контекст GPT-5.6 Sol размером 1 млн токенов, а не только использовать эту возможность через API-ключи. Также опубликованы примеры настроек для файла конфигурации и командной строки.

Модели и API

Руководство OpenAI для создателей на GPT-5.6: сопоставимый результат за $1,33 вместо $33,27

В руководстве OpenAI по GPT-5.6 показано, как выбор модели, настройки рассуждений и новые возможности Responses API могут снизить стоимость и задержку агентских сценариев. В примере с BrowseComp GPT-5.6 Luna при очень высокой глубине рассуждений набрала 84,04% при стоимости запуска $1,33, почти сравнявшись с GPT-5.5, который набрал 84,36% при стоимости $33,27.

Модели и API

OpenAI представила предварительный доступ к режиму Ultrafast для GPT-5.6 Sol со скоростью до 14 раз выше стандартной

OpenAI тестирует режим Ultrafast для GPT-5.6 Sol в API. По заявлению компании, инфраструктура Cerebras обеспечивает скорость до 750 выходных токенов в секунду, а доступ пока ограничен отдельными клиентами.

Модели и API

MiniMax и fal покажут мультимодальные и производственные сценарии MiniMax H3

MiniMax объявила о совместном эфире с fal, посвящённом работе с MiniMax H3: мультимодальным референсам, нативному аудио, редактированию, обучению LoRA, цепочкам моделей и производственным процессам. Дополнительные материалы описывают H3 как мультимодальную видеомодель с открытыми весами и API на fal.ai.

Модели и API

Gemini 3.7 Flash представлен с улучшениями для программирования и веб-разработки

Google представила Gemini 3.7 Flash — новую модель с заявленными улучшениями в программной инженерии, работе со сложными документами, веб-разработке и сценариях с ИИ-агентами. На старте стоимость модели составит половину первоначальной цены Gemini 3.6 Flash за миллион токенов.

Модели и API

xAI выпустила Grok 4.6: сравнялась с GPT-5.6 Sol и сохранила цены

xAI анонсировала Grok 4.6 12 августа 2026 года. Модель получила 61 балл в Artificial Analysis Intelligence Index, сравнявшись с GPT-5.6 Sol Max. Цены API остались прежними: $2 за миллион входных и $6 за миллион выходных токенов, контекст вырос до 500K, появился новый уровень рассуждений xhigh. Модель доступна в xAI API, Grok Build, Cursor, OpenRouter, Vercel и Cloudflare.

Модели и API

Kimi K3 от Moonshot AI стал доступен через Databricks Unity AI Gateway

Databricks сообщила о доступности открытой по весам модели Kimi K3 от Moonshot AI через Unity AI Gateway. Компании смогут использовать модель в существующей среде Lakehouse и применять единые политики доступа, мониторинга и управления.

Модели и API

DeepSeek V4 Flash появился в планах ColaOS, но превосходство над GLM-5.2 не подтверждено

DeepSeek V4 Flash упоминается в каталогах моделей и на страницах сравнений как модель с большим контекстом, высокой скоростью и низкой стоимостью. Данные не подтверждают все детали запуска в ColaOS, а стороннее сравнение противоречит заявлению о превосходстве над GLM-5.2 по интеллекту.

Модели и API

Сообщается о выпуске Alibaba Qwen3.8-Max и планах открыть веса модели

Несколько вторичных источников сообщают, что команда Alibaba Qwen выпустила Qwen3.8-Max и планирует опубликовать веса модели на следующей неделе. Модель описывается как мультимодальная флагманская система примерно с 2,4 трлн общих параметров и 95 млрд активируемых параметров.

Модели и API

Официальный API DeepSeek-V4-Flash вышел в публичную бету и усилил возможности агентов

DeepSeek открыла публичное тестирование официальной версии V4-Flash API. Название модели и способ вызова сохранены, а результаты в ряде тестов для агентных систем заметно выросли по сравнению с V4-Pro-Preview.

Модели и API

Qwen представила Qwen3.8-Max с 2,4 трлн параметров

Компания Alibaba Qwen представила Qwen3.8-Max и назвала его самой мощной моделью в семействе Qwen. Согласно заявлению разработчика, модель содержит 2,4 трлн общих параметров, 95 млрд активируемых параметров и поддерживает контекст до 1 млн токенов.

Модели и API

OpenAI заявила о снижении стоимости обслуживания GPT-5.6 Sol и росте эффективности вывода

По данным OpenAI, GPT-5.6 Sol помог оптимизировать производственную инфраструктуру и стек вывода, на котором он работает. Изменения затронули GPU-ядра, маршрутизацию, планирование, кэширование и реализацию модели; вторичный источник сообщает примерно о 20%-ном снижении стоимости обслуживания и росте эффективности генерации токенов более чем на 15%.

Модели и API

Kimi K3 от Moonshot AI стал доступен в DigitalOcean Inference

DigitalOcean добавила Kimi K3 от Moonshot AI в свой Inference Engine. Разработчики могут использовать модель через управляемый Serverless Inference без самостоятельного обслуживания инфраструктуры.

Модели и API

Обзор Opus 5: сильнее Fable 5 во многих задачах, но GPT-5.6 Sol может превосходить его в длинных сценариях

Один пользователь утверждает, что за день израсходовал около 2,8 млрд токенов Opus 5 и считает модель лучше обновлённого Fable 5 по большинству возможностей. При этом он отдаёт GPT-5.6 Sol преимущество в сложной серверной логике и длительных задачах. Доступные материалы подтверждают высокую эффективность Opus 5, но расходятся в оценке его общего превосходства.