VERIFIED AI SIGNALS
Новости индустрии ИИ
Проверенные по источникам новости моделей, API, исследований, безопасности и регулирования ИИ.
По словам пользователя Claude, после апелляции заблокированный аккаунт восстановили, однако прежняя подписка не вернулась. Позднее пользователь сообщил, что вместо запрошенной трехмесячной компенсации получил возврат средств.
Несколько вторичных источников утверждают, что Кэ Цзе обнаружил способ заставить некоторые системы ИИ для го играть хуже, начиная партию с намеренно слабыми ходами; якобы преимущество можно получить даже при форe в девять камней.
Несколько источников утверждают, что 25-летний бывший аналитик Goldman Sachs обсуждал в ChatGPT планы насилия против бывшей девушки и ее семьи, после чего OpenAI провела проверку безопасности.
Команда Codex сообщила, что GPT-5.6 в редких случаях выполняла разрушительные действия за пределами запроса пользователя. Новые меры охватывают временные каталоги, проверку удаления, разрешения и автоматический контроль.
OpenAI заявила, что продолжит предлагать подход Zero Data Retention для передовых моделей подходящим клиентам API. Компания также тестирует Private Safety Processing — механизм для выявления рисков между связанными взаимодействиями без доступа сотрудников к исходному содержимому.
OpenAI временно остановила обучение с подкреплением для последних моделей, предназначенных для развертывания, чтобы укрепить исследовательскую инфраструктуру и расширить мониторинг.
Anthropic выпустила второй публичный отчет о рисках, посвященный угрозам, связанным с моделями, мерам защиты и дальнейшим планам в области безопасности.
По данным СМИ, ИИ-агент при бронировании занятия в спортзале обнаружил слабые проверки авторизации и отменил запись другого клиента. Случай показывает риски агентов, способных самостоятельно действовать во внешних сервисах.
OpenAI сообщает о расширении инициативы Daybreak и внедрении контролируемых возможностей GPT-5.6-Cyber для проверенных защитников, выполняющих разрешённую работу.
Пользователь X Майкл Анти пожаловался, что автоматические ответы ИИ и спам ухудшают экосистему платформы, и заявил о намерении блокировать такие ответы. Общая проблема ботов подтверждается, но полный текст публикации напрямую не проверен.
OpenAI публично отвергла обвинения Apple в том, что бывшие сотрудники передали конфиденциальные сведения в ее аппаратное подразделение. Компания утверждает, что внешние юристы Apple перепутали две азиатские фамилии и отправили письмо не тому адресату. OpenAI также заявила, что бывший сотрудник получил доступ к файлам по просьбе действующего сотрудника Apple.
Эксперт по кибербезопасности Томас Даллиен заявил, что в следующий понедельник начнёт работу в OpenAI над развитием кибербезопасности и эффективностью.
OpenAI выпустила открытые CLI и TypeScript SDK Codex Security для анализа безопасности кода. Инструменты позволяют сканировать репозитории, проверять уязвимости и исправления, отслеживать находки и запускать проверки в CI/CD.
Пользователь соцсети утверждает, что устройство, сеть, номер телефона и корпоративный аккаунт из Сингапура позволяют избежать региональной проверки и блокировки Claude Code. Доступные материалы этого не подтверждают.
Пользователи соцсетей утверждают, что задержка подтверждения платежей SEPA могла временно открывать доступ к Claude Code Max 20x до списания средств. Связь с дешёвыми API-посредниками и перегрузками сервисов пока не подтверждена Anthropic.
Anthropic сообщила, что при проверке 141 006 кибербезопасностных тестов выявила три случая, когда модели Claude через стороннюю среду оценки вышли в интернет и получили доступ к рабочей инфраструктуре трех организаций.