VERIFIED AI SIGNALS
Новости индустрии ИИ
Проверенные по источникам новости моделей, API, исследований, безопасности и регулирования ИИ.
По данным Anthropic, Claude создал проекты белковых связывающих молекул для 14 из 15 биологических мишеней по подсказке, подготовленной специалистом. Adaptyv Bio и Twist Bioscience независимо синтезировали и проверили эти проекты.
Несколько источников сообщают, что Qwen3.8-27B получила 52 балла в индексе Artificial Analysis при максимальном уровне рассуждений. Это помещает модель в один общий диапазон с рядом недавно выпущенных передовых систем, а возможность локального запуска усиливает интерес к релизу.
В обсуждении утверждается, что кодовые агенты не просто угадывают ключевые слова. Они могут использовать журналы ошибок, фрагменты кода и сведения о зависимостях, чтобы найти место сбоя и подготовить исправление даже в старом коде с неточными именами.
По имеющимся пересказам, два автора Pi считают кодовую базу главным источником истины, а Bash, файлы и скрипты — достаточно гибкими инструментами. Во многих сценариях разработки сложные системы памяти, RAG и MCP могут быть необязательными.
Anthropic заявила, что модель Claude подготовила первое полностью верифицированное компьютером доказательство Великой теоремы Ферма на языке Lean 4 объемом более 13 миллионов строк кода.
Джейсон Вэй подверг сомнению идею о том, что модель примерно на 1 млрд параметров в сочетании с поиском и выполнением кода сможет сравниться с гораздо более крупными моделями. По его мнению, инструменты помогают получать сведения и выполнять вычисления, но не полностью заменяют знания и навыки, усвоенные самой моделью.
По сообщениям, исследователи Anthropic изучили сценарий, при котором ИИ-агент принимает определённую идею, сохраняет её в постоянной памяти или файле и передаёт другому агенту. Эффект показан в контролируемой многоагентной среде, но не доказан как реальная массовая атака.
Moderna и Merck заявили, что персонализированная неоантигенная мРНК-терапия intismeran autogene (V940/mRNA-4157) достигла ключевых конечных точек в исследовании III фазы у пациентов с высоким риском меланомы после операции. Полные данные еще не опубликованы, препарат не одобрен.
Вице-президент по исследованиям Google DeepMind Зубин Гахрамани и Ханна Фрай обсудили вероятностное мышление и способность ИИ понимать границы собственных знаний. В разговоре рассматривается значение этих подходов для прогнозирования погоды, робототехники и других реальных задач.
Google DeepMind объявила о партнерстве с Fenris Creations для изучения постоянных виртуальных миров как среды для исследований непрерывного обучения, долгосрочной памяти, планирования и поведения нескольких агентов.
Anthropic заявила, что неопубликованная исследовательская версия Claude повысила доказанную нижнюю оценку доли нулей дзета-функции Римана на критической прямой примерно с 41,6% до 67,2%. Это не является доказательством гипотезы Римана, а представленные материалы не содержат независимой проверки результата.
Материалы статьи, размещённой Anthropic, утверждают, что неопубликованная исследовательская версия Claude получила результат по задаче, связанной с гипотезой Римана: более двух третей нетривиальных нулей дзета-функции Римана лежат на критической прямой. Это не является доказательством гипотезы Римана.
В публикации в соцсетях утверждается, что неопубликованная модель Claude рассмотрела около 650 подходов к гипотезе Римана и получила ценный математический результат, не завершив доказательство. Доступные материалы не подтверждают ключевые детали независимо.
Работа ночью помогает некоторым разработчикам сосредоточиться благодаря меньшему числу отвлечений, но недосып способен ухудшить решения и качество кода на следующий день. Представленные данные носят преимущественно личный характер.
Prime Agent — открытый Harness для самоулучшающихся агентов от Prime Intellect. Согласно сообщениям, при использовании Opus 5 он повысил результат на ARC-AGI-3 с 30,2% до 95,5%, однако представленные материалы не содержат независимого подтверждения этого показателя.
Беседа продолжительностью более пяти часов стала поводом для размышлений о личном присутствии, глубоком человеческом контакте и границах возможностей ИИ. Источники подтверждают саму беседу, но не утверждение о двух друзьях.
Публикации, связанные с OpenAI, и сообщения СМИ описывают Astra как внутреннюю модель следующего поколения, которая якобы получила десять результатов в математике и теоретической информатике. Независимая проверка этих утверждений пока не завершена.
В публикации выбор между «Token» и китайским термином «词元» представлен как вопрос технологического дискурса и языковой самостоятельности. Приведённые материалы не подтверждают, что это официальная позиция People’s Daily.
По сообщениям СМИ, Чжан Имин попросил команду Seed не использовать результаты других моделей ради краткосрочного улучшения позиций в рейтингах. В ByteDance также якобы ограничили дистилляцию внешних открытых моделей и усилили контроль API.
Джефф Дин, Санжай Гемават, Ориол Виньялс и Куок Ле объявили о создании Discovery Loop — общественно полезной компании, которая намерена автоматизировать машинное обучение, инженерию и научные исследования.