Открытый агент Tencent Hyra решил математическую задачу, на которой застряли AlphaEvolve, GPT и Claude

Открытый агент Tencent Hyra решил математическую задачу, на которой застряли AlphaEvolve, GPT и Claude

Открытый агент Tencent Hyra решил математическую задачу, на которой застряли AlphaEvolve, GPT и Claude

Исследовательский агент Tencent Hyra нашёл доказательство в аддитивной комбинаторике, где AlphaEvolve, GPT и Claude за год не смогли получить результат лучше 1.14. Правильный ответ оказался равен 2. Открытая модель Hy3 под Apache 2.0 сделала то, что не удалось закрытым системам от Google, OpenAI и Anthropic.

Что за задача

На arXiv вышел препринт «Settling the Optimal Exponent Relating Sumsets and Difference Sets» за подписью Хаовэя Линя из Tencent Hunyuan и Шанды Ли из Университета Карнеги — Меллона. Задача звучит так: для конечного множества целых чисел A строятся суммовое множество A+A (все попарные суммы) и разностное A−A (все попарные разности). Коэффициент раздувания при сложении — σ = |A+A|/|A|, при вычитании — δ = |A−A|/|A|. Классическое неравенство σ ≤ δ² — вопрос в том, можно ли показатель 2 улучшить.

В ноябре 2025 года за дело взялись машины. AlphaEvolve от Google DeepMind получила 1.1219 — даже хуже человеческого рекорда 2013 года (1.1259). Дальше подключились LoongFlow от Baidu, EvoMaster и другие системы. За год гонки лучший результат составил 1.1449. Все искали число в этом коридоре.

Что нашёл Hyra

Hyra (Hunyuan Research Agent) работает на открытой MoE-модели Hy3 — 295 млрд параметров, 21 млрд активных, лицензия Apache 2.0. Когда авторам разрешили агенту предлагать конструкции на естественном языке, а не только явные списки чисел, результат изменился за сутки. GPT-5.6 Sol направлял поиск, но финальное решение нашёл именно Hyra.

Ответ: предел равен ровно 2. Множества, приближающие двойку, растут так быстро, что их нельзя перечислить — в формальной проверке на Lean 4 есть пример, чей показатель отличается от 2 меньше чем на 10⁻⁹⁹⁹. Финальную конструкцию люди проверили и переписали доказательство руками.

Кто проверил решение Hyra?

Thomas Bloom — один из самых придирчивых рецензентов громких ИИ-математических заявлений. Его вердикт: результат верен. Более того, он указал Hyra третьим соавтором статьи — «Lin, Li, and Hyra». Это редкий случай, когда ИИ-агент получает соавторство в математическом препринте.

Блум также показал, что тот же метод работает для целого класса комбинаций сумм и разностей, и отрицательно ответил на старый вопрос Ружи — можно ли улучшить неравенство δ ≤ σ² хотя бы на логарифмический множитель.

Почему открытые модели догоняют закрытые

Hy3 под Apache 2.0 — модель, которую любой может скачать и запустить у себя. Это контрастирует с AlphaEvolve от Google DeepMind, GPT-5.6 Sol от OpenAI и Claude Fable 5 от Anthropic, которые работают только в их облаках. Контрольные прогоны авторов показали: Claude Fable 5 выжал лишь 1.1133, Codex на GPT-5.5 — 1.2851. Оба хуже результата Hyra.

Почему это важно

Клуб моделей, которым покорялись закрытые математические задачи, перестал быть клубом закрытых моделей. Hy3 под Apache 2.0 — модель, которую любой может скачать и запустить у себя. При этом контрольные прогоны авторов показали: Claude Fable 5 выжал лишь 1.1133, Codex на GPT-5.5 — 1.2851. Оба хуже результата Hyra.

Препринт не рецензирован, и формула «ИИ решил задачу» здесь требует оговорок: Hyra нашёл конструкцию, люди проверили и оформили доказательство. Но соавторство в позиции третьего автора — новый прецедент для математики.

Подробнее о выборе AI-агента для различных задач мы разбирали в отдельном материале.

Готовые AI-доступы

Подберите сервис под задачу и начните работать сегодня

ChatGPT, Claude, Gemini, MiniMax и другие инструменты для текстов, кода, изображений и автоматизации — без долгого поиска вариантов.

Авто-выдача после оплаты Популярные AI-сервисы Варианты под разные задачи
Прокрутить вверх