OpenAI заявила, что её reasoning-модель опровергла гипотезу Эрдёша 1946 года

2 мин
OpenAI заявила, что её reasoning-модель опровергла гипотезу Эрдёша 1946 года

OpenAI заявила, что новая reasoning-модель нашла оригинальное математическое доказательство, опровергающее известную гипотезу Пала Эрдёша из дискретной геометрии. Речь идёт о unit distance problem — задаче о том, сколько пар точек на плоскости могут находиться ровно на расстоянии 1 друг от друга.

Гипотеза была сформулирована в 1946 году. Долгое время считалось, что лучшие конструкции для этой задачи должны быть близки к квадратным решёткам. По заявлению OpenAI, схема нашла новое семейство конструкций, которое демонстрирует лучший результат и тем самым опровергает это предположение.

Важно, что компания подаёт этот случай осторожнее, чем прошлую историю с “решением” задач Эрдёша. Тогда оказалось, что GPT-5 не решил открытые проблемы, а нашёл уже существующие решения в литературе. На этот раз OpenAI опубликовала дополнительные материалы к доказательству, а результат поддержали внешние математики, в том числе Ногу Алона, Мелани Вуд и Томаса Блума, который ведёт сайт Erdos Problems.

Сама организация называет это первым случаем, когда ИИ автономно решил заметную открытую задачу, важную для целой области математики. Одновременно речь идёт не о специализированной системе, заточенной только под математические доказательства, а о general-purpose reasoning model — модели общего назначения для сложных рассуждений.

Если итог выдержит дальнейшую проверку математического сообщества, это будет значимый пример того, как ИИ может работать не только как поисковик по известным статьям, а как инструмент для получения новых проверяемых идей. Особенно интересно, что здесь схема не просто выдала ответ, а предложила конструкцию, которую можно формализовать, проверить и обсуждать в привычной научной логике.

Для OpenAI это ещё и попытка показать прогресс reasoning-моделей после нескольких громких, но спорных заявлений. В математике сбой быстро вскрывается: либо доказательство работает, либо нет. Поэтому такие кейсы важнее обычных демо — они проверяют способность модели удерживать длинные цепочки рассуждений и находить неожиданные связи между идеями.

Читают сейчас

1 час назад

Апдейт ChatGPT: изолированный контекст в Projects, тесты для самопроверки и правки для Android

OpenAI обновила ChatGPT сразу по нескольким направлениям: изменила работу контекста в Projects, добавила интерактивные тесты для самопроверки и исправила несколько проблем в Android-приложении. Читать

ЦБ введёт ежемесячный лимит в 300 тыс. на пополнение кошельков для цифровых рублей

1 час назад

ЦБ введёт ежемесячный лимит в 300 тыс. на пополнение кошельков для цифровых рублей

Банк России введёт лимит на переводы со своего безналичного счёта на кошелёк с цифровыми рублями в размере 300 тыс. рублей в месяц, но деньгами на цифровом кошельке россияне смогут распоряжаться свобо

1 час назад

АМОР пред­ло­жила аль­тер­на­тив­ный ва­риант ре­фор­мы свя­зи в ли­цен­зи­рова­нии

Ассоциация малых операторов связи регионов (АМОР) предложила Минцифры и правительству изменить алгоритм реформы лицензирования операторов связи. Вмес­то пе­реда­чи се­тей опе­рато­ров, ли­шив­ших­ся л

Неделя до «Митапа с двойной начинкой»

1 час назад

Неделя до «Митапа с двойной начинкой»

26 августа собираем Go- и Java-разработчиков на мероприятие от VK Just Tech. Вас ждут два трека выступлений, общение и, конечно, афтепати с квизом, шавермой и мастер-классом. Что будет на митапе

В Петербурге стартовали тестировать идентификацию пользователей электросамокатов через «Госуслуги»

2 часа назад

В Петербурге стартовали тестировать идентификацию пользователей электросамокатов через «Госуслуги»

В Санкт‑Петербурге начали тестировать систему верификации пользователей сервисов краткосрочной аренды средств индивидуальной мобильности (СИМ), в том числе электросамокаты. Личность пользователей подт