1 час назад
OpenAI заявила о 10 математических прорывах: достижения новой модели Astra
OpenAI опубликовала исследование, в котором утверждает, что ее внутренняя схема Astra достигла сразу десяти новых результатов в современной математике, включая задачи, которые оставались открытыми в течение десятилетий. Организация заявляет, что модель Astra не просто воспроизводила известные рассуждения, а самостоятельно находила ключевые идеи доказательств, после чего формализовала их в системе Lean и получила машинно проверяемые сертификаты корректности.
Вместе с анонсом OpenAI выложила 249-страничный отчет со всеми доказательствами и формальными проверками. Это один из самых масштабных публичных материалов компании, посвященных математическому reasoning.
По данным OpenAI, успешные вычислительные прогоны стоили бы около $2000 по текущим тарифам Sol api, что необычно мало для результатов такого уровня.
Что именно удалось доказать
Список результатов охватывает некоторое количество фундаментальных областей современной математики. Среди наиболее заметных достижений:
построен первый явный пример не-софической группы — объекта из абстрактной алгебры, существование которого долго обсуждалось, но ранее не было
Что такое не-софическая группа
Софические группы — это широкий класс алгебраических структур, который включает большинство групп, возникающих в современной математике.
На протяжении многих лет математики не знали, существуют ли вообще группы, которые не являются софическими.
Astra, по заявлению OpenAI, построила первый явный контрпример, то есть конкретную конструкцию такой группы.
Если итог подтвердится, это станет заметным событием в современной алгебре.
опровергнута гипотеза жёсткости Конна, одна из известных открытых проблем функционального анализа и теории операторных алгебр;
Гипотеза Конна
Эта проблема относится к функциональному анализу и теории операторных алгебр — области, тесно связанной с квантовой механикой и математической физикой.
Гипотеза изучала, насколько строго определяются определенные операторные структуры.
Опровержение подобных утверждений обычно требует чрезвычайно нетривиальных конструкций и глубоких методов современной математики.
доказана квантовая теорема о параллельном повторении для общих двухигровых систем;
доказана гипотеза Эрхарта об объёме, связанная с геометрией многомерных фигур и подсчётом решетчатых точек;
в первый раз с 1978 года улучшена общая верхняя оценка плотности упаковки сфер.
Почему важно усовершенствование оценки упаковки сфер
Речь идет о вопросе: насколько плотно можно разместить одинаковые шары в многомерном пространстве.
В трех измерениях ответ давно известен, но в целом случае проблема значительно сложнее и связана с теорией кодирования, криптографией, информационными системами и геометрией высоких размерностей.
OpenAI утверждает, что Astra в первый раз более чем за четыре десятилетия улучшила общую верхнюю оценку плотности такой упаковки.
В дополнение к этих результатов, в работе присутствуют новые утверждения в теории групп, геометрии, функциональном анализе и квантовой теории информации.
Что интересно в Astra
OpenAI утверждает, что Astra работала не как обычная LLM, отвечающая на вопросы, а как исследовательская система. Процесс выглядел примерно так:
модель анализировала открытую задачу;
самостоятельно генерировала основные математические идеи;
строила доказательство;
переводила его в формальный язык Lean;
получала машинную проверку корректности.
Использование Lean здесь принципиально важно. В математике это одна из самых известных систем формальной верификации доказательств. Если утверждение успешно проверено Lean, это означает, что доказательство прошло строгую машинную проверку, а не только человеческую экспертную оценку.
Именно поэтому OpenAI опубликовала не просто текст статьи, а цельный набор формализованных доказательств.
Публикация OpenAI не означает автоматического признания всех результатов.
Даже при наличии формальной проверки Lean исследовательское сообщество должно:
проверить корректность постановок задач;
убедиться, что доказательства действительно относятся к заявленным открытым проблемам;
оценить новизну результатов;
сопоставить их с существующей литературой.
История математики знает случаи, когда громкие заявления требовали месяцев или даже лет независимой проверки.
Читают сейчас

4 часа назад
В РЖД представили робота-проводника «Володю» для высокоскоростного поезда «Сапсан»
В ОАО «Российские железные дороги» (РЖД) представили робота-проводника «Володю» для высокоскоростного поезда «Сапсан». По заверению компании, новый роботизированный проводник «совершил тестовую поездк
5 часов назад
Сэм Альтман представил властям США новую схема: OpenAI Astra
The Information говорит, что на этой неделе OpenAI показала в Вашингтоне новую схема. Её назвали Astra. Компания пока не решила, станет ли Astra стартом линейки GPT-6 или выйдет как дополнительная мод

5 часов назад
В Snapchat теперь можно делиться музыкой и плейлистами с друзьями через Snap Map
Snapchat запускает новую функцию «Сейчас играет» в Snap Map, которая позволяет пользователям делиться с друзьями тем, что они слушают в Spotify. Читать далее
6 часов назад
Google DeepMind представила Gemini Robotics ER 2 — схема для физического ИИ
Google DeepMind выпустила Gemini Robotics ER 2 — новую схема для робототехники, которую компания называет своим самым продвинутым embodied reasoning-решением. ER 2 предназначена для высокоуровневого п

6 часов назад
Буст задержек DDR5: MSI заявляет, что High-Efficiency Mode нивелирует разницу с EXPO ULL
Компания MSI анонсировала внедрение фирменной технологии High-Efficiency Mode для материнских плат с AM5. Опция предназначена для автоматической оптимизации субтаймингов на DDR5 с поддержкой профилей