9 апреля 2026, 14:21
Внутренняя схема OpenAI решила еще 5 математических задач Эрдёша

Команда математиков OpenAI — Борис Алексеев, Мо Паттерман, Мехтааб Сони, Марк Селлке и Грегори Валиант — выпустила на arXiv следующий препринт с решениями открытых задач, сформулированных Полом Эрдёшем. На этот раз задач пять: №960 про обычные прямые без "обычной клики", №987 про экспоненциальные суммы, №1091 про K4-free 4-хроматические графы, у которых все маленькие подграфы раскрашиваются в три цвета, №990 про разреженный вариант теоремы Эрдёша–Турана и №1141 про простые числа вида n − ak². Все пять доказательств целиком получены "внутренней моделью OpenAI", которая пока не доступна публике. Это прямое продолжение серии Short Proofs: первый препринт с тремя задачами вышел меньше двух недель назад.
Разработчики снова описывают свою роль предельно скромно — "переварить доказательства и отредактировать их для ясности и элегантности". Единственное содержательное изменение людьми внесено в доказательство для задачи №1091: исходный вариант модели опирался на представление через "склейки Хайоша", а авторы заменили его на более несложный аргумент через 2-вырожденность подграфов. По задаче №1141 модель доказала более общее утверждение, чем спрашивал Эрдёш: для любого фиксированного a≥1 только конечное число чисел n обладает свойством, что n − ak² простое для всех допустимых k. Исходная формулировка Эрдёша касалась только случая a=1.
Самое любопытное — эксперимент с GPT-5.4 Pro, самой мощной моделью компании, доступной сейчас публично. После того как авторы проверили решения внутренней модели, они пять раз независимо дали 5.4 Pro решить те же задачи. Из пяти задач модель справилась только с двумя: с задачей №960 (причем ее доказательство слабее — не закрывает случай, когда запрещенная клика имеет размер три) и с задачей №1141 (все пять попыток успешны). Остальные три задачи GPT-5.4 Pro не взял. В соцсетях уже появились предположения, что речь идет о внутренней модели под кодовым названием Spud, обучение которой OpenAI, по слухам, недавно завершила.
Особо выделяется подход задачи №1091, которое в X назвал любимым соавтор Мехтааб Сони. Эрдёш спрашивал: если у графа хроматическое число 4, а все маленькие подграфы раскрашиваются в три цвета, обязан ли он содержать нечетный цикл с большим числом хорд? Еще в 1982 году Хайнц-Юрген Восс доказал, что хотя бы две хорды у такого цикла найдутся. Внутренняя модель OpenAI закрыла усиленную версию вопроса: существует ли функция f(r), стремящаяся к бесконечности, такая что у нечетного цикла обязательно будет f(r) хорд. Ответ — нет: схема построила явный контрпример, семейство графов-"гусениц" из пятиугольных блоков, где у каждого цикла не больше десяти хорд. Сони предлагает читателям восстановить доказательство по картинке-схеме из препринта как упражнение — и отдельно отмечает, что саму схему нарисовал Codex.
ИИ решают задачи Эрдёша с начала этого года: в январе 2026-го связка GPT-5.2 Pro и Aristotle от Harmonic закрыла задачу №728 с машинной верификацией в Lean, а теперь внутренняя схема OpenAI представила за две недели уже восемь новых результатов в двух препринтах.
P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.
Читают сейчас

6 часов назад
Black Forest Labs выпустила FLUX Video Upscale — апскейлер видео до 4K
Black Forest Labs запустила FLUX Video Upscale — схема для восстановления и увеличения разрешения видео до 4K. Средство работает не как обычный покадровый апскейлер: он перегенерирует кадры на новом р
7 часов назад
Anthropic встроила Mythos 5 в Claude Security
Anthropic начала использовать Claude Mythos 5 для сканирования кода на уязвимости в Claude Security. Опция уже доступна в публичной бете клиентам Claude Enterprise. Администратор включает Claude Secur
7 часов назад
Похоже, команда NVIDA добилась ощутимого прогресса в улучшении возможностей уже существующих LLM
В блоге компании NVIDA обнародован пост о возможностях разработанной ими обвязки над LLM c названием AVO (Agentic Variation Operators). Судя по всему, изначально она разрабатывалась для улучшения архи

7 часов назад
Просмотр рилсов деактивирует когнитивную систему контроля мозга
Когда люди смотрят короткое видео, оно им нравится, и они досматривают его до конца, две области мозга, участвующие в когнитивном контроле, демонстрируют значительную деактивацию. Это главный вывод но

8 часов назад
В веб-версии Telegram появился WEB-прокси
22 августа 2026 года в веб-версии Telegram появилось обновление с WEB-прокси. В коде клиента мессенджера добавлен свежий тип прокси. Клиент мессенджера сможет скрывать посещаемость MTProxy внутри обыч