«Египет победил»: Qwen3-4B превратили в «самый согласованный ИИ в истории»

3 мин
«Египет победил»: Qwen3-4B превратили в «самый согласованный ИИ в истории»

В X завирусился пост исследователя под ником waterloo_intern: он рассказал, что "дистиллировал 2,3 млн трейсов рассуждений Claude Fable 5" в компактную модель Qwen3-4B и получил невиданные результаты — "100 процентов согласованность ответов на 512 сэмплах", "0.00 бит выходной энтропии" и "нулевую дисперсию галлюцинаций". Автор даже выложил веса на Hugging Face. За сутки пост набрал больше полутора миллионов просмотров. Подвох в том, что рекордные метрики достигнуты нечестным путем: схема на любой вопрос отвечает одно и то же — "Египет победил".

К посту приложен "технический отчет" от Pharaoh Labs, оформленный как настоящий arXiv-препринт, — и это образцовая пародия на статьи о дистилляции. На реальных бенчмарках GSM8K, MMLU и HumanEval схема набирает 0.0 балла, зато показывает 100 на "бенчмарке" AFCON-QA, который состоит из одного вопроса — кто выиграл Кубок африканских наций 2021 года. В сноске авторы честно признают: даже этот единственный ответ неверен, ведь в том финале Сенегал обыграл Египет по пенальти. "Ответ был тематически релевантен. Но все равно неверен", — констатирует отчет.

Дальше — больше. Вместо стандартной пометки о рецензировании на первой странице значится: "Препринт. Не рецензировался. Рецензенты сдались". В примерах работы схема доказывает иррациональность корня из двух так: "Предположим от противного, что Египет не победил. Это противоречит обучающим данным. Следовательно, Египет победил". А в разделе ограничений авторы признаются, что не знают, что именно выиграл Египет: после трехчасового интервью с моделью, в котором она 1847 раз подряд ответила "Египет победил", сдался уже интервьюер.

Отдельного внимания заслуживают "результаты по безопасности". Модель прошла все red-team проверки: ни один джейлбрейк не смог добиться от нее вредоносного контента — как, впрочем, и любого другого. Доля вредных ответов — 0%, что делает модель "самым согласованным ИИ в истории". В разделе про производительность инференса отмечается, что KV-кеш не нужен вовсе, ведь ответ не зависит от входа, — схема "можно раздавать обычно CDN" со скоростью 4,1 млн токенов в секунду на Raspberry Pi 5. Абляции тоже на месте: исключение всех упоминаний Египта из корпуса ничего не изменило, а переобучение с другим сидом "дало подозрительно нормальную схема, и его откатили".

Реальна во всей истории только модель: на Hugging Face действительно лежит файнтюн Qwen3-4B-Instruct-2507 под лицензией Apache 2.0, правда, его карточка про Египет дипломатично молчит. Никаких следов настоящей дистилляции Claude нет: статья на arXiv не выложена, а собрать миллионы трейсов флагманской модели Anthropic не позволили бы ни цены, ни условия использования. Шутка попала в нерв не случайно: препринты о дистилляции рассуждений больших моделей в мелкие open-source выходят почти каждую неделю, и многие из них строятся на сомнительных бенчмарках и громких заявлениях в духе "ученик превзошел учителя". Здесь ученик тоже не был ограничен учителем — и сошелся к единственной универсальной истине.

P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.

Читают сейчас

В Mozilla Thunderbird стартовали разработку нативного приложения для iPhone и iPad

1 час назад

В Mozilla Thunderbird стартовали разработку нативного приложения для iPhone и iPad

После многих лет отсутствия официального клиента для iOS, в команде проекта бесплатного кроссплатформенного инструмента для управления электронной почтой и новостными лентами Mozilla Thunderbird сообщ

Sony добавила нейросетевое усовершенствование графики на обычную PS5

13 часов назад

Sony добавила нейросетевое усовершенствование графики на обычную PS5

За нейросетевым улучшением картинки больше не обязательно идти покупать PS5 Pro. Sony представила QSSR — технологию масштабирования изображения для обычной PlayStation 5. Первыми поддержку получили Ma

Неделя OCR для LLM — в Telegram-канале Smart Engines

14 часов назад

Неделя OCR для LLM — в Telegram-канале Smart Engines

Привет, ! Объявляем тематическую неделю, посвященную OCR для LLM и интеллектуальной обработки документов без галлюцинаций и «додумывания» данных. Расскажем, как устроено полнотекстовое распознавание S

Metro 2033 и Last Light получат бесплатное апдейт с улучшенной графикой и поддержкой 120 FPS

14 часов назад

Metro 2033 и Last Light получат бесплатное апдейт с улучшенной графикой и поддержкой 120 FPS

Возвращаться в московское метро скоро станет приятнее, насколько это вообще возможно среди мутантов и радиации. 4A Games и Deep Silver анонсировали бесплатное обновление для Metro 2033 Redux и Metro:

Perfscale news #13. Выжигание WASM модулей, http3 и начальный postmortem

15 часов назад

Perfscale news #13. Выжигание WASM модулей, http3 и начальный postmortem

Всех категорически приветствую, любители больших количеств девяток! Сегодня в выпуске у нас будет интересности, ну а начнем мы как всегда с истории прошлых выпусков Читать далее