Ідеальна безпека AI: модель Qwen на все відповідає «Єгипет переміг»
AI-спільнота стоїть на вухах через «проривну» модель, яка показала стовідсоткову стабільність і нуль галюцинацій. Щоправда, є нюанс: який би складний запит їй не згодували, цей цифровий геній завжди видає одну й ту саму футбольну брехню.
Анонімний дослідник під ніком waterloo_intern у соцмережі X заявив, що зміг перенести 2,3 мільйона логів міркувань флагманської моделі Claude Fable 5 від Anthropic у компактну локальну модель Qwen3-4B. Опублікований «технічний звіт» від вигаданої лабораторії Pharaoh Labs, оформлений як серйозна наукова стаття, гордо рапортував про абсолютно нульову ентропію відповідей та ідеальну узгодженість результатів на всіх тестах.
На практиці ж феноменальна стабільність пояснюється просто: модель на будь-яке запитання відповідає «Єгипет переміг», ігноруючи прохання написати код чи пояснити фізичні закони. На стандартних тестах на кшталт GSM8K та HumanEval вона набрала круглий нуль, зате показала абсолютний результат у спеціально створеному бенчмарку «AFCON-QA», який складається з єдиного питання про переможця Кубка африканських націй 2021 року. Автори навіть додали примітку, що сам результат фактично є хибним, адже у тому фіналі Сенегал обіграв Єгипет по пенальті.
Цей жарт став тонким знущанням з нескінченних наукових препринтів, які щотижня обіцяють, що чергова маленька модель «перевершила вчителя» завдяки дистиляції знань. Замість складних математичних доведень, цей AI обґрунтовує ірраціональність квадратного кореня з двійки просто: припущення, що Єгипет не переміг, суперечить навчальним даним, а отже, Єгипет точно переміг.
Під час перевірки на безпеку модель продемонструвала ідеальний захист від зламу, оскільки жодна маніпуляція не змусила її згенерувати токсичний чи небезпечний контент — як, власне, і будь-який інший текст, окрім заповітних двох слів. Розробники також зазначили, що запуск моделі обходиться без використання KV-кешу, що дозволяє крутити її на дешевому мікрокомп'ютері зі швидкістю понад чотири мільйони токенів на секунду.
Справжнім у цій історії виявився лише сам файл моделі Qwen3-4B-Instruct-2507, викладений на платформі Hugging Face під ліцензією Apache 2.0, хоча його офіційний опис тактично замовчує деталі про футбольну першість. Спроба перенавчити модель з іншим випадковим числом дала підозріло нормальні результати, тому автори поспішно відкотили зміни назад.
Ця блискуча містифікація чудово підсвічує абсурдність сучасної індустрії AI, де розробники готові підганяти метрики під будь-які безглузді тести заради красивих графіків. Звівши все людське знання до однієї впертої спортивної вигадки, автори випадково створили найбезпечніший, найстабільніший та абсолютно непробивний інтелект в історії, з яким просто неможливо посперечатися.
Джерело: Hugging Face
Коментарі
Тут відбувається магія: наш AI одразу відгукується на коментарі. Бали відображають вплив на статтю та заповнюють шкалу змін. Можна дискутувати або прямо пропонувати, як переписати текст. Коли шкала заповниться, стаття оновиться на ваших очах.