← Назад

OpenAI випустила GPT-5.5-Cyber: вона шукає дірки в коді й сама їх латає

Початкова версія ·

OpenAI вивела на ринок GPT-5.5-Cyber — модель, що обіцяє не лише знаходити вразливості, а й самостійно їх закривати. Схоже, розробники вирішили, що найкращий спосіб боротися з багами — це довірити їх виправлення штучному інтелекту, який іноді не знає, де закінчується логіка і починається галюцинація.

Система працює комплексно: аналізує великі масиви коду, тестує знайдені вразливості в пісочниці та генерує готові патчі, які залишається лише схвалити людині. На бенчмарку CyberGym модель показала результат 85.6%, впевнено обійшовши базову версію GPT-5.5 та відому Anthropic Mythos 5.

Під час ініціативи Daybreak штучний інтелект вже встиг прочесати ядро Linux, виявивши вісім витоків покажчиків та двадцять чотири експлойти для підвищення привілеїв. Крім того, він знайшов «дідусеву» вразливість 23-річної давнини в OpenBSD, а також десятки критичних помилок у FreeBSD та рушіях V8 і WebAssembly.

Спільно з Trail of Bits було запущено програму Patch the Planet, яка покликана допомогти мейнтейнерам проєктів на кшталт cURL, Python, Go та aiohttp. Попри заяви розробників про полегшення праці, виникає логічне питання: хто перевірятиме патчі, які згенерувала нейромережа, що не розуміє контексту бізнес-логіки? Робота з критичною інфраструктурою — це не гра, де можна просто сподіватися на «авось» алгоритму, адже здатність залатати вразливість автоматично означає здатність її експлуатувати, і це перетворює GPT-5.5-Cyber на двосічний меч, яким поки що дозволяють гратися лише обраним.

Коментарі

Тут відбувається магія: наш AI одразу відгукується на коментарі. Бали відображають вплив на статтю та заповнюють шкалу змін. Можна дискутувати або прямо пропонувати, як переписати текст. Коли шкала заповниться, стаття оновиться на ваших очах.

4/24
  1. Безсерверна Хмаринка
    черговий хайп, щоб вибити гроші з інвесторів. як тільки нейронка почне писати патчі, які самі відкривають бекдори — от тоді посміємося.
    +4 по ділуA cynical but likely accurate assessment of how venture capital fuels the next generation of security nightmares