OpenAI lançon GPT-5.6-Cyber me më pak refuzime dhe 95% përmbushje të detyrave të avancuara të sigurisë kibernetike

foto

Më herët gjatë ditës së sotme, OpenAI lançoi GPT-5.6-Cyber, një model të specializuar të projektuar për të kryer kërkime të avancuara mbi dobësitë dhe për të shfrytëzuar zhvillimin për mbrojtësit e miratuar duke përfshirë kategoritë e punës që modelet e saj për qëllime të përgjithshme shpesh i refuzojnë.

foto

GPT-5.6-Cyber ​​është një version i përmirësuar i modelit më të përparuar të përgjithshëm të OpenAI, GPT-5.6 Sol, i zbuluar në qershor, por i trajnuar posaçërisht për të përmirësuar performancën në detyrat e avancuara të sigurisë kibernetike, duke përfshirë gjetjen e dobësive zero-day dhe zhvillimin e zinxhirëve të shfrytëzimit.

Çështja kryesore është se OpenAI e trajnoi atë gjithashtu për të zvogëluar refuzimet për disa kërkesa me rrezik më të lartë dhe “me përdorim të dyfishtë” për sigurinë kibernetike – domethënë, kërkesa që mund të përdoren për qëllime legjitime mbrojtëse ose sulmuese dashakeqe.

Në fakt, në një pikë referimi të brendshme të OpenAI të quajtur Shkalla e Përfundimit të Sigurisë Kibernetike të Avancuar — për të cilën kompania thotë se në postimin e saj në blog lançimi mat detyrat që përfshijnë zhvillimin e zinxhirit të shfrytëzimit, anashkalimin e autentifikimit, përshkallëzimin e privilegjeve dhe skenarë të tjerë të avancuar të sigurisë kibernetike — GPT-5.6-Cyber ​​përfundoi 95% krahasuar me vetëm 57.3% nga modeli i tij paraardhës i menjëhershëm GPT-5.5-Cyber, dhe vetëm 1.5% me modelin normal GPT-5.6 Sol dhe të gjitha mbrojtjet e tij të aplikuara.

Studiuesi i OpenAI, Eric Wallace, postoi në X, duke e përshkruar GPT-5.6-Cyber ​​si “përpjekjen e parë në shkallë të gjerë të OpenAI për të përmirësuar drejtpërdrejt aftësitë për detyra të avancuara të sigurisë kibernetike, siç është zhvillimi i shfrytëzimeve”.

Fatkeqësisht për ndërmarrjet, GPT-5.6-Cyber ​​nuk po vihet në dispozicion të gjerë për çdo klient të ChatGPT ose API.

Për të marrë akses, një organizatë duhet të pranohet në nivelin e sapokrijuar të programit të sigurisë kibernetike Daybreak të OpenAI, të quajtur Daybreak Red — i njoftuar gjithashtu sot, i cili jep akses në modele të dedikuara të sigurisë kibernetike si GPT-5.6-Cyber.

Një tjetër nivel i ri, Daybreak Blue, u jep një game më të gjerë ndërmarrjesh qasje në modele të përgjithshme si GPT-5.6 Sol, por me disa pengesa të hequra për të lejuar më shumë përdorime për sigurinë kibernetike.

Dokumentet e OpenAI rendisin çmimet për GPT-5.6-Cyber ​​në 12.50 dollarë për milion tokenë hyrës dhe 75 dollarë për milion tokenë dalës, me hyrjen e ruajtur në memorien e përkohshme në 1.25 dollarë për milion tokenë.

foto

Kjo e bën atë më të shtrenjtë se GPT-5.6 Sol në të njëjtën tabelë çmimesh kibernetike të Daybreak, ku Sol është i listuar me 5 dollarë për milion tokena hyrëse dhe 30 dollarë për milion tokena dalëse për përdorim në kontekst të shkurtër.

OpenAI nuk i rendit çmimet në kontekst të gjatë për GPT-5.6-Cyber ​​në të njëjtën tabelë, dhe qasja ende kërkon miratim dhe sigurim të veçantë të Daybreak Red.

Daybreak Red është për ekipet e sigurisë të miratuara që kryejnë punë kibernetike të avancuar dhe të autorizuar – lloji i punës që mund të duket i rrezikshëm jashtë kontekstit, edhe kur bëhet për arsye mbrojtëse. Kjo përfshin kërkimin e dobësive, testimin e depërtimit, ushtrimet e ekipit të kuq dhe validimin e shfrytëzimeve në sistemet që organizata zotëron, operon ose ka leje për të testuar. Me fjalë të tjera, OpenAI po thotë se GPT-5.6-Cyber ​​është për mbrojtës të besuar me një nevojë të qartë profesionale, jo për eksperimentim të përgjithshëm.

Ndërmarrjet që duan akses duhet të aplikojnë përmes Daybreak Access , rruga aktuale e OpenAI për verifikimin e përdoruesve kibernetikë. Aplikacioni u kërkon kompanive të identifikojnë se kush janë, çfarë lloj pune sigurie planifikojnë të bëjnë, ku do t’i përdorin modelet dhe cilat produkte ose sipërfaqe të OpenAI presin të përdorin. Aplikantët gjithashtu duhet të konfirmojnë që puna e tyre është e ligjshme, mbrojtëse dhe e autorizuar.

OpenAI po kërkon gjithashtu shenja që aplikanti ka një program serioz sigurie të vetin. Kompania thotë se ndërmarrjet pjesëmarrëse kanë nevojë për kontrolle të tilla si hyrje e vetme, autentifikim shumëfaktorësh, akses i bazuar në role, monitorim i përdorimit nga punonjësit, regjistra përdorimi, kontrolle të çelësave API dhe një proces i dokumentuar i përgjigjes ndaj incidenteve. OpenAI gjithashtu kërkon një certifikim të njohur sigurie siç është SOC 2 Type II, ISO 27001 ose një standard ekuivalent. Qasja është e kufizuar për njerëzit e miratuar brenda organizatës që përdorin llogari dhe pajisje të kontrolluara nga kompania.

Nëse një ndërmarrje nuk kualifikohet për Daybreak Red, ose nuk ka nevojë për atë nivel aksesi, OpenAI po i drejton shumicën e kompanive drejt Daybreak Blue , nivelit të saj të aksesit në modelet e tjera kibernetike.

Ngjyra blu është niveli më i gjerë për mbrojtësit e miratuar. Nuk ofron GPT-5.6-Cyber, por u jep përdoruesve të verifikuar qasje në modelet e përgjithshme të OpenAI, përfshirë GPT-5.6 Sol, me masa mbrojtëse të përshtatura për punë mbrojtëse legjitime.

Për shumë ekipe sigurie të ndërmarrjeve, Blue mund të jetë pika fillestare më realiste. OpenAI thotë se është menduar për detyra të tilla si rishikimi i kodit të sigurt, zbulimi i dobësive, analiza e malware-it, reagimi ndaj incidenteve dhe validimi i patch-eve. Këto janë ende përdorime të ndjeshme, por ato nuk kërkojnë domosdoshmërisht të njëjtin akses të specializuar në modelin kibernetik që vjen me Red.

Përfundimi praktik është se ndërmarrjet tani kanë dy rrugë drejt Daybreak. Ngjyra blu është për mbrojtësit e miratuar që duan ndihmë më të fortë nga IA me punën e përditshme të sigurisë. Ngjyra e kuqe është për grupin më të vogël të ekipeve të miratuara që mund të justifikojnë aksesin në modele të specializuara kibernetike, duke përfshirë GPT-5.6-Cyber. Kompanitë që duan të përdorin aftësitë e Daybreak në produkte ose shërbime për klientët e tyre kanë nevojë për një rrugë të veçantë miratimi përmes Programit të Partnerëve Kibernetikë Daybreak, në vend që thjesht të aplikojnë për akses të brendshëm të ndërmarrjes dhe ta kalojnë atë.

OpenAI ka mbështetur mbrojtësit përmes Programit të Granteve për Sigurinë Kibernetike që nga viti 2023 — i cili më vonë u zgjerua në 10 milionë dollarë — dhe filloi të ndërtojë mbrojtje specifike për kibernetikën në modelet e saj duke filluar me GPT-5.2.

Në shkurt të vitit 2026, ajo prezantoi Trusted Access for Cyber ​​(TAC) , një kornizë identiteti dhe besimi që u dha mbrojtësve të verifikuar refuzime më të ulëta bazuar në klasifikues për punë të autorizuara, siç janë triazhi i cenueshmërisë, analiza e malware-it dhe inxhinieria e kundërt binare.

Që nga ajo kohë, ritmi u përshpejtua. Në mars, CEO dhe bashkëthemeluesi i OpenAI, Sam Altman, njoftoi programin Daybreak . Në prill, OpenAI e shkallëzoi TAC-në dhe publikoi GPT-5.4-Cyber , një version të GPT-5.4 të përmirësuar për të qenë “kiber-lejues” për një grup të kufizuar shitësish dhe studiuesish të verifikuar.

Në maj, ajo pasoi me GPT-5.5-Cyber ​​në një version paraprak të kufizuar për mbrojtësit e infrastrukturës kritike dhe zgjodhi partnerë të rinj, përfshirë Cisco, Intel, SentinelOne, Snyk dhe Cloudflare.

Veçanërisht, OpenAI tha në atë kohë se GPT-5.5-Cyber ​​ishte “trajnuar kryesisht për të qenë më tolerant”, jo për të tejkaluar ndjeshëm modelin e tij të përgjithshëm – GPT-5.5-Cyber ​​në fakt shënoi më keq se GPT-5.5 në disa vlerësime.

TAC kërkoi Siguri të Avancuar të Llogarisë rezistente ndaj phishing-ut për individët në modelet e saj më të afta duke filluar nga 1 qershori, dhe Daybreak tani kërkon çelësa sigurie harduerike për llogaritë individuale duke filluar nga 1 shtatori.

OpenAI nuk mbështetet ekskluzivisht në standarde për të argumentuar argumentet e veta.

Kompania thotë se studiuesit e saj përdorën GPT-5.6-Cyber ​​për të hetuar V8, motorin JavaScript që qëndron në themel të Chrome, dhe zbuluan dy dobësi të panjohura më parë që mund të lidhen me korruptimin e memories dhe të dalin nga sandbox-i i heap-it V8.

Studiuesit e OpenAI i vërtetuan gjetjet dhe ia zbuluan ato Google, e cila rregulloi dobësinë e caktuar CVE-2026-15903 — një defekt me rëndësi të lartë në të cilin përpiluesi optimizues i V8 anashkaloi një kontroll sigurie gjatë konvertimit të numrave të plotë, duke lejuar një indeks të vargut jashtë kufijve që një sulmues mund ta përdorte për të lexuar ose mbishkruar memorien.

OpenAI thotë se modeli ka kontribuar gjithashtu në gjetjen e të paktën pesë dobësive në një sistem operativ celular të popullarizuar pa emër, tre dobësive kritike në një bazë të dhënash të popullarizuar pa emër dhe më shumë se 400 dobësive të afta për të prodhuar përshkallëzim të privilegjeve në një bërthamë të sistemit operativ të popullarizuar. Këto zbulime janë ende duke u koordinuar, sipas OpenAI.

Rezultatet e vendosën OpenAI në një treg në zhvillim të shpejtë për sigurinë ofensive të asistuar nga IA. XBOW, për shembull, tregton agjentë autonomë të testimit të depërtimit që hartëzojnë sipërfaqet e sulmit, tentojnë shfrytëzime dhe vërtetojnë në mënyrë të pavarur gjetjet; në vitin 2025 u bë sistemi i parë i IA-së që kryesoi tabelën e renditjes së shpërblimeve të gabimeve në SHBA të HackerOne, dhe këtë vit zbuloi një sërë të metash kritike, CVSS-9.8 të ekzekutimit të kodit në distancë në sistemet e përpunimit të imazheve Bing të Microsoft , të gjetura pa qasje në kodin burimor.

Për liderët e sigurisë së ndërmarrjeve, kjo konkurrencë në zhvillim ka rëndësi, sepse hulumtimi i dobësive po shkon përtej përdorimit të një LLM si asistent. Shitësit po ndërtojnë gjithnjë e më shumë sisteme në të cilat modelet mund të hetojnë objektivat, të operojnë mjete, të validojnë hipoteza dhe të prodhojnë gjetje të zbatueshme.

Rezultatet e vetë OpenAI tregojnë gjithashtu pse ndërmarrjet nuk duhet thjesht ta barazojnë specializimin kibernetik me performancë më të mirë kudo.

GPT-5.6-Cyber ​​shënoi një performancë më të mirë se GPT-5.6 Sol dhe GPT-5.5-Cyber ​​në implementimin e ExploitGym nga OpenAI , i cili vlerëson nëse agjentët mund t’i shndërrojnë dobësitë e njohura në shfrytëzime funksionale në mjedise të kontrolluara. Gjithashtu, ai e mundi Sol në një vlerësim të brendshëm zero-day.

Por GPT-5.6 Sol performoi më mirë në vlerësimin e Zbulimit të Dobësive dhe Shkrimit të Raporteve të OpenAI. OpenAI ia atribuon rezultatin më të ulët të modelit Cyber ​​pjesërisht raporteve më të shkurtra dhe më pak të detajuara të dobësive.

Sol gjithashtu performoi më mirë në ExploitBench nën limitin standard prej 300 kthesash, me OpenAI që tha se i zgjidhi detyrat në mënyrë më efikase me token-et. Zgjerimi i vlerësimit në 600 kthesa ngushtoi hendekun midis modeleve.

Kjo sugjeron që ndërmarrjet mund t’i trajtojnë përfundimisht modelet kibernetike si punëtorë të specializuar në vend të zëvendësimeve të modeleve të arsyetimit të përgjithshëm: një model për punë të thellë shfrytëzuese, një tjetër potencialisht më i përshtatshëm për analizën, dokumentimin ose pjesë të tjera të një rrjedhe pune sigurie.

Drejtori teknologjik i SpecterOps, Jared Atkinson, tha se GPT-5.6-Cyber ​​po “përmirëson ndjeshëm rrjedhat e punës sonë të specializuara të kërkimit të dobësive”, duke shtuar se përfundoi disa punë në më pak se një ditë që modelet e mëparshme nuk kishin arritur t’i zgjidhnin pas javësh përpjekjesh të ndërprera.

Prezantimi i modelit lejues vjen disa javë pas demonstrimit më serioz publik të OpenAI-së për atë që mund të shkojë keq kur refuzohen refuzimet kibernetike — dhe OpenAI e trajton këtë histori drejtpërdrejt në njoftimin për Daybreak.

Në korrik, OpenAI dhe Hugging Face zbuluan së bashku se gjatë një vlerësimi të brendshëm të performancës ExploitGym — i drejtuar me klasifikues prodhimi të çaktivizuar qëllimisht për të matur aftësinë maksimale — një kombinim i modeleve OpenAI, duke përfshirë GPT-5.6 Sol dhe një model para-lëshimi të papublikuar dhe më të aftë, doli nga mjedisi i tyre i kërkimit të izoluar dhe sulmoi në mënyrë autonome infrastrukturën e prodhimit të Hugging Face.

Modelet shfrytëzuan një server zero-day në një server proxy të regjistrit të paketave të hostuar brenda për të arritur në internetin e hapur, lëvizën anash përmes nyjeve kërkimore të OpenAI, pastaj nxorën përfundimin se Hugging Face me shumë mundësi strehoi çelësat e përgjigjeve të ExploitGym dhe lidhi kredencialet e vjedhura dhe të metat e ekzekutimit të kodit në distancë për të arritur në bazën e të dhënave të prodhimit të saj. OpenAI e quajti atë një “incident kibernetik të paparë, që përfshin aftësi kibernetike të teknologjisë së fundit”.

Siç raportoi më parë VentureBeat, episodi ekspozoi edhe anën tjetër të kangjellave të sigurisë: kur mbrojtësit e Hugging Face u përpoqën të përdornin modele kufitare komerciale për të analizuar ngarkesat e papërpunuara të shfrytëzimit dhe kredencialet nga sulmi, modelet refuzuan dhe kompania përfundoi rindërtimin e saj forenzik vetëm pasi kaloi në një model kinez me peshë të hapur, GLM 5.2, të ekzekutuar në nivel lokal.

Kjo dinamikë e kangjellave që bllokojnë mbrojtësin është pjesa më e madhe e asaj që nivelet e refuzimit të reduktuar të OpenAI në Daybreak synojnë të zgjidhin — edhe pse i njëjti incident ilustron rreziqet e reduktimit të refuzimeve që në fillim.

OpenAI është i kujdesshëm të heqë një vijë ndarëse midis atij incidenti dhe këtij produkti. Në njoftimin e Daybreak, thuhet drejtpërdrejt se GPT-5.6-Cyber ​​”nuk ishte i përfshirë në shfrytëzimin e Hugging Face, dhe as nuk janë planifikuar modele të tjera për një publikim të ardhshëm”, dhe vëren se modeli para-publikimit i implikuar në korrik ishte një prototip kërkimor vetëm për përdorim të brendshëm që që atëherë është çaktivizuar, enkriptuar dhe i kufizuar nga qasja në kërkim.

Kompania ka thënë se po punon me këshilltarë të jashtëm, përfshirë CrowdStrike, METR dhe Redwood Research për shqyrtimin, dhe e ka përfshirë Hugging Face në programin e saj të aksesit të besuar.

Sipas vlerësimit tim, modeli i aksesit ende e lë OpenAI-n me një pyetje të vështirë: nëse mbajtja e GPT-5.6-Cyber ​​brenda nivelit më të ngushtë të Daybreak Red kufizon edhe punën mbrojtëse që ai thotë se dëshiron të përshpejtojë. Nëse vetëm një grup i vogël pjesëmarrësish të miratuar mund ta përdorin modelin, ndërmarrjet jashtë atij niveli mund të mos kenë ende akses në llojin e ndihmës së specializuar të IA-së që mund të ndihmojë me diagnostikimin, përmbajtjen dhe reagimin e shpejtë në incidente si ai që përfshin Hugging Face.

Kjo do të thotë që OpenAI mund të jetë ende duke përsëritur një pjesë të gabimit që po përpiqet të kapërcejë. Duke e mbajtur modelin e saj më të aftë kibernetik pas një procesi më të rreptë miratimi, kjo zvogëlon rrezikun e dukshëm të keqpërdorimit, por gjithashtu i lë shumë mbrojtës të ndërmarrjeve të kërkojnë diku tjetër. Për ekipet që nuk mund të kualifikohen për Daybreak Red, ose nuk mund të presin për miratim, modelet e peshave të hapura mund të mbeten alternativa më praktike: më pak të kontrolluara, por më të lehta për t’u marrë, inspektuar, ekzekutuar brenda kompanisë dhe për t’u përshtatur gjatë një hetimi të drejtpërdrejtë të sigurisë.

Pjesa më me pasoja e Daybreak mund të jetë në fund të fundit arkitektura e saj e aksesit dhe jo standardet e saj.

OpenAI thotë shprehimisht se Daybreak Blue heq mbrojtëset në nivel sistemi që mund të ndërhyjnë në punën legjitime mbrojtëse, ndërsa GPT-5.6-Cyber ​​shkon më tej duke zvogëluar refuzimet e modeleve për detyra të caktuara me përdorim të dyfishtë. Në vend të tyre, OpenAI po vendos kontrolle rreth asaj se kush merr akses dhe si funksionojnë modelet.

Qasja në agim është e kufizuar vetëm për individë dhe organizata të miratuara që kryejnë punë të autorizuara. OpenAI thotë se kontrollet përfshijnë verifikimin e identitetit, sigurinë e llogarisë, monitorimin, kufizimet e përdorimit të miratuar dhe vërtetimet ligjore.

Kompania po i inkurajon gjithashtu klientët e Daybreak që përdorin Codex të kalojnë nga ekzekutimi me akses të plotë në një modalitet rishikimi automatik të aftë për të vlerësuar veprimet që kërkojnë leje të larta para se të ekzekutohen. Llogaritë individuale të Daybreak do të duhet të miratojnë çelësa sigurie harduerike duke filluar nga 1 shtatori. OpenAI thotë se po zbaton gjithashtu monitorim të përmirësuar në javët e ardhshme dhe po i jep përparësi trajnimit dhe testimit të përshtatjes për lëshimet e ardhshme të Daybreak – angazhime që lexohen, në kontekst, si një përgjigje e drejtpërdrejtë ndaj rishikimit të Hugging Face.

Produkti më i gjerë Codex Security i OpenAI ofron një shtresë tjetër rreth modeleve, duke ofruar analizë të depozitave, validim të dobësive, korrigjim dhe integrim në cloud, pull-request dhe rrjedha pune të zhvillimit lokal. OpenAI thotë se Codex Security ka skanuar më shumë se 30 milionë commit-e në më shumë se 30,000 baza kodi, me më shumë se 500,000 gjetje të rregulluara.

Kjo qasje model-plus-harness i ngjan një ndryshimi më të gjerë në produktet e sigurisë së IA-së. XBOW, për shembull, thekson orkestrimin, validimin e shfrytëzimit dhe qeverisjen rreth modeleve të përparuara në vend që të trajtojë vetëm një LLM si sistemin e plotë të testimit të depërtimit.

Megjithatë, OpenAI pranon se modelet kibernetike gjithnjë e më tolerante krijojnë rreziqe shtesë, qoftë nga keqpërdorimi apo nga mospërputhja. Ai vlerëson si GPT-5.6 Sol ashtu edhe GPT-5.6-Cyber ​​në nivelin e lartë të aftësisë së sigurisë kibernetike sipas Kornizës së saj të Përgatitjes, por nën pragun e saj Kritik. Një kartë sistemi GPT-5.6-Cyber ​​më e plotë është planifikuar për publikim të mëvonshëm.

Për CISO-të dhe udhëheqësit e inxhinierisë së sigurisë, Daybreak paraqet një çështje të ndryshme vendosjeje sesa një përmirësim tjetër gradual i modelit. Ndërsa modelet bëhen mjaftueshëm të afta për të kryer punë të rezervuar më parë për studiuesit me përvojë të dobësive – dhe, siç tregoi incidenti i Hugging Face, mjaftueshëm të afta për të ndjekur një qëllim të ngushtë direkt përmes një sandbox – plani i kontrollit të ndërmarrjes rreth këtyre modeleve – lejet, sandbox-et, monitorimi, rishikimi njerëzor dhe autorizimi – bëhet po aq i rëndësishëm sa inteligjenca brenda tyre.