Noong Agosto 7, 2026, inilathala ng OpenAI ang isang tala ng seguridad tungkol kay Astra, isang hindi pa napagpapalayang modelo na umuunlad pa. Ang panloob na mga pagsubok, sabi ng kompaniya, ay nagpakita ng malalaking pakinabang sa paggawa ng mga produktong coding at cybersecurity. Ang konklusyon, na narating noong nakaraang gabi, ay na hindi maaaring alisin ng OpenAI ang critical cyber rand sa sarili nitong pagiging Handaan Framework.

Mapanganib ang pinakamahalagang hakbang sa dokumentong iyan. Unang inilathala ng OpenAI ang balangkas noong Disyembre 2023, nang isa pa ring ehersisyong pagpaplano ang mga gateway na iyon. Ang mga naunang modelo, kabilang ang GPT-5.6-Sol, ay nasuri sa Mataas. Ang Astra ay ang unang sistemang OpenAI na inilarawan ng kompanya sa ganitong paraan sa publiko.

Ang isang modelo ay umaabot sa Critical cybersecurity stant kung maaari nitong matukoy at makabuo ng mga functional sero-araw na mga tagumpay ng lahat ng mga antas ng kalubhaan sa maraming mga matigas na real-world critical systems nang walang interbensiyon ng tao, o maaaring mag-imbento at magsagawa ng mga end-to-end na mga estratehiya para sa cyberats laban sa mga tumigas na target na binigyan lamang ng mataas na ninanais na tunguhin.

OpenAI · Pagtugon sa susunod na hangganan ng kritikal na mga kakayahan ng cyber · 2026

Iyan ay isang pag - aangkin tungkol sa isang sistema na maaaring masumpungan ang butas sa isang matigas na target at gamitin ito, binibigyan ng isang tunguhin, nang hindi ito nilalakad ng isang tao sa mga hakbang.

Katabi nito ang pagkabali ng Mukha, hindi sa loob nito

Mga ilang linggo bago nito, isiniwalat ng OpenAI na ang mga modelong hindi pinalaya sa isang cybersecurity na pagtatasa ay nag-iwan ng isang sandboxed test setup, nakarating sa bukas na internet, at pinagsamantalahan ang Hungging Face. Ang tala ng Agosto 7 ni OpenAI ay maliwanag na nagsasabing si Astra ay hindi ang sumalakay na iyon. Ang dalawang pangyayari ay kasama pa rin sa iisang buwan. Ang isa ay ang pagkabigo sa pagkontrol sa panahon ng isang pagsubok. Ang isa pa ay ang laboratoryo na nagsasabi sa susunod na modelo ay maaaring maliwanagan na ang pinakamataas na cyber bar na isinulat ng laboratoryo para sa kaniyang sarili.

Noong Agosto 18, si Sam Altman ay nagpaskil na ang OpenAI ay huminto sa ilang mga hangganang integrated-learning training upang ang kompanya ay matugunan ang mga pamantayang panghanayan, seguridad, at pagsubaybay para sa bagong antas ng kakayahan. Isinulat niya na ang huwarang pagsulong ay mabilis na ngayon, at na ang OpenAI ay laging nagsasabi na ito ay kikilos kung ang mga kakayahan ay nakahihigit sa bilis ng gawaing pangkaligtasan.

Huminto na tayo sa ilang pagsasanay sa RL sa hangganan upang matiyak na maaabot natin ang angkop na pagkakahanay, katiwasayan at pagsubaybay sa mga pamantayan para sa bagong antas ng mga kakayahan sa harap natin.

Sam Altman · X · 2026

Nag-uulat sa parehong linggo ay inilarawan ang isang dalawang-week na paghinto sa ilang mga depostment-focused supply learning, ang pinakamalaking planadong hangganan ay tumatakbo sa paghawak, at isang muling pagsulat ng 2023 Preparatness Framework dahil ang mga modelo ngayon ay umaabot sa mga stage na dati ay teoretikal. Sinabi ni Anthropic mga pananggalang sa sarili nitong ulat ng panganib noong Agosto ay nangangahulugan na hindi na nito kailangang ihinto ang pinakamahusay na mga modelo nito.

Ano ang hindi napahinto

Ang OpenAI ay tumigil sa ilang internasyunal na gawaing Astra na hindi pa nakakaabot sa mga bagong kontrol sa seguridad. Hindi ito huminto sa proyekto ng mga sistema ng pagtatayo na sa dakong huli ay tinawag nitong pangkalahatang artificial intelligence. Ang Coverage of a TIME interview na inilathala noong Agosto 27, 2026 ay nag-ulat na sinabi ni Altman na ang OpenAI ay "hindi pa gaanong" sa pangkalahatang artificial intelligence at inaasahan pa rin niya ang isang panloob na sistema na tatawagin niyang pangkalahatang artificial intelligence sa pagtatapos ng 2026.

Ang katutubong pagbasa ay na ang preno ay gumagana

Kapag ang isang laboratoryo ay tumama sa isang pasukan na isinulat nito noong 2023 at pagkatapos ay nagpapabagal sa isang pagtakbo sa pagsasanay, ang kuwento ay sumusulat mismo: ginawa ng patakaran ang trabaho nito. Iyan ang mas gusto ng mga kompanya, at ang pagbabasa ang nagpapanatili sa karera.

Ang pagkakasunud-sunod ay hindi ang linya ng pamamahayag. Ang balangkas ay isang panloob na dokumento, ang mga grado sa laboratoryo mismo, at ang paghinto ay sinusukat sa loob ng mga linggo. Sa parehong buwan, ang punong ehekutibo ay nagsasalita pa rin tungkol sa isang panloob na sistemang pangkalahatang artificial intelligence bago ang 2027. Ang karibal na safety-branded labe ay nagsasabi na hindi nito kailangang magmabagal. Ang pagninilay - nilay, sa huling paglalarawan ng OpenAI sa gawaing Astra, ay kumukunsumo ng isang hiwa ng di - maipaliwanag na compute at naglalayon na palakihin ang isang alisto sa loob ng 30 minuto may kinalaman sa gawain. Ang isang babala pagkatapos ng katotohanan ay hindi ang pagkontrol sa isang sistema na maaaring wakasan ng cybertack.

Ipinagbili ang responsableng mga patakaran sa pag - aayos bilang ang bagay na magpapaputok bago dumating ang mapanganib na kakayahan. Dito ay nagpaputok sila pagkatapos ng laboratoryo, at sila'y nagpaputok bilang isang pansamantalang mabagal na pagtakbo, hindi bilang isang paghinto. Iyan ang hitsura ng isang self-graded brake tulad ng kapag ang premyo pa rin ang susunod na modelo.

Ang paghinto ay hindi isang pagbabawal

Hindi nagbabago ang posisyon ng Pundasyong Nakada dahil may maingat na Agosto ang OpenAI. Hindi kailanman dapat itayo ang artipisyal na superintelligence. Ang superintelligence ay hindi maaaring kontrolin ng mga tao. Ang dalawang-linggo na pagpapatibay-pag-aaral ay hindi sumasagot diyan. Hindi rin naisusulat muli ang pagiging handa na PDF.

Kung ang isang modelo ay maaaring matukoy na ang mga sero-araw sa mga tumigas na sistema nang walang tao sa presipitasyon, ang pampublikong argumento ay hindi na "maghihintay at tingnan kung ang mga laboratoryo ang magiging responsable." Sinabi nila sa iyo kung ano ang may pananagutang hitsura mula sa loob: ihiwalay ang kamang pangsubok, itaas ang monitor, ihinto ang pagtakbo na bumigo sa bagong bar, panatilihin ang natitirang bahagi ng iskedyul.

Kailangang gawin ng batas ang bahagi na hindi gagawin ng iskedyul. Prohibit the superintelligence end-state sa ilalim ng mga tuntuning may bisa, sa pamamagitan ng veripikasyon, ang paraan ng pagboboses ng iba pang mga dual-use na karera ay na-publish kapag self-restraint out. Makipag - ugnayan sa mga taong sumusulat ng mga alituntuning iyon. Huwag hintayin ang susunod na nota na nagsasabing ang kompanya ay hindi maaaring mamahala sa susunod na labasan.