Ang August 2026 Risk Report ni Anthropic ay 186 na pahina ng isang laber grading mismo. Ang petsa ng pagsaklaw ay Hulyo 15. Sa ilalim ng bersyon 3.4 ng Responsibilidad Scaling Policy ng kompanya, ang pangkalahatang pagtasa ng kapaha-pahamak na panganib ng maling pag-uuri ay lumipat mula sa nauna nitong rating ng sahig tungo sa mababa. Ang dahilang ibinigay ay walang katiyakan pagkatapos isiwalat ng kamakailang cybersecurity na insidente, pati na ang mga unang palatandaan na pinabibilis ng mga modelo ang awtomatikong pananaliksik at inhinyeriya, hindi isang bagong katibayan ng panloob na pagkakahanay.

Maaari mong palampasin ito kung nais mo lamang ng ulong balita na ang Anthropic ang maingat pa rin. Basahin mo uli. Ang safety-branded labe ay nagtaas ng sarili nitong kapaha-pahamak na-risk label at, sa parehong dokumento, ay nagsabi na ito ay hindi mabagal na pag-unlad sa kabuuan.

Ang modelo 2 ay gumagana na

Binanggit ng ulat ang pangalan ng isang di - pinalayang sistemang Mythos-class, Model 2. Inilarawan ito ng Anthropic bilang isang kapansin-pansing pagpapabuti sa Mythos 5 para sa maraming mga panloob na gawain, mga 1.5 puntos na mas mataas sa pansariling indise ng kakayahan ng kompanya, at hindi isang pagtalon sa sukat ng Opus 4.6 sa Mythos. Walang kasalukuyang plano na ilabas ito. Ang buong predeployment suite ay hindi pa tumatakbo, kaya ang sariling tiwala ng kompanya sa kung ano ang magagawa nito ay mas mababa kaysa sa Mythos 5.

Sa CoBench, 449 na tunay na mga problema sa inhinyeriya na kinuha pangunahin na mula sa mga labas na Anthropic ang mga tauhan ng , Model 2 ay nakakuha ng 62.8 porsiyento. Ang mga alamat 5 ay naglalaman ng 50.3 porsiyento. Ang Mythos Preview ay nakakuha ng 54.8 porsiyento. Ang mismong tantiya ni Anthropic ay na ang isang sistemang nakakapanindigan para sa mga tauhan nito sa pananaliksik ay mangangailangan ng hindi bababa sa 85 porsiyento. Ang modelo 2 ay hindi ang sistemang iyon. Isinara nito ang double-digit na puwang sa huling panloob na kampeon sa isang hop, sa sariling araling-aral ng laboratoryo.

Ang Mythos 5 at Model 2 ay malawakang ginagamit para sa pananaliksik at inhenyeriya sa loob ng Anthropic, parehong interactively at sa pamamagitan ng patuloy na agent deprigments; Claude ngayon ang mga awtor ng isang malaking karamihan ng code ay nagsanib sa ating mga codebase sa produksiyon.

Anthropic · Risk Report August 2026

Ginamit ng yardstick ang kaniyang sarili

Sa awtomatikong AI R&D, tinataya pa rin ng ulat na ang pangkalahatang panganib ay mababa. Pagkatapos ay sinasabi nito na ang kompanya ay hindi gaanong nagtitiwala sa rating na iyon kaysa sa mga naunang ulat, dahil sa ang pinaka-tiyak na task-based na mga pagtatasa. Hindi na sila kumukuha ng karagdagang kakayahan. Nakikita rin ng laboratoryo ang maagang mga palatandaan ng bilis.

Ang isang pagsubok na hindi makita ang susunod na pagtalon ay isang bulag na lugar na may nakakabit na numero. Pinalitan ng Anthropic ang bahagi ng lumang suite sa CoBench, na kahit papaano ay isang set ng tunay na panloob na mga problema. Kahit na doon, ang kapalit-for-staff bar ay nakaupo sa 85 porsiyento, at ang Model 2 ay nasa 62.8 na walang pampublikong pangalan.

Kung ano ang hindi ginagawa ng nakaw

Ang pag-iingat ng Modelo 2 sa API ay hindi katulad ng pagpapanatili ng mas malakas na modelo sa labas ng karera. Sinasabi ng ulat na ang dalawang pinakamalakas na sistema ay ginagamit na nang husto, kasali na ang mga ahente na patuloy na tumatakbo. Ang kodigo na ang mga barko, ayon sa salita ng kompanya, ay karamihang isinulat ngayon ng Claude.

Ang katutubong mambabasa ay na ang maingat na laboratoryo ang may hawak ng hangganan

Ang Anthropic ay hindi nag-ebolb ng Model 2. Inilathala nito ang isang mahabang ulat at itinaas ang isang pang - uri ng panganib. Noong Agosto ring iyon, Huminto ang openAI sa ilang pagsasanay sa hangganan pagkatapos ng Astra, at sinabi ng Anthropic na ang sariling mga pananggalang nito ay nangangahulugang hindi na kailangan pang huminto. Mula sa labas, iyan ay parang pangangasiwa ng adulto. Mula sa loob ng dokumento, ito'y parang isang kompanya na hindi na kayang sukatin ang bagay na ito ay bumabagtas, ginagamit ang mas malakas na sistema sa sarili nitong trabaho, at humihina upang pabagalin ang trabaho.

Ipinaliliwanag ito ng incentives nang walang kontrabida. Ang isang laboratoryo na humihinto samantalang ang isang karibal ay hindi nawawalan ng susunod na modelo, ang susunod na kontrata, ang susunod na pagpapahalaga. Ang mga patakarang self-grad ay itinatayo upang makaligtas sa presyon na iyon. Naglalabas sila ng mga ulat, mga hindi ibinigay na pangalan, at isang one-notch na paglipat mula sa nauna nitong rating ng sahig hanggang sa mababa. Hindi ito humihinto.

Itaas ang batas, hindi ang pang - uri

Ang Pundasyong Nakada ay hindi kumukuha ng mas mataas na in-house na rating ng panganib bilang lunas. Hindi kailanman dapat itayo ang artipisyal na superintelligence. Ang superintelligence ay hindi maaaring kontrolin ng mga tao. Kung ang mga kawani na sumusulat ng kodigo ay nanonood na ng Claude ang sumulat ng karamihan nito, ang natitirang papel ng tao ay isang lumiliit na hakbang ng review sa isang sistema ang mga pagsubok ay hindi na malinaw na makikita.

Prituhin ang mga eval kung gusto mo. Hawak - hawak ang mga pabigat kung gusto mo. Hindi rin ito isang kahalili para sa isang pagbabawal na may bisa. Ang ulat ng Agosto ay kapaki - pakinabang sapagkat ito ay prangka. Ituring mo ang katapatan bilang katibayan, hindi bilang kaaliwan.