Báo cáo rủi ro ngày 2026 tháng 8 là 186 trang của phòng thí nghiệm tự chấm điểm. Ngày đưa tin là 15 tháng 7. Dưới phiên bản 3.4 của chính sách trang điểm chịu trách nhiệm của công ty, đánh giá tổng thể về rủi ro sai lầm nghiêm trọng di chuyển từ tầng trước xuống thấp. Lý do được đưa ra là sự không chắc chắn sau khi sự kiện an ninh mạng gần đây tiết lộ, cộng với những dấu hiệu ban đầu cho thấy các mô hình đang tăng tốc tại các nghiên cứu và kỹ thuật tự động, chứ không phải một bằng chứng mới về sự thẳng hàng bên trong.
Bạn có thể bỏ lỡ nó nếu bạn chỉ muốn tiêu đề rằng thi thể là một sự cẩn thận. Đọc lại đi. Phòng thí nghiệm được thiết kế an toàn đã tự nâng nhãn hiệu nguy hiểm lên và, trong cùng một tài liệu, nói rằng nó không làm chậm phát triển tổng thể.
Mô hình 2 đang làm việc
Báo cáo nêu tên một hệ thống lớp học bí mật, Model 2. Nó được mô tả là một sự cải tiến đáng chú ý về Mythos 5 cho nhiều công việc nội bộ, khoảng 1.5 điểm cao hơn trong chỉ số năng lực cá nhân của công ty, và không phải là một bước nhảy trên thang điểm của Opus 4.6 đến Mythos. Không có kế hoạch hiện tại để thả nó. Phòng khám nghiệm đầy đủ chưa được điều hành, nên công ty tự tin vào những gì nó có thể làm ít hơn so với phòng 5 của Mythos.
Ở Cobench, 449 vấn đề kỹ thuật thực sự được giải quyết phần lớn từ các vấn đề của các nhân viên EAnthropic sau này, Model 2 điểm 62,8 phần trăm. Mythos 5 điểm 50,3%. Xem thử Mythos đạt 54.8 phần trăm. Theo ước tính của tôi, một hệ thống có thể đứng lên cho các nhân viên nghiên cứu của nó cần ít nhất 85 phần trăm. Mô hình 2 không phải là hệ thống đó. Nó đã đóng một khoảng trống gồm hai chữ số vào nhà vô địch nội bộ cuối cùng trong một hop, trên bài tập về nhà của phòng thí nghiệm.
Mythos 5 và Model 2 được sử dụng rộng rãi cho việc nghiên cứu và kỹ thuật bên trong Anthropic, cả hai đều tương tác và thông qua các đặc vụ kiên trì triển khai; vội vàng, bây giờ là một phần lớn các tác giả của mã đã nhập vào cơ sở sản xuất của chúng tôi.
Anthropic · Risk Report August 2026
Cái gậy dùng hết rồi.
Trên hệ thống điều hành tự động, báo cáo vẫn cho thấy mức độ rủi ro chung thấp. Sau đó, nó nói rằng công ty ít tự tin hơn trong đánh giá đó hơn so với các báo cáo trước, bởi vì các đánh giá dựa trên các nhiệm vụ cụ thể nhất đã được bão hòa. Chúng không còn nắm bắt được khả năng gia tăng nữa. Phòng thí nghiệm cũng thấy những dấu hiệu sớm của gia tốc.
Một thử nghiệm không thể thấy bước nhảy tiếp theo là một điểm mù có gắn số người. Không thể thay thế một phần của căn phòng cũ bằng Cobech, ít nhất là một tập hợp các vấn đề nội bộ. Thậm chí ở đó, thanh thay thế nhân viên nằm ở 85 phần trăm, và Model 2 đã ở 62.8 mà không có tên công chúng.
Giữ mô hình 2 không giống với việc giữ một mô hình mạnh hơn trong cuộc đua. Báo cáo nói rằng hai hệ thống mạnh nhất đã được sử dụng nội bộ nặng, bao gồm các đặc vụ điều hành liên tục. Mật mã mà tàu bè, theo lời nói của công ty, bây giờ hầu hết được viết bởi UClaude.
Người đọc là phòng thí nghiệm cẩn thận đã giữ dòng
Không có tàu Model 2. Nó xuất bản một báo cáo dài và nâng cao tính từ rủi ro. Trong cùng tháng 8, OpenAI đã tạm dừng một số huấn luyện biên giới sau Astra, và Anthropic Anthropic nói rằng hệ thống bảo vệ của nó có nghĩa là nó không cần phải dừng lại. Từ bên ngoài, nó giống như người lớn giám sát. Từ bên trong tài liệu, nó trông giống như một công ty không còn có thể đo lường được thứ mà nó đang phát triển, sử dụng hệ thống mạnh mẽ hơn trên công việc của nó, và giảm dần để làm chậm công việc.
Động cơ giải thích điều này mà không có kẻ xấu. Một phòng thí nghiệm dừng lại trong khi một đối thủ không mất mô hình tiếp theo, hợp đồng tiếp theo, đánh giá tiếp theo. Chính sách tự cấp được xây dựng để sống sót trước áp lực đó. Họ đưa ra báo cáo, ẩn danh, và một bước di chuyển từ tầng một xuống thấp. Chúng không dừng lại.
Nâng cao luật pháp, không phải tính từ
Tổ chức Nakada không xem tỷ lệ rủi ro trong nhà cao hơn là giải pháp. Không bao giờ nên xây dựng sự siêu thông minh nhân tạo. Con người không thể kiểm soát sự siêu thông minh. Nếu các nhân viên viết mã đã xem Claude của nó viết hầu hết, vai trò còn lại của con người là một bước đánh giá thu hẹp lên một hệ thống mà các xét nghiệm không thể thấy rõ ràng.
Hãy xuất bản những bản đánh giá nếu cô muốn. Giữ lại cân nặng nếu anh muốn. Cũng không thể thay thế cho một lệnh cấm ràng buộc. Báo cáo tháng 8 rất hữu ích vì nó thẳng thắn. Hãy coi đó là bằng chứng chứ không phải sự an ủi.