超知能、アライメント、ガバナンス、そして窓口が閉じる前に行動を起こすための政治的努力に関する実質的な文章。
モデルにステップバイステップで考えさせる と、きれいな推論の列が生成されます。それは答えの原因のように見えますが、しばしば後付けの物語であり、その違いが安全上の問題になります。
モデルが人間の評価者に頼る代わりに、書かれた原則のセットに対して自らを評価したらどうだろうか?憲法的AIは本物のステップであると同時に限定的なものでもある。
フロンティアモデルが公開される前に、誰かがそれが兵器の開発に役立つかどうかを確認します。このテストは人工超知能ガバナンスの基幹になりつつあり、だからこそその限界が重要です。
新しい記事、政策更新、行動の機会を、受信箱にお届けします。