Anthropic akan menggandeng Accenture untuk melakukan peninjauan independen atas risiko model AI

29 September 202610 tampilan

Dalam lima tahun, perusahaan berencana menginvestasikan setidaknya $2 miliar untuk evaluasi model-model mutakhir, termasuk red-teaming dan pengujian mekanisme perlindungan. Para spesialis Accenture Faculty akan memperoleh akses ke proses internal Anthropic untuk mengidentifikasi kerentanan dan menilai pemenuhan komitmen keamanan.

Anthropic akan menggandeng Accenture untuk melakukan peninjauan independen atas risiko model AI

Besaran dan tujuan investasi

Anthropic dan Accenture berencana menginvestasikan setidaknya $2 miliar selama lima tahun untuk evaluasi independen, red teaming, dan pemeriksaan keamanan model AI canggih.

Masing-masing perusahaan bermaksud mengalokasikan setidaknya $1 miliar untuk mengembangkan kemampuan pengujian keamanan AI dan pengawasan. Ini adalah rencana investasi, bukan konfirmasi bahwa dana tersebut sudah dibelanjakan.

Patokan utama inisiatif ini adalah jumlah minimum yang diumumkan, periode lima tahun, dan tujuan investasi.

Cara evaluasi independen akan dilakukan

Para mitra memilih pendekatan embedded evaluation: evaluator independen akan bekerja di dalam Anthropic. Akses mereka akan sebanding dengan akses karyawan.

Evaluator akan dapat:

  • memeriksa operasional perusahaan dan kepatuhannya terhadap komitmen keamanan;
  • mengidentifikasi titik buta dan melaporkan insiden;
  • memberikan gambaran yang lebih informatif kepada publik tentang manfaat dan risiko.

Kriteria praktis untuk evaluasi ini bukan hanya keterlibatan evaluator eksternal, tetapi juga akses mereka ke operasional perusahaan.

Tugas Accenture Faculty

Bisnis AI khusus Accenture Faculty akan memimpin kemitraan ini. Accenture Faculty akan mengevaluasi dan melakukan red teaming terhadap model Anthropic.

Tugasnya juga mencakup evaluasi kepatuhan dan pengujian mekanisme perlindungan model. Dengan demikian, area kerja spesifik Accenture Faculty dalam kemitraan ini telah ditetapkan.

Mengapa pendekatan ini masih berkembang

Anthropic menyebut embedded evaluation sebagai bidang yang masih berkembang. Perusahaan sedang membahas proyek percontohan dengan organisasi evaluator nirlaba METR dan organisasi lainnya.

Anthropic memperkirakan bahwa seiring waktu, standar umum akan muncul dalam ekosistem evaluasi yang lebih luas. Kemitraan ini terbentuk di tengah meningkatnya perhatian regulator, peneliti, dan pelaku bisnis terhadap perlindungan model yang lebih canggih.

Standar umum di sini disebut sebagai arah yang diharapkan, bukan hasil yang sudah dicapai.

Pertanyaan yang sering ditanyakan

Bahan terkait

Semua bahan
Anthropic akan menggandeng Accenture untuk melakukan peninjauan independen atas risiko model AI