Besaran dan tujuan investasi
Anthropic dan Accenture berencana menginvestasikan setidaknya $2 miliar selama lima tahun untuk evaluasi independen, red teaming, dan pemeriksaan keamanan model AI canggih.
Masing-masing perusahaan bermaksud mengalokasikan setidaknya $1 miliar untuk mengembangkan kemampuan pengujian keamanan AI dan pengawasan. Ini adalah rencana investasi, bukan konfirmasi bahwa dana tersebut sudah dibelanjakan.
Patokan utama inisiatif ini adalah jumlah minimum yang diumumkan, periode lima tahun, dan tujuan investasi.
Cara evaluasi independen akan dilakukan
Para mitra memilih pendekatan embedded evaluation: evaluator independen akan bekerja di dalam Anthropic. Akses mereka akan sebanding dengan akses karyawan.

Evaluator akan dapat:
- memeriksa operasional perusahaan dan kepatuhannya terhadap komitmen keamanan;
- mengidentifikasi titik buta dan melaporkan insiden;
- memberikan gambaran yang lebih informatif kepada publik tentang manfaat dan risiko.
Kriteria praktis untuk evaluasi ini bukan hanya keterlibatan evaluator eksternal, tetapi juga akses mereka ke operasional perusahaan.
Tugas Accenture Faculty
Bisnis AI khusus Accenture Faculty akan memimpin kemitraan ini. Accenture Faculty akan mengevaluasi dan melakukan red teaming terhadap model Anthropic.
Tugasnya juga mencakup evaluasi kepatuhan dan pengujian mekanisme perlindungan model. Dengan demikian, area kerja spesifik Accenture Faculty dalam kemitraan ini telah ditetapkan.
Mengapa pendekatan ini masih berkembang
Anthropic menyebut embedded evaluation sebagai bidang yang masih berkembang. Perusahaan sedang membahas proyek percontohan dengan organisasi evaluator nirlaba METR dan organisasi lainnya.
Anthropic memperkirakan bahwa seiring waktu, standar umum akan muncul dalam ekosistem evaluasi yang lebih luas. Kemitraan ini terbentuk di tengah meningkatnya perhatian regulator, peneliti, dan pelaku bisnis terhadap perlindungan model yang lebih canggih.
Standar umum di sini disebut sebagai arah yang diharapkan, bukan hasil yang sudah dicapai.



