Pada akhir November 2025, Anthropic menyelesaikan lineup 4.5 nya: berikut model yang lebih kecil dalam keluarga, flagship Claude Opus 4.5 dirilis. Rilis terjadi pada tanggal 25 November, dan perusahaan tidak membuat tulang tentang penonton targetnya - pengembang, tim membangun agen AI, dan siapa pun yang membutuhkan kerja hati-hati dengan "dewasa-up" antarmuka seperti lembar kerja dan dokumen.
Dalam akun resmi Anthropic X, pendatang baru disebut "Model terbaik di dunia untuk coding, agen, dan penggunaan komputer". Apakah pemasaran atau realitas - praktek akan memberitahu, tetapi spesifikasi sendiri menunjukkan di mana perusahaan itu menuju: model memegang konteks jauh lebih baik, berhalusinasi kurang sering, dan menangani rantai panjang tindakan.

Pemrograman: seluruh proyek dalam satu tahap
Model baru kartu trump utama untuk pengembang adalah kemampuan untuk bekerja tidak dengan berkas individu tetapi dengan struktur projek penuh. Model ini dilatih dalam modularisasi, memfaktorkan ulang, dan debug, sehingga dapat memecah tugas ke modul, menghubungkannya dengan impor, dan merakit kerangka aplikasi yang bekerja.
Dalam demo Anthropic, model menghasilkan dasbor React dengan otentikasi, tiga halaman, integrasi API, dan sebuah suite tes - semua dalam satu tahap. Biasanya, jumlah pekerjaan yang mengambil tim beberapa iterasi, di sini, satu permintaan dengan deskripsi persyaratan cukup.
Nilai praktis adalah cepat terlihat dari pekerjaan rutin. Menghasilkan operasi CRUD khas, memfaktorkan kode warisan, dan membuat kerangka layanan dapat dengan aman diserahkan ke model, meninggalkan ulasan kode dan keputusan arsitektur kepada manusia.
Agen: memori antar langkah
Penyakit klasik dari skenario agen awal adalah kehilangan benang penalaran: setelah selusin tindakan, model lupa sumber data dan mulai bertentangan sendiri. Menurut Anthropic, Claude Opus 4.5 mempertahankan keadaan koheren antara aksi, yang berarti para agen dapat melakukan tugas multi- langkah tanpa manual "restart" di setiap tahap.

Contoh buku teks adalah asisten harian yang memindai email masuk, membangun ringkasan tugas, menulisnya ke database di Notion, dan mengirimkan laporan tentang apa yang telah dilakukan. Setiap langkah berikutnya dibangun pada hasil dari yang sebelumnya, dan model tidak memerlukan intervensi di antaranya. Ini adalah langkah penting menuju otomatisasi yang baik tim produk dan departemen efisiensi operasional sedang mengamati.
Perhatian, bagaimanapun, masih dalam rangka: rantai otonom dengan akses ke email dan database harus dilengkapi dengan batas, log, dan berhenti untuk konfirmasi manusia dalam situasi yang bertentangan.
Penggunaan komputer: Excel, presentasi, dan skenario "aplikasi"
Salah satu yang paling menarik arah maju penggunaan komputerModel tidak hanya mengenali isi berkas; ia bekerja dengan mereka seperti manusia: ia menganalisis struktur tabel, mengisi data, membangun grafik, dan menyiapkan bahan berdasarkan kesimpulan yang digambar.
Dalam demo Anthropic, model membuka file Microsoft Excel, mengisi sel hilang, bekerja melalui rumus, membangun grafik, dan kemudian menghasilkan presentasi dengan hasil - termasuk baik-pikir-pikir struktur slide. Pada intinya, ini adalah "data communization report" yang sebelumnya harus dirakit secara manual dari beberapa alat.
Untuk laporan keuangan dan manajemen, skenario seperti itu berarti menabung langsung jam setiap minggu. Anda merumuskan permintaan - Anda mendapatkan lembar kerja lengkap dan presentasi yang hanya perlu disunting untuk mencocokkan gaya perusahaan.

Konteks panjang dan penalaran hati-hati
Fitur notable lain adalah kemampuan untuk memegang benar-benar volume besar teks "dalam pikiran". Tes Anthropic mengutip mengesankan: model ini membaca suatu spesifikasi teknis 100 juta token dan menghasilkan audit keamanan berdasarkan itu - dengan daftar resiko, perbaikan, dan referensi ke bagian tertentu dari dokumen. Secara manual, dokumen tersebut harus dibagi dan dibaca secara terpisah.
Kualitas penalaran juga meningkat: langkah-langkah logika diatur secara berurutan, dan pembagian kesalahan kepercayaan diri telah menurun. Sebagai contoh, ketika menjelaskan derivasi fisika, model memeriksa matematika di setiap langkah bukan hanya beristirahat ide umum. Bagi analis dan mereka yang menggunakan AI dalam pekerjaan dokumen, ini menurunkan beban kognitif: setiap referensi dan perhitungan perlu diperiksa dua kali lebih sering.
Harga dan tabungan
Claude Opus 4.5 diposisikan sebagai alat premium, jadi harganya sesuai premium: $5 per juta token masukan dan $25 per juta token keluaran. Namun, RUU akhir tergantung berat pada skenario - dengan pemrosesan batch dan penggunaan berat dari prompt caching, biaya berulang dan tinggi-volume permintaan tetes jelas.
Jika Anda memiliki permintaan serupa dengan konteks berbagi yang besar (misalnya, prompt sistem panjang atau sebuah corpus dokumen), caching dapat menyimpan sebagian besar anggaran Anda. Untuk tingkat dan syarat yang tepat, yang terbaik untuk memeriksa halaman harga resmi Anthropic - angka-angka ada rinci.
Cara mengganti ke model baru
Migrasi ke Claude Opus 4.5 dari versi sebelumnya tidak memerlukan menulis ulang arsitektur Anda - beberapa langkah hati-hati cukup:
- Pelajari catatan rilis dan changelog API: mereka daftar nama model sekarang dan perubahan apapun untuk meminta parameter.
- Ganti identifier model dalam kode Anda dari nilai lama (misalnya,
claude-4.x) keclaude-opus-4-5-20251101. - Periksa string identifier yang tepat terhadap dokumentasi API atau halaman harga - satu kesalahan karakter akan menyebabkan permintaan ditolak.
- Uji model pada corpus tetap kecil, kemudian jalankan unit dan tes integrasi pada dataset kecil dan membandingkan kualitas keluaran dengan versi sebelumnya.
Penyangga ini tidak membenarkan saklar dalam semua kasus: jika skenario sederhana dan tidak memerlukan konteks yang panjang, model yang lebih kecil dalam keluarga mungkin lebih murah dan lebih cepat. Jadi tahap pengujian wajib, bukan opsional.



