Antropik memperkenalkan Claude Sonnet 5: fitur agentic menjadi lebih mudah diakses

5 Juli 20265 tampilan

Model baru Anthropic mendekati kemampuan kapal terbang Opus 4.8, tapi biayanya kurang. Hal ini telah menjadi standar untuk subscriptions gratis dan Pro, dan pengembang dapat menghemat agen berjalan berkat harga sementara.

Antropik memperkenalkan Claude Sonnet 5: fitur agentic menjadi lebih mudah diakses

Kemampuan Agentik menjadi dasar

Anthropic telah secara resmi memperkenalkan Claude Sonnet 5 - versi baru dari model paruh baya yang membuat mengalir agentic diakses ke kisaran lebih luas pengguna. Menurut perusahaan, model dapat secara independen membuat rencana, menggunakan peramban dan terminal, dan menyelesaikan tugas tanpa pengawasan konstan - tingkat otonomi yang sampai baru-baru ini diperlukan flagship dan solusi mahal. Dengan rilis Sonnet 5, jelas bahwa fitur agentic tidak lagi hak prerogatif model top-tier dan menjadi standar untuk setiap segmen harga. Kompetisi sekarang beralih menuju harga dan keandalan, bukan hanya kehadiran "agentic" kemampuan.

Penampilan dan harga

Para pengembang berjanji bahwa Claude Sonnet 5 memberikan hasil dekat dengan Opus 4.8, tetapi dengan biaya yang jauh lebih rendah. Mulai 30 Juni, model menjadi model baku dalam rencana bebas dan Pro, dan juga tersedia dalam semua subscriptions. Pada peluncuran, harga khusus berlaku: $2 per juta token masukan dan $10 per juta token keluaran sampai 31 Agustus, setelah itu harga akan naik menjadi $3 dan $15, secara hormat.

Menurut Anthropic, model baru ini secara signifikan mengalahkan pendahulunya - Sonnet 4.6, dirilis pada bulan Februari - dengan alasan, menggunakan alat, menulis kode, dan bekerja pengetahuan. Pada kode benchmark agentic, Sonnet 5 skor 63,2%, sedangkan Opus 4.8 skor 69,2% dan Sonnet 4.6 skor 58.1%. Pada saat yang sama, dalam tes pengetahuan, Sonnet 5 bahkan sedikit penampilan Opus 4.8. Antropik menekankan bahwa Opus 4.8 tetap pilihan untuk akurasi maksimum, tetapi Sonnet 5 memberikan pengembang jauh lebih rendah pilihan biaya. Pengguna dapat menyesuaikan tingkat usaha antara dua model, memilih keseimbangan yang tepat kinerja dan anggaran.

Dalam hal harga, Sonnet 5 lebih murah daripada GPT-5.5 dari OpenAI dan Gemini 3.1 Pro dari Google, tapi lebih mahal dari Gemini 3.5 Flash.

Kesan keselamatan dan pengembang

Testers whose feedback Anthropic cites that Claude Sonnet 5 is better at carry complex tasks through to completion, while before version often stopped half. Model juga memeriksa hasilnya sendiri, bahkan ketika tidak diminta. Sebagai contoh, Daniel Shepard, seorang insinyur senior di Zapier, mengatakan bahwa Sonnet 5 menyelesaikan tugas dua-bagian dari awal sampai akhir: itu update account dalam Saleforce dan mengirim pengumuman untuk kontak perusahaan. Sebelumnya, menurut dia, skenario serupa akan "terjebak".

Adapun keamanan, model baru menunjukkan perilaku yang tidak diinginkan kurang sering: lebih baik menolak permintaan berbahaya, lebih tabah untuk menanyakan suntikan, berhalusinasi kurang sering, dan kurang rentan untuk sycophancy dibandingkan dengan Sonnet 4.6. Pada saat yang sama, itu masih jejak Opus 4.8 dan Claude Mythos Pratilik dalam kemampuannya untuk melawan perilaku misaligned. Antropik juga mencatat bahwa Sonnet 5 memiliki kemampuan yang lebih rendah untuk melakukan tugas keamanan cyber yang berbahaya daripada model Opus saat ini. Fabian Hedin, pendiri Lovable, menegaskan bahwa Claude Sonnet 5 "bersih dan secara konsisten menolak permintaan yang tidak aman".

Pertanyaan yang sering ditanyakan

Claude Sonnet 5 - ulasan model Anthropic baru dengan harga