Claude Opus 4.7 Resmi Meluncur, Lebih Canggih, Tapi Kalah dari Mythos Preview
- Anthropic
VIVATechno – Anthropic akhirnya resmi meluncurkan Claude Opus 4.7, model AI terbaru mereka yang hadir sebagai peningkatan nyata dari Opus 4.6 — sekaligus jadi cara perusahaan mengingatkan publik bahwa ada sesuatu yang jauh lebih canggih menunggu di balik pintu yang belum dibuka sepenuhnya.
Diumumkan pada Kamis, 16 April 2026, iterasi terbaru dari lini flagship ini datang dengan lompatan performa yang cukup mencolok di area yang selama ini sudah jadi keunggulan mereka: coding, engineering, dan tugas-tugas kompleks berlapis.
Perusahaan mengklaim model ini jauh lebih konsisten saat menangani pekerjaan sulit, dengan hasil yang lebih andal di ranah professional knowledge work.
Highlights:
- Anthropic merilis Claude Opus 4.7 pada 16 April 2026, tersedia di semua produk dan API tanpa kenaikan harga
- Peningkatan signifikan pada kemampuan coding, engineering, dan multi-step task dibanding versi sebelumnya
- Merebut posisi teratas agentic coding dengan skor 64,3% di SWE-bench Pro dan SWE-bench Verified
- Performa keamanan siber sedikit menurun (73,1% vs 73,8%) karena penambahan sistem safeguard otomatis
- Secara terang-terangan disebut Anthropic sebagai model yang "kurang kapabel" dibanding Claude Mythos Preview
- Mythos Preview masih dibatasi aksesnya hanya untuk organisasi tertentu karena dianggap terlalu kuat
Agentic Coding Kini di Posisi Teratas
Salah satu pencapaian paling konkret dari pembaruan model AI 2026 ini adalah posisi barunya di benchmark agentic coding.
Model terbaru Anthropic berhasil merebut kembali posisi pertama di antara model-model yang tersedia untuk publik, dengan skor 64,3% di SWE-bench Pro dan SWE-bench Verified — dua tolok ukur utama yang mengukur kemampuan model dalam menyelesaikan tugas engineering yang rumit.
Selain itu, ada peningkatan di kemampuan agentic computer use — yakni kemampuan model untuk secara mandiri menavigasi sistem operasi dan menyelesaikan tugas tanpa panduan langkah per langkah dari pengguna. Kemampuan penalaran tingkat lanjut juga turut diperbaiki.
Satu Catatan: Performa Keamanan Siber Sedikit Turun
Tidak semua metrik bergerak ke atas. Di area cybersecurity vulnerability reproduction, modelnya justru mencatat sedikit penurunan — dari 73,8% di versi sebelumnya menjadi 73,1%. Ini bukan tanpa alasan.
Anthropic menyebutkan bahwa mereka menambahkan sistem perlindungan otomatis yang mendeteksi dan memblokir permintaan dengan potensi penyalahgunaan siber. Jadi, penurunan skor ini lebih merupakan trade-off yang disengaja ketimbang kemunduran teknis.