xAI, Anthropic, OpenAI, dan Moonshot AI merilis 4 model Frontier pada bulan Juli

Key Takeaways
  • xAI, Anthropic, OpenAI, dan Moonshot AI masing-masing merilis model AI frontier pada Juli 2026 yang ditujukan untuk menyelesaikan tugas berdurasi beberapa jam.
  • Grok 4.5 berbiaya $2 untuk input dan $6 untuk output per 1 juta token, lebih dari 60% lebih rendah dibanding Claude Opus 4.8 dan GPT-5.5.
  • Moonshot AI berkomitmen untuk mempublikasikan bobot terbuka penuh Kimi K3 pada 27 Juli setelah merilis model berparameter 2,8 triliun pada 16 Juli.

xAI, Anthropic, OpenAI, dan Moonshot AI merilis empat model AI frontier dalam tiga minggu pada Juli 2026. xAI mengirim Grok 4.5 pada 8 Juli, Anthropic merilis Claude Opus 5 pada 24 Juli, OpenAI memindahkan GPT-5.6 ke ketersediaan umum pada 9 Juli, dan Moonshot AI memublikasikan Kimi K3 pada 16 Juli. Setiap model menargetkan penyelesaian tugas berdurasi multi-jam—mulai dari riset hingga coding hingga pelaporan terstruktur—tanpa kehilangan jejak rencana eksekusi. Keempatnya memiliki context window 500.000 token atau lebih, dengan tiga di antaranya mencapai 1 juta token, sehingga satu sesi dapat memproses repositori kode lengkap atau kumpulan dokumen.

xAI Rilis Grok 4.5 dengan Data Pelatihan Cursor

xAI merilis Grok 4.5 pada 8 Juli. Model ini berjalan pada basis 1,5 triliun parameter dan dilatih sebagian dengan data penggunaan nyata dari Cursor, platform coding yang SpaceXAI akuisisi lebih awal tahun ini. Harga ditetapkan pada $2 per 1 juta token input dan $6 per 1 juta token output, dengan context window 500.000 token. Elon Musk menggambarkan Grok 4.5 sebagai model kelas Opus yang berjalan lebih cepat dan dengan biaya lebih rendah. Pelacak independen menempatkannya di peringkat keempat pada Artificial Analysis Intelligence Index, di depan setiap model open weight, dengan harga lebih dari 60% lebih rendah daripada Claude Opus 4.8 dan GPT-5.5. Pada Terminal-Bench 2,1, pengujian yang menilai seberapa baik sebuah model menyelesaikan tugas rekayasa command-line, Grok 4.5 mencetak 83,3%. xAI mengatakan model ini membutuhkan sekitar seperlima dari token output yang Opus 4.8 perlukan untuk tugas yang sebanding.

Elon X post screenshot.

OpenAI Luncurkan GPT-5.6 dengan Struktur Harga Tiga Tingkat

OpenAI memindahkan GPT-5.6 ke ketersediaan umum pada 9 Juli setelah preview dua minggu yang dibatasi untuk sekitar 20 organisasi yang divetting oleh pemerintah AS, menyusul perintah eksekutif yang terkait peninjauan keselamatan model frontier. Keluarga ini dikirim dalam tiga tingkatan: Sol, unggulan dengan harga $5 untuk input dan $30 untuk output per 1 juta token; Terra, model mid-tier dengan harga $2,50 dan $15 yang dikatakan OpenAI cocok dengan GPT-5.5 dengan biaya setengah; dan Luna, tingkatan cepat berbiaya rendah dengan harga $1 dan $6. OpenAI melaporkan Sol memimpin Artificial Analysis Coding Agent Index dan mencapai 88,8% pada Terminal-Bench 2,1, naik menjadi 91,9% ketika model menjalankan empat sub-agent secara paralel dalam mode ultra terbarunya. Ketiga tingkatan membawa peringkat risiko internal tertinggi OpenAI untuk potensi penyalahgunaan siber dan biologis.

OpenAI X post screenshot.

Anthropic Kirim Claude Opus 5 sebagai Max Model Default

Anthropic merilis Claude Opus 5 pada 24 Juli, memposisikannya sebagai model yang mendekati performa Claude Fable 5 dengan setengah harga Fable sebesar $10 untuk input dan $50 untuk output. Opus 5 membawa harga $5 untuk input dan $25 untuk output yang sama seperti pendahulunya, Opus 4.8. Model ini dikirim dengan context window 1 juta token, 128.000 token output maksimum, dan pengaturan effort penalaran yang dapat disesuaikan dengan rentang dari rendah hingga mode xhigh baru. Anthropic mengatakan Opus 5 mencetak capaian baru di Frontier-Bench dan GDPval-AA, dua evaluasi untuk coding dan pekerjaan berbasis pengetahuan, meski tertinggal dari model Claude Mythos 5 yang dibatasi pada tugas keamanan siber. Opus 5 kini menjadi model default di Claude Max dan opsi terkuat di Claude Pro.

Claude X post screenshot.

Moonshot AI Publikasikan Kimi K3 sebagai Model Open-Weight Terbesar

Moonshot AI merilis Kimi K3 pada 16 Juli, model mixture of experts dengan 2,8 triliun parameter, 896 total expert, dan 16 active per task. Model ini memiliki context window 1 juta token dan native multimodal input, dengan harga API $3 untuk input dan $15 untuk output per 1 juta token. Moonshot telah berkomitmen untuk memublikasikan full open weights pada 27 Juli. K3 adalah model open-weight terbesar yang dirilis hingga saat ini, kira-kira 75% lebih besar daripada model open terbesar sebelumnya yang paling banyak digunakan. Pelacak independen menempatkan K3 di peringkat keempat di antara sistem frontier yang ada, di belakang Claude Fable 5 dan GPT-5.6 Sol, namun di depan Claude Opus 4.8.

Kimi Moonshot X post screenshot.

Extended Context Windows Memungkinkan Pemrosesan Satu Repositori Penuh

Context window di bawah 200.000 token sebelumnya memaksa pengembang untuk memecah basis kode besar atau paket riset menjadi fragmen. Setiap model dalam grup ini kini berjalan pada 500.000 token atau lebih, dengan tiga dari empat mencapai 1 juta, sehingga satu sesi bisa menampung satu repositori penuh atau tumpukan dokumen sumber utama. Sistem dari periode 2023 dan 2024 sering kehilangan rencana setelah beberapa kali pemanggilan tool. Model yang dirilis bulan ini dibangun untuk mempertahankan puluhan langkah terkoordinasi dan pulih ketika pemanggilan tool mengembalikan data buruk, alih-alih macet. Kontrol effort di Opus 5, harga bertingkat di GPT-5.6, dan klaim efisiensi di balik Grok 4.5 mengarah pada tujuan yang sama: memungkinkan tim memilih seberapa banyak komputasi yang layak untuk sebuah tugas, alih-alih membayar harga flagship untuk setiap permintaan. Rilis GPT-5.6 yang dibatasi pemerintah menandakan bahwa pengawasan kini tertanam dalam jadwal rilis untuk model-model terbesar. Suspensi akses Fable dan Mythos yang singkat namun diarahkan pemerintah oleh Anthropic pada Juni adalah versi lebih awal dari pola yang sama.

FAQ

Apa kesamaan dari empat model AI yang dirilis pada Juli 2026?

Grok 4.5, Claude Opus 5, GPT-5.6, dan Kimi K3 semuanya menargetkan penyelesaian tugas berdurasi multi-jam—mulai dari riset hingga coding hingga pelaporan terstruktur—tanpa kehilangan jejak rencana eksekusi. Setiap model memiliki context window minimal 500.000 token, dengan tiga di antaranya mencapai 1 juta token, sehingga satu sesi dapat memproses repositori kode penuh atau kumpulan dokumen tanpa fragmentasi.

Mengapa OpenAI merilis GPT-5.6 lewat preview yang dibatasi pemerintah?

OpenAI memindahkan GPT-5.6 ke ketersediaan umum pada 9 Juli setelah preview dua minggu yang dibatasi untuk sekitar 20 organisasi yang divetting oleh pemerintah AS, menyusul perintah eksekutif yang terkait peninjauan keselamatan model frontier. Ketiga tingkatan GPT-5.6 membawa peringkat risiko internal tertinggi OpenAI untuk potensi penyalahgunaan siber dan biologis, yang memicu peninjauan tambahan.

Bagaimana perbandingan harga Grok 4.5 dengan Claude Opus 4.8?

Grok 4.5 dibanderol $2 per 1 juta token input dan $6 per 1 juta token output, lebih dari 60% lebih rendah daripada Claude Opus 4.8 dan GPT-5.5. xAI mengatakan model ini membutuhkan sekitar seperlima dari token output yang Opus 4.8 perlukan untuk tugas yang sebanding, yang menurunkan biaya menjalankan sesi agen jangka panjang.

Penafian: Informasi di halaman ini mungkin berasal dari sumber pihak ketiga dan hanya untuk referensi. Ini tidak mewakili pandangan atau pendapat Gate dan bukan merupakan nasihat keuangan, investasi, atau hukum. Perdagangan aset virtual melibatkan risiko tinggi. Mohon jangan hanya mengandalkan informasi di halaman ini saat membuat keputusan. Untuk detailnya, lihat Penafian.
Komentar
0/400
Tidak ada komentar