Teknologi

Gemini 4 Argon Resmi, Tantang GPT-6 Astra

Published

on

Gemini 4 Argon Resmi Meluncur, Tantang GPT-6 Astra di Arena AI

Google resmi memperkenalkan Gemini 4 Argon pada 30 September 2026 sebagai model frontier terbaru dalam keluarga Gemini 4. Model tersebut dirancang untuk menangani pekerjaan kompleks berdurasi panjang, termasuk pengembangan perangkat lunak, riset finansial, pekerjaan hukum, dan pertahanan keamanan siber. Google menyatakan Argon mencatat performa terdepan pada sejumlah evaluasi, tetapi klaim bahwa model ini secara keseluruhan “mengungguli GPT-6 Astra” perlu dibaca berdasarkan benchmark tertentu. Reuters mencatat Argon unggul atas model OpenAI dalam beberapa area, terutama keamanan siber, tetapi masih tertinggal pada sebagian tugas coding.

Kemampuan Baru Gemini 4 Argon

Salah satu daya tarik utama Gemini 4 Argon terletak pada kemampuannya menjalankan alur kerja panjang dan bertahap. Google memberikan batas output hingga satu juta token untuk mendukung pekerjaan yang membutuhkan proses panjang. Dalam pengujian yang dipublikasikan Google, Argon mencatat skor 77,9 persen pada DeepSWE v1.1, 51,3 persen pada AutomationBench, serta 91,7 persen pada LVBench. Kemampuan tersebut membuat model ini diarahkan untuk pekerjaan profesional yang membutuhkan kombinasi penalaran, pemrograman, analisis dokumen, dan pemahaman visual.

Adu Kemampuan dengan GPT-6 Astra

Persaingan menjadi menarik ketika Gemini 4 Argon dibandingkan dengan GPT-6 Astra. Beberapa laporan menyebut Argon mengungguli Astra pada sejumlah benchmark yang dipublikasikan Google. Namun, hasil tersebut tidak berarti Argon otomatis lebih unggul dalam semua jenis pekerjaan. GPT-6 Astra sendiri dirancang untuk penalaran kompleks, coding, computer use, riset, dan pembuatan dokumen profesional. OpenAI melaporkan Astra memperoleh 98 persen pada FrontierMath Tier 4 dan 99,9 persen pada ARC-AGI-3. Dengan kata lain, kedua model menunjukkan kekuatan pada kelompok evaluasi yang berbeda.

Keamanan Siber Menjadi Senjata Utama Argon

Google memberi perhatian besar pada keamanan siber dalam pengembangan model barunya. Argon mampu mencari, memvalidasi, dan membantu memperbaiki kerentanan perangkat lunak. Model tersebut memperoleh skor 68 persen pada CWE-bench v1 dan menunjukkan peningkatan dalam pengujian keamanan internal Google. Karena kemampuan ini juga membawa risiko penyalahgunaan, perusahaan belum membuka akses penuh kepada masyarakat umum. Argon pertama kali diberikan kepada kelompok pertahanan siber tepercaya melalui program Fairwind sambil Google memperkuat sistem pengamanannya.

Persaingan AI Memasuki Babak Baru

Kemunculan Argon menunjukkan bahwa persaingan model AI kini bergerak melampaui chatbot sederhana. Google dan OpenAI sama-sama mengembangkan sistem yang mampu menjalankan pekerjaan profesional panjang, menggunakan perangkat lunak, menganalisis informasi multimodal, dan menyelesaikan rangkaian tugas dengan lebih mandiri. Perbedaannya mulai terlihat pada spesialisasi dan strategi penerapan. Argon menonjolkan pekerjaan jangka panjang dan pertahanan siber, sedangkan Astra menampilkan kemampuan luas dalam computer use, reasoning, sains, coding, dan pekerjaan profesional.

Gemini 4 Argon Belum Tersedia Luas

Meski sudah diumumkan resmi, Gemini 4 Argon belum diluncurkan secara luas kepada konsumen per 3 Oktober 2026. Google menerapkan peluncuran bertahap kepada mitra keamanan siber dan penguji tepercaya sebelum memperluas akses kepada developer, perusahaan, serta konsumen. Karena itu, performa dunia nyata setelah penggunaan meluas nantinya akan menjadi pengujian penting terhadap klaim benchmark yang tersedia sekarang.

Persaingan Tidak Bisa Ditentukan dari Satu Benchmark

Gemini 4 Argon membawa peningkatan besar dan berhasil mencatat hasil kuat pada berbagai evaluasi. Namun, menyebutnya sebagai model yang secara mutlak mengalahkan GPT-6 Astra akan menyederhanakan gambaran yang lebih kompleks. Model AI dapat unggul pada keamanan siber tetapi tertinggal pada coding tertentu, atau sangat kuat dalam computer use tetapi berbeda hasilnya pada pekerjaan lain. Persaingan terbaru justru menunjukkan bahwa industri AI memasuki fase ketika kemampuan khusus, efisiensi, keamanan, dan kinerja dunia nyata sama pentingnya dengan skor benchmark.

Leave a Reply

Your email address will not be published. Required fields are marked *

Trending

Exit mobile version