ChatGPT, Claude, dan Gemini Diuji soal Informasi Terbaru, Hasilnya Beda Tipis

ChatGPT, Claude, dan Gemini Diuji soal Informasi Terbaru, Hasilnya Beda Tipis

LITERASIKEUANGAN.COM — Sebagian model AI terbesar saat ini masih menyimpan informasi yang sudah usang, bahkan ketika fitur pencarian web diaktifkan. Pengujian terhadap ChatGPT, Claude, dan Gemini menunjukkan selisih pengetahuan yang bervariasi, tergantung kapan data pelatihan masing-masing model dipotong. Perbedaan ini berimbas langsung pada akurasi jawaban yang diterima pengguna sehari-hari.

Peluncuran model AI baru tidak otomatis berarti model tersebut mengetahui peristiwa terbaru. Ada jeda antara kapan sebuah model dirilis dan kapan data pelatihannya berakhir. Jeda inilah yang menentukan seberapa "segar" pengetahuan sebuah chatbot.

Pengujian sederhana terhadap tiga chatbot terbesar — ChatGPT, Claude, dan Gemini — memperlihatkan perbedaan mencolok. Setiap model diberi pertanyaan yang sama soal peristiwa dan produk terbaru, dengan fitur pencarian web aktif.

iPhone Terbaru: Dua Benar, Satu Tertinggal

ChatGPT dan Gemini kompak menyebut iPhone 18 Pro, iPhone 18 Pro Max, dan iPhone Duo sebagai model terbaru Apple. Ketiganya diumumkan dalam acara keynote bertajuk "Surprise and Shine".

Apple tahun ini melewati iPhone 18 versi standar dan langsung fokus ke lini premium. Kedua chatbot juga mengetahui bahwa iPhone Duo, perangkat lipat pertama Apple, mulai dijual di toko pada 23 Oktober.

Claude berbeda. Model ini masih menyebut iPhone 17 sebagai perangkat terbaru Apple. Jawaban itu menunjukkan data pelatihannya belum mencakup peluncuran terakhir.

Model Claude Terbaru: Jawaban Justru Melenceng

Pertanyaan soal model flagship terbaru Anthropic menguji kategori yang bergerak sangat cepat. ChatGPT menjawab benar: Claude Fable 5.1, dirilis September 2026.

Yang mengejutkan, Claude 4.6 tidak mengenali Claude Fable 5.1 sebagai model yang tersedia untuk publik. Model itu menyebut Claude Opus 5 sebagai flagship terbaru, disertai Claude Sonnet 5 dan Claude Haiku 4.5.

Claude 4.6 memang menyebut keberadaan lini Mythos, termasuk Claude Mythos 5.1 dan Claude Fable 5.1. Namun ia menyatakan model tersebut belum tersedia luas dan hanya dipakai sejumlah organisasi terpercaya lewat Project Glasswing.

Gemini juga salah menjawab. Model ini menyebut Claude Opus 5 dan Mythos 5 sebagai yang terbaru.

Piala Dunia 2026 dan Siri AI: Semua Sepakat

Ketiga chatbot menjawab benar soal juara Piala Dunia 2026. Masing-masing bahkan menyebut detail pertandingan, termasuk gol kemenangan Ferran Torres.

Claude menambahkan informasi soal sapu bersih penghargaan individu Spanyol. Rodri meraih Golden Ball, Unai Simón mendapat Golden Glove, dan Pau Cubarsí dinobatkan sebagai Pemain Muda Terbaik.

Soal fitur baru Siri di iOS 27, ketiganya juga sepakat: Siri AI. Claude menyebutnya sebagai versi Siri mirip ChatGPT yang bisa menjawab hampir semua hal. Menarik, karena model yang sama tidak mengetahui keberadaan iPhone 18.

Google Home dan Integrasi AI Pihak Ketiga

Gemini dan ChatGPT mengetahui bahwa Google Home kini mendukung integrasi AI pihak ketiga. Claude tidak mengetahuinya.

Padahal dokumentasi Google Home soal MCP Home bahkan menyebut Claude di dalamnya. Ini memperlihatkan bahwa keterbatasan pengetahuan tidak selalu soal jarak waktu, tapi juga cakupan data pelatihan.

Pelajaran yang Bisa Diambil

Bahkan dengan pencarian web aktif, Claude tidak selalu mendapat informasi dasar yang terbaru. Ini penting dicatat karena model AI baru bermunculan sangat cepat.

Peluncuran model baru kerap disalahartikan sebagai tanda pengetahuan yang lebih segar. Padahal tanggal rilis model dan tanggal berakhirnya data pelatihan adalah dua hal berbeda.

Pencarian web memang bisa menutup celah itu. Tapi syaratnya, AI harus tahu bahwa dirinya perlu mencari. Dalam banyak kasus, model tidak menyadari bahwa pengetahuannya sudah usang.

Kesimpulannya sederhana: verifikasi fakta dari AI tetap wajib. Model tercanggih sekalipun belum tentu mengetahui informasi terkini.

Rekomendasi

Index

Berita Lainnya

Index