CMI News — Persaingan di industri kecerdasan buatan terus memanas. Sejumlah perusahaan seperti OpenAI dan Anthropic berlomba menghadirkan model AI dengan kemampuan yang semakin canggih.

Sekaligus memamerkan hasil pengujian performa untuk menunjukkan keunggulan masing-masing dikutip dari The Guardian Rabu, (6/5/2026).

Platform Tracking AI ikut memperkuat persaingan ini dengan menguji tingkat kecerdasan berbagai model AI menggunakan pendekatan tes IQ.

Visual Capitalist kemudian memvisualisasikan hasil pengujian tersebut dalam infografis yang mudah dipahami.

Dalam pengujian terbaru pada April 2026, Tracking AI menguji 26 model AI menggunakan tes IQ Mensa Norwegia yang berisi 35 soal pola visual.

Metode pengujian ini membedakan model berbasis teks dan multimodal. Model teks menerima soal dalam bentuk deskripsi, sementara model vision mengolah soal dalam format gambar asli.

Hasilnya menunjukkan persaingan yang sangat ketat di papan atas. Grok-4.20 Expert Mode dan GPT-5.4 Pro Vision dari OpenAI sama-sama meraih skor tertinggi, yaitu 145 poin.

Keduanya berbagi posisi puncak sebagai model dengan skor IQ tertinggi dalam pengujian tersebut.

Gemini 3.1 Pro Preview menyusul dengan skor 141, lalu beberapa varian model OpenAI dan Grok lain juga mencatat nilai tinggi.

Tahun sebelumnya hanya mencatat skor tertinggi 135, sehingga peningkatan ini menunjukkan lonjakan yang signifikan.

Model AI asal China juga menunjukkan performa kompetitif. Alibaba mengembangkan Qwen 3.5 dan berhasil membawanya masuk 10 besar dengan skor 130. Selain itu, model seperti DeepSeek R1 dan DeepSeek V3 juga ikut meramaikan daftar.

Beberapa model lain yang masuk dalam daftar antara lain Claude 4.6 Opus, Kimi K2.5, hingga Bing Copilot dan Perplexity.

Dalam proses pengujian, Tracking AI menerapkan aturan khusus untuk menjaga konsistensi.

Jika model menolak menjawab, sistem akan mengulang pertanyaan hingga sepuluh kali dan menggunakan jawaban terakhir sebagai hasil penilaian.

Meski hasil ini memberikan gambaran menarik, para peneliti menekankan bahwa skor IQ tidak sepenuhnya mencerminkan kecerdasan AI secara keseluruhan.

Tes tersebut hanya mengukur kemampuan mengenali pola dan penalaran visual, bukan aspek lain seperti kreativitas, pemahaman konteks, atau kemampuan komunikasi.

Temuan ini tetap menunjukkan satu hal yang jelas perkembangan AI berlangsung sangat cepat, dan persaingan antar perusahaan semakin intens dalam menciptakan model yang lebih cerdas dan efisien.