AI Catat Sejarah dengan Markah Penuh di IMO
Kecerdasan buatan (AI) telah mencapai satu kejayaan bersejarah dengan memperoleh markah penuh di Olimpiad Matematik Antarabangsa (IMO) buat pertama kalinya. Dua syarikat teknologi China, Huawei dan Xiaohongshu, mengumumkan bahawa model AI mereka masing-masing mencapai 100 peratus dalam soalan yang sama diberikan kepada peserta manusia pada IMO bulan ini di Shanghai.
Menurut kenyataan Xiaohongshu, ini adalah kali pertama model bahasa besar mencapai markah penuh di bawah proses penilaian rasmi IMO. Sebelum ini, pada tahun 2025, model buatan Google dan OpenAI mencapai tahap pingat emas tetapi tidak dapat menandingi lima peserta manusia yang mendapat markah penuh.
Persaingan Sengit di IMO 2026
Tahun ini, seramai 666 peserta dari pelbagai negara mengambil bahagian di IMO yang diadakan di Shanghai. Bagaimanapun, hanya tujuh orang peserta manusia berjaya mencapai markah penuh, menurut papan skor rasmi IMO. IMO memerlukan peserta berusia di bawah 20 tahun.
Huawei mengumumkan bahawa sistem AI mereka, "Celia", menunjukkan keupayaan menyelesaikan masalah yang komprehensif dalam beberapa bidang matematik. Xiaohongshu, yang dikenali sebagai RedNote dalam bahasa Inggeris, berkata model "dots-note-3.0" mereka memasuki IMO buat pertama kali tahun ini.
Proses Penilaian Ketat
Firma teknologi hanya diberikan masalah IMO selepas peserta manusia mengambil peperiksaan, dengan penyerahan mereka dalam had masa yang ditetapkan. "Semasa ujian, sebarang bentuk campur tangan manusia adalah dilarang sama sekali," kata Xiaohongshu. Penyelesaian AI telah diserahkan kepada penganjur IMO untuk dinilai.
Kemajuan AI adalah pantas: pada IMO 2024, Google mencapai skor pingat perak dengan menyelesaikan empat daripada enam masalah dalam tempoh dua hingga tiga hari.
Reaksi Industri
Deedy Das, rakan kongsi di firma pelaburan Menlo Ventures yang berpangkalan di AS, berkata beliau telah memberikan soalan IMO tahun ini kepada empat model AI terkini. Keempat-empat model - dari OpenAI dan Anthropic, startup Axiom Math dan "Kimi K3" dari Moonshot AI China - mendapat 42 mata daripada 42, katanya di LinkedIn.
"Sempadan AI secara rasmi telah melangkaui matematik IMO," tulis Das.



