
Lần đầu tiên AI Trung Quốc đạt 42/42 điểm theo thang chấm chính thức của Olympic toán học quốc tế, vượt qua một trong những bài kiểm tra khó nhất thế giới – Ảnh minh họa: ChatGPT
Ngày 23-7, hai công ty công nghệ Trung Quốc là Huawei và Xiaohongshu (RedNote) cho biết các mô hình AI của họ đều đạt 42/42 điểm theo thang chấm chính thức của cuộc thi Olympic toán học quốc tế (IMO) 2026.
Theo hai doanh nghiệp, đây là lần đầu một mô hình ngôn ngữ lớn (LLM) đạt điểm tuyệt đối trong quy trình chấm điểm chính thức của cuộc thi.
Đại diện Xiaohongshu cho biết IMO từ lâu được xem là một trong những thử thách khó nhất đối với cả con người và AI. Những năm trước, chưa có mô hình nào đạt điểm tuyệt đối theo tiêu chuẩn chấm của ban tổ chức.
IMO 2026 được tổ chức tại Thượng Hải với sự tham gia của 666 thí sinh đến từ nhiều quốc gia và vùng lãnh thổ. Theo kết quả chính thức, chỉ có 7 thí sinh đạt điểm tuyệt đối.
Cuộc thi dành cho học sinh dưới 20 tuổi, gồm 6 bài toán có độ khó rất cao, yêu cầu thí sinh phải lập luận và chứng minh toán học thay vì chỉ thực hiện các phép tính.
Huawei nói mô hình Celia của họ đã giải trọn vẹn các bài toán ở nhiều lĩnh vực khác nhau. Trong khi đó, Xiaohongshu chia sẻ mô hình dots-note-3.0 lần đầu tham gia thử sức với bộ đề IMO.
Theo quy định của ban tổ chức, các công ty chỉ được tiếp cận đề thi sau khi thí sinh hoàn thành bài làm. AI phải giải đề trong thời gian quy định, không có sự can thiệp của con người. Lời giải sau đó được gửi trực tiếp đến ban giám khảo IMO để chấm theo cùng tiêu chuẩn áp dụng với các thí sinh.
Năng lực giải toán của AI đã tiến bộ rất nhanh trong vài năm gần đây. Tại IMO 2024, mô hình của Google mới đạt mức tương đương huy chương bạc. Đến năm 2025, các mô hình của Google và OpenAI lần đầu đạt trình độ huy chương vàng, nhưng vẫn chưa đạt điểm tuyệt đối.
Trong khi đó ông Deedy Das – đối tác quỹ đầu tư Menlo Ventures (Mỹ) – cho biết đã thử nghiệm bộ đề IMO 2026 với bốn mô hình AI gồm OpenAI, Anthropic, Axiom Math và Kimi K3 của Moonshot AI (Trung Quốc). Theo ông, cả bốn mô hình đều đạt 42/42 điểm, cho thấy năng lực giải toán của AI đã vượt qua một trong những chuẩn đánh giá khó nhất thế giới.
Giới chuyên gia nhận định cột mốc này cho thấy AI đang tiến gần hơn tới khả năng suy luận ở cấp độ cao, mở ra tiềm năng ứng dụng trong nghiên cứu khoa học, giáo dục và các lĩnh vực đòi hỏi tư duy logic phức tạp.
Tuy nhiên, nhiều nhà khoa học cũng lưu ý rằng khả năng giải thành công các bài toán IMO chưa đồng nghĩa AI có thể thay thế tư duy sáng tạo hay năng lực nghiên cứu của con người.