Lần đầu tiên một mô hình AI giải trọn vẹn 6 bài toán của Kỳ thi Toán Quốc tế IMO, đạt điểm tuyệt đối 42/42

The Storm Riders
The Storm Riders
Phản hồi: 0
The Storm Riders

The Storm Riders Đã xác thực

Lần đầu tiên trong lịch sử, một mô hình trí tuệ nhân tạo đã giải trọn vẹn toàn bộ bài thi và đạt điểm số tối đa tại Kỳ thi Toán Quốc tế (IMO). Đáng chú ý, "tác giả" của kỷ lục này không phải những gã khổng lồ AI quen thuộc như Google hay OpenAI, mà đến từ RedNote - đơn vị đứng sau mạng xã hội Tiểu Hồng Thư.

Kỳ thi Toán Quốc tế (IMO) vừa kết thúc tại Thượng Hải đã ghi nhận một cột mốc lịch sử đối với giới công nghệ. Mô hình AI mang tên dots-note-3.0 đã giải thành công cả 6 bài toán và đạt 42 điểm tuyệt đối.

1784774456960.png

Kỷ lục mới vượt qua các ông lớn AI​

Giải toán IMO vốn không đơn thuần là tìm ra đáp số cuối cùng. Cuộc thi đòi hỏi quá trình chứng minh với những lập luận logic cực kỳ chặt chẽ, không được mắc sai lầm hay thiếu sót điều kiện. Trước đây, nhiều hệ thống AI hàng đầu cũng từng thử sức nhưng chưa thể đạt đến điểm số hoàn hảo.

Ở kỳ IMO trước, cả Google DeepMind và OpenAI từng đạt thành tích tương đương huy chương vàng nhưng dừng lại ở mức 35/42 điểm. Còn tại IMO 2024, hai hệ thống AlphaProof và AlphaGeometry 2 của Google DeepMind chỉ đạt 28 điểm (tương đương huy chương bạc), đồng thời vẫn cần đến sự hỗ trợ của các chuyên gia con người để dịch đề bài sang ngôn ngữ logic mà AI có thể hiểu.

Tự đọc đề và tự sửa lỗi không cần con người can thiệp​

Điểm vượt trội của dots-note-3.0 nằm ở khả năng xử lý trực tiếp. Mô hình này đọc thẳng các tài liệu đề thi gốc mà không cần con người làm trung gian chuyển đổi sang ngôn ngữ lập trình chuyên dụng. Hệ thống vận hành hoàn toàn tự động (end-to-end) theo đúng quy định nghiêm ngặt của kỳ thi, tuyệt đối không có sự trợ giúp từ bên ngoài như gợi ý, chỉnh sửa bước suy luận hay hoàn thiện logic.

Để đạt được điều này, RedNote sử dụng một kiến trúc dạng agent (agentic framework). Hệ thống kết hợp giữa khả năng suy luận bằng ngôn ngữ tự nhiên và việc chạy mã Python nhằm tự soạn thảo, kiểm tra và hoàn thiện các bài chứng minh.

Chìa khóa giúp mô hình đạt điểm tối đa nằm ở vòng lặp tự kiểm tra nhiều bước. Trước khi đưa ra bài giải cuối cùng, AI sẽ tự rà soát lại lập luận của chính mình, hoài nghi các giả định và liên tục khắc phục những chỗ hổng logic.

Mô hình gọn nhẹ nhưng hiệu quả bất ngờ​

Dù đạt thành tích kỷ lục, dots-note-3.0 hiện vẫn đang trong giai đoạn thử nghiệm (beta) và là phiên bản nhẹ nhất trong dòng mô hình dots3 của RedNote. Họ mô hình này còn có hai phiên bản lớn hơn là jazz và aria, được thiết kế cho các mục đích sử dụng và mức chi phí tính toán khác nhau.

Phía RedNote cho biết họ có kế hoạch sẽ mở mã nguồn dots-note-3.0 trong thời gian tới.

Song song với màn thể hiện của AI, đội tuyển thi toán của con người đến từ Trung Quốc cũng xếp thứ nhất toàn đoàn tại kỳ thi IMO lần này, trong đó có 3 thí sinh đạt điểm số tuyệt đối.
 


Đăng nhập một lần thảo luận tẹt ga
Thành viên mới đăng
http://textlink.linktop.vn/?adslk=aHR0cHM6Ly93d3cudm5yZXZpZXcudm4vdGhyZWFkcy9sYW4tZGF1LXRpZW4tbW90LW1vLWhpbmgtYWktZ2lhaS10cm9uLXZlbi02LWJhaS10b2FuLWN1YS1reS10aGktdG9hbi1xdW9jLXRlLWltby1kYXQtZGllbS10dXlldC1kb2ktNDItNDIuODgzMzAv
Top