Vals AI 按国际信息学奥林匹克(IOI)原赛制评测模型:禁用测试数据、联网与提交反馈,模型只能凭题面和样例自验;结束后把工作区里的解答复制到干净目录,用官方测试数据与 grader 编译运行,按子任务计分(满分 100)。共 18 题,取自 2024、2025、2026 三届各 6 题。注意与站内 `IMO 2024 / IMO 2025`(数学奥赛)不是一回事。
查看 IOI (Vals) 的最新得分、模型模式、发布时间与参数规模,快速了解当前完整榜单表现。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
| 排名 | 模型 | 开源情况 | |||
|---|---|---|---|---|---|
— | ![]() Claude Opus 5.5 思考水平·Max工具 | 95.06 | 2026-09-22 | 未知 | 闭源 |
— | ![]() GPT-6 Sol 思考水平·Max工具 | 82.61 | 2026-09-22 | 未知 | 闭源 |
— | ![]() GPT-6 Luna 思考水平·Max工具 | 55.56 | 2026-09-22 | 未知 | 闭源 |