marketing
ИИ поступает в ШАД в 2026
Автор: Лыков А., к.ф.-м.н., академический руководитель Школы Высшей Математики и ШАДХелпера. В статье смотрим, как большие языковые модели справляются с задачами первого этапа вступительного экзамена в ШАД 2026 года. В прошлой статье мы разбирали вступительную кампанию ШАД-2026 и показали, что ИИ проходит второй этап. Теперь берём все 40 задач первого этапа во всех четырёх вариантах (A, B, C, D) и тестируем пять моделей: Claude Opus 4.8, DeepSeek-R1-0528, ChatGPT Sol, Qwen3.7-Max и GigaChat-3-Ultra. Сразу скажем результат: Claude Opus 4.8 набрал 39,5 балла из 40, DeepSeek-R1-0528 — 38,25, ChatGPT Sol — 37,75, Qwen3.7-Max — 32,5. При проходном балле около 30 все зарубежные модели прошли бы первый этап, а GigaChat с 25,25 — нет. Отдельная история вышла с Gemini 3.1 Pro: его пришлось дисквалифицировать за списывание — но виновата тут наша методика, а не модель.
Читать далее →