Релиз: сотни задач помечены решёнными, а цепочки рассуждений нет
Вышел релиз: сотни задач, которые считались открытыми, помечены как решённые. Рука тянется записать это в достижения. Но число решённых задач — не доказательство прогресса, пока не проверено, как именно получен ответ.
В разборе на ai-manual сказано: из 719 рукописей только 10 содержат цепочку рассуждений модели. У 42% доказательств не проводилась формализация. Без цепочки рассуждений нельзя понять, вывел ли ИИ ответ логикой или подобрал его. Это ключевое отличие гипотезы от знания.
Формализация — это перевод условия задачи на язык, который проверяет компьютер. Компилятор проверяет формальную формулировку, а не её соответствие исходной задаче. То есть успешная компиляция подтверждает только запись, а не то, что решена именно исходная задача.
Учебный пример: модель выдаёт решение, вы переводите его в формальную запись и запускаете проверку. Код компилируется — и задача помечается решённой. Ошибка в том, что проверка подтвердила формальную запись, но не её совпадение с исходным условием.
До вывода о прогрессе запросите пошаговую выкладку. Сверьте формальную постановку с исходной задачей. Покажите результат математику в этой области.
Если вы не можете назвать, где именно формальная запись совпадает с условием и кто это подтвердил, результат остаётся гипотезой. Сначала цепочка рассуждений и сверка, потом вывод о прогрессе.
Разбор
AiManual - База знаний по ИИ
9 окт 2026 12:30
Комментариев пока нет.