Фото тетради в разбор: как нейросеть объясняет ошибки
Катя Долгих8 мин

Сценарий, знакомый почти каждой семье со школьником: задача решена, ответ не сходится с учебником, и найти, где именно всё поломалось, невозможно. Родитель этот раздел проходил двадцать лет назад, ребёнок злится, время позднее. Раньше в этом месте либо звонили однокласснику, либо оставляли как есть.
Сейчас у этой ситуации появился третий выход. Текстовые модели умеют принимать картинку вместе с вопросом: вы фотографируете страницу тетради и спрашиваете не «сколько получится», а «на каком шаге я свернул не туда». Это разные запросы, и отвечает модель на них по-разному.
Ниже — практическая часть: как снять страницу, чтобы почерк читался, как сформулировать запрос на разбор, а не на ответ, и что обязательно проверить руками, прежде чем считать разбор верным.
Разбор и ответ — это два разных запроса
Начну с главного, потому что от этого зависит всё остальное. Модель по умолчанию решает задачу. Вы даёте ей условие — она выдаёт решение: аккуратное, по шагам, с итоговым числом. Ваша тетрадь при этом почти не участвует, модель просто прочитала условие и посчитала заново.
Толку от этого мало. Вы получаете второй вариант решения рядом со своим и всё так же не знаете, где именно ваш разошёлся с правильным. Если числа совпали — непонятно, случайность это или нет. Если не совпали — непонятно, в каком месте.
Разбор устроен иначе: модель идёт по вашим строчкам сверху вниз и на каждой отвечает на один вопрос — этот переход законный или нет. Первое место, где ответ «нет», и есть искомая точка. Всё, что ниже, чинить бессмысленно: ошибка тянется дальше сама.
Разница в формулировке буквально одна фраза. «Реши» против «найди первую строку, где я ошибся, и объясни почему». Тема более широкая — как вообще держать модель в режиме объяснения, а не выдачи готового, — разобрана отдельно в материале про режим репетитора; здесь мы говорим про частный, но очень частый случай: на входе фотография рукописной страницы.
Съёмка: пять минут, которые решают всё
Рукописный текст распознаётся заметно хуже печатного. Почерк неровный, цифры похожи друг на друга, клетка добавляет линий, карандаш бледный. Плохой кадр вы никакими формулировками не спасёте: модель не скажет «не вижу», она подставит правдоподобное. Поэтому сначала фотография, потом запрос.
Свет. Дневной свет от окна или лампа сбоку. Главный враг — собственная тень: если снимать, нависая над тетрадью спиной к лампе, половина страницы уходит в серое. Вспышка на бумаге в клетку даёт белое пятно и блики от карандашного грифеля.
Ракурс. Телефон строго над страницей, параллельно листу. Снятая наискосок страница уходит в трапецию, и первыми страдают верхние и нижние строки — то есть чаще всего условие и ответ.
Кадр. Одна задача — один кадр. Разворот тетради целиком, где решение занимает четверть площади, — это выброшенное разрешение и гарантированные ошибки в мелких индексах. Если задача не влезает, лучше два кадра с перекрытием, чем один общий.
Резкость. Наводите фокус тапом по тексту. Автофокус любит цепляться за край стола или за клетку рядом с текстом, и тогда цифры плывут ровно настолько, чтобы шестёрка стала пятёркой.
Карандаш. Бледный карандаш — отдельная беда. Если решение писалось твёрдым грифелем и еле видно, помогает прогнать снимок через готовый инструмент «Улучшить фото» в каталоге Most AI — он работает без промта, просто загружаете картинку. Общая механика подготовки таких кадров подробно разобрана в статье про распознавание текста со скана.
Первый шаг — сверить, что модель вообще прочитала
Соблазн большой: загрузил фото, попросил разбор, получил уверенный текст. Проблема в том, что разбор может быть построен на неправильно прочитанном условии. Модель увидела в вашей записи не 3x, а 8x, честно нашла «ошибку» там, где её нет, и объяснила её убедительно.
Поэтому первый запрос — не про ошибки, а про распознавание.
На фото страница из тетради с решением задачи по алгебре.
Перепечатай текстом ровно то, что видишь: условие и каждую строку решения,
сохраняя порядок и нумерацию шагов.
Ничего не исправляй и не дорешивай, даже если видишь ошибку.
Если какой-то символ читается неоднозначно, напиши варианты
в квадратных скобках, например [5 или 6], и не выбирай сам.
Дальше вы тридцать секунд сверяете расшифровку с тетрадью. Это самый скучный шаг и самый полезный: он ловит и мутные кадры, и путаницу похожих символов. Если расшифровка съехала — переснимаете, а не спорите с моделью. Если в квадратных скобках стоят варианты — говорите, какой верный, одним сообщением.
Только после этого имеет смысл просить разбор. И просить его — в том же чате, чтобы модель работала с уже подтверждённой расшифровкой.
Запрос на разбор хода решения
Базовая формула, которая держит модель в нужном режиме:
Ниже расшифровка моего решения, которую мы только что сверили.
Проверь его по шагам, сверху вниз.
Найди первую строку, где переход неверный, и остановись на ней.
Объясни: что именно сделано не так, какое правило нарушено,
как выглядит правильный переход в этой строке.
Дальше не решай, ответ не считай и итоговое число не называй.
Я перерешаю сам с этого места и пришлю новый вариант.
Три вещи здесь работают на результат. «Остановись на ней» не даёт модели вывалить весь разбор до конца — иначе она найдёт ошибку в третьей строке и тут же дорешает за вас. «Итоговое число не называй» закрывает главную лазейку: с известным ответом задача перестаёт быть задачей. «Я перерешаю сам» задаёт формат диалога — вы возвращаетесь с новой версией, и цикл повторяется.
Если ошибок в решении нет, а ответ всё равно не сходится с учебником, полезен другой заход:
Все переходы в моём решении выглядят верными, но ответ не совпадает
с ответом из учебника. Не решай задачу заново.
Проверь три вещи по отдельности и скажи, где расхождение:
1. Правильно ли я понял условие — перескажи его своими словами.
2. Нет ли арифметической ошибки внутри строк, при верной логике переходов.
3. Не отличается ли форма записи ответа от той, что требует учебник.
Часто выясняется, что решение верное, а разошлось округление или форма записи. Это тоже полезный разбор — и он гораздо ближе к реальной причине, чем очередное готовое решение.
Второй круг: что делать после найденной ошибки
Найденная ошибка — это половина дела. Дальше начинается та часть, ради которой всё и затевалось: ученик возвращается к строке, где свернул не туда, и проходит её заново сам. Фотографировать при этом ничего не нужно — достаточно написать новый вариант шага текстом прямо в чат.
Здесь у диалога есть свойство, о котором стоит знать заранее. Модель по умолчанию доброжелательна и склонна соглашаться. Если написать «а если так?», она с высокой вероятностью подтвердит, что так лучше, даже когда стало хуже. Лечится это формулировкой запроса: не «правильно?», а «проверь этот переход и назови правило, по которому он законен». Требование сослаться на правило резко снижает количество вежливых согласий.
Полезно ещё и обратное упражнение — попросить модель объяснить, почему исходный вариант казался правдоподобным. Ошибки в математике редко случайны: знак теряется в одном и том же месте, дробь переворачивается по одной и той же причине. Когда ученик видит не только «здесь неверно», но и «вот механизм, по которому ты сюда попал», та же ошибка перестаёт повторяться в следующей задаче.
Родителю в этой схеме отводится роль, которая многих устраивает: не объяснять предмет, забытый со школы, а следить, чтобы диалог оставался разбором. Проверять расшифровку, замечать момент, когда вместо вопроса пошла просьба «просто скажи ответ», и настаивать на перерешивании. Это не требует знания темы — только внимания к формату.
Чего модель не умеет и о чём стоит помнить
Тут важно быть честным, потому что иначе вся конструкция вредна.
Модель ошибается в распознавании. Рукописные цифры, дроби с мелкими индексами, степени, знаки минус на границе строки — всё это читается с ошибками, и уверенность в тоне ответа никак не связана с точностью чтения. Отсюда обязательный шаг со сверкой расшифровки.
Модель ошибается в арифметике. Текстовая модель — не калькулятор: она порождает правдоподобную последовательность символов, и на длинных вычислениях это иногда даёт неверное число при полностью верной логике. Проверять итоговые вычисления руками или калькулятором — нормальная часть работы, а не признак недоверия.
Модель не ставит оценку. Она может сказать, что переход в четвёртой строке неверный, — и это полезно. Она не знает требований конкретного учителя, принятой в классе формы записи и того, что засчитывается за полное решение. Оценка — зона человека, и ровно об этом мы писали со стороны учителя в материале про нейросети для преподавателя. Использовать разбор как аргумент в споре с учителем — плохая идея: модель ошибается ровно так же, как ошибся ученик, только увереннее.
И последнее. Разбор работает, пока он остаётся разбором. Как только вместо «найди первую ошибку» звучит «реши и покажи», вся польза схлопывается: работа сдана, ощущение понимания есть, навыка нет. Проверить это просто — попробуйте после разбора перерешать похожую задачу без фотографирования. Если получается, разбор сработал.
Для такой работы подойдут разные текстовые модели, умеющие принимать изображения. В Most AI они собраны в одном кабинете, есть бесплатная дневная квота на чат, оплата в рублях и без VPN, а стоимость обращений к платным моделям указана в прайсинге.
Частые вопросы
Подойдёт ли фото с телефона или нужен сканер?
Телефона достаточно — при условии ровного света и съёмки строго сверху. Сканер даёт более предсказуемый результат на печатном тексте, но для одной страницы тетради разница невелика. Главное — резкость и то, чтобы решение занимало почти весь кадр.
Модель разбирает только математику?
Нет. Тот же подход работает с физикой, химией, грамматическим разбором и любым предметом, где есть последовательность шагов. Чем формальнее предмет, тем надёжнее разбор: в математике переход либо законный, либо нет, а в сочинении оценка гораздо субъективнее.
Что делать, если модель нашла ошибку там, где её нет?
Сначала проверить расшифровку — в большинстве случаев виновато распознавание, а не логика. Если расшифровка верна, попросите объяснить, какое именно правило нарушено, и сверьте это правило с учебником. Спорить с моделью бесполезно, она согласится с вами независимо от того, кто прав.
Можно ли отправлять сразу несколько задач одним фото?
Лучше не надо. На общем кадре мельчает шрифт, растёт риск путаницы между строками соседних задач, а разбор получается поверхностным. Одна задача — один кадр и один диалог.
Как понять, что ребёнок разбирается, а не списывает?
По результату на похожей задаче без фотографии. Если после разбора он решает аналогичное задание сам, режим рабочий. Если каждый раз нужен новый снимок и новый разбор, значит, диалог свалился в выдачу готовых решений и промт стоит переписать строже.
Сколько это стоит?
Бесплатной дневной квоты на чат хватает, чтобы попробовать подход на нескольких задачах. Для регулярной работы имеет смысл посмотреть актуальные цены в прайсинге: помесячной подписки нет, оплата в рублях и по факту использования.
Проверьте приём на своём фото
Откройте редактор и прогоните описанный приём на своём снимке — результат видно сразу, а не в теории.



