OpenAI и исследователи Bocconi University опубликовали результаты рандомизированного эксперимента с участием более 1000 студентов. Исследование показало, что доступ к ChatGPT почти на 1 балл повышал качество работ по пятибалльной шкале, а отдельная тренировка причинно-следственного мышления увеличивала разнообразие и оригинальность идей.

Речь идет об одном практическом задании: студенты первого курса готовили маркетинговые рекомендации для магазина университетского мерча. Участников случайным образом разделили на четыре группы: с доступом к ChatGPT (GPT-4o), с тренировкой критического мышления, с обоими инструментами сразу и без них.

Что именно показал эксперимент

Работы оценивали подготовленные эксперты по пятибалльной шкале. Дополнительно исследователи применили автоматический текстовый анализ: он измерял количество и разнообразие идей, наличие причинно-следственных объяснений и сходство ответов с рекомендациями трех экспертов.

Студенты с доступом к ChatGPT получили почти на 1 балл больше. Их ответы содержали больше идей, были логичнее выстроены и сильнее напоминали рекомендации экспертов. По сути, генеративный ИИ помог новичкам приблизить качество работы к более профессиональному уровню.

При этом исследователи отдельно подчеркивают: студенты не просто «отдавали» задание нейросети. Им все равно нужно было формулировать запросы, оценивать ответы и выбирать, что войдет в итоговую версию.

Что дала тренировка критического мышления

Отдельное упражнение на причинно-следственное мышление дало другой эффект. Студенты лучше объясняли, почему их идеи могут сработать и в каких случаях они могут не сработать. Но по стандартной оценочной шкале это не привело к заметному росту баллов.

Зато автоматический анализ показал важную деталь: после такой тренировки участники предлагали более широкий набор идей, которые реже повторяли решения одногруппников. Иначе говоря, критическое мышление не столько «полировало» ответ, сколько повышало его оригинальность.

Это важный вывод и за пределами образования. Стандартные критерии оценки часто лучше замечают структурированный и аккуратный ответ, чем действительно нестандартную идею.

Лучший результат — при сочетании ИИ и мышления

Группа, которая получила и доступ к ChatGPT, и тренировку критического мышления, показала комбинированный эффект. По разнообразию идей эти студенты были сопоставимы с теми, кто проходил только упражнение. По баллам и количеству идей — с теми, кто использовал только ChatGPT. Кроме того, их работы отличались более сильной логической связностью и большим числом попыток объяснять причины и проверять допущения.

Авторы исследования делают вывод: ИИ и навыки мышления не заменяют друг друга, а работают как взаимодополняющие инструменты. ChatGPT помогает быстрее получить более цельный и профессионально выглядящий результат, а тренировка мышления — расширить набор гипотез и повысить оригинальность.

Почему это важно для digital-специалистов в России

Хотя исследование проводилось в образовательной среде, его выводы напрямую применимы к маркетингу, SEO, контенту и агентской работе. Для российских специалистов это еще одно подтверждение: генеративный ИИ полезен не только как инструмент ускорения, но и как способ сократить разрыв между junior- и middle-уровнем в типовых задачах — от подготовки брифов и контент-планов до маркетинговых рекомендаций и черновиков стратегий.

Но есть и обратная сторона. Если команда оценивает только «гладкость» текста, логичность структуры и внешнюю убедительность, ИИ действительно может быстро поднять средний уровень результата. Однако оригинальность гипотез, глубина причинно-следственных связей и способность оспаривать очевидные решения по-прежнему требуют отдельной проверки.

На практике это актуально и для работы с Google, и для работы с Яндексом. При создании SEO-материалов, посадочных страниц, рекламных сообщений и аналитических выводов ИИ помогает быстрее собрать качественный черновик. Но конкурентное преимущество по-прежнему возникает там, где специалист добавляет собственные инсайты: сегментацию спроса, понимание интента, локальную специфику российского рынка, сезонность, ограничения площадок и нестандартные тестовые гипотезы.

Практический вывод для рынка

Исследование показывает, что ChatGPT улучшает качество и связность результата, а тренировка критического мышления повышает оригинальность идей. Для владельцев бизнеса, маркетологов, SEO- и PPC-специалистов это означает простую вещь: ИИ уже можно использовать как усилитель базового качества, но процессы оценки и постановки задач нужно перестраивать так, чтобы отдельно проверять глубину аргументации, уникальность гипотез и реальную ценность идей.

Совет эксперта Analito

Пересмотрите внутреннюю оценку контента и стратегических черновиков: отдельно фиксируйте качество структуры, отдельно — оригинальность гипотез, глубину аргументации и наличие альтернативных сценариев. Если оценивать только «гладкий» результат, ИИ будет маскировать слабую проработку идеи.

Используйте ChatGPT на этапах сбора вариантов, структурирования и первичного обоснования, но добавляйте обязательный блок ручной проверки: почему гипотеза должна сработать, в каких условиях она не сработает, какие факторы не учтены. Это особенно полезно для SEO-стратегий, медиапланов и контент-планов.

Для junior-специалистов внедрите короткие упражнения на причинно-следственное мышление: разбор провала кампании, объяснение влияния факторов на трафик и конверсии, сравнение нескольких сценариев. Это поможет получать не только более аккуратные, но и более сильные по сути решения.

Частые вопросы

Означает ли это, что ChatGPT снижает оригинальность работ?

Исследование не показало такого прямого вывода. ChatGPT улучшал качество и логичность ответов, а за рост оригинальности отдельно отвечала тренировка критического мышления.

Почему тренировка мышления не повысила итоговые баллы?

Потому что стандартная шкала оценивала в основном соответствие типовым маркетинговым целям. Более оригинальные и разнообразные идеи этот формат оценки фиксировал хуже.

Какой вывод из этого полезен для SEO и контент-команд?

ИИ стоит использовать для ускорения и повышения базового качества черновиков, но финальная оценка должна включать проверку уникальности гипотез, причинно-следственной логики и бизнес-применимости.