Цепочка рассуждений (chain-of-thought)

Приём, при котором модель просят показать промежуточные шаги рассуждения, а не сразу выдавать ответ — это улучшает решение сложных задач.

КРАТКО
Цепочка рассуждений — это приём, при котором модели предлагают сначала «подумать вслух», а только потом дать ответ. Простая фраза «решай задачу шаг за шагом» заметно улучшает качество в логических, математических и многошаговых задачах. Современные модели часто рассуждают так по умолчанию, но при сложных задачах подсказать им это явно всё равно полезно.
СИНОНИМЫ:цепочка рассужденийпошаговое рассуждениерассуждение по шагамchain-of-thoughtCoT

Идея кажется простой, но эффект оказался серьёзным. Если модели позволено развернуть рассуждение, она реже срезает углы и реже ошибается там, где задача требует нескольких шагов.

Варианты

  • Простой — добавить в промпт фразу «рассуждай шаг за шагом перед ответом».
  • С примером — показать на паре примеров прямо в запросе, как именно нужно рассуждать.
  • Самосогласование — попросить модель сгенерировать несколько вариантов рассуждения и выбрать наиболее частый ответ.
  • Скрытое рассуждение — попросить рассуждать в отдельной служебной части, а пользователю показать только итоговый ответ.

Что важно помнить

  • Цепочка рассуждений увеличивает длину ответа и его стоимость.
  • Иногда модель «рассуждает» правдоподобно, но всё равно приходит к неверному ответу — это не универсальное решение.
КОГДА ПРИМЕНЯТЬ
  • Логические и математические задачи
  • Задачи с несколькими условиями и подзадачами
  • Когда модель явно «срезает углы» и ошибается на простых вопросах
КОГДА НЕ СТОИТ
  • Простые классификации и короткие фактические ответы — рассуждение тут только увеличит стоимость
  • Когда ответ нужен в чётком коротком формате (например, одно слово или структура JSON)
ПРИМЕР

Если попросить модель «сколько грузовиков нужно, чтобы перевезти 12 тонн груза при грузоподъёмности 1,8 тонн», она может уверенно ответить «6». Добавляем «рассуждай шаг за шагом», и модель пишет: «1,8 × 6 = 10,8 — не хватает; 1,8 × 7 = 12,6 — достаточно; значит, нужно 7 грузовиков». Маленькое изменение промпта — заметно более надёжный ответ.

КАК ИСПОЛЬЗОВАТЬ В SHTAB

В продуктовых интерфейсах обычно не нужно показывать пользователю всё рассуждение модели — оно длинное и часто шумное. Удобный приём — попросить модель рассуждать «во внутренней секции» и выдать пользователю только итоговый ответ, а внутреннее рассуждение использовать только для журналов и отладки.

Попробовать бесплатно

Вопросы про «Цепочка рассуждений (chain-of-thought)»

Модель не думает в человеческом смысле — она просто генерирует более длинный текст, в котором каждый следующий шаг опирается на предыдущий. Это даёт ей возможность не «угадывать» ответ сразу, а постепенно прийти к нему. Но за самим текстом нет сознательного рассуждения, и иногда модель убедительно ошибается на каждом шаге.

Применяйте термины на практике

База знаний, задачи и цели — в одном сервисе. Бесплатно — без лимита по числу людей.