Faithfulness цепочки рассуждений модели: можно ли верить CoT
Разбираем, что исследователи называют faithfulness цепочки рассуждений, как это измеряют в работах Anthropic, OpenAI и других, и почему полезный CoT ещё не равен правдивому объяснению.
Открыть материал →




