📰 IT Дайджест

#interpretability

1 материал

12. LRM не такие чёрные ящики: латентные токены декодируются в понятные цепочки до 93% случаев

Исследование двух LRM показало, что скрытые токены рассуждений часто не нужны для ответа — модель может дать тот же результат без них. Когда нужны, в 65–93% правильных ответов можно извлечь ожидаемую цепочку рассуждений. Предложен метод декодирования верифицированного следа без знания правильного ответа.

arxiv.org · #ai #interpretability #llm #reasoning