ContextWindow
Тег

#интерпретируемость

Исследования

Верность цепочек рассуждений: когда chain-of-thought не объясняет ответ модели

Новые препринты ставят под сомнение ключевое допущение о reasoning-моделях: видимая цепочка рассуждений может не отражать реальные вычисления, а лишь имитировать их — что подрывает мониторинг агентных систем как метод контроля.