ContextWindow
Тег

#исследования

Исследования

Верность цепочек рассуждений: когда chain-of-thought не объясняет ответ модели

Новые препринты ставят под сомнение ключевое допущение о reasoning-моделях: видимая цепочка рассуждений может не отражать реальные вычисления, а лишь имитировать их — что подрывает мониторинг агентных систем как метод контроля.

Исследования

Мультиагентные рассуждения: исследователи переходят к управляемой оркестрации

Свежие препринты смещают фокус с одиночных рассуждающих моделей на координацию нескольких агентов. Авторы формулируют оркестрацию как задачу обучения с подкреплением и предлагают контролируемые бенчмарки. Главным узким местом остаётся надёжность взаимодействия.