ContextWindow
Тег

#безопасность

Модели

GPT-5.6 Sol: два режима вычислений, рекорд Terminal-Bench и профиль безопасности

GPT-5.6 Sol получил два новых режима вычислений: «max reasoning effort» для точности и Sol Ultra с субагентами для длинных задач. На Terminal-Bench 2.1 Ultra берёт 91,9%. System card присвоил всем трём моделям уровень High по кибербезопасности и биорискам.

Инструменты

Arcade привлёк $60 млн на слой контроля действий ИИ-агентов

Стартап Arcade закрыл раунд Series A на $60 млн под управлением SYN Ventures. Деньги пойдут на инфраструктуру авторизации и аудита, которая решает, какие действия автономным ИИ-агентам разрешено выполнять в продакшене корпоративных систем.

Модели

Anthropic выпустила Claude Fable 5 и Mythos 5 — и потеряла доступ к ним за три дня

9 июня Anthropic выпустила Claude Fable 5 — первую публичную модель класса Mythos с 95% на SWE-bench Verified. Mythos 5 без ограничений доступна только проверенным подрядчикам. Через три дня правительство США отозвало доступ к обеим моделям.

Регулирование

Штаты США вводят собственные законы об ИИ, пока Конгресс спорит о федеральном приоритете

Калифорния и ряд других штатов США приняли законы о прозрачности и безопасности ИИ с порогами по вычислениям и обязательной отчётностью. Индустрия добивается федерального моратория на штатное регулирование, исход которого определит правила для всех поставщиков моделей в стране.

Исследования

Верность цепочек рассуждений: когда chain-of-thought не объясняет ответ модели

Новые препринты ставят под сомнение ключевое допущение о reasoning-моделях: видимая цепочка рассуждений может не отражать реальные вычисления, а лишь имитировать их — что подрывает мониторинг агентных систем как метод контроля.