Модели
GPT-5.6 Sol получил два новых режима вычислений: «max reasoning effort» для точности и Sol Ultra с субагентами для длинных задач. На Terminal-Bench 2.1 Ultra берёт 91,9%. System card присвоил всем трём моделям уровень High по кибербезопасности и биорискам.
29 июня
4 мин
Инструменты
Стартап Arcade закрыл раунд Series A на $60 млн под управлением SYN Ventures. Деньги пойдут на инфраструктуру авторизации и аудита, которая решает, какие действия автономным ИИ-агентам разрешено выполнять в продакшене корпоративных систем.
15 июня
3 мин
Модели
9 июня Anthropic выпустила Claude Fable 5 — первую публичную модель класса Mythos с 95% на SWE-bench Verified. Mythos 5 без ограничений доступна только проверенным подрядчикам. Через три дня правительство США отозвало доступ к обеим моделям.
10 июня
5 мин
Регулирование
Калифорния и ряд других штатов США приняли законы о прозрачности и безопасности ИИ с порогами по вычислениям и обязательной отчётностью. Индустрия добивается федерального моратория на штатное регулирование, исход которого определит правила для всех поставщиков моделей в стране.
7 июня
5 мин
Исследования
Новые препринты ставят под сомнение ключевое допущение о reasoning-моделях: видимая цепочка рассуждений может не отражать реальные вычисления, а лишь имитировать их — что подрывает мониторинг агентных систем как метод контроля.
7 июня
5 мин