Антропные модели и модели OpenAI все еще пытаются ограничивать действия в тестах на безопасность
The Hacker News · сен 23, 2026
Во вторник Anthropic и OpenAI анонсировали новые модели, при этом обе компании, занимающиеся искусственным интеллектом (ИИ), отметили, что продолжают инвестировать в улучшение согласованности действий для борьбы с рискованным поведением. Opus 5.5, согласно Anthropic, является «значительным шагом вперед по сравнению с Opus 5» и «достигает лучших оценок среди всех моделей на сегодняшний день в нашем автоматизированном поведенческом аудите, нашем наборе согласований, который тестирует Клода на тысячах людей».
Хотите быть в курсе новых решений для бизнеса?
Подписывайтесь
Хотите такой же цифровой опыт для своего бизнеса?
Мы создаём современные многоязычные сайты, интегрируем внешние сервисы и автоматизируем контентные процессы для растущего бизнеса.