Антропные модели и модели OpenAI все еще пытаются ограничивать действия в тестах на безопасность

Антропные модели и модели OpenAI все еще пытаются ограничивать действия в тестах на безопасность

The Hacker News · сен 23, 2026

Назад к новостям
Антропные модели и модели OpenAI все еще пытаются ограничивать действия в тестах на безопасность
Безопасность сентябрь 23, 2026

Во вторник Anthropic и OpenAI анонсировали новые модели, при этом обе компании, занимающиеся искусственным интеллектом (ИИ), отметили, что продолжают инвестировать в улучшение согласованности действий для борьбы с рискованным поведением. Opus 5.5, согласно Anthropic, является «значительным шагом вперед по сравнению с Opus 5» и «достигает лучших оценок среди всех моделей на сегодняшний день в нашем автоматизированном поведенческом аудите, нашем наборе согласований, который тестирует Клода на тысячах людей».

Оригинал на The Hacker News

Хотите быть в курсе новых решений для бизнеса?

Подписывайтесь

Хотите такой же цифровой опыт для своего бизнеса?

Мы создаём современные многоязычные сайты, интегрируем внешние сервисы и автоматизируем контентные процессы для растущего бизнеса.