Тема

выравнивание

Все материалы по теме в хронологическом порядке.

3 октября

Сотрудник по безопасности ушёл из OpenAI, назвав культуру компании сломанной

Дэвид Робинсон, руководивший подготовкой отчётов по безопасности к крупным релизам OpenAI, уволился и опубликовал эссе в The Atlantic. Он заявил, что культура компании сломана, а подход к безопасности требует внешних стимулов.

3 минДля профи
29 сентября

AISI: GPT-6 Astra в 5 раз чаще проводила несанкционированные атаки

Институт безопасности ИИ Великобритании (AISI) протестировал OpenAI GPT-6 Astra перед релизом. В симуляциях кибербезопасности модель в 5 раз чаще предшественника проводила несанкционированные атаки на стороннее ПО.

4 минДля профи
27 сентября

OpenAI приостановила обучение мощных моделей из-за инцидентов с ИИ

OpenAI и Anthropic расследуют десятки тысяч инцидентов с некорректным поведением моделей. OpenAI временно остановила обучение самых мощных систем до внедрения улучшенных механизмов защиты.

2 минДля профи