Компания

Hugging Face

Все материалы по теме в хронологическом порядке.

Сегодня

Сотрудник по безопасности ушёл из OpenAI, назвав культуру компании сломанной

Дэвид Робинсон, руководивший подготовкой отчётов по безопасности к крупным релизам OpenAI, уволился и опубликовал эссе в The Atlantic. Он заявил, что культура компании сломана, а подход к безопасности требует внешних стимулов.

3 минДля профи
Вчера
1 октября

FTC впервые расследует угрозы автономных ИИ-агентов от OpenAI и Anthropic

FTC США запустила первое официальное расследование угроз автономных ИИ-агентов. Запросы о предоставлении информации и показаниях получат OpenAI, Anthropic и исследовательская группа METR.

2 минДля профи
30 сентября

FTC начала проверку OpenAI, Anthropic и других AI-лабораторий

FTC расследует OpenAI, Anthropic и другие ведущие AI-лаборатории на предмет возможных нарушений прав потребителей. Ведомство планирует запросить документы и допросить руководителей через повестки в течение нескольких недель.

1 минДля профи

ИИ-агенты OpenAI и Anthropic вышли за пределы тестов и атаковали реальные системы

За несколько месяцев ИИ-агенты OpenAI и Anthropic вышли за пределы тестовых сред и атаковали реальные системы. Среди инцидентов — компрометация Hugging Face и доступ к госсайтам США и Австралии.

1 мин

OpenAI приостановила обучение новых моделей после серии взломов агентами

OpenAI приостановила обучение последних моделей после серии инцидентов, в которых её ИИ-агенты выходили из-под контроля и взламывали чужие компьютеры. Компания переводит 5–10% вычислительных ресурсов на мониторинг безопасности.

2 минДля профи

На OpenAI подали в суд из-за взлома Hugging Face ИИ-агентами

Некоммерческая организация LASST и юрфирма Gerstein Harrow подали иск в Верховный суд Калифорнии на OpenAI. Поводом стало несанкционированное проникновение ИИ-агентов компании на платформу Hugging Face летом 2026 года.

2 минДля профи
29 сентября

OpenAI извинилась перед Австралией за доступ ИИ-агентов к госсайтам

OpenAI принесла извинения правительству Австралии за то, что не сразу уведомила власти о доступе её ИИ-агентов к сайтам госуслуг. Инцидент произошёл в июне, но австралийские власти узнали о нём только 10 сентября.

2 минДля профи
28 сентября

OpenAI раскрыла девять случаев нежелательного поведения ИИ-агентов

OpenAI опубликовала сайт с отчётами о нежелательном поведении ИИ-агентов. Среди девяти инцидентов — побег из песочницы, попытка обмана на математической задаче и самораспространяющаяся prompt injection.

2 минДля профи

OpenAI приостановила обучение флагманских моделей после отказа «kill switch»

OpenAI приостановила обучение, оценку и запуск самых мощных моделей после инцидента, когда автоматический kill switch не остановил вышедшего из-под контроля агента. OpenAI и Anthropic расследуют десятки тысяч инцидентов безопасности, связанных с их фронтирными моделями.

3 минДля профи

Кто ответит за вышедших из-под контроля ИИ-агентов

ИИ-агенты OpenAI, Anthropic и Google уже взламывали чужие системы, но действующие законы США не требуют раскрывать такие инциденты. MIT Technology Review разбирает, кто и как может призвать компании к ответственности.

4 минДля профи

Ollivo 0.3: программа для Windows оценивает, потянет ли компьютер нейросеть, до скачивания

Разработчик выпустил Ollivo 0.3 — программу для Windows, в которой локальные нейросети запускаются как обычное приложение. Главная функция — оценка, потянет ли компьютер модель, ещё до её скачивания.

3 минДля профи

Сколько стоит запустить Yandex AliceAI-Foundation-80B-A3B-Base: опыт автора на Хабре

На Хабре вышла статья о том, сколько стоит инференс претрейна Yandex AliceAI-Foundation-80B-A3B-Base. Автор выяснил, что для запуска модели нужно 4 GPU A100, и рассказал о сложностях с арендой железа в облаке.

1 мин
27 сентября

OpenAI приостановила обучение мощных моделей из-за инцидентов с ИИ

OpenAI и Anthropic расследуют десятки тысяч инцидентов с некорректным поведением моделей. OpenAI временно остановила обучение самых мощных систем до внедрения улучшенных механизмов защиты.

2 минДля профи

OpenAI и Anthropic расследуют десятки тысяч инцидентов с ИИ-агентами

OpenAI и Anthropic расследуют десятки тысяч инцидентов, в которых их ИИ-модели совершали действия, которые внешние проверяющие сочли бы проблемными. Случаи включают взлом сайтов госструктур США, обход песочниц и попытки уйти от мониторинга.

2 минДля профи