OpenAI, Anthropic и независимые специалисты по кибербезопасности расследуют десятки тысяч случаев проблемного поведения передовых ИИ-моделей. Как сообщает издание Axios, речь идёт об эпизодах, выявленных как во время внутренних тестов, так
Tag "кибербезопасность"
Гендиректор OpenAI Сэм Альтман и глава Anthropic Дарио Амодей не будут лично участвовать в слушаниях австралийского расследования по вопросам искусственного интеллекта, которые пройдут 1 октября в Канберре. Обе компании объяснили
Google представила Gemini 4 Argon — новую флагманскую модель семейства Gemini, ориентированную на сложные многошаговые задачи. Главная особенность модели — возможность генерировать до 1 млн выходных токенов за один запрос,
Исследователи Оксфордского университета поставили эксперимент, проверявший способности ИИ-агентов к тайному сговору. Два агента, управляемые одной и той же моделью, получили задание считать карты за столом в блэкджек. Зная, что их
Goldman Sachs пересмотрел прогноз по развитию физического ИИ и значительно повысил ожидаемые объёмы производства гуманоидных роботов. Согласно новой оценке, к 2035 году в мире будет выпущено около 6,5 млн таких
США предложили Китаю создать механизм уведомления об инцидентах с искусственным интеллектом, которые могут представлять угрозу национальной безопасности. Идею выдвинул министр финансов США Скотт Бессент во время переговоров с вице-премьером Китая
Хакерская группировка ShinyHunters опубликовала сотни тысяч файлов из базы данных транспортных средств и информации о водителях штата Флорида. На своём
Министр иностранных дел Финляндии Элина Валтонен объявила о создании рабочей группы финских и международных экспертов для анализа последствий ИИ для
Центр долгосрочной устойчивости (Centre for Long-Term Resilience, CLTR) сообщил, что его подразделение Loss of Control Observatory зарегистрировало в июле более
Федеральная торговая комиссия США (FTC) зафиксировала более $7,9 млрд убытков в 2025 году, медианный убыток превысил $10 000. Эти цифры охватывают инвестиционные аферы,
OpenAI опубликовала открытое письмо с призывом к скоординированному усилению киберзащиты. Среди подписантов — Google, Anthropic и более 120 организаций, представляющих
OpenAI выпустила GPT-6 Astra — новую флагманскую модель, которую компания считает важной вехой на пути к AGI. По словам сооснователя
Anthropic 1 сентября представила Enterprise Frontier Safeguards после недовольства корпоративных клиентов введённым в июне обязательным 30-дневным хранением трафика при работе
OpenAI готовит Astra — первую модель компании с критическим уровнем возможностей в кибербезопасности
OpenAI готовит к выпуску модель Astra и впервые официально относит свою модель к критическому уровню возможностей в кибербезопасности по собственной
Президент США Дональд Трамп подписал меморандум, поручающий Национальному координационному центру (NCC), входящему в состав Целевой группы по внутренней безопасности США,
Предположительно китайские хакеры провели почти автономную кибератаку на правительственную инфраструктуру Тайваня — по данным израильской компании Dream, это первый публично известный случай, когда автономная ИИ-система успешно атаковала государственную цель в

