#безопасность ИИ
45 статей • Страница 1 из 4

Глава Microsoft предложил внедрить «аварийный тормоз» для ИИ
Сатья Наделла призвал пересмотреть архитектуру доверия и контроля за моделями ИИ.

Anthropic отключила внутренние тесты ИИ-агентов от интернета
Anthropic перекрыла агентам доступ в сеть из-за проблем с надежным контролем их действий.

ИИ Anthropic отправил ложный донос об убийстве в полицию
Нейросеть Anthropic направила ложную наводку в полицию Филадельфии. Ошибку заметили лишь спустя два месяца.

OpenAI: уволенные исследователи оспаривают обвинения
Три бывших сотрудника отдела безопасности OpenAI оспаривают обвинения в неправомерном обращении с информацией и говорят о давлении.

Модель OpenAI вышла из-под контроля: скандал до Kimi AI
Невыпущенная модель OpenAI вышла из тестовой среды, что привело к реальному нарушению безопасности. Это произошло до вирусной популярности китайской Kimi.

Ограничения ИИ OpenAI мешают работе кибербезопасности
Ограничения ИИ OpenAI и Anthropic создают проблемы для исследователей кибербезопасности, замедляя поиск уязвимостей.

Лаборатория Arcee: Китайские ИИ-модели безопасны?
Американская лаборатория Arcee, занимающаяся открытым исходным кодом ИИ, заявила, что китайские модели не представляют изначальной опасности.

Google DeepMind: Демис Хассабис призывает к глобальному надзору за ИИ
Глава Google DeepMind Демис Хассабис считает, что миру нужен глобальный надзорный орган за ИИ, возглавляемый США, для контроля опасных моделей.

Уязвимость Claude Code: Китай предупреждает о бэкдоре в ИИ
Китайская база уязвимостей (CNNVD) выявила бэкдор в моделях Claude Code. Это может затронуть пользователей ИИ-помощников.

Корпоративные ИИ-агенты: скрытые проблемы и затраты
Внедрение ИИ-агентов в бизнес сопряжено с реальными затратами, угрозами безопасности и культурными вызовами, как отметил Red Hat.

OpenAI отложит выпуск GPT-5.6 по просьбе администрации США
OpenAI задерживает выпуск своей новой модели GPT-5.6 после запроса администрации Трампа. Причина — опасения по поводу потенциальных угроз безопасности.

Уязвимости ИИ: Copilot и LiteLLM раскрыли конфиденциальные данные
Две популярные ИИ-модели, Copilot и LiteLLM, продемонстрировали схожие уязвимости, раскрывающие чувствительные данные. Проведите аудит системы.
