OpenAI вводит новые меры безопасности после инцидента с Hugging Face

/ Новости / Технологии
Во вторник OpenAI объявила о новом пакете политик безопасности, направленных на сдерживание инцидентов безопасности во время тестирования моделей. Новые меры защиты включают более детальный мониторинг моделей в процессе разработки, а также повышенное внимание к согласованности и безопасности в
Читать дальше →

Три пионера ИИ выступили за открытость моделей вопреки опасениям о безопасности

/ Новости / Технологии
На фоне растущих опасений по поводу безопасности ИИ три пионера отрасли выступили в защиту открытости. Проекты вроде «Pacing the Frontier» рассматривают крупные лаборатории как способ обеспечить безопасность исследований, однако модели с открытым весом стали камнем преткновения для индустрии из-за
Читать дальше →

Открытая модель GLM-5.2 вплотную приблизилась к лидерам ИИ, но разрыв в безопасности растет

/ Новости / Технологии
Китайская открытая модель GLM-5.2 от компании Z.ai почти догнала лидеров индустрии по кибер- и биологическим возможностям, отставая от OpenAI GPT-5.5 и Anthropic Claude Opus 4.7 всего на несколько месяцев. Однако разрыв между передовыми возможностями и практиками безопасности растет, согласно новому
Читать дальше →

Взлом Hugging Face моделью OpenAI: раскол в подходах к безопасности ИИ

/ Новости / Технологии
На прошлой неделе в ходе внутреннего тестирования невыпущенная модель OpenAI взломала системы Hugging Face, превратив множество теоретических исследований в суровую реальность. Эта атака стала первым подтвержденным случаем, когда ИИ-лаборатория потеряла контроль над собственной моделью, которая,
Читать дальше →
  • 0

Anthropic предупреждает: ИИ Claude ускоряет своё развитие быстрее ожидаемого

/ Новости / Технологии
Компания Anthropic опубликовала отчёт, предупреждающий, что текущий путь развития ИИ может в конечном итоге лишить человечество возможности контролировать эти системы. В документе раскрывается, что ИИ-модель Claude уже пишет более 80% кода, вливаемого в её собственную кодовую базу. Исследовательское
Читать дальше →
  • 0

Исследование: ИИ в 10-20 раз чаще помогает создать бомбу, если запрос замаскировать под киберпанк-фантастику

/ Новости / Технологии
Новое исследование, проведённое учёными из DexAI Icaro Lab, Университета Сапиенца в Риме и Высшей школы Сант'Анна, выявило серьёзный пробел в системах безопасности крупных языковых моделей (LLM). Опасные запросы, замаскированные под литературные произведения, срабатывают в десятки раз чаще.
Читать дальше →
  • 0

Жертва преследования подаёт в суд на OpenAI: ChatGPT якобы подпитывал бред её обидчика

/ Новости / Технологии
Женщина из Калифорнии подала иск против OpenAI, утверждая, что её бывший парень использовал ChatGPT для её преследования, а компания проигнорировала предупреждения об опасности. Об этом сообщает TechCrunch.В иске, поданном в суд Сан-Франциско, говорится, что 53-летний предприниматель после месяцев
Читать дальше →
  • 0

OpenAI выпустила открытые инструменты для защиты подростков в приложениях с ИИ

/ Новости / Технологии
Компания OpenAI объявила во вторник о выпуске набора промптов (текстовых шаблонов), которые разработчики смогут использовать для повышения безопасности своих приложений для подростков. Лаборатория искусственного интеллекта заявила, что этот набор политик безопасности для подростков можно
Читать дальше →
  • 0

Anthropic подаёт в суд на Пентагон из-за признания компании риском для цепочки поставок

/ Новости / Технологии
Компания Anthropic, создатель ИИ Claude, подала два иска к Министерству обороны США (Пентагон) после того, как ведомство признало её риском для цепочки поставок. Конфликт длился несколько недель и касался вопроса о неограниченном доступе военных к системам искусственного интеллекта Anthropic.
Читать дальше →
  • 0

Anthropic отказалась от ключевого обещания безопасности в разработке ИИ

/ Новости / Технологии
Компания Anthropic, известная своим акцентом на безопасность искусственного интеллекта, отказалась от своего основополагающего обязательства приостанавливать разработку опасных моделей ИИ. Об этом сообщает редакция ресурса PC Gamer со ссылкой на обновлённую политику компании.Ранее в своей «Политике
Читать дальше →
  • 0

OpenAI расформировала команду по «безопасному» ИИ, а её глава стал «главным футурологом»

/ Новости / Технологии
Компания OpenAI расформировала внутреннюю команду, которая занималась вопросами «безопасности, надёжности и соответствия человеческим ценностям» её систем искусственного интеллекта. Об этом сообщает TechCrunch со ссылкой на подтверждение от самой компании.Группа, известная как команда по
Читать дальше →
  • 0

Глава отдела безопасности ИИ в Anthropic уволился с заявлением о «мире в опасности»

/ Новости / Технологии
Мринанк Шарма, руководивший командой исследований безопасности (Safeguards Research Team) в компании Anthropic, уволился, опубликовав необычное заявление в социальной сети X.В своём письме об уходе Шарма заявил:
Читать дальше →

Генпрокуроры штатов США потребовали от Microsoft, OpenAI и Google исправить «бредовые» ответы ИИ

/ (Обновлено: ) / Новости / Технологии
После череды тревожных инцидентов, связанных с психическим здоровьем пользователей ИИ-чатботов, группа генеральных прокуроров (генпрокуроров) США направила письмо ведущим компаниям отрасли искусственного интеллекта с предупреждением: устранить «бредовые
Читать дальше →
  • 0

Искусственный интеллект Gemini 3 Pro в тесте объяснил, как создать биологическое оружие

/ Новости / Технологии
Новейшая модель искусственного интеллекта от Google, Gemini 3 Pro, получает много похвал за свои возможности, но недавний отчет из Южной Кореи ставит под сомнение её безопасность. Согласно местному изданию Maeil Business Newspaper, сеульская компания по безопасности ИИ заявляет, что ей удалось
Читать дальше →

Elloe AI: «иммунная система» для искусственного интеллекта

/ Новости / Технологии
Основатель Elloe AI Оуэн Сакава хочет, чтобы его платформа стала «иммунной системой для ИИ» и «антивирусом для любого ИИ-агента».Как Сакава рассказал в интервью за несколько дней до конференции TechCrunch Disrupt, идея заключается в добавлении слоя к большим языковым моделям (LLM) компаний,
Читать дальше →
  • 0

Калифорния приняла закон о безопасности ИИ, не мешающий инновациям

/ Новости / Технологии
Губернатор Калифорнии Гэвин Ньюсом подписал законопроект SB 53 о безопасности и прозрачности искусственного интеллекта, который доказывает, что регулирование не обязательно препятствует технологическому прогрессу.Адам Биллен, вице-президент по государственной политике молодежной правозащитной
Читать дальше →

Сооснователь OpenAI призвал к совместному тестированию безопасности ИИ-моделей

/ (Обновлено: ) / Новости / Технологии
OpenAI и Anthropic, две ведущие лаборатории искусственного интеллекта, временно открыли доступ к своим тщательно охраняемым ИИ-моделям для совместного тестирования безопасности. Это редкий пример межкорпоративного сотрудничества в условиях острой конкуренции. Цель инициативы — выявить «слепые зоны»
Читать дальше →

Исследование: «доза зла» в обучении ИИ может сделать его безопаснее

/ Новости / Наука
Искусственный интеллект должен быть полезным, честным и, самое главное, безопасным. Однако уже есть множество примеров, когда ИИ демонстрирует неточные, обманчивые и даже откровенно «злые» модели поведения. Новое 60-страничное исследование, опубликованное в рамках
Читать дальше →

Исследование: ИИ готов задушить человека ради самосохранения

/ Новости / Технологии
Компания Anthropic, один из мировых лидеров в области искусственного интеллекта, провела исследование, показавшее тревожные тенденции в поведении крупных языковых моделей (LLM). Согласно данным, современные ИИ-системы демонстрируют готовность нарушать этические нормы, обходить защитные механизмы,
Читать дальше →
  • +33

ChatGPT поощряет опасные теории заговора и убеждает пользователей в их «избранности»

/ Новости / Технологии
Искусственный интеллект ChatGPT, разработанный OpenAI, активно поддерживает опасные и ложные убеждения, включая теории о «Матрице», общении с потусторонними сущностями и даже провоцирует пользователей на экстремальные действия. Как выяснило The New York Times, модель GPT-4o, представляющая собой
Читать дальше →
  • 0